Matcha-TTS â [ICASSP 2024] ðµ Matcha-TTS: A fast TTS architecture with conditional flow matching
å®è£ é£æåºŠ
Easy
æšè«ã»åŠç¿ã³ã¹ã
High
æ³å®çšé
TTSã¢ãŒããã¯ãã£èšèš
æŠèŠ
Matcha-TTSã¯ãé«éã§æ¡ä»¶ä»ãæµã®ãããã³ã°ãå®çŸããTTSã¢ãŒããã¯ãã£ã§ããã話è ã®ç¹åŸŽãèæ ®ããã
äœãæ°ããã
Matcha-TTSã¯ãé«éã§æ¡ä»¶ä»ãæµã®ãããã³ã°ãå®çŸããTTSã¢ãŒããã¯ãã£ã§ããã話è ã®ç¹åŸŽãèæ ®ããã
äœã«äœ¿ããã
TTSã¢ãŒããã¯ãã£èšèš
å®è£ æ å ±
- GitHub URL
- ãã
å®è£ ãã§ãã¯ãªã¹ã
å®è£ ãŸãã¯é åžããŒãž
OKã³ãŒããŸãã¯ã¢ãã«é åžããŒãžããæ€èšŒãå§ããããŸãã
äžæ¬¡æ å ±ãªã³ã¯
OKGitHub
æ€èšŒãããã
OKå®è£ ãŸãã¯ã¢ãã«é åžããŒãžãã詊ããå¯èœæ§ãé«ãã§ãã
èšç®è³æº
èŠç¢ºèªåŠç¿ãé«è§£å床æšè«ã§ã¯GPUã¡ã¢ãªãšå®è¡æéã«æ³šæãå¿ èŠã§ãã
ã©ã€ã»ã³ã¹
æªååŸé åžå ã®LICENSEãã¢ãã«ã«ãŒããPaperã®å©çšæ¡ä»¶ã確èªããŠãã ããã
åçšå©çš
æªååŸç ç©¶å©çšéå®ãããŒã¿ã»ããç±æ¥å¶éãAPIèŠçŽã®æç¡ã確èªããŠãã ããã
èªç€ŸããŒã¿ã§è©Šããªã
è£œé æ¥ã»ææéçºã®Excel/CSVããŒã¿ã«èœãšã蟌ãããã®æåã®æé ã§ãã
- 1ãŸãèªç€ŸããŒã¿ããå ¥åæ¡ä»¶ãç®ç倿°ãè©äŸ¡ãããææšã«åããŠæŽçããŸãã
- 2LightGBMãRandom Forestãªã©ã®ããŒã¹ã©ã€ã³ãå ã«äœãããã®ææ³ãšæ¯èŒããŸãã
- 3è©äŸ¡ææšã¯R2/RMSEãAUCãç°åžžæ€ç¥ã®åçŸçãå®éšåæ°åæžçãªã©ãçŸå Žã®æææ±ºå®ã«è¿ããã®ãéžã³ãŸãã
- 4SHAPãç¹åŸŽééèŠåºŠã§ãå¹ããŠããå åãç©çã»ååŠã»å·¥çšç¥èãšççŸããªãã確èªããŸãã
å®è£ é£æåºŠ
Easy - å®è£ ãŸãã¯ã¢ãã«é åžããŒãžãã詊ããå¯èœæ§ãé«ãã§ãã
å¿ èŠãªãœãŒã¹
- GPUç®å®: High
- ããŒã¿ã»ãã: è«æã»ãªããžããªåŽã®æå®ã確èªããŠãã ããã
- åŠç¿èŠåŠ: æšè«ã ãã§è©Šããå¯èœæ§ããããŸãã
- åŠç¿ãé«è§£å床æšè«ã§ã¯GPUã¡ã¢ãªãšå®è¡æéã«æ³šæãå¿ èŠã§ãã
å®åã§äœ¿ãå Žåã®æ³šæç¹
- ã©ã€ã»ã³ã¹ãšåçšå©çšæ¡ä»¶ã¯ãPaper / GitHub / Hugging Face ã®é åžå ã§ç¢ºèªããŠãã ããã
- 粟床ãåçŸæ§ãèšç®ã³ã¹ãã¯ããŒã¿ã»ãããè©äŸ¡æ¡ä»¶ã«äŸåããŸãã
- å人æ å ±ãæ©å¯ããŒã¿ãæ±ãå Žåã¯ãå ¥åããŒã¿ã®ä¿åå ãšå€éšAPIå©çšæ¡ä»¶ã確èªããŠãã ããã
é¢é£èšäº
diffusers â ð€ Diffusers: State-of-the-art diffusion models for image, video, and audio generation in PyTorch.
.diffusion ã¢ãã«ã®ã©ã€ãã©ãªãç»åã»åç»ã»é³å£°çæã«å©çšå¯èœã
Irodori-TTS â A Flow Matching-based Text-to-Speech Model with Emoji-driven Style Control
Emotion-driven Style Controlã䜿çšããŠããã¹ããã声ã®å€æãå®è¡ãããææ ã®ããããã¹ãããšã¢ã¿ã€ã¶ãã«ãªå£°ã«å€æããããšãå¯èœã«ãªããŸãã
ComfyUI-LTXVideo â LTX-Video Support for ComfyUI
å»çç»ååæã§ã深局åžç¿ã¢ãã«ãå®è£ ãããŠããåé¡ã«å¯Ÿãã解決çãæç€ºããŸããæ²»çãå°ãããã«ãæ¹å€ççµæã«åœ±é¿ãäžããå€åã«ã€ããŠç¹ã«éç¹ã眮ãããŠããŸãã
Awesome-Video-Diffusion â A curated list of recent diffusion models for video generation, editing, and various other applications.
Awesome-Video-Diffusionã¯ãRecent Diffusion Models for Video Generation, Editing, and Othersã®ãªã¹ããå ¬éããŠããŸãã