lyuxiang.lx
|
3e381002d7
|
add cosyvoice2
|
2024-12-11 16:14:19 +08:00 |
|
lyuxiang.lx
|
cde3cec6fa
|
add qwen lm
|
2024-12-10 14:50:20 +08:00 |
|
lyuxiang.lx
|
dc3f6432ba
|
fix bug
|
2024-11-22 15:11:55 +08:00 |
|
lyuxiang.lx
|
c3dfd23399
|
resume training
|
2024-11-15 16:41:17 +08:00 |
|
lyuxiang.lx
|
5ed5bb15c8
|
use stream read to save memory
|
2024-11-11 22:14:52 +08:00 |
|
lyuxiang.lx
|
487701c98c
|
fix huggingface-hub version
|
2024-11-05 09:34:51 +08:00 |
|
lyuxiang.lx
|
a2ece33477
|
fix hifigan yaml bug
|
2024-11-01 16:17:01 +08:00 |
|
lyuxiang.lx
|
16d66dc6a6
|
fix short tts_text bug
|
2024-10-22 12:56:29 +08:00 |
|
lyuxiang.lx
|
0930b4a106
|
fix lint
|
2024-10-22 11:22:35 +08:00 |
|
lyuxiang.lx
|
d554db7e32
|
fix hifigan init bug
|
2024-10-22 11:20:47 +08:00 |
|
lyuxiang.lx
|
d1f7c1c9d7
|
remove unnecessary code
|
2024-10-18 16:00:14 +08:00 |
|
lyuxiang.lx
|
5bd5dfecab
|
remove unnecessary f0 loss in discrimnator
|
2024-10-18 15:58:19 +08:00 |
|
lyuxiang.lx
|
a4db3db8ed
|
update flow cache
|
2024-10-16 15:24:47 +08:00 |
|
Xiang Lyu
|
ace734def8
|
Merge pull request #455 from boji123/bj_dev_stream_fix_promptcache
[debug] support flow cache, for sharper tts_mel output (handle prompt bug)
|
2024-10-16 14:12:40 +08:00 |
|
lyuxiang.lx
|
6b7286eb62
|
fix typo
|
2024-10-16 13:57:27 +08:00 |
|
lyuxiang.lx
|
7e6d60c24c
|
fix bug
|
2024-10-16 13:30:13 +08:00 |
|
lyuxiang.lx
|
29507bc77a
|
update lint
|
2024-10-16 13:06:31 +08:00 |
|
lyuxiang.lx
|
555efd0301
|
update readme
|
2024-10-16 12:59:57 +08:00 |
|
lyuxiang.lx
|
ea7d709fbb
|
update hifigan
|
2024-10-16 12:43:55 +08:00 |
|
lyuxiang.lx
|
73784974ce
|
update hifigan
|
2024-10-16 12:15:49 +08:00 |
|
lyuxiang.lx
|
789ee9e5e7
|
add hifigan train
|
2024-10-16 11:37:32 +08:00 |
|
lyuxiang.lx
|
cb200b21c5
|
add hifigan train code
|
2024-10-09 17:36:42 +08:00 |
|
Xiang Lyu
|
d49259855b
|
Merge pull request #453 from FunAudioLLM/dev/lyuxiang.lx
Dev/lyuxiang.lx
|
2024-09-29 14:54:31 +08:00 |
|
Xiang Lyu
|
67f298d94a
|
Merge pull request #451 from zhuzizyf/bug-fix-split_paragraph
Bug fix for split_paragraph
|
2024-09-29 14:51:18 +08:00 |
|
Xiang Lyu
|
4a1ec98304
|
Merge pull request #450 from zhuzizyf/optimize-TN
Optimize TN processing
|
2024-09-29 14:49:32 +08:00 |
|
lyuxiang.lx
|
abc6f70ace
|
update 25hz yaml
|
2024-09-29 10:42:57 +08:00 |
|
lyuxiang.lx
|
ffa28e3bbd
|
update token args
|
2024-09-29 10:35:10 +08:00 |
|
lyuxiang.lx
|
8555ab4ded
|
update readme
|
2024-09-26 15:02:27 +08:00 |
|
Xiang Lyu
|
69202008ce
|
Merge pull request #436 from FunAudioLLM/dev/lyuxiang.lx
Dev/lyuxiang.lx
|
2024-09-26 15:00:22 +08:00 |
|
lyuxiang.lx
|
ba3d9693da
|
load jit to device
|
2024-09-26 14:55:03 +08:00 |
|
lyuxiang.lx
|
06934c38c7
|
update vc code
|
2024-09-26 14:46:24 +08:00 |
|
lyuxiang.lx
|
d52358f6c5
|
update readme
|
2024-09-26 12:10:52 +08:00 |
|
lyuxiang.lx
|
72b89a52fb
|
update vc/tts code
|
2024-09-26 11:53:10 +08:00 |
|
lyuxiang.lx
|
49015f63e6
|
add vc code
|
2024-09-26 10:49:22 +08:00 |
|
lyuxiang.lx
|
ed87445540
|
add 25hz text tokenizer
|
2024-09-25 11:24:02 +08:00 |
|
Xiang Lyu
|
f6d44af146
|
Merge pull request #424 from zhoupc2015/main
fastapi服务启动限制ip从127.0.0.1改为0.0.0.0,这样docker映射端口才可以使用
|
2024-09-23 16:06:30 +08:00 |
|
Xiang Lyu
|
95051e5761
|
Merge pull request #408 from FunAudioLLM/dev/lyuxiang.lx
Dev/lyuxiang.lx
|
2024-09-19 18:07:11 +08:00 |
|
lyuxiang.lx
|
f65eca6723
|
add speech fade in out
|
2024-09-19 18:02:42 +08:00 |
|
Xiang Lyu
|
cd26f11859
|
Merge pull request #379 from boji123/bj_dev_stream_fix
[debug] fix badcase, add fade on speech output
|
2024-09-19 17:32:04 +08:00 |
|
Xiang Lyu
|
28f1353324
|
Merge pull request #404 from FunAudioLLM/dev/lyuxiang.lx
Dev/lyuxiang.lx
|
2024-09-18 17:43:45 +08:00 |
|
lyuxiang.lx
|
f6b5c42823
|
fix flake
|
2024-09-18 17:42:54 +08:00 |
|
lyuxiang.lx
|
ff8e63567a
|
use thread pool in tools
|
2024-09-18 17:41:15 +08:00 |
|
Xiang Lyu
|
2665b06e95
|
Merge pull request #356 from MiXaiLL76/main
Implemented fast processing of extract_embedding
|
2024-09-18 16:16:46 +08:00 |
|
Xiang Lyu
|
2898d5a851
|
Merge pull request #403 from FunAudioLLM/dev/lyuxiang.lx
update tempo change
|
2024-09-18 16:14:40 +08:00 |
|
lyuxiang.lx
|
e19e80fcd8
|
update tempo change
|
2024-09-18 16:13:40 +08:00 |
|
Xiang Lyu
|
f517d3627a
|
Merge pull request #378 from dongwon00kim/docker
Add dockerfile for python 3.8, cuda 11.8 and torch 2.0.1 version
|
2024-09-18 11:51:57 +08:00 |
|
Xiang Lyu
|
c901a12789
|
Merge pull request #360 from FunAudioLLM/dev/lyuxiang.lx
set onnx to false as last chunk rtf unstable
|
2024-09-06 17:12:23 +08:00 |
|
lyuxiang.lx
|
122df8c420
|
set onnx to false as last chunk rtf unstable
|
2024-09-06 17:10:54 +08:00 |
|
lyuxiang.lx
|
bcda6d807c
|
add prompt contraint
|
2024-09-05 17:09:07 +08:00 |
|
lyuxiang.lx
|
4d6a55243c
|
update workflow
|
2024-09-05 16:25:25 +08:00 |
|
Xiang Lyu
|
33a585374a
|
Merge pull request #354 from FunAudioLLM/dev/lyuxiang.lx
fix readme
|
2024-09-05 16:16:42 +08:00 |
|
lyuxiang.lx
|
90433f5373
|
fix lint
|
2024-09-05 16:15:34 +08:00 |
|
lyuxiang.lx
|
eeebc45313
|
fix readme
|
2024-09-05 14:39:42 +08:00 |
|
lyuxiang.lx
|
9100813b79
|
add lint workflow
|
2024-09-05 14:37:21 +08:00 |
|
Xiang Lyu
|
7f5e391041
|
Merge pull request #353 from FunAudioLLM/inference_streaming
onnx and fastapi
|
2024-09-05 14:28:16 +08:00 |
|
lyuxiang.lx
|
e141634da1
|
remove unnecessary code
|
2024-09-05 14:26:12 +08:00 |
|
lyuxiang.lx
|
11eacb810e
|
add uvicorn requirements
|
2024-09-05 14:12:27 +08:00 |
|
lyuxiang.lx
|
7555afb90a
|
update fastapi
|
2024-09-05 14:09:40 +08:00 |
|
lyuxiang.lx
|
2ce724045b
|
add onnx export
|
2024-09-04 18:15:33 +08:00 |
|
lyuxiang.lx
|
7795445ed9
|
update roadmap
|
2024-09-04 16:36:18 +08:00 |
|
Xiang Lyu
|
d8197de4cc
|
Merge pull request #347 from hexisyztem/inference_streaming
export onnx
|
2024-09-03 11:25:15 +08:00 |
|
Xiang Lyu
|
d2dea3d928
|
Merge pull request #330 from hexisyztem/flow_tensorrt
Flow tensorrt
|
2024-08-30 14:20:25 +08:00 |
|
Xiang Lyu
|
ee988420f3
|
Merge branch 'inference_streaming' into flow_tensorrt
|
2024-08-30 14:20:06 +08:00 |
|
Xiang Lyu
|
20e0715dac
|
Merge pull request #327 from FunAudioLLM/inference_streaming
Inference streaming
|
2024-08-29 23:51:21 +08:00 |
|
Xiang Lyu
|
662012999a
|
Merge branch 'main' into inference_streaming
|
2024-08-29 23:48:02 +08:00 |
|
lyuxiang.lx
|
1ab3186799
|
revert trt TODO
|
2024-08-29 23:35:19 +08:00 |
|
lyuxiang.lx
|
1d881df8b2
|
fix vocoder speech overlap
|
2024-08-29 19:10:08 +08:00 |
|
lyuxiang.lx
|
f1e374a9bb
|
add trt script TODO
|
2024-08-29 10:44:04 +08:00 |
|
lyuxiang.lx
|
8b097f7625
|
add export script
|
2024-08-28 19:37:35 +08:00 |
|
Xiang Lyu
|
dcc943db43
|
Merge pull request #323 from FunAudioLLM/hengwu.zty/zh_example
change dropout_rate to float type
|
2024-08-28 19:00:45 +08:00 |
|
lyuxiang.lx
|
9ab298dd49
|
add llm export script
|
2024-08-28 18:21:11 +08:00 |
|
Xiang Lyu
|
bb690d9d1e
|
Merge pull request #293 from FunAudioLLM/hengwu.zty/zh_example
add chinese example
|
2024-08-19 10:04:31 +08:00 |
|
Xiang Lyu
|
43a5f9cc58
|
Merge pull request #265 from eltociear/patch-2
chore: update encoder.py
|
2024-08-10 21:38:53 +08:00 |
|
lyuxiang.lx
|
f4e70e222c
|
update stream code
|
2024-08-07 17:09:23 +08:00 |
|
lyuxiang.lx
|
6be8d0fc36
|
add server_name
|
2024-08-01 15:33:56 +08:00 |
|
lyuxiang.lx
|
9504c3f88b
|
fix flow matching training for zero shot inference
|
2024-08-01 10:54:27 +08:00 |
|
lyuxiang.lx
|
553244b8f2
|
add roadmap
|
2024-07-30 13:51:20 +08:00 |
|
lyuxiang.lx
|
02f941d348
|
update model inference
|
2024-07-24 19:18:09 +08:00 |
|
lyuxiang.lx
|
a13411c561
|
add stream code
|
2024-07-23 00:02:30 +08:00 |
|
Xiang Lyu
|
2895d99b9a
|
Merge pull request #182 from v3ucn/speed_change_sox_version
Speed change sox version
|
2024-07-22 16:11:43 +08:00 |
|
lyuxiang.lx
|
ead9644e86
|
change flow config in cosyvoice.fromscratch.yaml
|
2024-07-18 11:18:45 +08:00 |
|
Xiang Lyu
|
47dec8d2bc
|
Merge pull request #127 from Cxywzx/main
FIX: 修复下载解压完成LibriTTS数据时,生成.complete文件失败。
|
2024-07-15 10:06:04 +08:00 |
|
Xiang Lyu
|
51c21660f3
|
Merge pull request #133 from zhuzizyf/fix-frontend-bug
Update frontend.py
|
2024-07-15 10:01:51 +08:00 |
|
Xiang Lyu
|
d1df60590a
|
Merge pull request #106 from v3ucn/corss
接口服务允许跨域请求,接入其他服务,比如ollama或者其他大模型服务
|
2024-07-12 10:03:44 +08:00 |
|
lyuxiang.lx
|
c2f9254006
|
add fastapi usage
|
2024-07-11 17:47:48 +08:00 |
|
lyuxiang.lx
|
44aea805ea
|
add train cfg in flow matching
|
2024-07-11 17:36:59 +08:00 |
|
Xiang Lyu
|
c7d9754eee
|
Merge pull request #56 from iflamed/fastapi
Add Fastapi server to serve TTS and download script
|
2024-07-11 15:21:49 +08:00 |
|
lyuxiang.lx
|
6cebcb3410
|
move use_spk_embedding to processor
|
2024-07-11 13:15:34 +08:00 |
|
lyuxiang.lx
|
0fd15bb12b
|
use spk_embedding when sft
|
2024-07-10 17:49:32 +08:00 |
|
lyuxiang.lx
|
a723ea375e
|
Merge branch 'main' of github.com:FunAudioLLM/CosyVoice into main
|
2024-07-10 16:42:11 +08:00 |
|
lyuxiang.lx
|
793a24862c
|
add constant lr scheduler
|
2024-07-10 16:37:25 +08:00 |
|
Xiang Lyu
|
282b915996
|
Merge pull request #81 from Cxywzx/main
FIX: 修复自然语言控制生成音频时发生错误
|
2024-07-10 12:28:00 +08:00 |
|
lyuxiang.lx
|
6a3e44242a
|
keep only embedding mean as spk embedding
|
2024-07-10 00:21:56 +08:00 |
|
lyuxiang.lx
|
ee9e87b4d3
|
add empty cache
|
2024-07-09 23:48:23 +08:00 |
|
lyuxiang.lx
|
7981796523
|
add WeTextProcessing
|
2024-07-09 23:37:54 +08:00 |
|
Xiang Lyu
|
5e97398d38
|
Merge pull request #62 from passerbya/main
更换默认ttsfrd为WeTextProcessing,修复半角句号结尾或者文本中没有标点会导致合成失败:RuntimeError: torch.cat(): expected a non-empty list of T…
|
2024-07-09 23:26:14 +08:00 |
|
Xiang Lyu
|
9aea393d18
|
Merge pull request #51 from DBinK/main
Update README.md
|
2024-07-09 08:22:01 +08:00 |
|
lyuxiang.lx
|
4e43a9d98b
|
remove academic third party
|
2024-07-08 17:22:27 +08:00 |
|
lyuxiang.lx
|
62c71075ac
|
update dockerfile
|
2024-07-08 16:40:46 +08:00 |
|
lyuxiang.lx
|
89fc7220ea
|
install deepspeed only on linux
|
2024-07-07 16:45:30 +08:00 |
|