Chobits-Chii-TTS-CosyVoice

《人形电脑天使心》(Chobits) 小叽 (Chii / ちぃ) 声线的日语 TTS 模型—— Fun-CosyVoice3-0.5B 在 Chobits-Chii-Voice 数据集(483 条 / 约 21.4 分钟)上全量 SFT(llm + flow,val_best 平均)。

⚠️ 仅供学习与研究使用,禁止商业用途;不得用于侵犯原作品及声优(田中理惠)权益的用途。

项目仓库:Anime2Real/Chobits-Chii-TTS(cosy-voice 分支, 含训练/推理/部署脚本与完整调研实测文档)。

使用

# pip 依赖与环境见仓库 cosy-voice 分支 README
import sys; sys.path[:0] = ['CosyVoice', 'CosyVoice/third_party/Matcha-TTS']
from huggingface_hub import snapshot_download
from cosyvoice.cli.cosyvoice import AutoModel

model_dir = snapshot_download('chenxin199305/Chobits-Chii-TTS-CosyVoice')
cosyvoice = AutoModel(model_dir=model_dir, fp16=True)

# 日语必须先假名化 (pyopenjtalk, 见仓库 tools/cosyvoice_zeroshot_eval.py 的 to_katakana);
# 参考音频 ref_audio.wav 见仓库 models/ 或 GPT-SoVITS 版模型仓库
for out in cosyvoice.inference_zero_shot(
        'チ ィ 、 ヒデキ ノ コト 、 ダイスキ',
        'You are a helpful assistant.<|endofprompt|>ヒデキ ワ チイ ヲ ヒロッ テ クレ タ',
        'ref_audio.wav'):
    ...

说明

  • 本仓库为自包含推理包:含 SFT 权重(llm.pt / flow.pt)与基座推理必需文件 (hift.pt / campplus.onnx / speech_tokenizer_v3.onnx / CosyVoice-BlankEN)。
  • 相比基座删减的文件(推理不需要):llm.rl.pt(RL 变体)、flow.decoder.estimator.fp32.onnx (TRT 导出用)、speech_tokenizer_v3.batch.onnx(训练用)。需要时请从 FunAudioLLM/Fun-CosyVoice3-0.5B-2512 补齐。
  • 基座许可 Apache-2.0;本衍生模型遵循数据集 CC BY-NC-SA 4.0。
  • 实测(RTX 4090, fp16):非流式 RTF 0.348,流式首包 1268ms,峰值显存 ~5GB。
Downloads last month
29
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for chenxin199305/Chobits-Chii-TTS-CosyVoice

Quantized
(22)
this model