猫猫们唱歌工具链 v8更新
更新工具链。这次也算是微调,主要在出图方面,放弃了SNS出图渠道,改为本地Krea2和Qwen Image 2.1出图。
智能体与 LLM 模型¶
- CherryStudio — 主控台,所有智能体调度
- DeepSeek v4.1 Flash — 主力模型
- Gemini 3.8 Flash - 重要节点参考LLM
- Space Bunny - 近十天免费的模型,930更新后质量和deepseek v4.1 flash相当,速度慢一些,据说是Minimax M3.1,免费期间代替Deepseek工作
音乐相关¶
- YuE2 — 改词、改曲
- SoulX Singer — 改音色并润色
- Open Soren WebUI - 歌曲最后一步合成
- 豆包录音识别 - 获得歌词准确时间,便于分镜,主要使用此渠道
- Qwen ASR - 获得歌词准确时间,便于分镜【备用】
图片生成¶
- Krea2 — 文生图,场景设定
- Qwen Image 2.1 — 图生图,图片修改与跳帧
- GPT Image 2.5 — 兜底付费生图
- VOSR2 - 图片超分放大,去噪效果极佳
视频生成¶
- MiniMax H3 — 视频生成主力(本地 16G 显存 + 64G 内存),一次采样0.3M,二次采样0.7M(640p)
- RTX Video Processor — 2x放大(1280p,缩小到85%出1080p视频),利用RTX Video SDK开发
模型供应商¶
- DeepSeek 官方
- OpenCode Go 官方订阅
- GrsAI 第三方中转站
📖 本文阅读量 加载中... 次
|
🌐 全站访问 加载中... 次