猫猫们唱歌工具链 v2更新
这两天更新了一下整体工具链上使用的工具。出图过程中使用了商汤刚刚发布的 1.5 模型,免费,可以大量反复测试出图。去除不必要的字幕SRT文件生成。音频文件增加母带处理。MiniMax H3视频生成改为二次采样。(540p ➡️ 640p,并提升速度30%-50%)。超分改用Topaz Video。
智能体与 LLM 模型¶
- CherryStudio — 主控台,所有智能体调度
- DeepSeek — 主力模型
- Kimi K2.7 Code
- GPT-5.6-Terra
音乐相关¶
- SoulX Singer — 歌词合成
- ACE Step — 歌曲二次合成
- Open Soren WebUI - 歌曲最后一步合成
图片生成¶
- SenseNova u1.5 Lite — 画面首帧生成,封面抽卡
- GPT Image 2 — 封面最终生成
视频生成¶
- MiniMax H3 — 视频生成主力(本地 16G 显存 + 64G 内存),一次采样0.3M,二次采样0.7M(640p)
- Topaz Video — 2x放大(1280p,缩小到85%出1080p视频)
模型供应商¶
- DeepSeek 官方
- OpenCode Go 订阅
- GrsAI 第三方
📖 本文阅读量 加载中... 次
|
🌐 全站访问 加载中... 次