跳转至

猫猫们唱歌工具链 v2更新

这两天更新了一下整体工具链上使用的工具。出图过程中使用了商汤刚刚发布的 1.5 模型,免费,可以大量反复测试出图。去除不必要的字幕SRT文件生成。音频文件增加母带处理。MiniMax H3视频生成改为二次采样。(540p ➡️ 640p,并提升速度30%-50%)。超分改用Topaz Video。

智能体与 LLM 模型

  • CherryStudio — 主控台,所有智能体调度
  • DeepSeek — 主力模型
  • Kimi K2.7 Code
  • GPT-5.6-Terra

音乐相关

  • SoulX Singer — 歌词合成
  • ACE Step — 歌曲二次合成
  • Open Soren WebUI - 歌曲最后一步合成

图片生成

  • SenseNova u1.5 Lite — 画面首帧生成,封面抽卡
  • GPT Image 2 — 封面最终生成

视频生成

  • MiniMax H3 — 视频生成主力(本地 16G 显存 + 64G 内存),一次采样0.3M,二次采样0.7M(640p)
  • Topaz Video — 2x放大(1280p,缩小到85%出1080p视频)

模型供应商

  • DeepSeek 官方
  • OpenCode Go 订阅
  • GrsAI 第三方
📖 本文阅读量 加载中... | 🌐 全站访问 加载中...

评论