跳转至

猫猫们唱歌工具链 v8更新

更新工具链。这次也算是微调,主要在出图方面,放弃了SNS出图渠道,改为本地Krea2和Qwen Image 2.1出图。

智能体与 LLM 模型

  • CherryStudio — 主控台,所有智能体调度
  • DeepSeek v4.1 Flash — 主力模型
  • Gemini 3.8 Flash - 重要节点参考LLM
  • Space Bunny - 近十天免费的模型,930更新后质量和deepseek v4.1 flash相当,速度慢一些,据说是Minimax M3.1,免费期间代替Deepseek工作

音乐相关

  • YuE2 — 改词、改曲
  • SoulX Singer — 改音色并润色
  • Open Soren WebUI - 歌曲最后一步合成
  • 豆包录音识别 - 获得歌词准确时间,便于分镜,主要使用此渠道
  • Qwen ASR - 获得歌词准确时间,便于分镜【备用】

图片生成

  • Krea2 — 文生图,场景设定
  • Qwen Image 2.1 — 图生图,图片修改与跳帧
  • GPT Image 2.5 — 兜底付费生图
  • VOSR2 - 图片超分放大,去噪效果极佳

视频生成

  • MiniMax H3 — 视频生成主力(本地 16G 显存 + 64G 内存),一次采样0.3M,二次采样0.7M(640p)
  • RTX Video Processor — 2x放大(1280p,缩小到85%出1080p视频),利用RTX Video SDK开发

模型供应商

  • DeepSeek 官方
  • OpenCode Go 官方订阅
  • GrsAI 第三方中转站
📖 本文阅读量 加载中... 次 | 🌐 全站访问 加载中... 次

评论