用 AI 创作的思路、方法与实践
分享跨越 AI 音频、图像与视频的模型选择、工作流程和生产经验,并从我们最熟悉的语音领域逐步展开。
Fish Audio Drama 3 即将上线:用日常语言指导声音演绎
了解 Fish Audio Drama 3:描述语气、节奏和角色,探索句中切换、多角色场景与单词级修改。
Hypit AI 是什么?安装方法、费用与视频制作流程
了解 Hypit AI 的视频工作流、官方 GitHub 与安装入口,分清软件和模型费用,并为第一条视频规划配音与字幕。
如何为 Hypit 视频项目制作配音:音色、文案与音频导出
用 Kitta 准备视频旁白:编写文案、选择音色、生成并导出音频,再核对 Hypit 项目的字幕时间。附双语文案和音频交付清单。
如何用 Kitta AI 制作 AI 视频配音
选择平静女声,粘贴视频文案,生成自然 AI 配音,并把音频用于 Reels、Shorts、TikTok 或 CapCut。
Fish Audio S2.1 Pro 模型介绍:高质量 AI 文字转语音与声音克隆
面向创作者和开发者的新一代多语言 TTS 模型。
小米 MiMo-V2-TTS:文本驱动的高表达 TTS
从自由文本风格指令到非语言事件与演唱能力:MiMo-V2-TTS 把“表达”做成了真正的语音生成能力。
MiMo-V2-TTS 风格指令写法
把情绪、语速、停连、音色质感和表演意图写成 1-2 句,形成可复制的配音模板。
MiMo-V2-TTS 非语言事件写法
停顿、呼吸、叹气、咳嗽、笑声这些细节,决定了“像机器人”还是“像真人表演”。
MiMo-V2-TTS 演唱能力与提示词
把“像在唱”的意图写清楚:节奏、情绪张力、收尾方式,能显著改变听感。
如何用 Fish Audio API 制作有声书
Fish Audio 是目前最自然的 AI 语音模型之一。本文介绍如何通过 Kitta AI(基于 Fish Audio API 构建)完成一本有声书的完整制作流程。
Fish Audio 声音克隆 YouTube 创作者完整指南
克隆一次你的声音,为所有视频生成配音——无需每次录音。本文介绍如何通过 Kitta AI(基于 Fish Audio API)建立高效的 YouTube 配音工作流。
Kitta AI S2 模型发布:AI语音合成进入2.0时代
更自然的情感表达、更精细的控制能力、更低的延迟——Kitta AI S2开启AI语音新纪元
2025 年最佳 ElevenLabs 替代方案
ElevenLabs 很流行,但不是唯一选择。这里整理了值得考虑的 AI 语音工具,以及 Kitta AI 为什么更突出。
有声书声音克隆:用 AI 制作专业旁白
AI 声音克隆正在重塑有声书制作——更低成本、更快交付、更一致的声音表现。
AI 配音:用 AI 把视频配成任意语言
传统配音昂贵且周期长。AI 配音可以在数小时内完成多语种本地化,而不是数周。