{"repo":"sdsds222/Unitale","free":true,"listed":false,"github":"https://github.com/sdsds222/Unitale","clone":"git clone https://github.com/sdsds222/Unitale.git","description":"一个基于Indextts和Qwen3TTS的 AI 有声书制作工具。利用 LLM 自动拆解剧本与识别情绪，集成多角色 TTS 语音合成（可智能分析音色并使用Qwen3TTS语音设计模型从音色描述文本生成音色），支持音效(SFX)、背景音乐(BGM)混音及实时台词音频滤波器的自动插入和匹配，可直接在浏览器导出 wav 成品，本工具本体无需配置环境即可跨平台在浏览器使用。现已支持背景图片提示词生成功能，可一键导出带情节背景图片和故事音频的mp4视频。","language":"HTML","stars":204,"topics":["ai","ai-agents","audiobooks","automation","indextts-2","llm","podcast","text-to-speech-app","tts","vuejs"],"license":"MIT","category":"ai-agents","readme_excerpt":"Unitale AI有声书制作工具 语言切换 / Language Switch: 中文版 English English Version Repo: https://github.com/sdsds222/Unitale AI EN 一个基于Indextts和Qwen3TTS的 AI Agent 有声书制作工具。利用 LLM 自动拆解剧本与识别情绪，集成多角色 TTS 语音合成（可智能分析音色并使用Qwen3TTS语音设计模型从音色描述文本生成音色），支持音效(SFX)、背景音乐(BGM)混音及实时台词音频滤波器的自动插入和匹配，可直接在浏览器导出 wav 成品，本工具本体无需配置环境即可跨平台在浏览器使用。 现已支持背景图片提示词生成功能，可一键导出带情节背景图片和故事音频的mp4视频。 先看使用教程：https://www.bilibili.com/video/BV1KSzWByEy7 语音智能合成效果演示：https://www.bilibili.com/video/BV1Nvc7zjEd1 界面简洁，使用简单，能够一键生成，用户可以对生成的音频内容进行微调。 工具在线使用页面（须自行配置LLM和云原生TTS项目的URL）： https://sdsds222.github.io/Unitale/ 1.5版本更新：现已支持LLM分析产生背景图片提示词，能够实现不同图片中出现的人物特征一致。需要用户自行将图片生成提示词复制粘贴到其他的图片生成模型后，手动存入背景图片块中，即可导出符合故事情节背景图片和故事音频的mp4格式视频。 现已支持音色自动分析生成功能，基于llm分析剧情，产生角色音色描述文本，再利用描述文本使用qwen3tts生成音色参考音频。 初始资源包（含音色、音效、BGM等素材）： 【请解压后再导入工程！】下载地址：https://wwazp.lanzouw.com/i9S4t3ihazba 或者直接下载本仓库的初始工程文件，如果网速允许的话。 IndexTTS 2 免费云原生项目： 最新：https://cnb.cool/ConyStudio/IndexTTS2-Qwen3VoiceDesign 旧版：https://cnb.cool/ConyStudio/index-tts-v2 Fork云原生仓库后，即可点击按钮在线启动部署，启动后，在前端TTS配置界面输入云原生项目的port里面的Ip地址即可调用。 如果需要本地部署，需要使用旧版的CNB项目，现在本地搭建一个基于官方的IndexTTS2模型，然后将旧版的cnb项目中的api.py脚本放入webui.py同目录下，使用uv启动api.py，即可使用本工具调用（但无法使用Qwen3TTS音色设计功能）。 使用资源调度管理脚本，实现在同一个云原生工程内共存两个模型。 b站生成效果演示视频： https://www.bilibili.com/video/BV1qjF1zuEc5/ https://www.bilibili.com/video/BV1GpF1zNEXm/ https://www.bilibili.com/video/BV1AkzLB7E8M https://www.bilibili.com/video/BV1v2kjB5EKV https://www.bilibili.com/video/BV1jYkGBqEkL LLM使用OpenAI通用接口 LLM支持使用各种支持OpenAI通用接口的大模型。 本人测试使用的是Gemini的Openai通用接口。输入Base U","default_branch":null,"files":null,"tree":[],"storefront":"/r/sdsds222","claimed":false,"request_supported":{"post":"https://gitbuyer.com/r/sdsds222/Unitale/request-supported","requests":0},"note":"indexed from public GitHub; nothing is for sale on this page. Clone it from GitHub. Paid listings live at /search."}