AUDIO STUDIO · v4

Sound stories, made. In voices.

Multi-voice TTS · sound stage · track editor 一个人,一套工具,完成有声剧。

SCROLL · 进入工具
TTS | SoVITS 离线 MiniMax TTS |
台词生成
台本工作室
对话游戏
画板
图像分析
音轨编辑
语音识别
漫画翻译
酒馆
单人读本
多人顺序读本
多人混合读本
01

选角

02

声线调校

03

声场

角度 距离 50 前后
04

台词

0 / 500
05

结果

👆 点击「生成」开始制作
01

片段

01

片段

台本编写
参与角色 (0)
系统预设(选填,DeepSeek 调用规则)
对话验证(测试当前模型连接)
🤖 AI自动标注 粘贴文本,一键生成角色和台词剧本
💬 对话游戏
设置
场景预设
用户人设
角色记忆
角色配置
点击选择图片/视频
或拖拽到此处
preview
选择或新建一个对话开始…
🎮

游戏初始设置

设定初始状态后开始对话, 已有对话不会被覆盖

先在上面添加至少一个角色
📁
点击或拖拽上传图片
支持 JPG/PNG/WebP,建议尺寸 1024x1024
预览
0.7
正在生成,请稍候...
图片
📥
拖拽图片到这里 / 点击上传 / 粘贴 (Ctrl+V) / 输入 URL
模型
默认 Grok 4.3 (高质量视觉). 2026-07-01 起 DeepSeek 走 vision pipeline, 可作主模型.
追问模型 (可选, 默认跟主模型)
DeepSeek 纯文本, 快 + 便宜, 适合追问细节
分析模板
系统提示词 (可编辑)
温度
0.7
鉴人准 + 内容无审查。关掉则只用上方下拉框选的模型。
🖼
上传图片后, 点击「开始分析」
支持拖拽 / 粘贴 / URL / 点击
历史会话
00:00.000
00:00.000
100%
暂无音轨
从「台词生成」面板发送片段,或从「音效库」导入音频
音频来源
📁
拖拽音频到这里,或点击选择
支持 .wav .mp3 .m4a .ogg .flac .webm .mp4
识别模型
语言
Manga · Translator

漫画翻译

上传漫画/图片,AI 自动识别、翻译并嵌字。支持日语、英语、中文等多种语言。

检查中...
🖼️
拖拽图片到这里
支持 PNG, JPG, WEBP
原图预览
🖼️
翻译结果将显示在这里
翻译结果
⚙️翻译设置
识别detector · OCR · size
实时预估输出...
开启后检测器锁定为 CTD(letterbox 不模糊边缘),阈值降至 0.30 / 0.40,适合抓贴近边缘的小字。 关闭则用默认检测器与阈值。
修复inpainter · size
输出direction · font · lang · translator
(留空用回退)
高级选项 (自动记住)
2
12
-2
1.0
1.0
0.07
翻译日志
SillyTavern 未连接 ↗ 新窗口
全屏查看
角色状态
💰 0 点 积分
地点
时间
理智
100
敏感度
50
羞耻心
20
尿意
10
体力
80
陌生
道具背包
突然下雨
窗外突然下起了雨,气氛变得微妙起来……
敏感度+3 · 羞耻心+2
恋人结局
你们终于在一起了!幸福的恋人生活开始了!
甘雨好感度: 135