TTS · 单角色模式
单人读本
Pick a voice · write the line · ship the take
MiniMax 在线
01
选角
02
声线调校
03
声场
角度 0°
距离 50
前后 前
04
台词
05
结果
TTS · 多角色模式
多人顺序读本
每段独立角色 · 按顺序发言 · 自动拼接成一条音轨
MiniMax 在线
01
片段
TTS · 多角色混合模式
多人混合读本
多角色同时发言 · 通过偏移控制重叠 · 营造空间感
MiniMax 在线
01
片段
▶
参与角色 (0)
▶ 系统预设(选填,DeepSeek 调用规则)
▶ 对话验证(测试当前模型连接)
▼
🤖 AI自动标注
粘贴文本,一键生成角色和台词剧本
DIALOGUE · 角色扮演
对话游戏
角色扮演对话 · 多角色 · 状态与好感度系统
🧠 加载中…
🔊 加载中…
💬 对话游戏
▶
设置
▾
▶场景预设
▶用户人设
▶角色记忆
▶角色配置
点击选择图片/视频
或拖拽到此处
或拖拽到此处
选择或新建一个对话开始…
游戏初始设置
设定初始状态后开始对话, 已有对话不会被覆盖
场景与角色
角色初始好感度
调整后仅作用于本次新对话
先在上面添加至少一个角色
初始状态
初始时间 & 地点
Imagine · Studio
画板
图片描述 Prompt / 一键多模板 / 多模型切换 / 历史记录.
ComfyUI 在线
点击或拖拽上传图片
支持 JPG/PNG/WebP,建议尺寸 1024x1024
正在生成,请稍候...
Vision · Analyzer
图像分析
上传图片,AI 多模型视觉理解。默认 Grok 4.3 高质量视觉,可换 DeepSeek V3 Chat 追问细节。
13 模型 · 输出清理
图片
拖拽图片到这里 / 点击上传 / 粘贴 (Ctrl+V) / 输入 URL
模型
默认 Grok 4.3 (高质量视觉). 2026-07-01 起 DeepSeek 走 vision pipeline, 可作主模型.
追问模型 (可选, 默认跟主模型)
DeepSeek 纯文本, 快 + 便宜, 适合追问细节
分析模板
系统提示词 (可编辑)
温度
0.7
鉴人准 + 内容无审查。关掉则只用上方下拉框选的模型。
上传图片后, 点击「开始分析」
支持拖拽 / 粘贴 / URL / 点击
历史会话
TRACKS · MULTITRACK
音轨编辑
多轨混音 / 模板 / 音效库 / 项目保存。
Web Audio API
暂无音轨
从「台词生成」面板发送片段,或从「音效库」导入音频
Whisper · Transcription
语音识别
上传音频或输入 URL,AI 自动转写为文字。支持中文、英文、日语等语言。
Whisper 已就绪
音频来源
拖拽音频到这里,或点击选择
支持 .wav .mp3 .m4a .ogg .flac .webm .mp4
识别模型
语言
Manga · Translator
漫画翻译
上传漫画/图片,AI 自动识别、翻译并嵌字。支持日语、英语、中文等多种语言。
检查中...
🖼️
拖拽图片到这里
支持 PNG, JPG, WEBP
🖼️
翻译结果将显示在这里
⚙️翻译设置
识别detector · OCR · size
实时预估输出...
开启后检测器锁定为
CTD(letterbox 不模糊边缘),阈值降至 0.30 / 0.40,适合抓贴近边缘的小字。
关闭则用默认检测器与阈值。
修复inpainter · size
输出direction · font · lang · translator
(留空用回退)
高级选项 (自动记住)
2
12
-2
1.0
1.0
0.07
翻译日志
角色状态
地点
时间
理智
100
敏感度
50
羞耻心
20
尿意
10
体力
80
陌生
—
道具背包
突然下雨
窗外突然下起了雨,气氛变得微妙起来……
敏感度+3 · 羞耻心+2
恋人结局
你们终于在一起了!幸福的恋人生活开始了!
甘雨好感度: 135