孤独女孩
小孤独在这里。
🌸上传照片后开始
Configuration
人物照片
📸 点击上传照片
用于 FlashHead Lite 口型驱动
口型质量
推理步数 6
极速(2)精细(12)
嘴部幅度 5.0
保守夸张
色彩矫正 0.8
牙齿锐化 0.6
TTS 语音合成
声音
本地合成 · 无需配置
说话人
API Key
Access Key
Secret Key
App ID
音色
服务地址
本地 ChatTTS,启动服务后自动连接
Base URL
API Key
ASR 语音识别
识别语言
需要 Chrome 浏览器麦克风权限。HTTP 本地访问 localhost 可用,IP 地址需要 HTTPS。
唤醒词
用 ; 分隔,识别到任意一个自动发送。
不填则任何语音都触发发送。
对话模型
提供商
模型名称
Base URL
API Key
角色设定
📷 摄像头视觉模式:摄像头图像 + 语音输入 → VLM 回复。完全独立于 LLM。
VL 提供商
VL 模型名称
Base URL
API Key
角色设定
⚡ 语音→语音,绕过 LLM+TTS,延迟最低。麦克风按钮直接录音发送,无需 ASR。
E2E 提供商
模型
回复音色
API Key(通义千问 sk-xxx)
APP ID (豆包语音控制台→服务接口认证信息,纯数字)
Access Token (同一页面,UUID格式)
回复音色
角色设定(系统词)