麦克风
→
听写
→
模型
→
语音
→
扬声器
待机
把声音、图像和文字,接进你自己的模型
先在右上角打开设置填入服务商与 API Key;没有 Key 也能用浏览器自带的语音与听写。
01 粘贴图片或拖入图片,即可让模型识别
02 按住话筒说话,松开后自动对话并语音回复
03 在「图像」「语音」页生成图片、合成语音、转写音频
语音通道:浏览器听写 → 浏览器朗读
生成结果保存在本机浏览器图库(IndexedDB),可下载或发送到对话。
正在生成…
图库还是空的。
生成的第一张图会出现在这里。
拖入图片,或点击选择文件
识别结果
合成语音 TTS
浏览器朗读(无需 Key)
转写音频 ASR
API 转写(Whisper 兼容)
拖入音频文件(mp3 / wav / m4a / webm / ogg),或点击选择
转写结果