麦克风 听写 模型 语音 扬声器
待机

把声音、图像和文字,接进你自己的模型

先在右上角打开设置填入服务商与 API Key;没有 Key 也能用浏览器自带的语音与听写。

01 粘贴图片或拖入图片,即可让模型识别
02 按住话筒说话,松开后自动对话并语音回复
03 在「图像」「语音」页生成图片、合成语音、转写音频
语音通道:浏览器听写 → 浏览器朗读

生成结果保存在本机浏览器图库(IndexedDB),可下载或发送到对话。

拖入图片,或点击选择文件

合成语音 TTS 浏览器朗读(无需 Key)
转写音频 ASR API 转写(Whisper 兼容)

拖入音频文件(mp3 / wav / m4a / webm / ogg),或点击选择