点击「开始」并授权麦克风,即可实时显示字幕
选「千问微调 ASR」后,识别走云端已微调的构音障碍模型(经后端代理转发,音频不出浏览器本地之外的前端)。需确保后端 server.js 已包含该代理并重启。
当前使用浏览器原生语音识别,不调用任何外部大模型。 填写下方信息并启用后,每段最终字幕会先经过大模型处理(润色 / 翻译 / 总结),并流式实时显示。 接口遵循 OpenAI 兼容的 Chat Completions 格式,可对接豆包、千问、混元、Ollama、vLLM 等。
已内置后端代理:三家的密钥都放在后端 server-config.json 的 providers 段,前端不暴露、也不受浏览器跨域(CORS)限制。点上方按钮选服务商,再在后端对应位置填入 Key 并重启服务即可。
提示:本接口默认 POST JSON,请求体为
{ model, messages:[{role:'system',content:prompt},{role:'user',content:text}], stream:true }。