2026年9月15日
Google 今天发布了 Gemini 3.8 Live 和 3.8 Live Extended Thinking——两个新的语音到语音模型,其形态与 OpenAI 的 GPT-Live 系列相似。
我把文档交给 GPT-6 Astra Extra High,让它为我构建了这个 Web UI,用于试用这些新模型。你可以选择一个模型和语音预设,输入可选的系统提示词,然后通过浏览器开始语音对话,包括在模型说话时打断它的能力。
该实现不使用任何库。它连接到 wss://generativelanguage.googleapis.com/ws/google.ai.generativelanguage.v1alpha.GenerativeService.BidiGenerateContent?key=...
WebSocket 端点,并使用 Web Audio API 的 AudioContext
进行采集和播放。
这里是Gemini Live 教程,用于入门该 WebSockets API。
近期文章
使用 GPT-6 Astra 和 ChatGPT Work 生成跑步路线- 2026年9月12日OpenAI 智能体早在 5 月就攻击了 RubyGems- 2026年9月12日关于纳维-斯托克斯千禧年大奖难题的一些思考- 2026年9月8日
