跳到主要内容
未列出页
此页面未列出。搜索引擎不会对其索引,只有拥有直接链接的用户才能访问。

Speech 扩展

🎥Plug & Play
Watch the demo

本教程介绍如何把 Speech MCP 服务器 添加为 goose 扩展,以实现实时语音交互、音视频转录、文字转语音,以及多说话人音频生成。

要求

PyAudio 从麦克风采集音频需要 PortAudio

快速安装

配置​

信息

运行此命令需要系统已安装 uv,因为会用到 uvx。

添加此扩展之前,请确认系统已安装 PortAudio。PyAudio 从麦克风采集音频必须有 PortAudio。

  1. Launch the installer
  2. Click Yes to confirm the installation
  3. Click the button in the top-left to open the sidebar
  4. Navigate to the chat

使用示例​

这个示例演示如何用 goose 和 Speech MCP 服务器扩展,把语音指令变成代码。你可以直接对 goose 说话,启动语音界面,给出口头提示,让 goose 根据请求生成并打开一个网页。

这样就可以解放双手来用 goose 构建,让开发更易用、更有互动性。

  1. 在 goose 桌面版中打开一个新会话

goose 提示词​

可以用这些话启动语音界面:

  • 「goose,我今天不想打字。」
  • 「我们用语音聊吧。」
  • 「我们可以语音对话吗?」
  • 「我想说话,不想打字。」
  • 「goose,启动语音界面。」
goose 我今天不想说话

goose 输出​

明白。那我可以改用语音指令帮你。我会启动语音界面,这样你可以说出请求,而不必打字。

---- Launch Speech UI ----

goose 语音 🎙️​

goose:

我已经启动语音界面。你现在可以说出请求,而不必打字。听到我的声音、看到麦克风激活后再说。你需要什么帮助?

Max:

goose,我们做一个简单页面,上面写着 vibes,再让它变色、在页面上移动,做完后在浏览器里打开这个页面