这是一个使用OpenAI 文本转语音 API 提供语音状态更新的模型上下文协议 (MCP) 服务器。这使得语言模型可以通过简短的语音消息与用户进行通信:报告任务进度或确认命令已执行。当与Cursor或Claude代码一起工作时尤其有用:你可以给代理分配一个任务,然后去做其他事情,但仍然可以收到关于代理进度的状态报告,并在任务完成后需要你的注意时得到通知。
这个MCP服务器旨在开箱即用:系统消息中附带的summarize工具描述要求模型使用此工具来报告任务进度。
该服务器公开了以下工具:
summarize(text: str): 使用OpenAI的TTS API将提供的文本转换为语音并播放给用户。这对于在代码更改或命令执行后提供状态更新或确认非常有用。你需要一个OpenAI API密钥才能使用此服务器。
更新你的claude_desktop_config.json(位于macOS上的~/Library/Application\ Support/Claude/claude_desktop_config.json和Windows上的%APPDATA%/Claude/claude_desktop_config.json)以包含以下内容:
{
"mcpServers": {
"voice-status-report": {
"command": "uvx",
"args": [
"voice-status-report-mcp-server"
],
"env": {
"OPENAI_API_KEY": "YOUR_OPENAI_API_KEY"
}
}
}
}
该服务器接受以下命令行选项:
--ding: 启用在每个语音消息之前播放的叮咚声。默认情况下,叮咚声是禁用的。--voice [VOICE]: 选择语音生成的声音。可用选项:alloy, ash, coral(默认),echo, fable, onyx, nova, sage, shimmer。--speed SPEED: 设置语音速度(0.5-4.0,数值越大越快)。默认值为4.0。--instructions TEXT: 为TTS模型提供自定义语音指令。默认情况下,服务器使用预设指令以产生平静友好的声音。# 启用叮咚声并使用不同的声音运行
voice-status-report-mcp-server --ding --voice nova
# 使用较慢的语音速度运行
voice-status-report-mcp-server --speed 2.0
# 使用自定义语音指令运行
voice-status-report-mcp-server --instructions "Voice should be confident and authoritative"
{
"mcpServers": {
"voice-status-calm": {
"command": "uvx",
"args": [
"voice-status-report-mcp-server",
],
"env": {
"OPENAI_API_KEY": "YOUR_OPENAI_API_KEY"
}
},
}
}
当使用非默认参数时,可以使用以下配置:
{
"mcpServers": {
"voice-status-report-mcp-server": {
"command": "uvx",
"args": [
"voice-status-report-mcp-server",
"--ding",
"--voice", "nova",
"--speed", "3.0",
"--instructions", "Voice should be confident and authoritative"
],
"env": {
"OPENAI_API_KEY": "YOUR_OPENAI_API_KEY"
}
}
}
}
一旦连接,Claude可以使用该工具提供音频反馈,例如:
该项目根据MIT许可证发布 - 查看LICENSE文件获取详情。