🔍 问题检查清单
🐛 问题描述
当使用本地部署模型时,Claude Code HaHa 获取输出的速度远远慢于实际生成的速度。
For example: 如下图
如图, LM Studio 后台可以看到生成已经完毕

但是与此同时 Claude Code HaHa 依然在以固定速度获取输出

现在这个速度严重影响了开发效率,明明一百多 tokens 每秒的生成速度被 Claude Code HaHa 硬控了。
在早期的版本似乎并没有发现这个问题(不确定)
📝 复现步骤
- 使用 LM Studio 部署本地模型
- 在 Claude Code HaHa 里使用 LM Studio 的 API 地址。
💻 运行环境
- 操作系统: Windows 11 25H2
- Bun 版本 (
bun --version): 1.3.12
- Node 版本 (
node --version): 24.7.0
- API 提供商 (如 MiniMax / OpenRouter / Anthropic 官方等): LM Studio
- 使用的模型: Gemma 4 26B A4B
- 启动方式 (TUI / --print / Recovery CLI): TUI
📋 错误日志
无
📷 错误截图
如上文
@dosubot
🔍 问题检查清单
🐛 问题描述
当使用本地部署模型时,Claude Code HaHa 获取输出的速度远远慢于实际生成的速度。


For example: 如下图
如图, LM Studio 后台可以看到生成已经完毕
但是与此同时 Claude Code HaHa 依然在以固定速度获取输出
现在这个速度严重影响了开发效率,明明一百多 tokens 每秒的生成速度被 Claude Code HaHa 硬控了。
在早期的版本似乎并没有发现这个问题(不确定)
📝 复现步骤
💻 运行环境
bun --version): 1.3.12node --version): 24.7.0📋 错误日志
无
📷 错误截图
如上文
@dosubot