Claude Code 持续迭代秘器:Ralph Loop 让 AI 坚持到任务真正完成
为什么 Claude Code 总是"差不多就行"? 用过 Claude Code 的开发者多少都遭遇过这个场景:把一个需求丢给 Claude,它忙活一阵,输出了一堆代码,然后——停了。 测试跑不过?它可能只是把报错结果附上来,等你进一步下指令。逻辑没完全实现?它交差了,...
为什么 Claude Code 总是"差不多就行"? 用过 Claude Code 的开发者多少都遭遇过这个场景:把一个需求丢给 Claude,它忙活一阵,输出了一堆代码,然后——停了。 测试跑不过?它可能只是把报错结果附上来,等你进一步下指令。逻辑没完全实现?它交差了,...
Garry Tan 有两个身份:Y Combinator 总裁,和一个高产的开源开发者。2026 年,他在 GitHub 上有 1,237 次贡献,60 天内生成了超过 60 万行生产代码。同时,他还全职管理 YC。 这不是段子,数据来自 gstack 项目的 README。...
前言 ✍ 在大模型后训练这条线里,大模型的参数量往往是几十亿、上百亿。SFT / RLHF / DPO / GRPO 这些“训练流程”本身固然重要,但如果用 全参数微调(Full Fine-tuning) 去做,显存和存储压力会非常大:为了能够减少训练参数,...