2 分•作者: navels•大约 2 个月前•原帖
neal是我在尝试使用一个LLM编码代理(在这种情况下是Codex GPT-5.4)来自主处理我们大型前端代码库迁移时编写的命令行工具。在这个项目中出现了一些问题,这些问题指导了neal的开发: 1. 告诉代理“继续工作,除非被阻塞”在长时间内实际上并不奏效。 2. 大型项目应该被拆分成更小的工作块。 3. 编码代理在每个工作块开始时应使用新的上下文,以防止上下文衰退。 4. 编码代理在过程中受益于另一个代理进行对抗性审查。 最终我得到的是一个协调器,它: - 允许你配置计划者、编码者和审查者角色。我最初使用Codex和Claude的SDK,但后来添加了OpenRouter以及兼容模式,以验证模型是否能够处理协调。目前有44个兼容的OpenRouter模型。 - 运行你提供的计划,通过计划者/审查者循环将工作拆分成合理大小的块,并格式化计划文档,以便neall能够执行。 - 通过编码者/只读审查者循环运行每个工作块。一旦两个代理都满意,neal就会继续下一个工作块。完成所有工作后,会通过编码者/审查者循环进行最后一次检查,以确保实现满足整个计划。 - 在每个工作块中重置编码者的上下文,以防止上下文漂移,同时保持审查者的上下文长期有效。 迁移工作完成了(549次提交,增加/修改了3000多个文件)。我还通过neal运行了100个基准案例(来自SWE-bench Pro),这些案例Codex无法独立解决,结果发现使用neall与Codex作为编码者和审查者角色时解决了8个案例,而使用Claude作为审查者时解决了15个。我原本希望得到更令人兴奋的基准结果,但这至少证明了neal的价值,特别是将不同模型放在审查者角色中。 neal是一个通过以下命令安装的npm包: ``` npm install -g @navels/neal ``` 并通过以下命令进行配置: ``` neal setup ``` 它可以与您的Codex和/或Claude代码订阅一起使用(只要这些CLI在本地经过身份验证),或通过OpenAI/Anthropic/OpenRouter API密钥使用。 我在我的博客上有关于neal功能及其诞生的更详细的介绍:[https://navels.dev/blog/neal/](https://navels.dev/blog/neal/) 考虑到模型能力的快速进展,我并不期待这个工具会在不久的将来仍然非常有用,但我仍然将其作为我的日常工具,使用Claude Fable作为计划者/编码者,Codex Sol作为审查者。如果你尝试使用neal,我很想听听你的反馈,特别是如果你有一些用例不太适用,或者希望有额外的模型可用。
8 分•作者: alex000kim•大约 2 个月前•原帖
我能写出的最小异步强化学习训练器:一个循环在笔记本电脑上运行REINFORCE算法进行CartPole训练,同时在集群上异步运行GRPO(例如,8个H100训练器,8个vLLM工作节点,作为一个[SkyPilot作业组](<a href="https:&#x2F;&#x2F;docs.skypilot.ai&#x2F;en&#x2F;latest&#x2F;examples&#x2F;job-groups.html" rel="nofollow">https:&#x2F;&#x2F;docs.skypilot.ai&#x2F;en&#x2F;latest&#x2F;examples&#x2F;job-groups.html</a>)在Kubernetes上运行)。<p>这一切都不依赖于Ray、TRL或DeepSpeed等,工作节点通过标准库HTTP与训练器进行通信。
3 分•作者: azatom•大约 2 个月前•原帖
为什么这个问题总是在变化,而且最基本的问题却被忽视?<p>很久以前我就报告过这个问题,但它似乎被搁置了。虽然这看起来是个小问题,但实际上非常令人沮丧,而且有简单的解决办法。<p>在横向滚动时,字符并没有消失,只是看不见而已。<p>https://i.postimg.cc/C5bN0CQT/vscode.jpg
1 分•作者: aurareturn•大约 2 个月前•原帖
API错误:529 超载。这是一个服务器端的问题,通常是暂时的——请稍后再试。如果问题持续,请检查 https://status.claude.com。
2 分•作者: 217•大约 2 个月前•原帖
我的VPS有问题吗,还是CMUX的原因,或者发生了什么?有时在打开SSH会话时,整个CMUX会冻结2到10秒。我应该使用什么替代方案?