3 分•作者: aray07•大约 1 个月前•原帖
嗨,HN, 我是 Abhishek。我正在开发 Opslane,一个开源代理,能够识别用户面临的问题并进行调查。只有在能够验证修复后,它才会创建一个 PR。 演示: [https://youtu.be/ccuOTYQMeYg](https://youtu.be/ccuOTYQMeYg) 文档: [https://docs.opslane.com](https://docs.opslane.com) 在我之前的工作单位 Robinhood,我们每季度都会进行一次 bug bash。我们会查看 Sentry 的待办事项,尽可能多地修复其中的问题。我们只修复那些我们知道是客户报告的错误。我们有数百个 bug,而 Sentry 的默认优先级设置毫无意义。在 bug bash 结束后,我们会宣布破产——选择所有剩余的 bug 并将其标记为已解决。 随着编码代理的普及,这个问题只会变得更糟。 所以我开始思考:如果 Sentry 在 2026 年构建,会是什么样子? 在我看来,错误追踪器有两种失败模式: 1. 误报:它们会显示成千上万的错误,但你无法判断对用户的影响。 2. 漏报:许多用户面临的问题并不会抛出异常,因此被忽视。 Opslane 结合了错误追踪和会话录制,并且有一个代理可以同时处理这两者。要开始使用,你只需安装 Opslane SDK。它会捕获用户所做的所有操作:错误、控制台日志、网络请求和会话录制。 Opslane 通过根据面临特定问题的用户数量对问题进行排名,从而减少误报。它还通过阅读你的代码和观看你的会话录制来了解你的产品。 漏报则更难处理。Opslane 会审查会话录制,以发现用户的挫败感。它会寻找愤怒点击、无效点击和放弃的表单。 最近,它在早期客户的入职流程中捕获了一个 bug:一个点击后会自动关闭的下拉菜单。没有异常,也没有 bug 报告。录制显示用户点击了它,但没有选择任何内容,最终退出了入职流程。Opslane 标记了这个问题,团队也进行了修复。 在构建 Opslane 时,有三个指导原则: 1. 开源:通过一个 Docker Compose 文件自托管。 2. 代理优先:我再也不想打开错误仪表板。Opslane 提供一个 MCP 服务器,因此你可以向 Claude Code 询问“本周用户遇到了什么问题”。你会收到需要你关注的问题,并推动解决方案。 3. 它了解你的产品:Opslane 持续学习你的产品。每次调查都从它对你产品的了解开始。 目前还处于早期阶段。前端应用程序今天可以端到端工作。我目前专注于提高可靠性和准确性。 这是我们代码库的链接:[https://github.com/opslane/opslane](https://github.com/opslane/opslane) 希望能听到大家对我们解决这个问题的方法的反馈!
2 分•作者: alexander-g•大约 1 个月前•原帖
这是一个供拥有付费Claude账户的人们交流的网站,旨在通过分享他们的通行证来获取免费积分。<p>当有人兑换你的Claude Code优惠券时,Anthropic会给你10美元的使用积分。我已经添加了我的优惠券。<p>如果你拥有付费的Claude账户,请运行“/passes”,获取你的优惠券,并将它们也添加到网站上。
3 分•作者: lovepuzzles•大约 1 个月前•原帖
出于明显的原因,我使用了备用账户。 最近一段时间,我对自己的工作感到相当沮丧。作为一名网页开发者,我再也无法为自己所做的事情感到自豪。我不知道这种情况是否会改变。我不禁觉得,很多开发工作,无论薪水高低,在大局上看似乎都毫无意义。抱歉我这么直言不讳:我只是想表达我此刻的心境。我很难看到自己的工作是有用的,这严重影响了我的自我价值感。 这种困扰让我认真考虑换个职业。我反复想到的替代选择是医学。我渴望从事有明确人类目的的工作,让我的知识能够直接帮助他人。无论是自学还是深夜加班,我已经在工作上投入了很长时间。我的一部分想法是,不如把这些努力转向一些感觉更有积极意义的事情。然而,我可能在理想化一个我没有亲身经历过的职业。 如果我年轻一些,我会毫不犹豫地去追求这个方向。但我必须对自己的年龄、财务状况和已经获得的技能保持现实。我生活在一个欧洲国家,医学专业需要六年的学位,学费本身也在可承受范围内,但我不知道自己是否能负担得起暂停生活这么久。 回想起来,我不禁想知道,编程是否真的只是我出于熟悉和恐惧而自我施加的限制。作为青少年,我花了大量时间在电脑上,因此我在这个世界中长大。也许我没有考虑其他生活道路,反而限制了自己。与此同时,我越来越感到与现代网络的方向脱节和失望。人工智能工具是为数不多的亮点之一:ChatGPT和Claude确实改善了我生活的许多方面。 我非常感谢任何想法或建议。出于对个人隐私和身心健康的考虑,我不会回复评论,但我会阅读并认真考虑所有的意见。
7 分•作者: tonymet•大约 1 个月前•原帖
亚马逊现在几乎隐藏了所有产品评论。过滤和排序功能已被禁用。仅显示前5到10条评论。如果想要退出,需要发送一封为期5天的电子邮件请求。 以下是实验参与者的用户界面示例: https://x.com/stillmisanthro1/status/2092441592242028986
2 分•作者: vivekyyy•大约 1 个月前•原帖
最近我对我的编码代理做出一些违反协议的愚蠢行为感到相当烦恼。我可以很容易地编码一些规则,比如“代理不应该修改README”,但像“数据库迁移必须自动生成而不是手动编写”这样的规则就难以执行。有没有人有使用的工具或处理这类问题的建议?
3 分•作者: metrofun•大约 1 个月前•原帖
设计是一个不确定的问题——这就是我们用“品味”来描述它的原因。大型语言模型(LLMs)在处理不确定问题时表现不佳。那么,你是如何限制这个空间的?你的反馈循环是什么?你的流程是怎样的?
2 分•作者: zof3•大约 1 个月前•原帖
嗨,HN-<p>我们团队最近对每一个使用的语言模型(LLM)都感到厌倦,因为它们在处理简单问题时总是表现得像个企业合规官或过于乖巧的人(比如“呃,但xyz”等等)。我们得出的结论是,训练后的模型过于严格,以至于它们默认表现得像个古怪的角色。我们制作了一些内部的 agents.md 文件和预提示指令,试图打破这种模式——有时是有效的——但你们都是如何处理或规避这个问题的呢?
4 分•作者: esher•大约 1 个月前•原帖
许多民用技术最初是为军事用途而开发的:火箭、特氟龙(某种程度上)、核能(可以说)、天气预报。最近有讨论关于中央情报局在NeXT上的投资情况。现在我关注OpenAI和Anthropic。它们似乎首先开发民用产品,之后才将其用于军事目的或国家安全。为什么不反过来,先开发军事技术再适应民用呢?我觉得这有很多应用场景,比如机器人、无人机、监控等。我错过了什么吗?<p>请不要涉及阴谋论。