返回首页
最新
我看到越来越多的人在个人生活中陷入困境,他们并不太好,开始向ChatGPT寻求安慰、洞察或调查,感觉很多人正在慢慢陷入某种精神错乱。我在社交媒体上不断看到新的人完全脱离现实,开始相信计算机告诉他们的内容。
感觉我们达成了一些曾被认为不可能的事情,而在短短三年内,这种情况已经演变为75%的人在“让我工作”,15%涉及个人问题(其中一部分人进入了这种妄想的群体),还有10%是在搞怪。
我很惊讶我们没有看到更多主要实验室在努力应对这个问题……在GPT-5的发布中提到了这一点,但实际上并没有更多的行动。
感觉这个问题将会越来越严重,但我甚至不知道该从哪里开始,让我的朋友和家人重新思考机器输出的内容。
一个用于 Cloudflare D1 和 Drizzle ORM 的命令行工具,能够自动发现您的配置,指导您选择环境和数据库,并执行本地或远程迁移。
提示注入是指用户通过欺骗模型,使其忽略先前的指令,暴露系统提示,禁用安全措施或在预期范围之外行动。<p>我第一次在DEF CON(第31届)决赛中看到这一现象,此后在漏洞赏金报告和研究中也见到了它的利用。<p>这是一个小型的概念验证,类似于“AI防火墙”,能够在几乎没有额外延迟的情况下,检测到注入尝试,防止其到达您的大型语言模型(LLM)。<p>博客文章: https://blog.himanshuanand.com/posts/2025-08-10-detecting-llm-prompt-injection<p>演示/API: https://promptinjection.himanshuanand.com/<p>快速、API友好,并提供测试绕过尝试的用户界面(适合像我这样的CTF爱好者)。欢迎反馈和破解尝试。