3作者: rohansx5 个月前原帖
嘿,HN, 当你将真实文档或客户数据发送给大型语言模型(LLMs)时,你会面临一个痛苦的权衡: - 发送原始文本 → 隐私灾难 - 使用[REDACTED]进行编辑 → 嵌入破坏,RAG检索失败,多轮对话变得无用,模型通常拒绝回答关于被编辑实体的问题。 实际的解决方案是保持一致的伪匿名化:同一个真实实体始终映射到同一个标记(例如,“塔塔汽车” → ORG_7)。这保留了向量搜索和推理的语义意义,然后你可以重新填充响应,以便提供者永远看不到实际的名称、数字或地址。 我厌倦了与Presidio和自定义粘合剂(截断的RAG块、印度语言的变格、拼写错误/兄弟的模糊合并、LLM混淆、百分比破坏数学)进行斗争。因此,我构建了Cloakpipe,一个小型的单二进制Rust代理。 它的功能包括: - 多层检测(正则表达式 + 财务规则 + 可选的GLiNER2 ONNX命名实体识别 + 自定义TOML) - 在AES-256-GCM加密库中进行一致的可逆映射(内存被清零) - 智能重新填充,能够处理截断块,如[[ADDRESS:A00 - 内置的模糊解析,用于拼写错误和相似名称 - 数值推理模式,使得百分比在计算中仍然有效 完全开源(MIT),零Python依赖,延迟小于5毫秒。 代码库: [https://github.com/rohansx/cloakpipe](https://github.com/rohansx/cloakpipe) 演示和快速入门: [https://app.cloakpipe.co/demo](https://app.cloakpipe.co/demo) 希望能收到任何审计过其RAG数据流或在编辑与语义问题上苦苦挣扎的人的反馈——特别是在法律、金融科技或非英语工作流程中。 你们采用了什么方法?
15作者: keks0r5 个月前原帖
我们创建 rudel.ai 是因为意识到自己对 Claude Code 会话没有任何可见性。我们每天都在使用它,但对哪些会话有效率、为什么有些会话被放弃,或者我们是否真的在不断进步毫无头绪。 因此,我们为其构建了一个分析层。在连接了我们自己的会话后,我们最终得到了一个包含 1,573 个真实 Claude Code 会话、超过 1500 万个标记和超过 27 万次交互的数据集。 我们发现的一些令人惊讶的事情包括: - 技能仅在 4% 的会话中被使用 - 26% 的会话被放弃,其中大多数在前 60 秒内 - 会话成功率因任务类型而异(文档类任务得分最高,重构类任务得分最低) - 错误级联模式在前 2 分钟内出现,并能合理准确地预测放弃情况 - 目前没有有意义的基准来评估“良好”的代理会话表现,我们正在构建一个。 该工具是免费的,完全开源,欢迎就数据或我们的构建过程提问。
14作者: aminerj5 个月前原帖
我是作者。代码库在这里:<a href="https://github.com/aminrj-labs/mcp-attack-labs/tree/main/labs/04-rag-security" rel="nofollow">https://github.com/aminrj-labs/mcp-attack-labs/tree/main/labs/04-rag-security</a> 该实验室完全基于 LM Studio + Qwen2.5-7B-Instruct (Q4_K_M) + ChromaDB 运行——无需云 API,无需 GPU,也无需 API 密钥。 从零开始到看到攻击成功:git clone,make setup,make attack1。大约需要 10 分钟。 有两件事值得提前说明: - 95% 的成功率是针对一个包含 5 个文档的语料库(对攻击者来说是最佳情况)。在成熟的文献集合中,您需要相应更多的被污染文档才能主导检索——但机制是相同的。 - 在数据摄取阶段嵌入异常检测是最大的惊喜:作为独立控制的成功率从 95% 降至 20%,超越了所有三种生成阶段防御的组合。它运行在您的管道已经生成的嵌入上——无需额外的模型。 所有五个层级结合后:10% 的残余。 欢迎讨论方法论、PoisonedRAG 比较或任何看起来不对劲的地方。
2作者: larsmosr5 个月前原帖
嘿,HN——我是一名独立开发者。之所以开发这个,是因为我厌倦了AI爬虫以纯文本的方式读取我的HTML,而robots.txt却无能为力。 核心技巧:使用种子对HTML中的字符和单词进行混排,然后利用CSS(flexbox顺序、方向:rtl、unicode-bidi)将它们在视觉上重新排列。浏览器渲染得非常完美,但textContent返回的是垃圾数据。 除此之外:还包括电子邮件/电话的RTL混淆,使用诱饵字符,AI蜜罐向大型语言模型(LLM)爬虫注入提示指令,剪贴板拦截,基于画布的图像渲染(DOM中没有img src),robots.txt阻止30多个AI爬虫,以及法医取证线索以证明内容盗窃。 它无法阻止的包括:执行CSS的无头浏览器、截图+光学字符识别(OCR),或者任何决心足够强的人进行逆向工程。我把这些放在了README的威胁模型中,因为我宁愿自己说出来,也不想让别人替我说。现实的目标是提高爬取的成本——大多数爬虫使用简单的HTTP请求,而我们让这些请求变得无效。 使用TypeScript、Bun、tsup、React 18+。162个测试。MIT许可证。没有任何销售——SDK是免费的,且功能完整。 理解这个的最佳方式:在网站上打开开发者工具并检查文本。 GitHub: [https://github.com/obscrd/obscrd](https://github.com/obscrd/obscrd)
2作者: JitseLambrichts5 个月前原帖
我构建了一个以本地为优先的用户界面,基于小型模型如 Qwen、Llama 和 Mistral 添加了两种推理架构:一个是顺序思维流程(计划 → 执行 → 评估),另一个是并行代理委员会,其中多个专家模型并行辩论,由一个评审综合出最佳答案。无需 API 密钥,零 .env 设置——只需使用 pip 安装 multimind。GSM8K 的基准测试显示,与单模型推理相比,准确性有显著提升。
2作者: akshaydeshraj5 个月前原帖
我一直在从 ChatGPT、Claude 和 README 文件中复制多行命令,但在终端粘贴时总是出现 `command not found` 的错误。括号粘贴模式并没有帮助——它阻止逐行执行,但内容本身仍然会出现问题(多余的 `$` 提示、断开的续行、跨行的操作符)。 SmartClip 直接与您的 shell 粘贴功能(zsh、bash、fish)连接,并在 shell 看到命令之前默默修复多行命令。您可以像往常一样使用 Cmd+V 粘贴——没有新的快捷键,没有守护进程,也没有后台进程。 它使用基于分数的启发式方法来检测 shell 命令(因此不会破坏您的 JSON 或散文),智能地连接行(反斜杠续行、管道、`&&`),去除提示字符,并在插入之前使用 `bash -n` 验证所有内容。如果它不确定或修复后的语法无效,则保持不变。 大约 150 行的 bash 代码。零依赖。 使用 `brew install akshaydeshraj/smartclip` 或 `npm install -g smartclip-cli` 安装。
2作者: BeyondTheMap5 个月前原帖
嗨,HN。我是一名工业技术工程专业的学生,最近我对霍尔木兹海峡的物理和物流瓶颈进行了分析。 与通常的军事视角不同,我从系统失效和热力学的角度严格分析了这个关键节点。具体来说: - 伦敦劳合社的海上战争风险保险公司如果取消一项政策,将会立即导致全球船队停靠在港口。 - 两条宽3公里的航运通道的物理限制。 - 像迪拜和利雅得这样的城市完全依赖海水淡化厂,只有严格的72小时水源缓冲时间,否则将面临全面崩溃。 我在这里整理了一个10分钟的视觉资料:https://youtu.be/eLuuja8UWb0 期待听到你们对这个节点结构脆弱性的看法。
1作者: fariniasty5 个月前原帖
我在Instagram上无目的地滑动时,问自己:我为什么要这样做?<p>我是一名平面设计师,并不是专业的开发者,但我决定构建一个与“无论如何都要增加互动”的机器完全相反的东西。没有算法。没有永久的个人资料。没有无限滚动。只有GPS、互惠和48小时的短暂帖子。<p>概念<p>如果帖子停留在你拍摄它们的物理位置会怎样?我构建了Bliip:一个基于雷达的Vanilla JS PWA平台,内容与GPS坐标绑定,并在48小时后过期。<p>我不再称其为“社交媒体”,而是开始将其视为“本地现实节点”——这听起来有些自命不凡,但请耐心听我解释。这不是关于关注别人,而是关于发现你当前所处的空间。<p>核心机制:<p>给予与获取:你必须发布内容才能解锁附近的内容,持续24小时。不允许潜水者。 GPS锁定:内容与空间绑定,而不是用户。 叙述者:一个讽刺的“系统”AI(守门人),在入门时会调侃你。<p>这实际上是为谁准备的?<p>Bliip显然并不适合每个人。它是为那些在音乐节、校园或邻里聚会上,想要了解三英尺外的人在看什么的人准备的——而不是六小时前算法决定他们应该看到的内容。<p>技术难题<p>薛定谔的照片:现代手机不会立即释放文件;它们在后台处理HDR/AI。如果你抓取文件的速度太快,它“还不存在”。我不得不直接将Blob转储到RAM中以绕过操作系统的延迟。<p>没有服务器农场的视频(FFmpeg.wasm):我无法承担转码后端的费用。我使用FFmpeg.wasm将处理转移到客户端的CPU上。在移动浏览器上让它正常工作需要一场关于SharedArrayBuffer和COOP/COEP头配置的噩梦(真正的PWA体验),但它确实有效。<p>AI脑外科手术:我在AI的帮助下编写了这个,这是一场充满幻觉的过山车。在过程中,GPT-5在复杂的WASM内存逻辑上开始失败。我尝试切换到Claude,但它坚持认为是2025年,并在某一时刻字面上输出了“KURWA MATEUSZ”(我的名字加上一个波兰脏话),在上下文崩溃的瞬间。我最终将项目的“大脑”“移植”到Gemini上,完成了最后的1万行代码。<p>Google Play的地狱:新的“12个测试者14天”规则对独立开发者来说是创伤。如果第13天只有11个测试者而不是12个,Google就会重置计时器。仅仅为了在商店“存在”就花了两个月的时间。<p>现实检查<p>有机用户出现了。他们看到霓虹/赛博朋克的设计,认为:“约会应用。”<p>我学到了行业术语TTD(Time To Dick)。Bliip的得分令人震惊地短。评分降到了1.0,因为用户期待的是Tinder,却得到了一个带有讽刺叙述者的基于位置的雷达,告诉他们去外面走走。<p>我花了几个月解决内存泄漏和构建Redis空间索引,结果却得到了裆部照片和一星评价。这是独立开发者最黑暗的时刻。完全孤立。<p>当前状态<p>经过1年的独立开发: 38,106行代码(Vanilla JS,PHP,Redis) €0的营销预算 15个活跃用户 遗憾:0<p>技术栈: 前端:Vanilla JS PWA(没有大型框架,只有汗水) 后端:PHP + MySQL + Redis(空间索引/地理搜索) 视频:客户端FFmpeg.wasm 基础设施:€30/月的VPS<p>我学到的东西<p>用户会误解你的教堂,并在角落里拉屎。那些留下来帮忙清理的人才是真正的观众。 不要为每个人构建(首先为自己构建)。 技术栈并不重要(PHP在地理应用中是一个黑马)。 作为一个会编码的设计师是一种超能力(也是一种诅咒)。<p>试试吧:https://play.google.com/store/apps/details?id=me.bliip.twa 网站:https://bliip.me