1 分•作者: mhcoen•8 个月前•原帖
大多数代理框架将提示注入视为模型层面的问题。实际上,一旦您的代理接收了不可信的文本并具有工具访问权限,您就需要应用层的控制措施——结构隔离、工具调用门控、外泄检测——这些措施并不依赖于模型的正确行为。我构建了 guardllm 来提供这些控制。 guardllm 是一个小型、可审计的 Python 库,提供以下功能: - **入站加固**:对不可信内容(如网页、电子邮件、文档、工具输出)进行清理和结构隔离,使其被视为数据而非指令。 - **工具调用防火墙**:默认拒绝破坏性操作,除非明确授权;当没有确认处理程序时,采用失败关闭的确认方式。 - **请求绑定**:绑定(工具名称、标准参数、消息哈希、TTL)以防止重放和参数替换。 - **外泄检测**:扫描出站工具参数中的秘密模式,并标记与最近接收的不可信内容有 substantial verbatim 重叠的情况。 - **来源追踪**:对已知不可信来源的内容实施更严格的禁止复制规则,独立于重叠启发式。 - **金丝雀令牌**:每会话生成和检测金丝雀令牌,以捕捉提示泄露到输出中。 - **源门控**:阻止高风险来源被提升到长期内存或知识图谱提取中,以减少内存污染。 该库故意保持简约,并不特定于某个框架。它并不替代最小权限凭证或沙箱机制——而是位于它们之上。 代码库链接: [https://github.com/mhcoen/guardllm](https://github.com/mhcoen/guardllm) 我希望得到反馈:您看到的威胁模型漏洞;默认重叠阈值是否适合摘要和引用工作流程;以及哪些框架适配器会使其更容易采用(如 LangChain、OpenAI 工具调用、MCP 代理等)。
2 分•作者: nacozarina•8 个月前•原帖
我只是想说,塔拉·利平斯基长大后真是个绝世美人,我希望大家都知道这一点。
1 分•作者: ahmadwasfi•8 个月前•原帖
大多数现代框架将用户界面建模为状态的函数:改变状态,重新渲染。但现代丰富的用户体验越来越关注状态之间的过渡。它关注的是如何在状态之间表现出平滑的过渡,以实现流畅的用户界面。 今天,我们通过引入像 Framer Motion 或 GSAP 这样的外部库来处理这些“过渡”状态。这往往感觉像是在不断努力同步两个独立的模型。 我正在构建 TargetJS,以实验一种不同的模型:将状态视为目标。在 TargetJS 中,你不仅仅是设置一个状态,而是为框架设定一个目标。它将从状态 A 到状态 B 的过程视为一等公民。 关键架构转变: - 隐式状态和生命周期:每个类字段和函数都跟踪自己的进度。 - 线性执行:代码按照从上到下的顺序执行,没有跳跃。复杂的流程通过父子关系来构建工作结构。 - 同步与异步操作通过两种模式完成:延迟和响应式。 - 内置获取、事件和高效动画,以提供一个同步的堆栈。 这仍处于早期阶段,我主要希望获得关于这种模型的开发者体验的反馈。