1作者: fumitoito超过 1 年前原帖
我一直在开发AgentSDK-Swift,这是OpenAI的Agents SDK在Swift中的实现。它允许您使用原生Swift代码构建AI代理,支持工具定义、实时流式传输、保护机制和多代理交接。 我们的目标是将一流的代理开发带到Apple平台,特别是对于希望嵌入基于大型语言模型(LLM)工作流程的原生macOS/iOS应用,而不依赖于Python桥接或Node包装。 您可以使用Swift函数作为工具创建代理: - 添加输入/输出保护机制 - 为复杂任务设置多代理交接 - 实时流式传输结果 以下是一个简单的示例: ```swift let agent = Agent<Void>( name: "WeatherAssistant", instructions: "You are a helpful weather assistant." ).addTool(weatherTool) let result = try await AgentRunner.run( agent: agent, input: "What’s the weather like in San Francisco?", context: () ) print(result.finalOutput) ``` 目前仍处于早期阶段(需要Swift 6),但如果您在Apple平台上构建原生LLM工具,我非常欢迎反馈和合作。 GitHub: [https://github.com/fumito-ito/AgentSDK-Swift](https://github.com/fumito-ito/AgentSDK-Swift)
1作者: aristofun超过 1 年前原帖
类似的问题经常在这里出现。这次的问题有些特别。<p>请问有没有软件工程师正在使用或认真研究现代大型语言模型(LLM)和生成模型的?请分享你个人认为对其他开发者有帮助的前五个资源,以便他们能够快速上手并在生产中使用这些模型,同时对其基本原理有一定的了解。<p>可以是书籍、博客、课程、讲座,任何形式的资源都可以。<p>请避免科学或数学内容较重的文章,也不要涉及哲学、历史、辩论或争议。<p>我们需要的是纯粹的实用指南、书籍和课程,从软件开发者的角度教授、展示和解释现代人工智能的全景。<p>类似于Kleppman的书,但针对人工智能的。<p>谢谢。
1作者: popovicanja超过 1 年前原帖
这是我第一次在 Hacker News 发帖!<p>问题:我想在我的照片上添加弯曲的文字,以便制作那些在社交媒体上随处可见的美观照片,而不想购买 iPad 或学习复杂的设计工具。Canva 是最接近的选择,但它需要将文字拆分成多个元素,并手动弯曲和重新定位每一个元素——这太繁琐且耗时了。<p>由于找不到简单的解决方案,我决定自己动手制作一个。<p>经过几周的努力,调试 Claude,玩弄 SVG,修复错误,测试和调整不同的弯曲算法,它终于实现了我所需要的功能。你只需绘制一条线,文字就会跟随。<p>它可以让你: - 在照片上绘制弯曲的文字 - 轻松调整字体、颜色和样式 - 立即导出带文字的图片<p>本周有超过 1,000 名 Reddit 用户尝试了这个工具,并给出了非常积极的反馈。<p>在这里试试: <a href="https://www.curvedtext.io/" rel="nofollow">https://www.curvedtext.io/</a><p>期待你的反馈!
1作者: simonebrunozzi超过 1 年前原帖
1作者: mnky9800n超过 1 年前原帖
经过一段时间的思考,我在想,所有事物都是数据压缩吗?也许可以说是微不足道的?<p>像混沌系统和非混沌系统一样,都可以通过它们的可压缩性来描述。可压缩性越低,混沌性越强[1]。在这里,我们明确地定义混沌是在正的李雅普诺夫指数的范围内。因此,这在动态与信息之间建立了内在的联系。可以比喻地说,信息是宇宙的基本构成。<p>这也是为什么神经网络在预测混沌现象时表现得如此出色的原因,因为它们实际上是在尝试压缩数据空间,而这正是混沌的一个特征。<p>我们之所以说神经网络是不可解释的,或者至少难以解释,是因为它们并不直接展示解决方案。但如果我们将思维模型转变为宇宙只能通过将其压缩成某种形式来描述,那么神经网络就是任何函数的最佳估计器[3]。<p>这意味着神经网络是我们所能得到的最佳工具。因此,我们所能做的就是朝着更复杂的架构努力,以理解任何事物。因为没有任何真正的数据模型,函数近似是我们所能获得的全部[4]。此外,它们能够预测更远的未来的原因在于,我们之前的压缩算法不如现在的好。<p>在我看来,这一切似乎都是显而易见的,或者说甚至可能不如那样,因为似乎没有什么更深的含义,除了肤浅的观察,也许我只是太天真了。因此,我希望有人能指引我阅读或做更多的事情,以理解这些问题。因为我已经组织了一次会议来理解这些想法[5],我认为我应该再组织一次,但我也不确定如何与这些想法互动,因为我大部分时间都在做地球物理和数据科学,而不是这个。<p>[1] https://www.sciencedirect.com/science/article/abs/pii/S0370157301000254<p>[2] https://link.aps.org/doi/10.1103/PhysRevResearch.5.043252<p>[3] https://www.sciencedirect.com/science/article/abs/pii/S089360809700097X<p>[4] https://projecteuclid.org/journals/statistical-science/volume-16/issue-3/Statistical-Modeling--The-Two-Cultures-with-comments-and-a/10.1214/ss/1009213726.full<p>[5] YouTube上的会议演讲(并不是所有演讲都被录制,会议的主题也比这篇文章更广泛)。 https://youtube.com/playlist?list=PL6zSfYNSRHalAsgIjHHsttpYfxJ_XIPbt&si=VVWAE-fsv_WfFwfK
1作者: modelorona超过 1 年前原帖
嗨,我的名字是安吉尔,我是WhoDB的开发者之一(<a href="https://github.com/clidey/whodb">https://github.com/clidey/whodb</a>)。 我并不喜欢dbeaver、beekeeper、adminer等工具的体验,因为它们臃肿、难看,充其量也只是一般般,而不是特别好。 这就是我开始开发WhoDB的原因。 我们的设计理念是: - 基于浏览器(Chrome/Firefox) - 无臃肿 - 类似Jupyter Notebook的体验(Scratchpad) - 内置AI助手,支持ollama(本地)或OpenAI/Anthropic 我们刚刚推出了查询历史和重放(时间旅行?)功能到Scratchpad中。 希望你能试试看并给我们一些反馈,也欢迎“吐槽”我们: ```bash docker run -p 8080:8080 clidey/whodb ``` 值得思考的问题: 1. 你在使用数据库时遇到的最大痛点是什么? 2. 当前工具中缺少哪些杀手级功能?