返回首页
最新
我曾经非常喜欢参加黑客马拉松,有时也会作为导师或评委参与其中。随着“氛围编码”提交数量的激增,1- 提交的数量急剧增加,2- 评判项目质量变得更加困难,因为现在主要是评估他们使用的工具的质量。
我并不是在贬低使用人工智能。在某些方面,“氛围编码”确实表现出色,比如前端开发通常做得很好,但对于更复杂的项目,我仍然没有说服自己。
我对这篇文章的接受度没有任何期待,因为它对开源持有“过于纯粹”的看法。然而,除非我们在没有附加条件的开源之外有所进步,否则这个生态系统将继续保持现状,依然破碎。为什么我们那些超负荷工作、薪水微薄的开源开发者不为他们的软件设定一个类似于“如果你赚超过1,000,000美元,就给我付费”的许可呢?JSON 的设计者(“那个” JSON)道格拉斯·克罗克福德曾让IBM请求使用JSLint的许可,因为道格拉斯在其中添加了“软件应当用于善,而非恶”的注释/条款。[1]
我们不知道GPL在法庭上是否有效。不过,似乎你在许可中写的任何内容都能起到一定的威慑作用。因此,你的代码库可以采用现有的宽松许可,比如MIT,并添加我提到的条款。为他人商业使用你的开源项目设定一个程序。例如,大时间公共许可证就是一个这样的例子。[2]
[1] https://wonko.com/post/jsmin-isnt-welcome-on-google-code/
[2] https://bigtimelicense.com/versions/2.0.2#big-business
嘿,HN,我开发了 Rememex,一个用于本地文件的语义搜索层。
问题是:我总是找不到文件。不是因为它们被删除了,而是因为我记不住确切的文件名或关键词。grep 需要精确的单词,而其他工具只能搜索文件名。我想输入我“想要表达的内容”,然后找到我需要的东西。
它是如何工作的:
- 支持 120 多种文件类型的索引(代码、文档、图片、配置文件)
- 混合搜索:向量嵌入 + 全文搜索 + JINA 交叉编码重排序
- 通过 Windows UWP 引擎对图像进行 OCR 处理
- 读取 EXIF GPS → 反向地理编码为城市名称(“来自伊斯坦布尔的照片”有效)
- EXIF 日期 → 转换为人类语言(“夏季早晨”可以找到 7 月 8 日早上拍摄的照片)
- 根据语言智能分块(Rust 在 fn/struct,Python 在 def/class)
- 内置 MCP 服务器,供 AI 代理作为工具使用
所有功能均在本地运行。嵌入使用本地 ONNX 模型(Multilingual-E5-Base)作为默认设置,您也可以选择接入 OpenAI/Gemini/Cohere。
这个名字来源于 Vannevar Bush 的 Memex(1945),他设想了一种存储和检索人类所有知识的设备。
技术栈:Rust(Tauri 2)、React/TypeScript、LanceDB、rayon
我将其与 grep 进行了基准测试,在代理任务中,Rememex 一直能在一步内找到所需内容,而 grep 则需要 3-5 步或完全失败。关键区别在于:grep 需要精确的关键词,而 Rememex 需要的是概念。
目前仅支持 Windows(依赖 UWP OCR),但核心引擎是可移植的。
希望能收到关于搜索质量和架构的反馈。
MIT 许可,永久免费。