返回首页
最新
我正在寻找一个GitHub项目,作者是一位技术人员,他写了一篇关于结婚/订婚的文章,讲述了他与某人相识十年的经历,以及他如何了解伴侣的喜好,比如她最喜欢的冰淇淋口味等。我不记得是在哪个地方看到的这篇文章,是在Reddit还是HN上。
这篇文章有一个很酷的功能,可以回放文章的完整草拟过程,查看每一次修订。我相信这是一个开源项目,托管在GitHub上。
有没有人对这个项目有印象?我的谷歌搜索和在HN上使用Angola搜索的尝试都没有成功。
你好。<p>我正在用新的国际象棋规则测试这个假设。这些规则的变化也可以轻松应用到线下游戏中。
我的公司强迫我使用 Bitbucket,没办法转到 GitHub,我确实很怀念 GitHub 的命令行工具。<p>我不知道为什么 Atlassian 不够重视命令行工具的开发?这让人不得不使用 Rovo CLI $$$$。<p>所以,我构建了一个框架,将他们的 OpenAPI 文件封装成一个命令行工具,目前的结果非常不错。<p>当然,这不是官方的。<p>https://github.com/scr2em/bitbucket-cli
<a href="https://reddit.com/r/uBlockOrigin/comments/1vgcjg5/about_disgusting_facebook_devs/" rel="nofollow">https://reddit.com/r/uBlockOrigin/comments/1vgcjg5/about_dis...</a><p><a href="https://www.neowin.net/news/facebook-ads-are-so-hard-to-block-that-ublock-origin-stopped-filtering-them/" rel="nofollow">https://www.neowin.net/news/facebook-ads-are-so-hard-to-bloc...</a>
我已经在这个项目上工作了一段时间,想要从HN社区获取反馈。
基本想法是将网站已经发布的结构化数据视为一个代理接口。
例如,如果一个网站公开了一个Schema.org的SearchAction,如下所示:
```
<a href="https://example.com/search?q={search_term_string}" rel="nofollow">https://example.com/search?q={search_term_string}</a>
```
AgenticSchema可以发现它,并提供一个工具,例如:
```
search_site(query)
```
这样,代理就可以直接搜索该网站自己的数据库,而不是依赖搜索引擎然后再抓取结果。
同样的方法也适用于实体和关系(电影 → 演员 → 人物,游戏 → 出版商,文章 → 作者等),我还在尝试自定义的JSON-LD/RDFa词汇。
该项目可以通过MCP/WebMCP公开发现的功能,并在操作和URL安全性方面提供保守的默认设置。
我特别感兴趣的是“结构化网络数据 → 代理能力”是否是一个有用的抽象,以及你认为它在哪些方面存在问题。
代码库:<a href="https://github.com/searchstefano/agenticschema" rel="nofollow">https://github.com/searchstefano/agenticschema</a>
每小时,GH Archive 记录大约 16 万个公共 GitHub 事件,目前约有 64% 的推送是垃圾信息。成千上万的自动创建账户(用户名由单词加数字组成,如 smithhoward5868,仓库名称毫无意义)每小时向新仓库推送数百次,全天候 24/7 不间断。其中一个仓库,LiamBruhin/SillyStuff,在一个小时内由一个用户推送了 690 次,并且持续了超过 13 个小时。
我建立了一个实时监测系统,必须检测这些“农场”以进行诚实排名,我已经跟踪它们 34 个小时。实时链接:https://github-pulse.surge.sh — 完整报告及图表和农场账本:https://github-pulse.surge.sh/report.html — 开源单脚本:https://github.com/Atheistam/github-pulse
但我真的不知道这些推送的目的是什么。没有星标,没有分叉,没有问题,没有拉取请求,没有有意义的 README——只有对新仓库的无尽推送。这是为了搜索引擎优化吗?GitHub Actions 的转售?训练数据的污染?有没有人见过这种模式,或者有人知道最终目的是什么吗?