我已经在这个项目上工作了一段时间,想要从HN社区获取反馈。
基本想法是将网站已经发布的结构化数据视为一个代理接口。
例如,如果一个网站公开了一个Schema.org的SearchAction,如下所示:
```
<a href="https://example.com/search?q={search_term_string}" rel="nofollow">https://example.com/search?q={search_term_string}</a>
```
AgenticSchema可以发现它,并提供一个工具,例如:
```
search_site(query)
```
这样,代理就可以直接搜索该网站自己的数据库,而不是依赖搜索引擎然后再抓取结果。
同样的方法也适用于实体和关系(电影 → 演员 → 人物,游戏 → 出版商,文章 → 作者等),我还在尝试自定义的JSON-LD/RDFa词汇。
该项目可以通过MCP/WebMCP公开发现的功能,并在操作和URL安全性方面提供保守的默认设置。
我特别感兴趣的是“结构化网络数据 → 代理能力”是否是一个有用的抽象,以及你认为它在哪些方面存在问题。
代码库:<a href="https://github.com/searchstefano/agenticschema" rel="nofollow">https://github.com/searchstefano/agenticschema</a>
返回首页