1 分•作者: adsharma•大约 1 个月前•原帖
大多数图分析软件包都有一个可变图实现,它使用堆分配的向量来存储图。这种方法适用于小型图,但如果你使用 G.add_edge() 加载一个包含十亿条边的图,那将需要相当长的时间。 我们不需要发明新的标准。这样的可互操作的不可变内存标准已经存在:Apache Arrow 和压缩稀疏行(CSR)。CSR 在 scipy、cugraph 和列式图数据库等多个领域被广泛使用,适用于 CPU 和 GPU。 icebug-format 将这两者结合成一个基于 Apache Parquet 的磁盘标准和一个基于 Apache Arrow 的内存格式。 该软件包提供了多种流行语言的绑定,包括 Python、TypeScript 和 Rust。 该软件包附带便捷脚本,可以在内存/磁盘受限的环境中将平面表(如 vertex.parquet 和 edges.parquet)转换为这种格式。 示例图: <a href="https://huggingface.co/datasets/ladybugdb/ldbc-csr/tree/main" rel="nofollow">https://huggingface.co/datasets/ladybugdb/ldbc-csr/tree/main</a> 转换自: <a href="https://ldbcouncil.org/benchmarks/graphalytics/datasets/" rel="nofollow">https://ldbcouncil.org/benchmarks/graphalytics/datasets/</a> 最大转换图包含 30 亿条边。 许可证:MIT 快速入门: <pre><code> uv tool install icebug-format icebug-format --source-dir wiki-Talk lbug -i wiki-Talk-csr/schema.cypher</code></pre>
2 分•作者: flowerpil•大约 1 个月前•原帖
作为一个拥有干净IP范围和注意力缺陷多动症(ADHD)的人,我通过在多个域名下分散使用不同的邮箱账户来管理我的收件箱。我从未找到过一个能够满足我所有需求的邮件客户端,因此我花了一些时间自己制作了一个,现在它已经成为我每天使用的工具。 这个客户端经过优化,视觉上简单,且高度可配置,支持颜色、文件夹/子文件夹、排序,以及调整搜索查询功能,以更好地匹配你常用的搜索内容。此外,还有一些小而实用的功能,比如专门构建的渐进式网络应用(PWA)、批量域名导入、MCP(邮件控制面板)和深色模式。 它完全可以自我托管,开源且没有任何人工智能的臃肿或风险投资的成分。我并不是想出售什么,而是希望制作一个不那么糟糕且易于使用的工具,如果你试过的话,非常欢迎你的反馈!:~)