2作者: aki_asahara大约 1 年前原帖
嗨,HN, 我们很高兴地介绍Fixstars AIBooster,这是我们新推出的性能工程工具,旨在显著加速AI模型训练,同时优化GPU的利用率。 AIBooster提供: - 实时监控GPU、CPU、内存和电力消耗。 - 清晰识别性能瓶颈,帮助开发者优化AI工作负载。 - 经过验证的AI训练过程加速——用户通常能实现2-3倍的速度提升。 - 通过最大化基础设施效率实现显著的成本节约。 该工具免费试用,设置简单,并能无缝集成到您现有的基础设施中。 我们开发这个工具是为了让AI开发者在不需要复杂调优的情况下,充分利用他们的GPU基础设施。 我们期待您的反馈、问题或建议!
3作者: babakode大约 1 年前原帖
我刚刚推出了 JS1024——一个创意编码挑战,严格限制为 1024 字节的 JavaScript。<p>不允许使用库和框架。只有原始代码。<p>你可以提交视觉效果、生成艺术、小型游戏、合成器,或者任何你能装进 1KB JavaScript 的作品。<p>→ <a href="https:&#x2F;&#x2F;js1024.fun&#x2F;" rel="nofollow">https:&#x2F;&#x2F;js1024.fun&#x2F;</a><p>可以把它看作是 JS1k 或 4k 演示场景的精神继承者——带有现代的元素。<p>欢迎反馈、想法或帮助传播这个消息。如果你曾经制作过小型 JS 演示,请分享——我很想看看。
2作者: jakedata大约 1 年前原帖
在跨越国际边界时,旅行者可能会被合法要求提供对其设备的访问权限。这种情况下,旅行者通常没有拒绝的余地。 我正在寻找一个双引脚的时间基于一次性密码(TOTP)应用程序,它看起来像是在正常工作,无论实际情况如何。输入错误的PIN可能会导致应用程序生成无效的代码,同时可以选择清除真实的配置。 实际上,尝试使用无效代码可能会在接收虚假登录请求的服务器上触发各种操作。发送SOS邮件可能就是其中一种操作。 我不确定这样的应用程序是否存在于主要的应用商店中。你有什么想法吗?
1作者: skoutXII大约 1 年前原帖
嘿,HN!<p>作为一名史诗奇幻和科幻小说的读者,我经常会拿起手机查找一些冷门的配角,或者“Genebackis”和“Genebaris”之间的区别。因此,我开发了runik,将世界观内的定义直接带到我的电子阅读器上,让我能够更深入地沉浸在故事中。<p>Runik将粉丝维基的内容解析成Kobo和Kindle兼容的词典。它利用设备内置的单词查找功能,因此无需越狱,并且可以离线使用定义。<p>该项目仍处于早期开发阶段,使用Go(Wails)+ Svelte + Dictutil构建——欢迎反馈!<p>注意:Kindle支持需要kindlegen,该工具与Kindle预览器应用程序捆绑在一起(详细信息见README)。<p><a href="https:&#x2F;&#x2F;runik.app&#x2F;" rel="nofollow">https:&#x2F;&#x2F;runik.app&#x2F;</a> <a href="https:&#x2F;&#x2F;github.com&#x2F;Runik-3&#x2F;core">https:&#x2F;&#x2F;github.com&#x2F;Runik-3&#x2F;core</a>
1作者: liquid99大约 1 年前原帖
大家好, 我创建了 CopySymbol,旨在让您能够自定义 Unicode 符号,并将其下载为 SVG 或 PNG 格式。您还可以复制符号及其 Unicode、HTML、CSS 和 Alt 代码。 它拥有超过 70 个类别,一键复制,剪贴板历史记录,并且在移动设备上也能良好运行。 期待听到您的想法。感谢您关注!
4作者: picolas大约 1 年前原帖
嗨,HN, 我最近在做一个小的副项目,已经有几个星期了。这个项目解决了我个人的一个痛点,我非常享受这个构建过程。现在我想把它分享给大家——并不一定是为了把它变成一个创业公司,而是希望能获得反馈或用户。 问题是,我对这一切都很陌生。我之前从未真正推出过任何东西。我不知道如何“将其发布出去”,而又不显得过于自我宣传或像垃圾信息。我真的希望人们能告诉我它的问题所在。 请问这样做的最佳方式是什么? 我很想听听你们的经验,或者你们过去成功的做法。 非常感谢! (附言:如果可以的话,我很乐意在准备好时分享一个链接,但现在我只是想寻求一些建议。)
13作者: adilhafeez大约 1 年前原帖
嗨,HN——我们是Arch团队(<a href="https://github.com/katanemo/archgw">https://github.com/katanemo/archgw</a>),一个用Rust编写的开源LLM代理。今天,我们发布了Arch-Router(<a href="https://huggingface.co/katanemo/Arch-Router-1.5B" rel="nofollow">https://huggingface.co/katanemo/Arch-Router-1.5B</a>),这是一个用于基于偏好的路由的1.5B路由模型,现已集成到代理中。随着团队整合多个LLM——每个模型具有不同的优势、风格或成本/延迟特征——将正确的提示路由到合适的模型成为应用设计中的关键部分。但这仍然是一个未解决的问题。大多数路由系统可分为两类: - 基于嵌入的路由器使用意图分类器——将提示标记为“支持”、“SQL”或“数学”,然后路由到匹配的模型。这在简单任务中有效,但在真实对话中会失效。用户在对话中会改变话题,任务边界模糊,产品变更需要重新训练分类器。 - 基于性能的路由器根据基准测试(如MMLU或MT-Bench)或延迟/成本曲线选择模型。但基准测试往往忽视了生产中重要的因素:特定领域的质量或主观偏好,比如“法律会接受这个条款吗?” Arch-Router采取了不同的方法:通过用自然语言书写的偏好进行路由。您可以编写规则,例如“合同条款 → GPT-4o”或“快速旅行提示 → Gemini Flash”。路由器使用一个轻量级的1.5B自回归模型将提示(和对话上下文)映射到这些规则上。无需重新训练,也没有脆弱的if/else链。我们在Twilio和Atlassian团队的输入下构建了这个系统。它能够处理意图漂移,支持多轮对话,并允许您通过一行更改路由策略来更换模型。完整细节请参见我们的论文(<a href="https://arxiv.org/abs/2506.16655" rel="nofollow">https://arxiv.org/abs/2506.16655</a>),以下是一些快照: 规格: - 1.5B参数——可在单个GPU(或CPU测试)上运行 - 无需重新训练——可以指向任何组合的LLM - 考虑成本和延迟——将重任务路由到昂贵模型,将轻任务路由到更快/更便宜的模型 - 在我们的对话路由基准测试中表现优于更大的封闭模型(详细信息见论文) 链接: - Arch Proxy(开源):<a href="https://github.com/katanemo/archgw">https://github.com/katanemo/archgw</a> - 模型 + 代码:<a href="https://huggingface.co/katanemo/Arch-Router-1.5B" rel="nofollow">https://huggingface.co/katanemo/Arch-Router-1.5B</a> - 论文:<a href="https://arxiv.org/abs/2506.16655" rel="nofollow">https://arxiv.org/abs/2506.16655</a>
5作者: AllanSavageDev大约 1 年前原帖
我刚刚被锁定了我的LinkedIn账户,惊讶地发现唯一的恢复方法是通过一个名为Persona的第三方服务提交政府身份证和自拍视频。他们没有提供任何替代方法——没有电子邮件验证,没有人工审核,什么都没有。只能选择: 提交生物识别面部识别,或者 失去对账户的访问权限(在许多情况下,也失去你的职业网络)。 我住在美国(印第安纳州/德克萨斯州),查了一下法律影响。关于生物识别数据有一些法律,但没有实际的方法可以选择退出或要求替代方案。 这似乎是对一个职业社交平台的巨大越权。并不是每个人都愿意为了继续使用他们的个人资料而将面部扫描和身份证交给第三方供应商。尤其是当标记原因不明确,并且没有上诉途径时。 有没有其他人遇到过这种情况?其他平台现在也在这样做吗?我很想知道是否有任何解决办法,或者有没有人成功对抗过这种情况。