rom 是一个大约 5000 行的 C 语言 libretro 前端,可以在终端中玩游戏。它使用 kitty 图形协议在 Ghostty 或 kitty 中渲染原生像素,甚至可以在 tmux 中内联显示!<p>支持九个平台:SNES、NES、GB/GBC、GBA、Genesis、PC Engine、N64、Doom/Heretic/Hexen、Wolfenstein。适用于 macOS 和 Linux,采用 MIT 许可证。<p><a href="https://github.com/jhickner/rom" rel="nofollow">https://github.com/jhickner/rom</a>
返回首页
最新
我是$BIGTECH公司的软件工程经理。我想了解一下你们的软件团队是否在个别开发者利用大型语言模型(LLMs)和编码工具等方面之外,取得了任何实质性的进展。
你们是否成功地在团队成员之间共享数据和上下文,创建共享工作流程,减少了繁琐的工作、错误或生产事故,这些都是你们采用人工智能的结果吗?
感谢分享任何想法。
嗨,HN!
我正在开发Pomi,这是一个独立的语音助手,首次在Rabbit R1上发布。这里有一个30秒的视频,展示我询问旧金山的天气:<a href="https://youtu.be/vxG5is_nNqU" rel="nofollow">https://youtu.be/vxG5is_nNqU</a>
我开始这个项目是因为我发现R1作为硬件非常吸引人:它小巧、个性十足,并且专为与AI助手的互动而设计。首先要说明的是,这并不是出于对Rabbit软件的不满或试图“修复”它的动机。我想探讨一个不同的问题:我能在设备上直接构建出多少定制的、持久的语音助手体验?
为了适应R1的2.88英寸方形显示屏,我不得不从零开始构建用户界面。用户可以点击番茄图标进行对话,实时转录会以前景覆盖的形式显示,短暂暂停后消息会自动发送。回复会出现在同一对话覆盖中。此外,还有一个环境锁定显示、对话管理、动画主页状态,以及使用Picovoice的离线“嘿,Pomi”唤醒词。
项目中不太明显的一部分是让助手运行时表现得像设备的一部分,而不是一个开发过程。我使用了Nous Research的Hermes - 这是一个很棒的平台,我在其他项目中也大量使用。助手网关在启动时启动,状态存储在本地,并由Android的服务系统进行监督。通常它在本地主机上运行,但我将R1连接到我的私人Tailscale网络,并提供了一个仅其他设备(如我的Mac)可以访问的自定义tailwind URL。
这个代码库包含Android shell、Hermes运行时配置、我用于迭代240×282界面的UI实验室,以及构建、配置、安装、更新、检查和恢复设备的脚本。它针对的是运行Android 13的兼容root的Rabbit R1。它不重新分发Rabbit固件或任何用户凭据。
我最初只是为我自己的R1构建这个项目,但我整理了代码,以便其他R1用户也能复现:<a href="https://github.com/sidmohan0/pomi" rel="nofollow">https://github.com/sidmohan0/pomi</a>
我刚开始收集公众反馈,所以请告诉我你的想法。我特别感兴趣的是语音交互模型、减少说话与收到回复之间的时间,以及安装过程是否足够实用,适合其他R1用户。我也很想知道,如果原始软件不再是限制条件,人们会用这款硬件构建什么。
PS:我使用了Tailscale,这使得像OTA更新和从我的电脑访问Hermes仪表板等事情变得轻松多了,但这并不是必需的!
构建(据说)是简单且便宜的。媒体展示了那些增长速度超过历史上任何公司的人工智能成功案例。YouTube上的“专家”们在宣传那些在三个月内实现100万美元年经常性收入的人工智能/SaaS工具。
但这只是世界的一小部分。我们一直在构建有用的产品,能够带来实际效果,客户也很喜欢……但是,由于缺乏大额资金和人手有限,我们似乎无法在喧嚣中脱颖而出,获得任何关注。
那么,对于那些没有数百万资金用于客户获取的人来说……在2026年,什么方法能够每天吸引几个用户来尝试新工具呢?
随着大型语言模型(LLMs)的不断增强,我正在精简我的代理技能库。我已经移除了多步骤工作流程(如超级能力)和网页封装(如代理浏览),因为现在基础模型已经能够原生处理这些,这加快了上下文处理速度并提高了性能。
你是否也在进行类似的整理?最近你放弃了哪些曾经常用的工具或技能?