我想听文章而不想要机器人声音或其他订阅服务,因此我开发了Chickadee:一个免费的开源Chrome扩展,它在本地运行语音模型。
它直接在您的浏览器中使用WebGPU运行Kokoro-82M,这是一个拥有8200万个参数的语音模型。语音是在您的计算机上生成的,无需账户、API密钥或订阅。
Chickadee包含:
• 12种声音和可调节的播放速度
• 原页面上的句子高亮显示
• 初始模型下载后的离线语音
• 无需账户、订阅或API密钥
来源: [https://github.com/sahilmahendrakar/chickadee](https://github.com/sahilmahendrakar/chickadee)
我很想听听您的想法。可以在这里试用: [https://www.usechickadee.com](https://www.usechickadee.com)
返回首页
最新
我们开发了这个工具,以便在我们的企业环境中安全地查看Markdown文件,作为启动VS Code的轻量级替代方案。<p>它只是一个完全在客户端执行的单一HTML文件。除了标准渲染外,它还支持浮动导航、简洁的打印样式表,并可以将结果导出为独立的HTML文件(在移动设备上表现良好)。<p>在线查看器:<a href="https://ibm.github.io/tsar-mcp/tools/MarkdownViewer/MarkdownViewer.html" rel="nofollow">https://ibm.github.io/tsar-mcp/tools/MarkdownViewer/Markdown...</a><p>源代码:<a href="https://github.com/IBM/tsar-mcp" rel="nofollow">https://github.com/IBM/tsar-mcp</a>
你不喜欢桌面上有很多文件,比如 Screenshot 2026-09-14 at 6.42.17 AM.png 吗?<p>mkdir ~/Screenshots<p>defaults write com.apple.screencapture location "$HOME/Screenshots"<p>killall SystemUIServer<p>https://gist.github.com/andrewarrow/1584ca32badeb19868dcc3bec657eaa9<p>https://gist.github.com/andrewarrow/3d61d1c8ecdd3a7e7401bbec481718ca<p>launchctl bootstrap gui/$(id -u) ~/Library/LaunchAgents/com.aa.rename-screenshot.plist<p>现在我得到了:<p>~/Screenshots $ ls<p>basifacial_decidua.png<p>dehull_knopweed.png<p>erlking_walloping.png
在2025年11月和12月,受到西蒙·威利森(Simon Willison)关于“骑自行车的鹈鹕”基准测试的启发,我让一些当时的语言模型(LLMs)根据三十个类似的提示生成SVG图像,例如“生成一个章鱼操作管风琴的SVG”。西蒙在他的博客中提到了这个实验[1]。
九个月过去了,许多更强大的模型已经发布,因此我今天再次进行了这个实验。链接的网站展示了结果。
通过OpenRouter将十个提示运行在六个模型上大约花费了二十美元,所以我暂时就停在这里了。
[1] <a href="https://simonwillison.net/2025/Nov/25/" rel="nofollow">https://simonwillison.net/2025/Nov/25/</a>
这些人是否认为人工智能确实是奇迹,并且应该尽快使其发展得尽可能先进?
大家好,
我一直在开发Otis,这是一个开源的AI代理,旨在为您提供一个在本地和托管的开放权重模型之间的简约体验,设计上注重隐私。
在设置过程中,它会根据Otis运行的硬件推荐一个本地模型,下载并通过llama.cpp为您运行。Ollama、LM Studio和Nvidia PAIR也受到支持。
我很期待大家来试用,并欢迎所有反馈!