返回首页
最新
大家好,
最近我在各种笔记应用之间跳来跳去。大多数应用都还不错,但有一半的时间我只是想打开一个标签,快速记录一个想法,然后继续前进。我希望能找到一种感觉即时或快速的工具。
我找不到一个既简单又有趣的应用,所以最终我自己做了一个我觉得不错的。
这个应用完全在浏览器中运行,使用SQLite WASM本地存储所有内容(这一点是我最喜欢的,因为我认为WASM的应用还远未充分发挥)。如果你将它安装为渐进式网页应用(PWA),它还可以离线使用。支持斜杠菜单、Markdown快捷键、待办事项、代码块,常见的区块功能,还有更多功能即将推出 :)
你可以在这里试试。
<a href="https://notem.pages.dev" rel="nofollow">https://notem.pages.dev</a>
我很好奇你们的想法。
几小时前,我将我的域名服务器切换到Cloudflare,以便通过我自己的子域名启用R2存储桶服务。结果我发现,它在我的HTML-only、无JavaScript的网站textlog.cc中悄悄注入了一段JS分析代码——我不得不去分析仪表板,将网站添加到分析中,然后再禁用这段代码。我认为这种做法完全是侵入性的,用户应该主动选择启用这样的功能,而不是被迫选择禁用。给那些可能对此不知情的人一个警告。
Atlas.nvim 让你可以直接在 Neovim 中查看拉取请求(PR)。浏览差异,查看和回复评论,解决讨论线程,并留下本地笔记。<p>欢迎反馈。
《Distro Fighter: WARS》目前处于封闭测试阶段,但HN有自己的入口:<a href="https://distrofighter.com/wars?beta=hackernews-2026" rel="nofollow">https://distrofighter.com/wars?beta=hackernews-2026</a> - <a href="https://distrofighter.com" rel="nofollow">https://distrofighter.com</a>的街机对所有人开放。<p>促销活动将在今晚午夜开始(每周一次),而赛季(迁移)则是每季度一次。每年年底将会有一个巨大的惊喜。
我构建了一个专门的 DeepSeek V4 Flash 0731 包(最初总参数为 284B,活跃参数为 13B),保留了推理、工具调用和编码能力:<p><a href="https://huggingface.co/steadfastgaze/DeepSeek-V4-Flash-0731-Coder-56.8GB-MoEspressoV2" rel="nofollow">https://huggingface.co/steadfastgaze/DeepSeek-V4-Flash-0731-...</a><p>我让它编写了一个针对 ARM64 的最小 C 编译器,然后用 Fibonacci 和 FizzBuzz 程序测试结果,成功完成时间不到 1 小时,完整记录见:<p><a href="https://youtu.be/XiwSilmV8B0" rel="nofollow">https://youtu.be/XiwSilmV8B0</a><p>您可以在我的引擎上运行它,适用于 Silicon Macs,链接为 <a href="https://github.com/steadfastgaze/MoEspresso" rel="nofollow">https://github.com/steadfastgaze/MoEspresso</a>,而为实现这一结果开发的核心库之一可在 <a href="https://github.com/steadfastgaze/mlx-iqk" rel="nofollow">https://github.com/steadfastgaze/mlx-iqk</a> 找到。<p>上述记录是在一台 128GB 内存的 MacBook M3 Max 上进行的,但您也可以在 32GB 的 MacBook 上运行,具有非常可用的上下文(128K tokens)和预计的 5 tok/s。我曾在一台无风扇的 16GB 内存 MacBook Air M1(1.39 tok/s)上尝试过,但可用的上下文非常小。<p>如何实现:
- 首先,进行高效量化:mlx-iqk 利用 IQ_K 张量编码,比 llama.cpp 或 barebones MLX 提供的更高效,最初由 Iwan Kawrakow 设计 - 我还将布局更改为 k 连续布局,以使其更快,至少在这个 Metal 设置中是这样。<p>- 其次,专家剪枝:40 个学习路由层中的每个都有 256 个专家,并非所有专家在编码用例中同样重要。我移除了 80B 参数 - 这是一种已知的技术,称为 REAP,详细信息见 <a href="https://www.cerebras.ai/blog/reap" rel="nofollow">https://www.cerebras.ai/blog/reap</a>。<p>- 第三:平衡最便宜的 IQ1_S_R4 张量编码(每个权重约 1.5 位),选择性地将投影提升到 IQ2_KS 或 IQ2_K,当测得的误差减少证明字节的合理性时。<p>其中一个主要想法不仅是保存相关知识,还要确保它不会忘记如何……停止思考,如何使用推理。在最初的实验中,它有时会在没有关闭思考部分的情况下推理数千个 tokens,或者会陷入循环。<p>然后我通过在校准混合中大幅加权工具调用痕迹和结构化推理来解决这个问题。
大家好。
我想向大家介绍一个我在过去几个月里一直在开发的工具——真实虚假数据生成器。
网址是:https://real-fake-data.com
这个工具的基本需求是提供测试数据,这些数据(1)与真实数据相同但并不真实,(2)确保您的数据管道能够捕捉到现实生活中的问题,而不仅仅是开发者在开发时会记得覆盖的问题。
首先,现实是不断变化的。您可能会有一个提交表单,要求填写车辆注册号码,但您会遇到问题(不同国家,不同规则)。您要么花一个月的时间挖掘各种场景,要么就随便设置一个“最大长度7”的限制,然后离开。您的工具已经上线并正常工作——但是有一天,某个国家或州决定将车辆牌照的长度设置为8……您的系统就会失败(用户无法输入新的车辆牌照),而您的测试管道仍在正常工作,并给您发送虚假的绿色微笑。
其次,您真的无法预测所有情况。您面向全球用户?很好,但他们使用不同的字母表。您美丽的用户体验/用户界面可能会因为用户的姓名缩写变成4或5个字母而崩溃。或者姓氏字段可能太短。或者它是否会接受即使在欧洲也使用的非拉丁字符?
当您创建新软件时,您还需要一些种子数据——以便在开发时能够看到您的工具与一些模拟用户、模拟帖子、模拟产品、模拟交易等的表现。同样,您要么花费大量时间来编写这些数据——即使有AI的帮助——要么您就只能留下user1、user2、user3,失去了从真实用户的角度来看待您的工具的能力。
我的工具——real-fake-data.com——解决了所有这些问题。
- 您想接受德国身份证、美国车辆号码、西班牙18岁以上的个人、来自波兰的真实地址——我们有超过300个真实数据生成器(真正存在,保证校验和,遵循所有规则)。
- 您想创建一个包含30个用户的种子数据库,每个用户都有几个订单、支付详情和日志——带有有意义的真实时间戳——只需定义数据模式,数据就会生成。
- 您想在一个恶劣的环境中运行测试——我们可以做到——您可以为每个生成器切换到正常模式、边缘模式(正确的数据但在正确性边缘,例如:出生日期是昨天,最长的姓氏,波兰最短的车辆号码)、极端模式(正确的数据但故意制造问题,例如未修剪的空格、新行、隐藏的UTF字符等)和无效模式(不正确的数据,用于检查您的表单是否会拒绝或正确处理)。
- 您想使用相同的数据重新运行测试——这可以做到,使用种子号,您将始终获得相同的随机数据——因此您可以选择何时需要随机数据,何时需要重复的安全性。
- 您希望您的Claude以低成本为您提供数据?太好了,MCP服务器已准备好供您使用。
- 您想轻松编写Playwright测试?只需`const person = await fakeData.plPerson({ sex: 'f' });`,您就可以完成。
- 您想使用VSCode插件在浏览器中直接获取测试数据,而无需离开?很好——按Ctrl+Shift+P“生成虚假UUID”——您就可以在不离开VS Code界面的情况下准备好数据。
- 您想确保任何数据都不会让您的软件面临风险?很好——确保种子是随机的,开启边缘模式,您将确信一旦现实世界中出现新的数据格式,您的管道将会针对它们进行测试。
这要花多少钱?对于简单使用,它是免费的。没有隐藏费用,不需要信用卡,也没有任何形式的月订阅。每月2000个免费代币。
我非常希望能收到更多的反馈,并听听您对这个工具的看法。
它还具有MCP插件,VS Code扩展中的Playwright插件,允许您在不离开IDE的情况下获取任何数据。
祝好,
Karol Nowakowski