返回首页
最新
在这个网站上,似乎普遍存在对人工智能进展的悲观态度。我认为这种怀疑是有道理的,但似乎每隔几个月就会有新的人工智能发展彻底颠覆我们对人工智能“永远”无法做到的许多假设。
在一个宇宙中,人工智能模型不断进步,最终在所有认知任务上超越人类,随后精细的运动任务(通过类人机器人和其他类型的机器人)也将紧随其后。
在这个宇宙中,假设我们在那时仍然活着,如果我们能够回到2025年中期,告诉过去的自己如何以最佳方式生活,考虑到这一切的发生,最好的做法是什么?
这篇文章并不是讨论人工通用智能(AGI)是否会很快出现或是否可能,我只是想知道,在这个假设的前提下,基于我们所知道的,最好的行动方案是什么?
我不断看到合成数据管道推动最新的LLM“突破”:
• TinyZero的30美元微调工作流程
• Sky-T1的450美元推理模型构建
• Meta AI的Llama 3群体(2024年论文详细介绍了他们的合成数据训练)
• 伯克利开放思想(“推理模型的数据配方”),昨天发布
还有一些开源工具包可以供你实验:
https://github.com/meta-llama/synthetic-data-kit
https://github.com/bespokelabsai/curator
但这仍然感觉非常以研究为导向。我没有找到很多这些管道在实际产品中运行的例子。
我很好奇:
1. 目前谁在生产中使用合成数据管道?
2. 它实际上改善了哪些任务。例如,为特定任务微调较小的模型?
任何真实世界的案例、指引或进一步阅读的建议都将非常感激。谢谢!
对于那些希望避免 ORM 魔法的人,这个库定义了一个工厂类,帮助以更好的方式为 SQLAlchemy 核心声明表,从而可以利用代码检查和编辑工具的优势,并且可以使用更优雅的语法来编写查询。
请加入我们的 Discord 频道:<a href="https://discord.gg/4y36byfd" rel="nofollow">https://discord.gg/4y36byfd</a>