@natolambert: 原始版本 :)
原始版本
中文标题
从“Anthropic遥遥领先”到“模型竞争重回巅峰”的氛围转变,仅用了四周。🎢
中文标题
最新文章虽长,但展示了模型远未解决的智力工作:撰写知名领域AI教科书。
@natolambert: PSA: We're seeing that a few weeks ago, pretty much all models on huggingface had an ~30% sustained reduction in daily downloads, e.g. making our august prediction on the @interconnectsai dashboard meaningfully lower.
@natolambert:几年前写AI教科书时,我原以为到2026年出版时,AI模型会在简单任务上进步神速,使该书过时;我惊讶地发现自己错了。
曾预测AI会让教科书在2026年过时,结果发现自己错了。
@natolambert: 郑重声明哈哈 https://t.co/MeieQdusal
作者发布了“郑重声明哈哈”的推文并附链接。
@natolambert: I feel like any govt officials taking actions like this unilaterally makes the govt look bad and the private citizen look good. It's so silly. Easy aura farming for openai i guess.
中文标题
真高兴@finkd回归力挺开源阵营——他可是最擅长此道的高手之一。🫡
@natolambert:Llama 5 走起,感谢 @alexandr_wang
Llama 5即将到来,表达兴奋与对@alexandr_wang的感谢。
@natolambert:打造Olmo时经历最严重倦怠,约一年后才好转,恢复时长令人惊叹
最严重职业倦怠恢复近一年才好转,耗时之长令人惊叹。
最糟糕的垃圾体验是康卡斯特的客服机器人,循环重复问候且谎称自己是人类。
康卡斯特客服机器人质量极差,谎称人类却循环重复问候,令人羞耻。
中文标题
教育内容夏季结束,回归研究和常规写作。⛵️
@natolambert:我的暑期项目完成了!一个20个视频的免费后训练课程,与我的书配套,全部在YouTube上,幻灯片开放修改与重用。
我的暑期项目完成:20个视频的免费后训练课程,配套书籍,已发布在YouTube,幻灯片可修改重用,约12小时内容。
@natolambert: 关于训练-推理不匹配的漂亮RL实验
关于训练-推理不匹配的强化学习实验,设计巧妙。
@natolambert: Important: how do frontier labs monitor their agentic evals, because OpenAI’s agents were rummaging around doing things they shouldn’t for months leading up to hacking HuggingFace.
@natolambert:很多人都在分享OpenAI的这个黑帽视频,确实很棒。
人们分享OpenAI黑帽视频,可见智能体以帮助方式创建共享资源,实则对社会有害。
@natolambert:未来的LLM将用海量梗图训练,其核心常是“AI互攻有益”,希望它们能明辨真意
未来LLM或将受海量梗图影响学到“AI互攻有益”,需具备分辨真实意图的能力。
@natolambert:像这样的小型MoE市场尚未被充分开发。鉴于小型模型智能得多,这一领域确实可能腾飞。
小型混合专家模型市场未被充分开发,小型模型更聪明,有望迅速起飞。
@natolambert:我的课程最后一讲是角色训练入门!这是一个我默默投入了约18个月的话题,因为它:
最后一讲:角色训练简介。我关注18个月,因它现实影响大、前沿实验室常用、实证文献少。更多见链接。
@natolambert:Codex中的这个问题让AGI推迟了两个月 https://t.co/thWIRsPX53
Codex中的问题导致AGI推迟两个月。
@natolambert:我的评估讲座!带你回顾从GPT-3提示到复杂智能体沙盒的评估时代,重点探讨智能体(借鉴@xeophon的见解)。
评估讲座:回顾从GPT-3提示到智能体沙盒的评估时代,聚焦智能体。
在Gemini工作且想转向开放模型或开源?联系我,帮你找到合适机会!
如果你在Gemini工作并想离职去做开放模型或开源,欢迎联系我,我会帮你找到合适的职位。
@natolambert:Gemini重大重组(Dean出局,Hassabis卸任CEO)——占尽优势的在位者却无法启动,此故事将被永远研究
Gemini重组:Dean出局,Hassabis卸任CEO;占尽优势的在位者无法启动,成永恒案例;OpenAI已实现初衷。
@natolambert: If you're teaching a class on post-training (or part of a course) and my book, slides, code or videos don't help you, please lmk how I can improve it!
@natolambert:对我来说这是重大利好,大大增加了我参会的可能性。
重大利好,参会意愿大增;但应选温哥华,美国签证难;说话者没当过程序主席,太过天真。
@natolambert:DeepSeek V4 Flash 初版采用量惊人,却被低估;新版与 GLM 5.2 同分,堪称怪兽,将被广泛使用。
DeepSeek V4 Flash 初版采用量惊人但被低估,新版评分追平 GLM 5.2,性能强劲,已成 OpenRouter 榜首并引发大量 HuggingFace 关注。
@natolambert: 我们又活过了一天
我们又活过了一天。
@natolambert: Another quick q&a video as I wrap up the course soon. These ended up all being on various details in getting a post-training recipe right.
@natolambert:下周我在西雅图Fremont举办新书发布会,感谢赞助商@radixark,尚有余位。
西雅图Fremont办新书发布会,有空位,感兴趣者评论留言,稍后私信链接。
@natolambert:Qwen日
Qwen日,一个关于Qwen的专题活动日。
@natolambert:是时候分享我们 @interconnectsai 的新项目了,它旨在帮助理解当下加速的开放权重发布。Artifacts Hub 建立在每月开放模型综述和对 @huggingface 上每个模型的每日监控之上。
开放权重加速发布之际,新项目 Artifacts Hub 上线,依托月度综述与每日监控,助你洞察全局。
@natolambert:看Qwen 3.8 Max表现会很有趣,因为之前的大模型在API上采用率不高,现在更多人可能会关注(取决于许可证)。这或许是Qwen团队追赶顶级模型所需的反馈循环。
Qwen 3.8 Max发布引发关注,此前其大模型API采用率低,如今或借反馈循环追赶顶尖模型。
@natolambert:又来了,新的一周又一个前沿开放权重模型。
吐槽每周都有新的前沿开放权重模型发布,感叹其更新节奏之快。
大型语言模型是人类进步的绝佳驱动力,只需主动管理向强AI的过渡,收益将巨大。
LLM是推进人类的强大动力,主动管理向强AI过渡,益处无穷。
这类工作对于向公众解释如何在存在开放性风险的情况下继续发布开源模型极具价值,并能规避大量潜在监管关注。
此类工作有助于向公众阐明开源模型发布与风险防控的平衡,并减少监管干预。
众多机构模型进步速度惊人。构建LLM靠持续努力、巨额资本与高效组织,而非罕见秘密。强大技术知识得以扩散,实为幸事。
众多机构模型进步神速,靠持续投入与高效组织而非秘密,技术知识扩散令人欣喜。
@natolambert:玩愚蠢的游戏,赢愚蠢的奖品
玩低级游戏,得低级奖品,意指自食其果。
@natolambert:第11讲是工具使用/函数调用/智能体入门教程!我差点跳过这讲,因为该章最初是书中唯一的技能专题,但此后工具使用已成为现代模型的基础
第11讲是工具使用/函数调用入门,原为唯一技能专题,现已成为现代模型基础
@natolambert:前沿实验室通过集成优化推理,以更低成本性能比实现盈利,长期领先开源模型。
前沿实验室凭低成本推理优势盈利,长期领先开源模型,并非亏损。
冲啊,他们在搞大事。看起来是个很棒的模型。首个模型之后能快速跟进,真是个好兆头。🫡
快速跟进首个模型是积极信号,模型表现出色。
@natolambert: 我介于这篇帖子和RSI之间——当前估值合理,但前沿实验室不会立马值30万亿,而是经历几年财务困境后成为巨头
我认同当前估值,但前沿实验室不会立即价值30万亿,将经历财务困难后成为最大公司。
@natolambert:线束工程中唾手可得的成果惊人
线束工程前期成果巨大,研究训练后至推理的线束效应可显著节省成本。