T-Router:学习丘脑路由以实现参数高效强化学习推理
T-Router仅以0.466%参数实现丘脑式路由,复用计算块,推理超越LoRA与全参数GRPO。
正交却耦合:面向模型合并的几何分量解耦
DiGA以预训练权重为参考,将任务向量正交分解并分组件聚合重组,缓解跨组件耦合,提升模型合并性能。
覆盖优先于控制:面向可控逆合成的路线指令锚定与引导
提出RIGS两阶段框架:先训练投影器学习指令偏好,再引导冻结生成模型,兼顾备选覆盖与指令控制。
面向驾驶行为视频描述的预训练模型适配比较研究
比较自动驾驶中LLM微调与提示方法;在BDD-X上,全量微调SpaceTimeGPT部分指标超基线,并分析LoRA与VideoLLaVA提示工程的局限。
PartiCam:基于奖励引导的相机控制视频生成
提出免训练粒子滤波的奖励引导框架,以全局-局部精炼实现精准稳定的相机控制视频生成。
面向选定高斯过程近最优性证书的预序e值
以预序e值审计GP包络选择,剔除矛盾候选,用存活者最大上界作任意时间有效认证,降低误认证风险。
语料库引导的双路径传播用于图检索增强生成
提出NexusRAG,用语料级实体邻域结构引导语义与结构双路径传播,提升多跳检索证据召回率。
Muon 中的行归一化之谜
研究Muon行归一化:引入维度相关复杂度因子,合成任务更慢,大模型预训练却更优,理论实践仍成谜。
System One 模型 Jev 的评估与基准测试
零样本评测 Jev:37 个数据集多数优于 Qwen/Gemma,概率校准良好,支持选择性预测。
GrammarRL:通过强化学习实现有效的语法约束解码
GrammarRL用正反向自监督奖励的强化学习适配语法约束,无需标注,成本同贪心解码,提升达9.8分。
读者熟练度塑造逐层惊奇度特征
词汇熟练度影响LLM惊奇度的分层预测深度:低熟练读者首遍注视的预测深度更深,总注视时长亦然。
从前到后:面向非对称跨视角车辆重识别的视觉语言模型基准测试
提出前到后车辆重识别基准,评测视觉语言模型;其未稳定超越检索基线,推理可提升,人类更可靠。
CDMD:面向表格数据的跨数据集混合类型扩散模型
提出CDMD,直接在混合类型特征空间上跨数据集联合训练扩散模型,单模型生成质量优于各专用模型。
ID 平衡:基于 PID 负载控制的极稀疏 MoE 稳定训练
将无辅助损失方法视为不完整PID控制器,提出ID平衡,随误差增大加强校正,降低负载不均衡并稳定训练。
配对难度至关重要:重新审视成对式LLM评判评估与一致性
现有评判指标多受近秩差配对主导,不一致实属必然;排序信号来自大秩差配对,故应按秩差条件化评估。
面向文本到图像模型后门防御的正常扩散动力学学习
提出NDDL,仅用良性样本学习扩散轨迹正常转移动力学,以预测偏差检测并定位后门,泛化性强。
面向大语言模型服务的高带宽闪存特性研究
HBF扩展LLM服务内存,分层存储与缓存感知调度使完成时间降36.1–87.0%、能耗降55.8%,写入寿命延至14.82年。
更好的演示文稿,还是不同的评审?评估企业和投资银行中智能体框架的增益
投行演示稿智能体框架得分高于直接生成,但评审差异与重复评分波动削弱改进结论。
镜头光晕去除与重建
提出光晕去除与重建:建大型数据集,微调扩散模型去大光晕;建模光晕并与3DGS联合分解,可编辑迁移。
RESUME:基于运动与残差信号循环状态更新的高效视频语言建模
RESUME以锚帧初始化隐状态,逐预测帧循环更新,向视频语言模型输出时序轨迹,时序推理显著提升。
AIMS:面向仿真到现实多模态ISAC的智能体AI框架
提出双智能体AIMS框架协调场景构建与任务学习,提升多模态ISAC仿真到现实迁移车辆检测与波束预测。
要纠正,不要删除:用纠正性监督缓解涌现性失准
微调有害数据可致涌现性失准;将中毒样本改为纠正答案比删除更能降低失准,并提升医疗回答。
Billiger.de 产品:双语实体匹配基准
发布德英双语实体匹配基准,覆盖13类商品,含难例,验证显示其比现有基准更难。
问题接力中的魔鬼:源条件接力引导缓解音视频大语言模型幻觉
揭示音视频大模型中问题接力致源混淆定位幻觉,提出免训练源条件接力引导,显著缓解源混淆定位幻觉。
EffGS:高效高保真高斯泼溅
EffGS通用加速框架融合频率感知引导、局部密度控制与自适应尺度调制,提升训练渲染效率并保持高保真重建。
固定步长SGD的精确平稳高斯逼近
固定步长SGD不变分布的精确高斯逼近,归一化迭代1-W距离误差O(√α),四状态例下界匹配。
姚顺雨(@ShunyuYao14):Gemini。https://t.co/RYFKLKxuJm
推文仅提及Gemini并附链接,未提供更多实质内容。
@埃隆·马斯克:值得一试
值得一试
从知识检索转向证据探索与综合
原文未提供摘要
大型语言模型为组合优化发现互补启发式方法
大型语言模型能为组合优化发现互补的启发式方法。
The Den 借助 ChatGPT Work 每周腾出 10-15 小时用于发展
新店开业之际,该社交俱乐部将拨款申请准备时间从3天缩至2小时,酒牌材料从4天缩至3小时。
谷歌发布Gemini 4 Argon,称其迄今最强模型
谷歌发布最新Gemini模型,主打编程与网络安全。
@dotey:让 ChatGPT 按“守序—中立—混乱”九宫格给 AI 风云人物归类,它给我画了这张图 https://t.co/59357FboSc
用户让 ChatGPT 用九宫格归类 AI 风云人物并生成图像。
@natolambert:乐见谷歌以 Gemini 4 惊艳众人;更多实验室站上前沿,对消费者(竞争)与世界(权力去集中化)皆是好事,期待其现实场景表现。
乐见谷歌 Gemini 4 带来惊喜;更多前沿实验室促进竞争、分散权力,期待落地表现。
Meta任命德鲁夫·沃赫拉领导东南亚业务
Meta宣布,Dhruv Vohra将出任全球业务集团东南亚区董事总经理,负责领导东南亚业务。
五角大楼请马斯克与帕尔默·勒基协助决定军方下一步该做什么
防长赫格塞思启动120天未来战争研究,马斯克、勒基与金里奇领衔;批评者称二人公司已在售相关技术。
LongLive-Plug:面向视频生成的一次性通用蒸馏
提出LongLive-Plug,实现视频生成的一次性通用蒸馏,提升生成效率。
@_akhaliq:Omni-IO 技能
提出 Omni-IO 技能,使智能体原生支持全模态输入输出。
Anthropic 上线新站点,面向 Claude 开发者
Anthropic 推出面向 Claude 开发者的新站点,涵盖工程深度文章、Claude Code 与 API 指南、团队分享及彩蛋。
LEGO-Anything:面向3D场景重建的编码智能体
提出LEGO-Anything,利用编码智能体进行3D场景重建。
Figure AI 让 Figure 02 人形机器人跳入芬兰铸造厂钢水退役,熔融金属将制成限量纪念品
Figure 02 是 Figure 第二代人形机器人,首进 BMW 工厂并运行自研 AI Helix,现以熔入钢水方式退役。
@elonmusk:精准分析
埃隆·马斯克认为该分析准确。
为何 Dwarkesh 对 Computer Use 的看法有误,以及 OpenAI 如何在一周内推出对标 Jev 的产品
DevDay 报道:首期播客对话 OpenAI CUA 团队与 API 平台负责人。
Demis Hassabis宣布Gemini 4 Argon新前沿AI模型
发布Gemini 4 Argon前沿AI模型,关键能力大幅提升,先面向政府和可信网络防御者,随后广泛开放。
他建造了这座城市
纽约市博物馆展出Joe Macken耗时21年用轻木和纸板打造的50×27英尺城市模型,震撼超预期,10月12日闭展,值得一看。
@Suhail:大家快去注册 .si 域名!感谢 @snagged 的 @rob 帮我们把它锁定 :)
呼吁注册 .si 域名,并感谢 @snagged 的 @rob 帮忙成功拿下。
@NVIDIAAI:我们正在寻找下一批研究生奖学金获得者。
招募全球博士生,2027–2028研究生奖学金最高6万美元,含导师指导与技术支持,10月30日前申请。
Valor、Atreides 和红杉资本以7.5亿美元估值投资AI初创公司Flow Engineering
Flow Engineering将AI智能体用于硬件设计,Roelof Botha任天使投资人与董事
白宫开始对中期选举感到恐慌
特朗普仍认为共和党有机会,但其助手们信心不足。
Factory CEO 指控其风投董事会顾问替 Cognition 当间谍
风投人 Chris Degnan 曾任 Factory AI 董事会顾问,现已出任 Cognition 首席营收官。