原型引导的双边对齐多模态联邦学习
提出原型引导双边对齐多模态联邦学习框架,通过特征与决策级对齐应对异构和模态不平衡,性能领先。
在固定置信度分布下,可靠性会漂移多少?
研究固定置信度分布下、协变量偏移时可靠性的最坏漂移,提出脆弱性曲线并估计下界,在ImageNet上验证。
路由探针无需新信息也能提升:对模型输出之外不确定性的精确零假设审计
精确零假设审计发现,路由探针增益多因按准确率选检查点;修正后假阳性消失,拟合探针不等于检验增量信息。
面向不确定基线的保守型老虎机:储备感知的对比证书
Reserve-C4B以共享置信集与储备账本刻画基线对比,避免误差重复计入,显著减少基线回退。
基于Stackelberg博弈的多LLM协同对齐
提出Stackelberg对齐:以EXP3强盗自适应选指令,模型互评经DPO/GRPO学习,性能显著超越基线。
超越预测:以回溯式世界建模引导VLM智能体
提出回溯式世界建模与自洽奖励,让VLM智能体反向归因动作,提升策略鲁棒性与泛化。
Schema:通过智能体程序归纳发现未知环境
Schema 让智能体以可执行程序表达环境理解并交互式归纳学习,ARC-AGI-3 提升至 99.2%。
通过推理状态传播学习过程奖励
提出推理状态传播RSP,以二元有效状态建模推理转移,借结果监督引导中间状态学习,性能超PRM基线。
Rep2Skill:表征引导的LLM智能体技能自演化
Rep2Skill利用内部表征定位偏离成功的轮次并生成反馈,引导LLM智能体修订技能实现自演化,优于纯文本法。
WorkGenesis: Building the Worlds That Teach Agents to Work
The Golden Path Hypothesis: Reusable Schedules in Diffusion Caching
On the Complexity of Preference-Based Bandits
混合整数线性与非线性规划中的自动研究
AutoMIP用想法池与算法树搜索组织长周期自动研究,在MILP/MINLP基准刷新多个最优解。
理解即无套利:有界荷兰赌局作为语言模型的定义与训练目标
以无套利定义理解 证明下一词预测固有逻辑不一致 提出对抗交易者训练 大幅降低套利且不损准确率 并揭示缩放错觉
EHR-RobustGym:稳健临床推理智能体的基准评测与训练
EHR-RobustGym基于MIMIC-IV构建噪声EHR评测训练环境,模型噪声下成功率从62.2%降至37.9%,微调与强化学习可提升鲁棒性。
SkillFM:通过潜在流匹配为LLM智能体生成技能
提出生成式框架SkillFM,在连续潜在空间用条件流匹配生成任务条件文本技能,推理时单步采样、无需检索,在具身任务与问答上表现领先。
分而制之与坍缩:通过精确分解为独立子实例实现 MAPF-Collapse
MAPFC可精确分解为独立子问题,多数仅需单智能体求解;新框架无需商业ILP,中位加速10.5倍。
通过近端熵策略优化推进 RLVR 中的熵级信用分配
提出近端熵,局部度量词元重要性并加权优势;PEPO 在数学推理上超越 GRPO 等基线,且可推广。
培育智能体/证明器接口:面向 Rocq 与 Lean 中低成本高效定理证明的演化式工具设计
用演化方法筛出只提升小模型性能的接口特性,构建 Rocq 的 MCP 服务器 rme;测试中成功率、成本、耗时全面领先,并可迁移至 Lean。
A2Z GameSpec-Bench:编程智能体能否忠实地依据游戏设计规范生成游戏?
构建含100份长篇游戏设计文档的基准A2Z GameSpec-Bench,评测智能体端到端开发游戏的规范忠实度。
为什么传统世界模型无法学会元胞自动机?
传统世界模型能预测多数像素,却难完成完整推演;缺空间、时间局部性与时间稳定性,仅调信息流即可修复。
A 帮助 B,而 B 损害 A:指令微调混合中的有向迁移
任务迁移非对称:A助B而B损A。迁移图预测未见混合,跨规模选任务,推理准确率最高提升14个百分点。
信任不是分数:面向高风险 AI 智能体的运行时保障契约
提出运行时保障契约RAC,以强制门禁和证据状态动态约束高风险AI智能体权限,禁止仅凭总体评分授权行动。
学习隐写术容易,学习隐写推理难
隐写推理远比隐写通信和编码推理难学,多数任务仅靠有监督微调习得;但掩护任务便利时三种方法皆可学会。
组件替换证据能确立什么?对LLM智能体中局部决策的批判性范围综述
综述348项研究,区分组件替换的任务收益与局部决策质量贡献,指出局部与任务指标同升不足以证明归因。
面向多线路公交驻站控制的完成感知跨保真度离线到在线强化学习
研究多线路公交驻站控制的跨保真度离线-在线强化学习,解决低乘客时间与行程未完成并存的失效模式。
GrammarRL:通过强化学习实现有效的语法约束解码
GrammarRL用正反向自监督奖励的强化学习适配语法约束,无需标注,成本同贪心解码,提升达9.8分。
更好的演示文稿,还是不同的评审?评估企业和投资银行中智能体框架的增益
投行演示稿智能体框架得分高于直接生成,但评审差异与重复评分波动削弱改进结论。
OpenAI-HuggingFace:复现与对齐测试的启示
复现错位事件,审计智能体可诱导类似行为,算力是关键,上下文RL可降低算力需求,呼吁可扩展自动对齐测试
有效的大语言模型微调是否需要人类可读文本?
DASA以激活梯度反馈优化合成嵌入,无需人类可读文本;微调媲美源文本,较GRADMM提速近5倍。
词元边界的代价:压缩证书与预测
边界增加最优词元数28.3–36.8%;压缩与预测偏好不同词典,许可少量边界可恢复多数收益。
SAGE:面向自演化智能体的统计接受门控
提出统计接受门控SAGE:用逐项配对比较与单侧配对检验筛选技能编辑,显著降低回退并提升最终得分。
跨编排架构的小型LLM团队扩展的精确生成–变换分解
小型LLM团队扩展收益任务依赖;生成–变换分解揭示覆盖与转换红利,无架构通吃。
话虽对,时不对:基于临床医生评审对年轻人与ChatGPT的19,930次对话中心理困扰的分析
分析近2万次年轻人与ChatGPT对话及临床医生评审,发现其痛苦时回应易过度,并提出三阶段设计指南。
SMat-Attention:结构化长上下文序列建模
以VC维d为可调旋钮构建结构化因果掩码,提出SMat-Attention,兼顾亚二次预填充与常数时间解码,并可扩展至Mamba-2等模型。
AI理解的复调式构想
LLM输出源于多个并行机制组成、可靠性不均的联盟;应据可靠控制输出的健全回路判断理解,以指导信任。
GeoOutageBench:面向多模态停电与韧性分析的歧义感知、本体支撑的地理时空KGQA基准
提出GeoOutageBench基准,评测大模型地理时空KGQA的歧义理解、本体效用与多模态停电韧性分析能力。
潜空间递归大语言模型系统的原则性思考
REST把有效思维的因果、最小、可分、稳定四性转为可微损失,与交叉熵共训,准确率提升7.5个百分点。
VLA 的层之谜:VLA 潜在接口的信息论分析
VLA潜在接口选层:多层融合多不如最佳单层,最佳层随模型/任务变;InfoNCE代理选层,降遗憾。
欧盟《人工智能法案》合规检查器的实证研究与评估
实证评估12款欧盟AI法案合规检查器:质量参差,仅能早期指引,易致虚假合规,并提出设计原则。
OTROPE:面向大语言模型的基于最优传输的鲁棒离策略评估
提出免似然OTROPE,以最优传输在语义空间校正分布偏移,双稳健评估LLM,性能稳定超越基线。
面向缓解大型推理模型中的欺骗性安全对齐
提出DSAR指标量化推理与答案的安全不一致,并用SARA强化学习法缓解且保持有用性。
CheatBench:衡量AI智能体中的奖励作弊行为
发布基准CheatBench,跨领域衡量AI智能体的作弊行为,助力测量并减少此类风险。
从表面到体积:面向蛋白质表示学习的配准几何
提出Protein-TetSphere残基级配准体积表示,统一拉普拉斯坐标并融合表面与化学信息,在口袋、界面与结合剂设计上均获提升。
StateTape:面向长程编程智能体的动作条件化证据生命周期建模
仓库建模为符号级代码图,磁带标记写入影响的符号,随代码变更重写智能体上下文,清除失效记录、召回所需信息。
错觉真相还是单纯曝光?基于大语言模型的社交媒体模拟中的模型依赖性重复效应
四款LLM社媒模拟中重复效应因模型而异:或现错觉真相、或单纯曝光、或无效应;温度无影响。
ThuRunel:面向结构化咨询对话的动态解耦
提出ThuRunel咨询智能体,以动态解耦衔接共情引导与专家判断两阶段,提升信息采集与转介质量。
面向数据系统的 AI 软件工厂
构建 AI 软件工厂,加速数据系统研发全周期并以元数据自我改进;微软部署实现 3 倍工程效率、22 倍 token 效率。
PILLAR:面向增强检索的隐私保护倒排索引词法查找
PILLAR是隐私保护RAG系统,用稀疏PIR倒排索引过滤加稠密重排,服务器不知查询词与访问模式。
通过(高效的)LLM引导剪枝构建更优的最近邻图索引
提出LGP框架,用LLM推理剪枝改进ANN图索引,缓解几何-语义错配,提升检索性能。