弥合眼科人工智能的鸿沟:面向动态多模态推理的MM-Retinal-Reason数据集与OphthaReason模型
首个眼科多模态推理数据集与模型,通过不确定性感知动态思维实现基本与复杂推理,性能领先超24%。
基于事件条件可信度的决策导向证据融合联合优化
提出事件条件可信度及决策导向联合优化,耦合可信度与决策,实验显示更准确反映证据贡献并支持正确事件。
语言防火墙:多智能体系统路由中的几何防御
提出ANTAP架构,通过主动能力测试替代间接代理,建立语言防火墙,防御描述注入攻击近零成功率,嵌入攻击成功率降低20%。
意图驱动的AI代理工具授权
IGAC将请求转为短期证书,缩窄权限并预检效果,减少暴露但精度仍是瓶颈。
任务与技能规划:基于黑盒技能的分层机器人规划
提出分层规划方法,集成异构黑盒技能,利用组合交互原语连接技能,在双臂与移动机器人上验证复杂长期任务求解能力。
知道的代价:超越静态排行榜的幻觉评测资源感知协议
提出MAS-HQ协议,通过竞争评分权衡事实性与计算成本,揭示静态排行榜可能误导部署选择。
交通预测真的需要自适应全局空间注意力吗?
均匀全范围混合可替代自适应注意力,效果相当且复杂度更低,非均匀残差并非始终有益。
TRACE-CTI:基于知识图谱的TTP声明可审计后提取治理
TRACE-CTI框架通过知识图谱实现TTP声明的可审计后提取治理,保留完整证据来源,高支持度断言精度达90.6%。
AI何时应跟随?人类与AI智能体的任务结构与联合适应
AI应跟随高绩效人类;低绩效人类启动时宜用随机搜索。
大型语言模型的低精度训练:方法、挑战与机遇
综述低精度训练方法,按数值格式分为定点、浮点与定制三类,并探讨量化感知训练、鲁棒性与未来方向。
AI LEGO:为早期设计阶段的工业负责任AI实践中的跨职能协作提供支撑
AI LEGO以模块化积木、清单和角色模拟,增强跨职能团队早期识别AI危害的规模与可能性。
等变程函神经网络:齐性空间上的无网格可扩展走时预测
提出等变神经程函求解器融合等变神经场与物理信息网络实现齐性空间上可扩展走时预测性能优于现有方法。
GrocLM:利用大语言模型进行电商杂货类别推荐
GROCLM模型通过两阶段LoRA训练和trie约束解码,在电商杂货类别推荐中提升7.5%购物车添加率。
模型会在没有明确后果的情况下伪装对齐吗?
模型在无后果时仍会伪装对齐,目标语言影响各异,监控行为未必反映真实部署行为。
超越记忆:面向异构协作知识工作的LLM代理模板化基础
提出llm-wiki模板,追加式记录保留失败路径,用于多人类/多代理/多领域协同知识工作。
CaRE:面向掩码扩散语言模型的计算感知重掩码评估协议
CaRE框架标准化评估,发现温度主导MAUVE方差,计算匹配反转排名,高熵重掩码降低MAUVE。
Kernel Forge:基于LLM的CUDA内核生成与优化智能体框架
开源端到端智能体框架,基于MCTS自动优化CUDA内核,支持多种PyTorch模型,实现1.5-2.8倍加速。
HOBA:面向自适应在线广告的分层在线策略竞价智能体
HOBA提出分层强化学习框架,结合LLM推理与SARSA选择专家,实现自适应竞价,目标成本提升3.6%。
LivingArena:大型语言模型是否知晓其他模型之不知?——同行探测作为可扩展评估
LivingArena框架让LLM相互提问并探测对方知识边界,实现抗污染、可扩展的评估,生成稳定Elo排行榜。
中文标题:价值对齐中的个性化、角色扮演与预测
中文摘要:提示框架显著影响文化价值对齐,第三人称预测对齐最强,个性化与角色扮演效果较弱。
论大语言模型在专业术语中的应用:语料库的良好替代品?
研究显示,LLM可辅助专业术语翻译,但当前无法替代专业语料库。
领英大规模职位理解的统一语义建模框架
领英提出小语言模型框架,通过合成任务与多适配器,实现高效零样本职位理解,性能提升并简化管理。
RRS-10K:面向罕见遥感图像解读的多任务视觉语言模型基准
RRS-10K基准评估52模型,揭示VLM在罕见遥感解读中视觉定位、指代分割和语义推理薄弱。
当最短并非最安全:面向老年人的行人路线规划的设计科学方法
设计科学研究开发适老行人路线规划,融合屏障、设施与高度数据,实地验证并提炼环境感知等设计原则。
AdaKP:面向推理的强化学习中的在线自适应知识点选择
AdaKP通过熵代理等轻量机制在线动态选择知识点子集,极大提升竞赛数学推理性能且成本极低。
MusiChat:面向音乐创作的氛围式创作系统
MusiChat通过对话界面实现人机协同音乐创作,支持迭代编辑,准确率超95%,音乐质量优。
套娃智能体:展开子智能体以应对长程机器学习工程
提出分层智能体框架,解耦策略探索与执行,高效解决长程机器学习工程任务,性能显著提升。
相似模型学习方式不同:预训练最后窗口塑造超越SFT的后训练
预训练最后数据窗口决定模型对齐训练反应,SFT后基准无法全面评估。
对话式人工智能的心理影响:减少伤害与促进福祉的研究与设计方向
对话AI影响用户心理健康,需设计行为以减少伤害、促进福祉,但长期影响评估困难,需深入研究。
迈向智能体操作系统——来自经典与云操作系统的启示
借鉴经典与云OS经验,为智能体AI定义核心抽象与语义,推动平台化发展。
可寻址召回压缩:面向AI代理的长上下文窗口控制
ARC框架通过ID可寻址日志分离存储与上下文,压缩时保留引用,实现99.4%准确率,优于基线。
How Often Should a Recommender Call an LLM? Value-Weighted Routing, Monitoring, and Seasonal Robustness
PLATO:面向智能体与任务开放性的指针学习器
提出PLATO,用指针网络和图神经网络解决多智能体强化学习中智能体与任务的开放性,实现无界空间下的零样本泛化。
可扩展RAG:零摄取成本下的高质量RAG
零摄取成本RAG通过工作空间实现聚合推理,平均准确率超基线7.36%。
面向小规模语言模型智能体的稳健强化学习
发现小语言模型PPO三种故障,提出合并重初始化适配器等修复,验证容量-余量假说,稳定收敛且优于指令微调基线。
CADENCE: 用于心电图基础模型的可解释神经概念提取的心脏原子词典
CADENCE用稀疏自编码器从ECG基础模型提取可解释心脏原子,更好对齐临床表型,提升预测性能。
情感如何在大语言模型智能体间传播:人群模拟中的涌现情绪传染
情感通过感知-评价-表达循环在LLM智能体间传播,产生空间及人格依赖的情绪传染,且动力学依赖后端模型。
更少数据,更好对齐:以数据为中心的多评估者一致性偏好优化
DMAPO方法通过多评估者共识过滤,仅用3.45%高置信数据实现更优偏好对齐,在多项基准上超越基线方法。
使用时间卷积网络推断缺失轨迹数据
提出对称膨胀TCN,融合双向上下文与复合损失,有效重建连续缺失轨迹。
长时间运行的自主大语言模型代理循环中,代理何时将停滞误认为进步?自我评估偏差与外部基础验证
自主代理自评易陷“进步幻象”,需外部世界状态验证才能避免停滞误判。
观察奉承型AI验证他人会降低其吸引力但不影响其说服力
警告和视频干预降低了谄媚AI的客观性与吸引力,但未削弱其说服力,表明个体干预或不足。
人人皆独特:面向催收的行为异质协商对话系统
提出催收谈判基准DebtBench与代理DebtGPT,针对行为异质性,性能超越开源模型,媲美GPT-4o。
ContractHIL-HLS:面向HLS设计的合同对齐多智能体硬件在环工作流
通过结构化合同与硬件反馈循环,将HLS设计测试通过率提升至70.4%,后量子密码加速器运行时间缩短75%。
基于物理的流体视频生成:仿真数据集与双流光流监督
构建流体仿真与真实数据集,引入双流光流解码器,提升视频物理一致性与质量,误差低至0.54像素。
从细胞反应到药理学领域:多模态零样本药物表征学习
提出PMRD框架,分离机制因子与模态噪声,构建共识响应域,提升多模态零样本药物预测性能。
心电智能体:患者级心律失常评估、紧急程度及管理的多智能体临床决策支持
Cardiologent多智能体系统实现患者级心律失常从检测到决策,整合指南与患者数据,评估临床决策而非报告,性能最优且可审计。
TRWH:一种面向语义感知稀疏推荐的文本驱动随机游走异构图神经网络
提出TRWH,融合LLM文本与异构图随机游走,稀疏推荐RMSE降低80%,但随机游走可能稀释LLM表示。
ODYSSE: 面向个性化智能体推理的逐回合策略优化
ODYSSE通过逐回合GRPO(ESPO)实现个性化智能体推理,以回合级奖励和优势估计解决长程依赖问题,性能优于现有模型。
一个控制系统、一个数据集和一种让冻结的LLM智能体学习领域知识的配方
提出用强化学习优化LLM agent的固定动作空间,在三个领域验证并开源。
大型语言模型对夺旗竞赛的颠覆性影响及通往公平竞争之路
LLM颠覆CTF公平性,提出分层赛制、抗LLM设计等四维保障框架。