一个加速植物表型组学科学发现的自主AI框架
提出端到端自主AI框架,将高通量植物表型数据分析从数天缩短至秒级交互,加速科学发现。
创造智能:通用人工智能的计算基础
提出基于集合论与超维计算的离散认知理论,以子集模式匹配实现常数时间联想记忆,开辟高能效人造智能新路径。
面向工业级车辆路径问题的自适应先聚类后路径分解方法
提出自适应CFRS系统,利用大语言模型动态分解,在50万客户实例中展现竞争力与可扩展性。
AxDafny:Dafny中的智能体化验证代码生成
AxDafny是验证器引导的Dafny代码生成框架,验证成功率大幅提升至92.7%。
异构学生支持需求下的合格教育能力规划:一个合成基准与决策支持框架
提出合成基准与决策框架,揭示新资格获取时效决定最优策略:及时则闭环胜,否则静态保险优。
代理门控生成与基础模型嵌入用于贝叶斯材料设计
在固定预算下,基于排名选择的代理门控以约五分之一调用量逼近全量oracle性能,最佳组合为ORB嵌入+高斯过程,已开源。
TreeAgent:基于专家规则与视觉语言模型的林业偏差自动标注通用多智能体框架
提出多智能体系统TreeAgent,结合专家决策树与视觉语言模型,通过投票机制自动化树高偏差标注,优于传统ML且减少专家成本。
自我学习再审视:从自生成问答中学习的隐性脆弱性
自生成QA训练存在证据选择偏差和答案服从指令的脆弱性,通过固定目标与过滤可缓解。
面向AI原生世界中计算机科学课程的AI韧性评估
提出基于Pareto盈余的AI韧性评估框架,允许学生自由用AI,但减少AI预算或强度造成的评分优势,衡量超越AI基线的能力。
基于储物柜的卡车-无人机路径规划:集成考虑取货、配送和禁飞区
针对集成取货、配送和禁飞区的卡车-无人机路径问题,提出两阶段深度强化学习启发式,有效降低运营成本且计算快速。
描绘非洲人工智能鸿沟:基础设施、可及性与能力
非洲AI鸿沟源于基础设施薄弱(渗透率38%,数据中心不足1%)、数据成本高及人力短缺,但本地初创与大学正推动发展。
智能体AI增强医生对临床决策的信任
智能体AI显著提升医生信任(治疗计划89.57%偏好),但存在过度依赖错误输出的局限,需临床监督。
中文标题:倾听言外之意:ASR嵌入与LLM增强语言学的联合学习用于痴呆检测
中文摘要:提出融合Whisper声学特征与LLM语言特征的多模态框架,在痴呆检测数据集上F1达90.14%,优于单一模态。
DSIP:基于扩散模型的多智能体运动规划的无信号交叉口动态协调规划器
提出DSIP框架,用扩散模型实现无信号交叉口连续轨迹优化,显著减少延迟并提高速度。
建模细胞周期感知的单细胞药物扰动响应
提出scCycleMol框架,通过细胞周期监督提升单细胞药物扰动预测,表达与相位准确率显著提高。
基于人工智能的物联网安全服务提供方案
本文提出深度强化学习与联邦学习结合的物联网安全服务框架,选择可靠对象并监控行为,在资源受限设备上有效。
LUMOS:为无障碍AI代理设计的语义操作系统层
LUMOS是AI与操作系统间的语义交互层,将无障碍元数据转为机器可读蓝图,减少截图依赖,支持实时UI查询。
基于大语言模型驱动的个性在应急模拟决策中的应用
利用大语言模型结合人格特质驱动虚拟人决策,显著影响个体和群体行为,提升模拟真实性与多样性。
在边缘检测音频深度伪造:浏览器插件中的轻量级SSL检测
提出设备端轻量SSL音频伪造检测,集成浏览器插件,准确率提升10%、速度提升40%,保护隐私。
预算自适应路由:当强者已作答时跳过弱者
提出预算自适应路由,根据卸载预算选择跳过弱模型或条件推理,降低延迟且精度优于强模型。
一下午从创意到原型:脚手架辅助、AI驱动的快速可视化分析原型开发
AI+脚手架将数月原型开发缩至一下午,专家知识注入关键,先自由设计再引入脚手架效果最佳。
一次检索覆盖全部:面向会话级RAG的共现感知知识库重组
共现聚类与邻居扩展使单次检索会话覆盖率从41%提至58%,检索调用减34%,知识库压缩80%,提出以会话级覆盖作为企业RAG核心指标。
基于大语言模型的多模态语音、手势和音乐交互式机器人动作合成
利用大语言模型融合语音、手势和音乐节拍,生成机器人动作序列,实现自然流畅的人机交互。
信息辅助的DVL校准
提出信息辅助校准法,GNSS环境下精度提升20%,无GNSS自校准提升35%,降低导航漂移。
最小化基于基础模型的语义通信中的量化语义信息年龄(QSAoI)
提出QSAoI指标,基于基础模型框架联合优化量化和块长,算法最小化期望QSAoI。
可解释、可控制的时变IIR降噪器,用于设备端助听
TVF模型以24k参数实现10.7ms延迟的可解释实时降噪,性能接近2.3M参数大模型,计算量减少29倍。
频谱文本融合:一种频率感知的多模态时间序列预测方法
SpecTF在频域融合文本与时间序列,轻量交叉注意力重加权频带,显著提升预测性能且参数更少。
基于事件和结构化检索的长音频问答
LA-RAG将长音频转为事件记录,通过SQL检索和LLM生成,问答准确率超70%,延时低于0.6秒,时序检测提升11-17%。
Can Generative Artificial Intelligence Survive Data Contamination? Theoretical Guarantees under Contaminated Recursive Training
对齐目标问题:人类、AI系统及其设计者的道德判断分歧
研究发现,当机器人行为被描述为人类设计产物时,人们更倾向道义推理,引发对齐目标问题:如何选择规范目标指导AI发展。
Driver-WM:以驾驶员为中心的交通条件潜在世界模型,用于座舱动态滚动预测
通过门控因果注入融合交通与驾驶员状态,实现座舱动态长时预测与语义对齐。
EAGT: 面向泛化性与可迁移性的超声心动图增强
评估29种增强技术,发现几何增强提升跨数据集泛化,组合互补增强可改善困难域迁移。
模型能力增强的数据与评估闭环
提出“能力切片”构建闭环,将基准失败转为数据干预,两案例验证:排除数据错误与定位推理短板。
探寻推理中的真理:一种引导LLM轨迹的动态表示编辑框架
提出DynaSteer框架,通过模式聚类和Fisher-LDA分离真理,动态监测熵值选择性引导推理,提升LLM准确性。
基于留出选择的递归自进化智能体
RSEA通过留出选择实现递归自进化安全,在多个基准中表现最优或稳健,避免退化。
双精灵博弈:审计驱动的AI治理中的采纳与福祉
采用进化博弈论,伤害最小化代理在特定条件下可取代RLHF代理,但自审计不足以防止社区伤害,取决于价值观一致性与时间范围。
通过伦理困境对LLM进行亚里士多德美德画像
提出VirtueMap框架,通过伦理困境排序评估LLM的实践智慧、正义等五维度,九种模型平均一致性达90.3%。
GPTNT:在《继续说话没人会爆炸》中基准测试多模态智能体间的实时协作
GPTNT基准测试多模态智能体实时协作拆弹,现有模型无一成功,揭示状态追踪、时间压力等弱点。
AI模型网络:概念、现状与未来
受互联网启发,提出AI模型网络架构,实现模型互联与协同推理,解决大模型高成本与部署难题。
DysLexLens:低资源LLM框架分析在线论坛中阅读障碍学习者的经验
提出DysLexLens低资源LLM框架,通过词典过滤与知识图谱推理,分析论坛中阅读障碍学习者的AI工具使用体验并评估。
多智能体大语言模型团队中,人格构成何时重要?
人格构成影响多智能体团队性能,效果取决于任务结构:编码任务影响小,开放式协作和谈判影响大。
中文标题:奥德赛:构建可验证的局部保真基础模型
中文摘要:提出范畴框架ODYSSEY,通过基厂组合构建可验证局部保真模型,实现领域构造、证据提取等功能。
内化未来:面向世界模型规划的统一智能体训练范式
通过三阶段训练(中期训练、格式引出SFT、前瞻强化学习)弥合格式-能力差距,使LLM智能体内化未来感知规划,优于基线。
NormAct:具身规划中隐藏社会规范遵从的基准
NormAct基准揭示多模态大模型隐藏规范遵从率仅26.4%,所提方法将任务成功率从24.2%提升至46.7%。
ATOD:面向多轮自主智能体的退火轮次感知在线策略蒸馏
ATOD结合退火OPD-RL调度与轮次级重加权,在三个任务上平均成功率超OPD 3.03%、超GRPO 23.62%,并超越教师模型2.16%。
可验证几何问题求解:求解器驱动的自动形式化与定理提出
提出SD-GPS框架,以求解器驱动自动形式化并验证定理,显著提升几何推理性能。
RelBall:基于四元数旋转的关系球体用于知识图谱补全
RelBall通过模变换和尾实体关系球体,全面建模知识图谱中的关系模式与层次结构,提升链接预测性能。
AI驱动的高科技系统设计综合:创新自动化
利用深度学习和生成式AI自动创造系统,案例验证从仿真优化到自主设计的转变。
多模态图社交媒体流行度预测基准
提出多模态图基准MMG-Pop与网络MMG-PopNet,融合信号并验证优越性,揭示跨平台泛化等新见解。
DataStates-LLM:基于可组合状态提供者的Transformer模型可扩展检查点技术
提出DataStates-LLM,利用状态提供者解耦状态与数据移动,实现异步非阻塞检查点,吞吐量提升4倍,训练时间缩短2.2倍。