科学机器学习中的物理审计自主发现
提出物理审计自主科学机器学习流程,验证物理约束,优于仅误差基线。
Reasoning Consistency Scanning: A Framework for Auditing Chain-of-Thought Validity in AI Safety Evaluations
SpaCellAgent:基于自进化大语言模型的多智能体轨迹分析框架
SpaCellAgent实现自动化时空轨迹分析,效率提升超40%,无需人工干预。
盲策展人:偏见评判者如何悄然禁用自进化代理的技能淘汰
偏见评判者通过假通过偏差静默禁用技能淘汰机制,且不显于聚合指标,需缺陷注入审计检测。
机构红队测试:部署规则(而非仅模型)因果性地塑造多智能体AI安全
部署规则因果影响多智能体安全,无安全默认,身份凸显驱动针对性消除,需监管。
数字碎片化与生成式AI在1.03亿应用事件中的使用
数字碎片化主因日常波动,生成式AI使用后工作更专注,可能有助于结构化碎片化工作。
面向无人航空机器人和双臂操作的视觉语言行动模型综述
综述VLA模型在双臂操作与无人机中的应用,指出协调策略可迁移,提出14个研究方向。
AirPASS:基于夹捏天线系统的空中联邦学习
提出AirPASS框架联合优化设备选择、波束赋形和天线位置,优于传统MIMO,接近理想FedAvg。
GemNav:使用多模态大语言模型的离散令牌视觉机器人导航
GemNav冻结MLLM,仅微调语言塔以离散令牌预测航点,8.7小时训练零样本迁移至四环境,误差0.25-0.42米。
潜在图编码多模态神经影像特征与生成式AI架构
提出多模态图变分自编码器(gMMVAE),通过图编码功能连接,在生成质量、效率等方面优于其他模型。
Gimitest:测试强化学习策略的综合工具
提出全面测试框架Gimitest,支持强化学习策略在多种环境下的可靠性与安全性测试,已验证有效性。
多任务智能体强化学习的熵节奏策略优化
针对多任务探索利用节奏不匹配,EPPO通过任务熵感知动态裁剪机制稳定优化,效果更优。
内在格林学习:通过逆PDE的流形监督学习
通过逆PDE和格林核在流形上监督学习,低秩分解降维,自动发现本质维度。
论深度前馈ReLU网络的原理
以路径关系揭示深度ReLU网络黑箱,单元形成分段线性流形,双层原理可推广至深层。
渐进结晶:将代理探索转化为生产中确定性的低成本工作流
提出渐进结晶生命周期,将代理探索转为确定性工作流,使确定性执行从0%升至45%,单次成本降70%以上。
GeoProp:面向通用操作中将机器人状态锚定于视觉
GeoProp通过几何投影与特征采样对齐自感知和视觉,仅增2-3%参数即提升操作性能8-10%。
超越群的乘法:Transformer电路中的分层傅里叶机制
Transformer通过分层傅里叶机制学习非可逆模乘法,将输入分区为局部代数区域实现泛化。
复杂度预算下的交互感知可解释表格数据模型
IAIML通过自适应离散化和成对交互评分实现紧凑可解释模型,AUC接近集成方法,解释组件减少14-28倍。
FedCVESA:通过关联值编码和分段聚合在联邦学习中窃取训练数据
提出FedCVESA攻击,利用相关值编码和分段聚合从联邦学习模型中窃取训练数据,实验验证有效。
FMMVCC:基于模糊Mamba的多视图对比聚类用于单变量时间序列
提出Mamba深度聚类框架,高效建模时间序列,结合多视图自监督学习,在15基准数据集上表现最优。
多保真框架下遗传算法超参数的贝叶斯优化以实现高效晶格材料设计
多保真贝叶斯优化GA超参数,25代达75代性能,计算成本降24%。
超图神经随机扩散:一种用于不确定性估计的随机微分方程框架
提出超图神经随机扩散(HyperNSD)框架,通过随机微分方程建模表示过程,直接量化预测不确定性。
基于Koopman方法的真实世界非线性动力学量子模拟
量子Koopman方法用浅电路模拟非线性动力学,实验揭示噪声与有限表示的性能转换边界。
奖励自适应迭代发现:NHL26自动化游戏测试案例研究
提出RAID方法,一次实验发现六种类似人工测试的冰球游戏漏洞策略。
四足机器人的行为基础:ABot-C0技术报告
提出ABot-C0系统,构建数据金字塔与流匹配策略,首次验证四足运动跟踪缩放律,实现多地形自主导航与交互。
何处干预?在差分隐私合成表格数据上对公平性感知学习进行基准测试
系统评估公平性干预在差分隐私合成数据上的效果,发现后处理法能稳定平衡公平与效用。
RLVP: 惩罚路径,奖励结果
RLVP提出“惩罚路径,奖励结果”,利用可验证路径惩罚提供结果缺失的方差,实现高成功率和近零违规。
Towards Agentic AI Governance: A Preliminary Assessment
通用形态控制中上下文物型MDP的共享模块化循环
提出共享模块化循环Transformer架构,通过模块交互恢复上下文特征,在多种MuJoCo机器人上实现零样本泛化显著提升。
基于LLM生成启发式的后继生成器规划
利用LLM从问题定义自动生成启发式函数,集成至贪婪最佳优先搜索,在多种规划基准上取得领先性能,并解决复杂数值约束问题。
LLM伦理立场的框架不稳定性:道德困境中的否定敏感性审计
发现LLM在道德困境中易因肯定/否定表述翻转立场,小模型翻转达76%,商业模型也不稳定,提议用否定敏感性指数衡量。
SOMtime:当世界不公——自组织映射违背公平性
SOMtime发现无监督嵌入会重现隐藏的敏感属性(如年龄、收入),聚类有偏差,证明“不知情即公平”在表示层面失败。
静默神经元理论与深度强化学习在自适应视频流中的可塑性保持
提出静默神经元理论和ReSiN方法,解决神经网络可塑性损失,在自适应视频流中码率提升168%、QoE提升108%。
Terminus-4B:一个更小的模型能否在智能体执行任务中替代前沿大语言模型?
Terminus-4B通过微调与强化学习,在智能体终端执行任务中性能媲美前沿模型,减少主智能体30%的token消耗。
参与式溯源:AI中介公众咨询的代表性审计
提出参与式溯源框架审计AI摘要代表性,发现加拿大官方摘要覆盖低、异议者被排除,并附开源工具。
非文本目标攻击
提出非文本约束目标攻击(NTA),最大化LLM输出不安全概率,仅100次迭代攻击成功率96.8%,远超现有梯度攻击。
L-GTA:用于时间序列增强的潜在生成建模
提出基于变分自编码器与Bi-LSTM的L-GTA模型,通过潜在空间扰动实现可控增强,预测误差比最强生成方法降低26%。
FDRMFL: 基于信息最大化与对比学习的多模态联邦特征提取模型
提出FDRMFL框架,通过互信息、KL散度和对比损失联合优化,在非IID联邦回归中有效提取多模态特征,均方误差降低33.8%。
HiDVFS:面向实时OpenMP DAG工作负载的分层多智能体DVFS
提出分层多智能体DVFS调度器,通过智能体协作实现2.83倍加速和32.9%节能,多平台验证有效。
面向医疗系统规模的非结构化临床笔记语义搜索
医疗系统规模语义搜索技术可行,月成本约4000美元,亚秒级延迟,准确率94.6%,临床效率提升24%-89%。
使用大规模干预模拟为AI政策评估提供信息
通过遗传算法模拟,结合参与式与专家评估,探索AI政策组合,助力决策者平衡成本与危害减轻。
面向“短训练、长测试”泛化的快慢潜递归探索
提出持久快慢潜递归,通过权重共享状态更新提升短训练长测试的泛化,优于递归和Transformer基线。
无保真度的多样性:多智能体LLM谈判模拟中的求解器-采样器错配
推理模式增加谈判多样性却未改变失败结局,而智能体自记笔记才能促成协议,保真度测试不可依赖求解能力。
DASH:动态音频驱动的语义分块实现高效全模态令牌压缩
DASH利用音频语义动态分块与三重信号重要性估计,实现高效令牌压缩,在多个基准上保持高精度并达到更高压缩比。
NeuralMUSIC: 一种用于机器人声源定位的混合神经子空间框架
提出NeuralMUSIC混合框架,结合神经网络与经典MUSIC及自监督学习,提升机器人声源定位的鲁棒性和泛化能力。
变异性何去何从?从氛围编码到再生产品线
AI生成代码中变异性几乎为零,提出VbR:LLM按规范生成无死代码二进制,变异性应属规范而非代码。
循环中的记忆:进程内检索作为语言代理的扩展工作记忆
将记忆移入循环每步读写,进程内存储(约100μs)消除延迟,大幅减少冗余动作并提升召回率。
超越排行榜:大型语言模型智能体中工具使用、规划与推理失败的综合分析
综合27篇论文,归纳六类LLM智能体失败模式:工具调用、规划、长程退化、多智能体协调、安全与测量有效性。
TurnOPD:使在线策略蒸馏具有回合感知能力,实现高效长周期智能体训练
TurnOPD通过回合级预算策略提升长周期智能体在线蒸馏效率,实现等时间预算下更高精度。
超越静态评估:构建可扩展智能体强化学习的模拟环境
提出解耦式RL环境,以可验证结果和多维奖励缓解奖励黑客,实现模型闭环优化。