5947 条条目 · 106 个活跃源
2026年7月9日
04:00
ArXiv AI

科学机器学习中的物理审计自主发现

提出物理审计自主科学机器学习流程,验证物理约束,优于仅误差基线。

04:00
ArXiv AI

Reasoning Consistency Scanning: A Framework for Auditing Chain-of-Thought Validity in AI Safety Evaluations

04:00
ArXiv AI

SpaCellAgent:基于自进化大语言模型的多智能体轨迹分析框架

SpaCellAgent实现自动化时空轨迹分析,效率提升超40%,无需人工干预。

04:00
ArXiv AI

盲策展人:偏见评判者如何悄然禁用自进化代理的技能淘汰

偏见评判者通过假通过偏差静默禁用技能淘汰机制,且不显于聚合指标,需缺陷注入审计检测。

04:00
ArXiv AI

机构红队测试:部署规则(而非仅模型)因果性地塑造多智能体AI安全

部署规则因果影响多智能体安全,无安全默认,身份凸显驱动针对性消除,需监管。

04:00
ArXiv AI

数字碎片化与生成式AI在1.03亿应用事件中的使用

数字碎片化主因日常波动,生成式AI使用后工作更专注,可能有助于结构化碎片化工作。

04:00
ArXiv AI

面向无人航空机器人和双臂操作的视觉语言行动模型综述

综述VLA模型在双臂操作与无人机中的应用,指出协调策略可迁移,提出14个研究方向。

04:00
ArXiv AI

AirPASS:基于夹捏天线系统的空中联邦学习

提出AirPASS框架联合优化设备选择、波束赋形和天线位置,优于传统MIMO,接近理想FedAvg。

04:00
ArXiv AI

GemNav:使用多模态大语言模型的离散令牌视觉机器人导航

GemNav冻结MLLM,仅微调语言塔以离散令牌预测航点,8.7小时训练零样本迁移至四环境,误差0.25-0.42米。

04:00
ArXiv AI

潜在图编码多模态神经影像特征与生成式AI架构

提出多模态图变分自编码器(gMMVAE),通过图编码功能连接,在生成质量、效率等方面优于其他模型。

04:00
ArXiv AI

Gimitest:测试强化学习策略的综合工具

提出全面测试框架Gimitest,支持强化学习策略在多种环境下的可靠性与安全性测试,已验证有效性。

04:00
ArXiv AI

多任务智能体强化学习的熵节奏策略优化

针对多任务探索利用节奏不匹配,EPPO通过任务熵感知动态裁剪机制稳定优化,效果更优。

04:00
ArXiv AI

内在格林学习:通过逆PDE的流形监督学习

通过逆PDE和格林核在流形上监督学习,低秩分解降维,自动发现本质维度。

04:00
ArXiv AI

论深度前馈ReLU网络的原理

以路径关系揭示深度ReLU网络黑箱,单元形成分段线性流形,双层原理可推广至深层。

04:00
ArXiv AI

渐进结晶:将代理探索转化为生产中确定性的低成本工作流

提出渐进结晶生命周期,将代理探索转为确定性工作流,使确定性执行从0%升至45%,单次成本降70%以上。

04:00
ArXiv AI

GeoProp:面向通用操作中将机器人状态锚定于视觉

GeoProp通过几何投影与特征采样对齐自感知和视觉,仅增2-3%参数即提升操作性能8-10%。

04:00
ArXiv AI

超越群的乘法:Transformer电路中的分层傅里叶机制

Transformer通过分层傅里叶机制学习非可逆模乘法,将输入分区为局部代数区域实现泛化。

04:00
ArXiv AI

复杂度预算下的交互感知可解释表格数据模型

IAIML通过自适应离散化和成对交互评分实现紧凑可解释模型,AUC接近集成方法,解释组件减少14-28倍。

04:00
ArXiv AI

FedCVESA:通过关联值编码和分段聚合在联邦学习中窃取训练数据

提出FedCVESA攻击,利用相关值编码和分段聚合从联邦学习模型中窃取训练数据,实验验证有效。

04:00
ArXiv AI

FMMVCC:基于模糊Mamba的多视图对比聚类用于单变量时间序列

提出Mamba深度聚类框架,高效建模时间序列,结合多视图自监督学习,在15基准数据集上表现最优。

04:00
ArXiv AI

多保真框架下遗传算法超参数的贝叶斯优化以实现高效晶格材料设计

多保真贝叶斯优化GA超参数,25代达75代性能,计算成本降24%。

04:00
ArXiv AI

超图神经随机扩散:一种用于不确定性估计的随机微分方程框架

提出超图神经随机扩散(HyperNSD)框架,通过随机微分方程建模表示过程,直接量化预测不确定性。

04:00
ArXiv AI

基于Koopman方法的真实世界非线性动力学量子模拟

量子Koopman方法用浅电路模拟非线性动力学,实验揭示噪声与有限表示的性能转换边界。

04:00
ArXiv AI

奖励自适应迭代发现:NHL26自动化游戏测试案例研究

提出RAID方法,一次实验发现六种类似人工测试的冰球游戏漏洞策略。

04:00
ArXiv AI

四足机器人的行为基础:ABot-C0技术报告

提出ABot-C0系统,构建数据金字塔与流匹配策略,首次验证四足运动跟踪缩放律,实现多地形自主导航与交互。

04:00
ArXiv AI

何处干预?在差分隐私合成表格数据上对公平性感知学习进行基准测试

系统评估公平性干预在差分隐私合成数据上的效果,发现后处理法能稳定平衡公平与效用。

04:00
ArXiv AI

RLVP: 惩罚路径,奖励结果

RLVP提出“惩罚路径,奖励结果”,利用可验证路径惩罚提供结果缺失的方差,实现高成功率和近零违规。

04:00
ArXiv AI

Towards Agentic AI Governance: A Preliminary Assessment

04:00
ArXiv AI

通用形态控制中上下文物型MDP的共享模块化循环

提出共享模块化循环Transformer架构,通过模块交互恢复上下文特征,在多种MuJoCo机器人上实现零样本泛化显著提升。

04:00
ArXiv AI

基于LLM生成启发式的后继生成器规划

利用LLM从问题定义自动生成启发式函数,集成至贪婪最佳优先搜索,在多种规划基准上取得领先性能,并解决复杂数值约束问题。

04:00
ArXiv AI

LLM伦理立场的框架不稳定性:道德困境中的否定敏感性审计

发现LLM在道德困境中易因肯定/否定表述翻转立场,小模型翻转达76%,商业模型也不稳定,提议用否定敏感性指数衡量。

04:00
ArXiv AI

SOMtime:当世界不公——自组织映射违背公平性

SOMtime发现无监督嵌入会重现隐藏的敏感属性(如年龄、收入),聚类有偏差,证明“不知情即公平”在表示层面失败。

04:00
ArXiv AI

静默神经元理论与深度强化学习在自适应视频流中的可塑性保持

提出静默神经元理论和ReSiN方法,解决神经网络可塑性损失,在自适应视频流中码率提升168%、QoE提升108%。

04:00
ArXiv AI

Terminus-4B:一个更小的模型能否在智能体执行任务中替代前沿大语言模型?

Terminus-4B通过微调与强化学习,在智能体终端执行任务中性能媲美前沿模型,减少主智能体30%的token消耗。

04:00
ArXiv AI

参与式溯源:AI中介公众咨询的代表性审计

提出参与式溯源框架审计AI摘要代表性,发现加拿大官方摘要覆盖低、异议者被排除,并附开源工具。

04:00
ArXiv AI

非文本目标攻击

提出非文本约束目标攻击(NTA),最大化LLM输出不安全概率,仅100次迭代攻击成功率96.8%,远超现有梯度攻击。

04:00
ArXiv AI

L-GTA:用于时间序列增强的潜在生成建模

提出基于变分自编码器与Bi-LSTM的L-GTA模型,通过潜在空间扰动实现可控增强,预测误差比最强生成方法降低26%。

04:00
ArXiv AI

FDRMFL: 基于信息最大化与对比学习的多模态联邦特征提取模型

提出FDRMFL框架,通过互信息、KL散度和对比损失联合优化,在非IID联邦回归中有效提取多模态特征,均方误差降低33.8%。

04:00
ArXiv AI

HiDVFS:面向实时OpenMP DAG工作负载的分层多智能体DVFS

提出分层多智能体DVFS调度器,通过智能体协作实现2.83倍加速和32.9%节能,多平台验证有效。

04:00
ArXiv AI

面向医疗系统规模的非结构化临床笔记语义搜索

医疗系统规模语义搜索技术可行,月成本约4000美元,亚秒级延迟,准确率94.6%,临床效率提升24%-89%。

04:00
ArXiv AI

使用大规模干预模拟为AI政策评估提供信息

通过遗传算法模拟,结合参与式与专家评估,探索AI政策组合,助力决策者平衡成本与危害减轻。

04:00
ArXiv AI

面向“短训练、长测试”泛化的快慢潜递归探索

提出持久快慢潜递归,通过权重共享状态更新提升短训练长测试的泛化,优于递归和Transformer基线。

04:00
ArXiv AI

无保真度的多样性:多智能体LLM谈判模拟中的求解器-采样器错配

推理模式增加谈判多样性却未改变失败结局,而智能体自记笔记才能促成协议,保真度测试不可依赖求解能力。

04:00
ArXiv AI

DASH:动态音频驱动的语义分块实现高效全模态令牌压缩

DASH利用音频语义动态分块与三重信号重要性估计,实现高效令牌压缩,在多个基准上保持高精度并达到更高压缩比。

04:00
ArXiv AI

NeuralMUSIC: 一种用于机器人声源定位的混合神经子空间框架

提出NeuralMUSIC混合框架,结合神经网络与经典MUSIC及自监督学习,提升机器人声源定位的鲁棒性和泛化能力。

04:00
ArXiv AI

变异性何去何从?从氛围编码到再生产品线

AI生成代码中变异性几乎为零,提出VbR:LLM按规范生成无死代码二进制,变异性应属规范而非代码。