5403 条条目 · 106 个活跃源
2026年7月9日
04:00
arXiv cs.AI

PRoVeFL:联邦学习中的隐私保护、鲁棒且可验证聚合

提出PRoVeFL框架,通过多密钥全同态加密实现隐私、拜占庭鲁棒与可验证聚合,支持多种鲁棒算法,性能提升高达100倍。

04:00
arXiv cs.AI

规范引导提升LLM代码测试有效性

规范接地比测试数量更关键,显著提高代码正确率,降低误报率,效果跨模型一致。

04:00
arXiv cs.AI

tsbootstrap: 时间序列的无分布不确定性量化与共形预测

通过块、残差等重采样与自适应共形校准,解决时间序列依赖性问题,内存高效且速度快。

04:00
arXiv cs.AI

Reliable and Developer-Aligned Evaluation of Agents for Software Engineering

04:00
arXiv cs.AI

面向模块化软体机器人自适应控制的持续学习框架

提出持续学习框架,使模块化软体机器人适应形态变化且不遗忘旧知识,分布式学习提升精度,实验验证有效性。

04:00
arXiv cs.AI

A Multi-Analyst LLM Pipeline for Auditable Rule Discovery Across 68 Public Physiological Corpora

04:00
arXiv cs.AI

混合最小二乘/梯度下降方法用于MIONet

提出混合最小二乘/梯度下降法加速MIONet训练,通过交替优化分支网络参数并分解大矩阵。

04:00
arXiv cs.AI

从代理型到自生型网络管理:面向AI原生6G及未来网络的标准视角

自生型网络管理扩展代理AI能力,通过自我编程与演化,分阶段部署应对6G复杂运维挑战。

04:00
arXiv cs.AI

AI增强计算中随机预言机的计算

SOTM框架研究缓存与新鲜响应方案:缓存响应设转录上限,新鲜响应通过重复调用积累证据突破上限,影响计算能力与词元成本。

04:00
arXiv cs.AI

当智能体失控:基于激活的多智能体系统恶意行为检测

AcMAS通过分析激活空间内部推理状态,检测异步多智能体系统隐蔽攻击,无需显式图模型,性能远超基线。

04:00
arXiv cs.AI

MADB:一个具有专业多维度标注的大规模音乐美学数据集

构建含9999首曲目、10维感知标注的大规模音乐美学数据集,揭示模型与人类判断的显著差距。

04:00
arXiv cs.AI

中文标题

基于RAG记忆与多模态教练的端到端大模型飞行规划,最高有效性达93.8%,实现自然语言到安全高效航线的转化。

04:00
arXiv cs.AI

WAM-TTT:测试时通过观察人类游玩导引世界行动模型

WAM-TTT通过测试时训练将人类视频融入记忆,无需机器人动作或标注,高效导引世界行动模型。

04:00
arXiv cs.AI

中文标题:在信任其判决前先验证梦想:世界模型模拟器的可接受性

中文摘要:世界模型需认证才能用作测试预言机,提出L0-L4可接受性阶梯,发现视觉保真度不预测行动鲁棒性。

04:00
arXiv cs.AI

中文标题:记忆稀缺、开放模型与AI产业重构(2026-2030)——推理经济学、训练成本分化和基础设施偿付能力的定量情景分析

中文摘要:四大力量重塑AI产业:内存涨价、开放模型、推理效率提升、巨头转售算力。行业偿付取决于带宽需求、溢价粘性与算力年份。

04:00
arXiv cs.AI

通过模拟部署预测发布前的LLM安全性

模拟部署通过替换对话回复估计LLM不良行为率,比传统评估更准确,且可基于公开数据集。

04:00
arXiv cs.AI

DiPhon:基于图极限的扩散模型实现可扩展的图生成

DiPhon利用图极限的Jacobi扩散,实现从小图训练到生成大图的可扩展图生成。

04:00
arXiv cs.AI

CarbonCLIP:通过整合街景语义与时间上下文训练从卫星图像增强碳预测

CarbonCLIP融合街景语义与时间上下文,将多模态知识转移至卫星表示,仅用卫星图像精准预测城市碳排放。

04:00
arXiv cs.AI

POO-LPSP:层次分析法中优先权推导的并行鱼鹰优化最小惩罚平方优先化方法

提出POO-LPSP方法,用并行鱼鹰优化求解最小惩罚平方模型,提升AHP优先权可靠性,可替代传统特征向量法。

04:00
arXiv cs.AI

HumAIN: 人类感知隐式社交机器人导航

HumAIN通过知识蒸馏将隐式社交线索融入导航规划,教师-学生架构实现高效类人导航,轨迹预测指标平均提升29.8%。

04:00
arXiv cs.AI

关于通过中间谱子空间视角的视觉-语言模型对抗脆弱性

从中间谱子空间研究视觉-语言模型对抗脆弱性,提出SSGRA攻击,揭示脆弱性机理。

04:00
arXiv cs.AI

面向样本高效扩散模型RLHF的选择性时间步加权与基于优势的回放

提出两种互补策略,通过加权关键时间步和优先回放有效轨迹,实现扩散RLHF最高6倍样本效率提升。

04:00
arXiv cs.AI

图信号流模型的稳定性

证明GNN参数化流模型的排列等变性与稳定性界限,提出正则化策略提升对结构噪声的鲁棒性。

04:00
arXiv cs.AI

摩擦中的创造力:面向探索性结构设计的人机交互

生成式AI消除摩擦与结构设计师迭代需求错位,提出视觉-语言模型交互系统,减少重复建模摩擦并保留反思性设计摩擦。

04:00
arXiv cs.AI

协作式合成数据生成在联邦学习中的知识迁移

利用预训练自编码器共享潜在空间,客户端传统计量,服务器聚合加噪生成合成数据,实现隐私单轮联邦学习。

04:00
arXiv cs.AI

CARLA-GS:自动驾驶极端案例合成中的表征、推理与物理仿真解耦

CARLA-GS解耦视觉表征、语义推理与物理执行,实现可编辑高斯场景与LLM推理,生成时空一致、物理可行的自动驾驶极端案例。

04:00
arXiv cs.AI

粗糙路径签名核的量子卷积神经网络

提出混合量子-经典架构,结合路径签名核与量子卷积网络,克服时间重参数化,实现时间序列分类。

04:00
arXiv cs.AI

ALER-TI:面向时间序列插值的对齐潜在嵌入检索

提出ALER-TI框架,利用历史模式对齐潜在嵌入,有效提升时间序列插值性能。

04:00
arXiv cs.AI

打破数据库锁定:用于数据库旁路的高性能存储读取器的智能体再生

Jailbreak利用LLM直接读取数据库存储文件生成高效读取器,实现27倍加速,打破数据库锁定。

04:00
arXiv cs.AI

复合AI系统中聚合的力量与局限

通过分析三种机制,证明聚合可扩展复合AI系统的可诱导输出集,克服模型和提示工程局限。

04:00
arXiv cs.AI

AGAPI-Agents:基于AtomGPT.org的开放智能体AI平台,加速材料设计

提出AGAPI开放平台,集成多种工具,验证工具增强的AI在材料设计中不可或缺,精度显著提升。

04:00
arXiv cs.AI

中性基底:持续性解释分歧下共享记录的设计约束

定义中性基底,约束基础层仅含固定引用与归因,因果规范作为归因断言,确保中立性。

04:00
arXiv cs.AI

中文标题:AI聊天机器人自杀风险检测与响应:开源VERA-MH安全评估的人类验证研究

中文摘要:研究验证了VERA-MH基准评估AI聊天机器人自杀风险检测的可靠性,其评分与临床专家高度一致,支持其作为自动化安全工具。

04:00
arXiv cs.AI

自适应差分隐私联邦学习框架

提出自适应差分隐私联邦学习,通过局部降维、自适应裁剪和鲁棒聚合,缓解噪声放大,提升收敛与分类性能。

04:00
arXiv cs.AI

通过条件归一化流潜在空间中的归纳偏置进行时间序列异常检测

将异常迁移至潜在空间,引入归纳偏置,异常检测转化为统计合规性测试,效果好。

04:00
arXiv cs.AI

EMO-R3:面向多模态大语言模型情感推理的反思性强化学习

提出EMO-R3框架,通过结构化情感推理与反思奖励,显著提升多模态大模型情感智能与可解释性。

04:00
arXiv cs.AI

度量人工智能的元认知能力

主张采用meta-d'框架评估AI元认知敏感性,并用信号检测理论测量其基于不确定性的决策调节能力。

04:00
arXiv cs.AI

M$^3$:重塑离散化物理模拟的训练度量

提出M³框架,通过多尺度空间划分平衡训练数据,显著提升连续域预测精度,误差降低最高4.7倍,实现数据高效建模。

04:00
arXiv cs.AI

When Summaries Distort Decisions: Information Fidelity in LLM-Compressed Financial Analysis

04:00
arXiv cs.AI

更快速、更简单的$k$-中位数和$k$-均值贪心算法

本文简化了递归贪心算法,实现更快的$k$-中位数和$k$-均值聚类,在图或欧氏空间中达到或超越最新水平。

04:00
arXiv cs.AI

对比CFG:通过对比正反概念引导扩散采样

提出对比CFG,通过对比损失引导扩散采样,有效注入或移除概念并保持样本质量。

04:00
arXiv cs.AI

理解具有平滑激活函数的两层神经网络

提出四个核心原理,揭示平滑函数两层网络的训练解与黑箱秘密,证明通用逼近。

04:00
arXiv cs.AI

通过隐式时间步进快速学习软体机器人控制

隐式时间步进结合增量曲率控制,实现软体机器人快速策略学习,速度提升达40倍且精度不降。

04:00
arXiv cs.AI

HiMoE-VLA:面向通用视觉-语言-动作策略的分层混合专家模型

HiMoE-VLA用分层混合专家模块处理异构数据,将负迁移转为正迁移,在多项任务上取得领先性能。

04:00
arXiv cs.AI

LHM-Humanoid: 杂乱场景中连续物体运输的长周期人体运动控制

提出双控制器与对抗性先验,实现无重置连续抓取-搬运-放置,成功率显著优于现有方法。

04:00
arXiv cs.AI

我们真的能学习一个表示来优化所有奖励吗?

提出FB改进变体,收敛误差小10^5倍,零样本性能提升24%。

04:00
arXiv cs.AI

ButterflyMoE:通过结构化蝴蝶轨道实现压缩可扩展的三值专家

ButterflyMoE用共享三值原型加旋转实现专家多样化,8专家压缩80倍,256专家压缩150倍,内存效率远超基线。

04:00
arXiv cs.AI

基于LLM信息辅助的模型规划与提示选择在部分已知环境中的物体搜索

提出LLM辅助模型规划与提示选择方法,结合概率估计与成本优化,实现高效物体搜索,实验提升显著。

04:00
arXiv cs.AI

从节拍到泄露:攻击性AI如何从播放列表推断敏感用户信息

开发musicPIIrate工具,利用深度学习从播放列表高精度推断用户隐私,提出JamShield防御框架降低10%推理F1分数。

04:00
arXiv cs.AI

基于逐层参数调优的最优FALQON量子近似优化方法

提出Optimal FALQON,优化每层时间步长与缩放因子,显著提升成功概率和效率,并为QAOA提供更优初始参数。