基于基数约束的大规模投资组合优化问题与增强型多目标进化算法
通过新表示、算子和修复机制增强多目标进化算法,实现基数约束下更快收敛和广泛搜索,性能不降。
PAC-ACT:面向动作分块变换器的后训练Actor-Critic
提出PAC-ACT后训练框架,对动作分块变换器进行强化学习微调,提升工业接触任务成功率和力安全性,峰值力降低46倍。
通过BREW框架改进语言代理:从经验中引导学习的环境知识引导
BREW框架将代理交互轨迹蒸馏为知识库,通过EG-MCTS算法优化,在三个基准上提升10-20%成功率并减少10-15%执行步数。
走向可关闭智能体:强化学习智能体与大语言模型中随机选择的泛化
DReST奖励函数让智能体在轨迹长度上保持中性且有用,实验证明其泛化性并显著降低干扰关闭行为。
PHINN-EEG:梦境状态脑电图的拓扑时间序列分析——用于梦境内容分类的动态贝蒂曲线与拓扑条件神经信号合成
提出PHINN-EEG拓扑框架,用动态贝蒂曲线分析梦境脑电,目标AUC 0.82-0.90,并实现拓扑条件神经信号合成。
超越嵌入:面向二进制代码相似性的可解释特征提取
基于语言模型代理生成可解释特征,无需训练即可匹配嵌入方法性能,结合后显著更优,实现准确性、可扩展性与可解释性共存。
RLHF中人类信念的描述性和规范性理论
人类信念显著影响RLHF偏好,降低信念与智能体能力不匹配可提升策略性能。
M4V:面向高效文本到视频生成的多模态Mamba架构
M4V多模态Mamba框架,通过MM-DiM块降低45%算力,实现高效高质量文本生成视频。
HiPO:面向LLM自适应推理的分层偏好优化
HiPO将推理响应分为片段并加权优化,提升LLM数学推理性能和逻辑性。
测量诱导纠缠的数据驱动可学习性转变
通过测量记录训练神经网络,发现测量诱导纠缠存在可学习性转变:阈值下多项式资源可学习,阈值上指数增长。
中文标题
利用生成式AI赋能911接警员培训,实战部署六大经验教训,为公共安全领域AI训练提供指导。
如何让你的数据实现差分隐私:生成差分隐私合成数据的实用指南
本文提供生成差分隐私合成数据的实用指南,涵盖图像、表格、文本等模态,旨在解锁隐私受限数据的价值。
ReinforceGen:具有自动数据生成与强化学习的混合技能策略
提出结合任务分解、数据生成、模仿学习与运动规划的系统,经强化学习微调,操控任务成功率达80%,性能提升89%。
神经网络中利普希茨连续性的原理
本文探讨利普希茨连续性原理,从训练动态和频率信号传播角度,分析其对鲁棒性与泛化的影响。
LLMbda演算:AI智能体、对话与信息流
LLMbda演算通过信息流控制和分离职责防御提示注入,提供可验证安全保证,在AgentDojo测试中接近最佳防护效果。
调整导数以实现机器学习中的因果公平性
用偏导数定义因果公平,提出调优算法平衡统计均等与预测均等。
语言模型需要睡眠:学习自我修改与巩固记忆
提出“睡眠”范式,通过记忆巩固与做梦实现模型持续学习与长期知识转化。
在聊天中拒绝,在代码中实现:IDE编码代理中的工作流级越狱构建
IDE编码代理的工作流级越狱可绕过单轮拒绝,所有提示均产生不安全输出,传统评估高估安全性。
Infinity-Parser2 技术报告
提出多模态文档解析模型,结合合成数据与多任务强化学习,开源5M语料库,Pro版达SOTA性能。
中文标题:智能体神经架构搜索
中文摘要:AgentNAS结合LLM与NAS,自动生成并分解带槽位架构,在17项任务中取得11项最优,证实两种搜索机制互补。
个体仿生学:隐私与智能机器人假肢的统一
引入“个体仿生学”新领域,聚焦智能假肢隐私风险与攻击,提出开放研究问题。
基于sEMG信号的图神经网络实时手势识别模型
提出基于图网络的sEMG手势识别方法,利用8电极肌电带,准确率99%,耗时48ms,适合实时应用。
VectorizationLLM:基于智能向量化的AI助手
基于Google开源LLM,辅助MATLAB学习向量化与傅里叶分析,提供概念解释和示例但不给答案。
尼日利亚机械:一个低资源工业数据集及其领域锚定推理层
发布尼日利亚工业小数据集及领域锚定推理方法,解决模型提示脱节问题,实现完全领域相关与准确检索。
过度思考:放大推理权重以提取习得秘密
通过放大推理权重(overthinking),模型揭示习得秘密的频率可达原模型的10倍,有效提升审计隐藏信息能力。
PARA-PV:基于冻结基础模型和分布偏移校正的物理感知检索增强光伏预测
提出物理感知检索增强框架PARA-PV,融合冻结基础模型与分布偏移校正,提升光伏预测精度。
大语言模型意见一致就正确吗?——对自我一致性与跨模型一致性作为置信度信号的审计
合意不等于正确:模型可能因共享偏见而一致。大规模研究显示一致性是弱的正确性预测因子,尤其前沿模型过度自信,自我一致性仅是条件代理。
先竞争后协作:前沿AI教师构建可验证课程,使编程学生超越模仿
前沿AI教师经竞争排名后协作构建可验证课程,用RLVR替代SFT,使编程学生能力相对提升49%。
心理能力:AI评估中缺失的维度
当前AI评估重技术性能,忽视人机交互心理影响,本文提出心理能力作为评估新维度。
AI引导的刺激发现与生成优化自闭症面部情绪感知研究
AI模型发现自闭症与常人情绪判断差异集中于少数表情,可优化刺激选择与生成,提升研究敏感性与可靠性。
盲点基准:评估多模态模型中的盲点
提出盲点基准,用简单任务暴露AI模型盲点。评估显示闭源模型优于开源约10%,但无模型全面占优。
FedOPAL:基于分析视觉提示调整的单次联邦学习
FedOPAL用视觉提示修正特征分布,实现高效单次联邦学习,零服务器训练成本达迭代方法精度。
MobiDiff:面向人类移动数据生成的语义感知多通道离散扩散模型
MobiDiff是端到端离散扩散模型,直接生成多通道语义移动数据,推理速度比现有方法快5.3倍。
中文标题
基于CPM的多智能体框架,通过情感触发与协作评估,实现角色对话中动态情感演化,实验验证有效。
SHAP加权跨模态专家融合用于情绪与情感识别:证据与局限性
提出SHAP加权跨模态专家融合,分析归约方式影响,在情绪识别中接近早期融合,贡献透明实证分析。
CommuniWave:一种用于量化城市社区临时非正式行为程度的机器学习模型
CommuniWave模型通过街景视频量化非正式行为程度,生成波动图,支持社区动态监测与精细决策。
中文标题:迈向肝细胞癌精准治疗:用于风险分层和治疗指导的临床推理大语言模型
中文摘要:开发HCC-STAR大语言模型,基于电子病历实现风险分层、治疗推荐和生存预测,临床验证优于现有方案,辅助医生提高决策准确性。
SolarChain-Eval:面向去中心化能源市场中可信经济智能体的物理约束基准
提出物理约束基准SolarChain-Eval,评估多维度可信性,实验显示效用-安全权衡,需物理约束与透明审计。
等价性的幻觉:LLM中量化效应的统计表征
量化评估常忽略行为变化,引入正确一致性指标发现中度量化时模型行为发散,查询和键投影更敏感。
Using AI-based Learning Assistants in Higher Education: A Large-Scale Descriptive Analysis
思想有基因组:科学谱系推理与基于谱系的思想生成基准测试
提出IG-Bench基准,评估AI科学谱系推理与思想生成;14个LLM系统表现揭示组合瓶颈,最高准确率仅27.3%。
Reaction-network reasoning with frontier models for experimentally confirmed catalyst-selectivity hypotheses
基于Takagi-Sugeno模糊推理的私有Substrate区块链闭环动态验证节点缩放
提出TS模糊推理系统,实时读取区块链参数,实现验证节点自动动态缩放,减少振荡,保持稳定。
张量网络理论的多智能体自动形式化
多智能体驱动自动形式化张量网络,实现矩阵乘积态定理,探索新证明路径,生成库并扩展至拓扑相,瓶颈是数学意图强制执行。
基于内部归因图的大语言模型越狱机制可解释性
通过构建内部计算图揭示对抗攻击如何改变模型推理,识别漏洞模式并进行因果干预,提升模型鲁棒性。
视而不见:针对代理爬虫的压缩感知内容保护
CAPE框架通过不可见扰动诱导压缩信息丢失,保护高价值文本,无需改变可见形式。
从遗留文档到OSCAL:基于MCP的智能体管道实现关键基础设施威胁驱动的持续合规
MCP管道将系统描述转为OSCAL合规工件,解耦LLM与知识检索,降低错误并提升召回率,使风险可见可审。
论对话时序在ASR合成训练数据中的作用
贝叶斯优化揭示重叠与间隙权衡:高重叠降低词错误率,长间隙增加错误率。
面向语言模型交互中敏感数据隐私保护的多智能体防火墙架构
提出开源多智能体防火墙,混合检测保护LLM交互敏感数据,F1达94.93%。
上下文访问鸿沟:交互级架构作为能动性不平等的补充维度
定义上下文访问鸿沟(CAD),揭示动态检索与手动附加的AI效用断层,补充能动性不平等框架。