中文标题:利用非结构化数据增强体制转换检测:基于国债市场的研究
中文摘要:结合LLM与统计检验的体制转换检测框架,在国债市场实现F1=0.82,优于纯数据驱动方法。
TRINE:一种面向多模态AI的令牌感知、运行时自适应FPGA推理引擎
TRINE是单比特流FPGA加速器,无需重配置执行多模态推理,通过模式切换和依赖感知卸载,20-21W功耗下延迟降低22.57倍。
结构化交互在实际多机器人系统中超越模型扩展提升分布式协调
固定预算下,交互结构(模块层次化)比扩大模型尺寸带来更显著性能提升(47分 vs 9分)。
人工智能失控事件管理:响应与恢复力
提出AI失控事件管理框架,区分不可控与可控场景,针对意外与对抗性失控制定分级响应指南。
基于多重网格分层学习的工程尺度三维飞机全场预测
提出MHLF框架,实现工程尺度三维飞机全场流场预测,加速收敛3-8倍且保持精度。
Evolutionary Algorithm for Reservoir Learning and Yielding
机器中的社会推理:探究大型语言模型辩论中的集体求真动态
通过多智能体辩论验证论辩推理理论,集体求真优于个体,并提出模型内在属性评测新方法。
CodeGolf Bench:评估大语言模型简洁代码生成能力的多语言基准
推出CodeGolf Bench基准,评估LLM在60种语言中生成简洁代码能力,推理模型表现优于非推理模型,C++上差距尤其明显。
受内存限制而非带宽限制:批大小为1的LLM解码中的物理AI推理差距
物理AI单流解码受内存限制,带宽利用率低,高带宽GPU存在启动开销,仅特定量化才有效。
中文标题:针对软件逆向工程AI代理的自动化攻击
中文摘要:提出用遗传算法生成对抗提示,欺骗LLM反编译系统,使其误解二进制代码,破坏分析输出。
针对软件逆向工程AI智能体的提示注入攻击检测与混淆研究
研究检测逆向工程AI的提示注入攻击及其混淆防御,提出策略提升系统安全性。
OrcaRouter:面向生产的LLM路由器,采用混合离线-在线学习
提出OrcaRouter,结合LinUCB和混合学习,在RouterArena排名第二,准确率75.54%,成本低。
论检索内容表示在RAG管道中的影响
控制实验表明,答案保留是RAG准确性的关键,表示形式影响有限。
扩散模型中的遗忘学习:一种结合KL散度和似然约束的统一框架
提出基于KL散度和似然约束的统一框架,实现遗忘与模型效用的更好权衡。
较小的模型是GRPO中策略级多样性的天然探索者
利用小模型策略多样性训练大模型,S2L-PO通过渐进退火平衡探索与利用,提升数学推理性能并降低计算成本。
面向大语言模型对齐的差分隐私偏好数据合成
提出DPPrefSyn算法,基于Bradley-Terry模型合成差分隐私偏好数据,实现隐私保护的对齐,效果显著。
GaMi:通过跨模态减法解耦实现几何无关的材料识别
GaMi融合毫米波与声学,通过跨模态减法解耦和对比学习,在不受约束几何条件下实现95.2%的材料识别准确率。
TUX:衡量人类与AI的默契理解
提出TUX指数衡量人机默契,实验发现个性特征影响默契,且TUX可解释性随预测变量丰富而提高。
基于Gumbel-Softmax先验的联邦变分偏好对齐用于个性化用户偏好
提出FedVPA-GP框架,利用联邦混合先验和正交损失,保护隐私下解耦冲突偏好,性能优于传统方法。
轨迹中的捉迷藏:发现VLA运行时监控的故障信号
论文提出Hide-and-Seek框架,通过轨迹间内对比学习从轨迹标签定位故障动作,实现VLA运行时高效故障检测,性能领先且泛化良好。
面向战略智能体策略的安全均衡策略优化
SEPO通过惩罚可剥削性、合谋和外部性成本,提升多智能体战略博弈安全性,纠正过度合作。
Sophrosyne:关系数据系统中的智能体探索需要节制
Sophrosyne通过指令引导探索,减少4.6倍过度探索,提升Text2SQL准确率12.4%。
无需最优示范者的逆强化学习:一种可行奖励集方法
针对多个次优示范者提出可行奖励集框架,理论证明联合集单调收缩与恢复保证,提出离线算法,实验验证有效性。
BlueFin:金融电子表格中LLM智能体的基准测试
BlueFin基准评估LLM智能体在金融电子表格上的能力,前沿模型平均得分不足50%,动态正确性薄弱。
De-attribute to Forget for LLM Unlearning
退火Softmax贪心算法在多臂贝叶斯老虎机中的应用
证明退火Softmax贪心在β-正则先验下贝叶斯后悔逼近最优,类似RLVR机制无需显式不确定性追踪。
AMix-2: 在大语言模型中确立蛋白质为原生模态
AMix-2将蛋白质作为LLM原生模态,通过扩散语言建模统一理解与设计,在ProteinArena基准上优于前沿模型。
沉浸式TTS:基于多模态扩散Transformer和领域特定表示对齐的环境感知文本到语音
提出ImmersiveTTS模型,通过多模态扩散Transformer和表示对齐生成与环境融合的自然语音,性能优于现有方法。
DEM:一种用于生理传感器网络可解释异常检测的蒸馏解释模型
DEM模型蒸馏梯度提升专家到可解释决策树,实现高精度可解释异常检测,速度比SHAP快1235倍。
通过代码进化学习求解与优化
CHECKMATE利用形式规范引导代码进化,自动生成算法,在工业配置与调度问题上超越现有求解器。
线性排序问题:变革之时
针对线性排序问题数据过时、多最优解挑战,提出新基准套件和多样化高质量解生成方案。
斯蒂弗尔流形上的路由:自适应子空间选择何时有助于跨域脑电解码?
动态斯蒂弗尔路由通过交叉注意力自适应选择子空间投影,三个结构性质防止退化为集成平均,跨域脑电解码准确率提升约5%。
DRIFT:面向无导频6G非地面网络的联合信道估计与预测
提出DRIFT轻量框架,在LEO非地面网络中联合信道估计与预测,减少导频开销,提升12%频谱效率且计算成本低。
策展人引导的多语言艺术描述对视障观众的小型视觉语言模型的初步研究
初步研究表明,小型视觉语言模型为视障观众提供多语言艺术描述时,语言专用适配器对部分语言更稳定,多语言适配器在德语有竞争力。
SpecDB:通过面向特征的分解由LLM生成的定制数据库
SpecDB利用LLM按需生成定制数据库,模块化构建,性能与主流数据库相当,代码量仅3%。
SWIM: 用于游泳动作的单实例全身模仿
提出SWIM方法,从单个游泳动作学习,泛化到多种环境,数据高效,稳定鲁棒。
神经包容性情绪调节的用户体验研究视角
提出生成式AI增强的UXR方法论,整合DBT、SDT和COM-B模型,生成10张设计指导卡,支持ADHD成人神经包容性情绪调节干预。
在监管背景下为数字健康开发AI驱动的用户体验研究视角:来自尼日利亚男同性恋和跨性别者HIV护理的典型案例
提出生成式AI增强的UXR方法论,产出十张理论驱动UXR游戏卡,为边缘人群提供可复制的隐私与污名感知框架。
STEP:学习渐进时间序列的结构化嵌入
提出自监督对比学习结构化嵌入,利用极坐标几何解释渐进时间序列状态与模式,性能媲美黑盒模型且可解释。
MIMO:通过单语目标实现的多语言信息检索
MIMO两阶段框架,利用教师模型英语语义空间,知识蒸馏加跨语言对比学习,提升检索性能并保持对齐。
从证据到设计:为紧急与公共安全情境下的数字福祉构建AI增强的用户体验研究视角
结合AI与用户体验研究方法,为紧急与公共安全人员开发低认知负担、适应情境且注重心理安全的数字福祉干预。
开发基于文化背景、AI增强的用户体验研究观点(POV):远程医疗痴呆症护理示例案例研究
结合AI与混合方法,构建文化敏感用户体验研究观点,用于尼日利亚远程医疗痴呆症护理。
MindVoice: 利用预训练先验从非侵入式神经信号重建可理解语音
提出MindVoice框架,通过解耦语义与声学重建并融合预训练语音模型,从EEG/MEG中合成清晰语音,显著优于现有方法。
为什么线性循环记忆在部分可观测强化学习中有效
线性递归记忆作为部分可观测强化学习中的记忆单元,其线性滤波器可成为HMM最优策略的充分统计量并降低状态模糊性。
心向量图空间中的心脏潜在表征学习
提出LVCG框架,在VCG空间学习心脏潜在表示,减少冗余,提升泛化,超越ECG基线,尤其擅长域迁移场景。
个性化以说服:情境化与温暖对对话式AI信任与依赖的影响
情境化降低AI说服力,与温暖结合可恢复;信任预测行为但非中介;AI素养分离信任与行为,用户易服从AI。
基于物理引导深度展开的AI-RAN实用跨频段信道预测
物理引导深度展开框架GUIDE,无需重训即在未知环境实现高波束赋形增益,推理速度远超现有方法。
既非替代亦非万能:比较基于LLM的对话式与图形化决策支持在工业任务中的应用
对话界面降低简单任务认知负荷,但复杂任务优势消失,准确性无显著差异。