RIVET:鲁棒幂等语音属性编辑
RIVET利用幂等性提高模型对标签噪声的鲁棒性,改善编辑效果并保留说话人身份。
FAPO:多步LLM流水线的全自动提示优化
FAPO全自动诊断并优化多步LLM流水线,通过提示编辑和结构变化提升性能,在18项对比中15项胜出,平均提升14.1个百分点。
在拉取请求之前:挖掘多智能体协调
提出grite协调基础,在git内记录并发代理工作,消除78%重复,有效吞吐量翻三倍,可挖掘PR历史不可见的故障。
VCG: 极端冷启动条件下电商视频流的多模态检索框架
VCG系统利用视觉语言模型实现电商视频零样本检索,缓解冷启动与偏差,提升50%视频完成率。
VOiLA: 基于学习扩散模型的矢量化在线规划用于POMDP智能体
VOiLA用扩散模型学习POMDP模型,蒸馏加速在线规划,性能优于RSAC,泛化强,实物10/10成功。
人形机器人数据标准:物理AI缺失的基础设施
数据标准使具身经验可解释、共享、追溯、重用,解决非累积瓶颈,是物理AI的基础设施。
时序自模仿学习
TSIL从学习过程挖掘高效成功轨迹,转化为自监督信号,提升长程操作任务的效率与鲁棒性。
跨数据集、年龄和性别泛化:低资源儿童语音识别微调策略的综合分析
通过音高特征组合与F-TDNN模型,在TORGO数据库上对构音障碍语音的识别相对提升约4.6%。
通过预训练数据组合工程化缩放定律
加入多样且对齐下游任务的预训练数据,可使缩放偏向数据量而非模型参数。
智能体电子设计自动化:交接视角
提出交接有效性原则,分类阶段、流程、组织三种边界,并设计五层通信协议以保障可信智能体EDA。
策略感知的向量搜索:向量数据库中细粒度访问控制的愿景
针对向量数据库细粒度访问控制缺失,提出策略感知搜索模型,比较策略并揭示挑战。
FFinRED:专家引导的金融大语言模型红队测试基准生成与评估框架
FinRED是专家引导的金融大语言模型安全测试框架,通过双层分类法和真实文档生成提示,减少假阴性,已部署于韩国金融安全研究所。
协同策略:响应式人机音乐表演共创
提出Co-policy框架,分离语义理解与物理执行,实现人机实时音乐协同创作与精准响应。
Measuring Biological Capabilities and Risks of AI Agents
SIMBA:面向NWP应用的FY-4A GIIRS超光谱红外辐射建模双向反演正向模拟框架
提出SIMBA双向反演-正向模拟框架,联合反演与辐射重建,通过循环一致性和双向Mamba提升温湿度反演及辐射重构性能。
超越静态端点:工具程序作为灵活智能体Web服务的接口
ToolPro将工具意图编码为可执行程序,减少端到端延迟53.4%和流量96.1%。
一种用于机器人移动履行系统高效路径查找的神经形态强化学习框架
提出SDQN-RMFS框架,实现ANN到神经形态芯片高保真部署,稀疏事件计算节省11281倍能耗、延迟减半且决策质量不变。
基于事件的ICU爆发抑制检测中EEG基础模型评估
REVE-base模型在ICU爆发抑制检测中事件F1达0.868,全微调最优,预训练模型小样本优势显著。
AI经济学家代理:一种基于模型的、融合RAG与知识图谱及大语言模型的代理经济分析框架
提出结合RAG和知识图谱的AI经济学家代理,基于模型计算生成连贯可追溯的经济报告。
信息检索中的非负弹性网络解码
提出非负弹性网络解码,通过稀疏非负线性组合选择文档集,理论及实验均优于密集检索,提升多样性与效果。
现实场景中的安全与隐私提示:用户向大语言模型提问的内容与模型的回应
从真实对话分析用户安全隐私提问,商业模型回答质量高但有时产生矛盾回应。
可信自组合大数据即服务:基于LLM编排的多智能体框架,实现自动化数据工程、AutoML、MLOps部署与漂移感知生命周期优化
提出LLM编排的多智能体BDaaS框架,实现数据工程到部署监控的全生命周期自动化,提升可信性与适应性。
跨国劳动力中的AI采纳:人力资源领域生成式AI接受的社会技术条件
HR中GenAI采纳取决于设计-员工匹配及信任建立,受知识条件影响,建议关注角色差异与知识基础设施。
EAGG:通过几何感知图条件实现具身对齐的抓取生成
EAGG利用几何感知图条件对齐不同末端执行器,实现高成功率与低接触距离的跨具身抓取生成。
从观测中学习红方代理策略的神经符号自主网络代理
提出模仿学习技术,从网络观测和防御动作学习红方策略,集成神经符号防御代理,实现高精度预测。
超越采样标记:在可验证奖励强化学习中保持候选支持
CaSP通过保留top-N候选概率质量缓解RLVR探索坍塌,提升pass@K且不损pass@1。
视觉验证实现推理时策略引导与自主策略改进
提出VERITAS框架,用视觉验证器评估动作,推理时提升策略性能,无需额外训练,自主改进堪比人类演示。
ReproRepo: 通过GitHub仓库问题规模化可重复性审计
提出利用GitHub问题可扩展评估LLM代理的可重复性审计能力,最佳代理覆盖约90%论文。
TRACE:电路图上的计算学习
TRACE通过层级Transformer与函数偏移学习,精准建模电路图计算功能,性能全面超越现有架构。
OmniSapiens:一种基于异质性感知相对策略优化的社会行为处理基础模型
提出异质性感知相对策略优化平衡异质数据,模型在10个任务和5个基准上均达最优,性能提升达12%。
利用AutoML实现可持续深度学习:面向深度移位神经网络的多目标超参数优化方法
采用多目标多保真超参数优化,在深度移位神经网络上实现高精度与低能耗,推动可持续深度学习。
SSIL:面向端到端驾驶的自监督模仿学习
提出首个自监督模仿学习框架SSIL,无需驾驶数据或预训练模型,利用伪转向角和交叉注意力机制,性能媲美监督学习。
心理健康AI的安全声明必须保留时序证据
心理健康AI安全评估需保留交互时序证据,否则结论无效。SCOPE-MH原则保障时序性,是安全部署前提。
E2Vec: 融合时间信息的特征嵌入方法用于分析电子书系统中的学生行为
E2Vec用词嵌入融合时间信息生成学生行为特征向量,在风险检测中有效。
基于梯度的因果发现框架及其在复杂工业过程中的应用
提出GRNGC方法,利用L1正则化梯度推断因果,仅需单个模型,灵活高效,在多个数据集上优于基线。
高斯差分隐私在机器学习中报告差分隐私保证的应用
主张用非渐近高斯差分隐私报告机器学习DP保证,避免不完整,实验证明其对DP-SGD等算法拟合优异。
Top-Theta注意力:通过补偿阈值稀疏化Transformer
无需训练,静态阈值稀疏化注意力,补偿保精度,推理时V-cache减少3-10倍,精度损失不超1%。
面向多样化类人团队协作与交流的大语言模型算法提示生成
结合质量多样性优化与LLM代理,自动生成多样化类人团队行为的提示,有效捕捉大尺度数据难以观测的行为。
SPATIA:空间细胞表型的多模态生成与预测
SPATIA融合形态、基因和空间信息,多层级生成预测细胞表型,生成保真度提升8%,预测精度提升3%。
世界模型批判:一种用于世界建模的生成式潜在预测架构
定义世界模型目标为模拟所有可行行动可能性,并提出生成式潜在预测(GLP)架构。
破解代码:通过系统性越狱攻击评估AI代码代理的安全性
JAWS-Bench基准测试显示代码智能体越狱攻击成功率高(最高75%),需执行感知防御。
中文标题:BadScientist:研究代理能否撰写令人信服但不可靠的论文以欺骗LLM审稿人?
LLM审稿系统易被伪造论文欺骗,接受率攀升,检测几乎随机,暴露出AI驱动评审的根本缺陷。
LLM辅助的RSMA异构无人机网络联合保密预编码与轨迹设计
提出LLM引导分层优化框架,联合优化保密预编码与轨迹,提升RSMA无人机网络保密率与能效。
对抗攻击利用超位特征间的干扰
超位编码导致特征干扰,产生对抗脆弱性及攻击可迁移性
显式上下文驱动的神经声学建模用于高保真RIR生成
利用显式几何特征(距离分布)引导神经模型生成更准确的房间脉冲响应。
基于原则的流匹配强化学习源于块级策略优化
提出块级策略优化GCPO,用于流匹配后训练,相比GRPO性能提升高达43%。
基于几何与深度学习的可复现流程:利用现场摄像机监测城市河流漂浮人为垃圾
提出深度学习与几何模型监测河流漂浮垃圾,验证数据协议及几何投影加回归修正可行性。
Co-PLNet: 协作点线网络实现提示引导的线框解析
Co-PLNet通过点线协作与空间提示,提升线框解析精度及鲁棒性,兼具实时效率。
增强型进化多目标深度强化学习用于可靠高效无线可充电传感器网络
提出融合LSTM与动态帕累托评估的增强型进化多目标深度强化学习算法,有效平衡节点存活率与能量效率。
学习注入的形式化推理:从合约合成到工件复用与形式语义
融合AI,通过合约合成、工件复用与语义匹配,构建知识驱动的验证范式。