11412 条条目 · 106 个活跃源
2026年9月14日
04:00
arXiv cs.LG

LatentVerse:理解多模态潜在表示中共享与模态特定信息的框架

LatentVerse统一表征诊断,分解多模态嵌入为共享与模态特定成分,提升生物医学模型可解释性。

04:00
arXiv cs.LG

面向长时域LLM智能体强化学习的粒度自适应信用分配

提出GACA,以回滚NLL为不确定性代理,自适应混合步级与回合级优势,提升长时域智能体成功率。

04:00
arXiv cs.LG

基于标签偏移校正贝叶斯评分的分裂共形预测

提出标签偏移校正贝叶斯评分,借后验预测倾斜修正源预测,目标域区间更短且覆盖相当。

04:00
arXiv cs.LG

经认证的ICU警报AI分诊

ICU警报三向分诊:以95%置信认证误抑制预算,抑制74.8%误报仅静默1.5%真警。

04:00
arXiv cs.LG

超越查询本身:检索信号能否改善自适应多模态RAG路由?

控制变量对比显示,检索信号未能可靠提升多模态RAG自适应路由,其增益须经对照验证。

04:00
arXiv cs.LG

RiPPLE:面向神经架构搜索的跨搜索空间早期训练性能预测

RiPPLE用少量锚点早期训练外推代理标签,并传播至无标签架构特征,实现跨搜索空间全空间排序。

04:00
arXiv cs.LG

观察锚定式选择性同化用于治疗后胶质瘤纵向肿瘤状态代理预测

提出观察锚定选择性同化,预测治疗后胶质瘤纵向肿瘤状态代理,Dice与持久化相当,校准改善阈值支持。

04:00
arXiv cs.LG

MInTRL:异策略干预可提升同策略强化学习

MInTRL以稀疏局部干预扩展同策略探索,序列级优势回归免重要性采样,在数学代码基准超越基线,适度干预最佳。

04:00
arXiv cs.LG

固定量化混合专家(MoE)实例池上的质量约束路由

固定量化MoE实例池内,按质量预算与容量约束路由;用FWP预测风险,吞吐乘数1.284,提升2.5%。

04:00
arXiv cs.LG

Moreau–Yosida 未调整 Langevin 采样的泊松校正子复杂度界

研究MYULA,用泊松校正子证明平滑目标与不变律W₂误差O(h)+Õ(h^{3/4}),达ε精度需Õ(ε^{-4/3})次迭代。

04:00
arXiv cs.LG

SAGE-Loop:具备试错修正与自适应集成的可靠闭环LLM驱动AutoML

SAGE-Loop以闭环试错修正与自适应集成提升LLM驱动AutoML多任务性能与稳定性。

04:00
arXiv cs.LG

时序递归青睐更少层数

在流式任务中,时序递归可跨步传递计算;在同等单步算力下,最优分配显著偏向更少层数,性能相当或更优。

04:00
arXiv cs.LG

面向异构联邦电信网络客户流失预测的差分隐私联邦近端优化框架

提出差分隐私联邦近端优化框架,用于异构电信网络客户流失预测,兼顾隐私保护与预测性能。

04:00
arXiv cs.LG

TokenMapper:迈向可互操作语音令牌翻译的一步

TokenMapper 实现异构语音分词器间的直接令牌到令牌翻译,无需波形重建,显著降低延迟。

04:00
arXiv cs.LG

SCOPE-OPSD:用于同策略自蒸馏的 Fisher 条件化特权子空间

SCOPE-OPSD 用 Fisher 条件化特权子空间投影师生残差,提升短预算同策略自蒸馏。

04:00
arXiv cs.LG

GSF-χ:面向手性图变换器的全局立体化学场

提出GSF-χ,以全局立体化学场和Chiral-RoPE编码手性,分离ECD奇偶信息,提升手性预测。

04:00
arXiv cs.LG

解码器余弦相似度在 SAE 特征流发现中失效之处

构建状态+更新→目标特征转换图谱并消融验证;多数强效应转换解码器余弦相似度低,故其不足以发现SAE特征流。

04:00
arXiv cs.LG

面向高性能微调的基于聚类的平衡采样与数据并行分配

CluSTER以梯度聚类与数据并行均衡分配压缩微调数据,减少冗余,训练提速69.6%且精度几乎无损。

04:00
arXiv cs.LG

物理引导的合成高频超声生成用于皮肤层分割

提出物理引导合成高频超声框架,基于k-Wave仿真生成图像与密集掩码,预训练提升真实皮肤层分割性能。

04:00
arXiv cs.LG

以预测视界分辨的归因解释时间序列预测

指出现有方法误设各预测步依赖相同历史值,提出HRX为每步生成独立归因图并给出评估协议,实验验证有效。

04:00
arXiv cs.LG

SIFPBPNet:一种基于个性化稳态表征、用于可穿戴无袖带血压估计的双路径网络

提出双路径网络SIFPBPNet,用图注意力网络从多日PPG提取个体稳态特征,融合瞬时动态,显著提升无袖带血压估计精度。

04:00
arXiv cs.LG

基于Hessian分析的相关性引导快速机器遗忘

提出相关性引导的快速遗忘框架,借助Hessian闭式更新参数,速度提升82倍,遗忘更彻底且精度更优。

04:00
arXiv cs.LG

SIMS:面向多任务学习的尺度不变评价函数标量化

提出SIMS,用对数变换诱导的评价函数实现尺度不变,解决多任务标量化对损失尺度敏感问题,性能领先。

04:00
arXiv cs.LG

纸上书写,获取在线数字笔迹:手写的新纪元

提出结合数字笔、传感器硬件与嵌入式AI算法,在普通纸上书写即可实时重建手写数字轨迹。

04:00
arXiv cs.LG

InRTL:面向关系表的有效表内-表间交互学习

InRTL统一建模表内与表间交互,采用列感知编码器和线性化注意力,在24项真实任务上验证有效。

04:00
arXiv cs.LG

再论 AI 对齐的失真:RLHF 是一种尚可的功利主义对齐器

RLHF的扭曲指数退化源于偏好数据与参考策略分布不匹配,而非算法固有;无不匹配时可达最优,宜用同策略数据或先微调。

04:00
arXiv cs.LG

面向皮层脑沟标注的几何到语义球面迁移学习

提出几何到语义球面迁移学习,海量无标签预训练并注入脑沟底先验,提升脑沟标注,三级脑沟增益14.8%。

04:00
arXiv cs.LG

ProactiveBench:流式视频模型真的能像人类一样交互吗?

ProactiveBench评估流式视频模型的主动交互能力,发现模型普遍过早响应,揭示类人交互的时间决策差距。

04:00
arXiv cs.LG

Behavior Quotient Learning for Low-Rank Adaptation of LLM Agents

04:00
arXiv cs.LG

RunningTensor:将线性注意力泛化到高阶递归状态

RunningTensor将线性注意力记忆推广为o阶张量;三阶验证保持线性复杂度并提升检索表现。

04:00
arXiv cs.LG

基于课程学习的对抗式异构智能体强化学习用于海上自主四旋翼无人机着陆

采用HAPPO、课程学习与对抗风智能体训练舰载机械臂捕获四旋翼,分布外海况成功率更高、坠毁率更低。

04:00
arXiv cs.LG

气味描述词语料库能测量什么、不能测量什么:效价、衰减与公共记录的上限

审计四个语料库:公共记录信度上限33%;缺失方差是效价,需直测;五人评分即超全描述词,15-20人饱和

04:00
arXiv cs.LG

GenOR-Twin:融合运营话语与数学优化的语义中间件

GenOR-Twin 用 LLM 将运营日志译为数学约束,支持动态注入、数字孪生同步与自适应优化。

04:00
arXiv cs.LG

为决策而非预测优化:将平滑净获益作为训练目标的探索

提出可微平滑净获益训练目标,使优化对齐临床阈值效用;多数据集显示增益有限、依情境,不支持普遍替代NLL,但值得研究。

04:00
arXiv cs.LG

基于PAC-贝叶斯方法量化特权信息的价值

提出算法无关的PAC-贝叶斯框架,量化特权信息的潜在价值,无需测试数据即可预测性能增益。

04:00
arXiv cs.LG

重尾噪声与Hölder光滑性下随机梯度方法的收敛性

研究Hölder光滑与重尾噪声下非凸随机优化,给出SGD及梯度裁剪收敛率,并首次保证极重尾情形。

04:00
arXiv cs.LG

VertiFuseX:基于多流时序融合的可泛化金融预测

VertiFuseX融合多尺度时序倒数第二层特征与并行DNN,显著提升金融预测精度、跨市场泛化与交易稳健性。

04:00
arXiv cs.LG

大的远距离梯度未必可靠:面向长时程自回归预测的可靠性加权信用分配

提出可靠性加权反向路由,缓解长时程自回归预测远距离梯度不可靠问题,多测试台降误差但有适用边界。

04:00
arXiv cs.LG

物理状态引导的扩散采样用于全波形反演

提出物理状态引导扩散采样,分离波动方程与去噪梯度,提升全波形反演精度与鲁棒性。

04:00
arXiv cs.LG

基于群胚的局部对称强化学习内部状态表示

提出用群胚捕捉局部状态相关对称并动态发现等价结构,在对称约简空间学习,提升样本效率与收敛,优于Q学习。

04:00
arXiv cs.LG

面向风电场控制的离线强化学习:动态风向下的风洞研究

提出离线强化学习MTD3-BC,动态风向下经风洞实验验证,偏航控制可提升风电场功率约10%。

04:00
arXiv cs.LG

一个来自芬兰水域的大规模AIS数据集

发布芬兰水域(波罗的海及芬兰湖泊)2.29亿条AIS数据集,含船型特征与交通可视化,助力海事研究。

04:00
arXiv cs.LG

神经优化器动力学中重尾谱涌现的维度校正命中时间

将重尾谱涌现视为右删失命中时间问题,发现维度校正谱隙律与条件性理论机制。

04:00
arXiv cs.LG

信息诱导的训练几何:精确约简、规范补全与结构化表达力

训练数据经信息通道约束优化器几何,给出仿射不变正定压缩的精确约简、规范补全与结构化表达力。

04:00
arXiv cs.LG

面向跨维度大规模最优传输的双引导分层边缘定位

提出HELLO分层边缘定位求解器,对偶引导初始化与细化,线性内存,百万级跨维度OT数量级加速且达全局最优。

04:00
arXiv cs.LG

谱重尾起始的完整 Adam 定理

证明Adam谱重尾起始的完整定理,给出命中时间阈值律,并表明更强任意梯度定理不可能。

04:00
arXiv cs.LG

面向表格基础模型的注意力量化

表格基础模型注意力Q/K/V量化为FP8并做FP8矩阵乘法,Triton内核提速1.7倍,精度无损。

04:00
arXiv cs.LG

隐于轮次:预测联邦学习中802.11信道争用的时间开销

802.11联邦学习通信耗时随密度增百倍,轮数对负载不敏感,误差2.3%–10.2%,未证公平性。

04:00
arXiv cs.LG

面向抗离群点随机梯度下降的基于分位数的损失过滤

提出基于分位数的损失筛选QkL-SGD,抗离群点且可线性收敛;实验表明中间分位数优于标准SGD与min-k。

04:00
arXiv cs.LG

良性损失景观可与最坏情况困难性共存

树张量网络含梯度下降难学目标,但可实现目标的最小范数局部极小皆全局;困难源于秩亏导致的高阶退化鞍点。