11572 条条目 · 106 个活跃源
2026年8月19日
04:00
arXiv cs.LG

基于生成建模的变分鲁棒离群值高斯过程回归

提出生成式高斯过程回归,自适应减轻离群值影响,用变分广义EM学习。实验表明预测精度优于或持平鲁棒基线,计算复杂度为三次方。

04:00
arXiv cs.LG

CaliBench:视频世界模型的随机动力学是否经过物理校准?

提出CaliBench基准,用可解释离散空间检验视频世界模型的随机校准度,发现多数模型概率分布严重失准,且无模型全面占优。

04:00
arXiv cs.LG

时间感知验证机器学习燃油消耗模型:基于CCGS“威尔弗里德·劳里尔爵士”号1赫兹运行数据的证据

针对随机划分导致时间泄漏,采用时间序列交叉验证评估船舶燃油模型,并基于388万条1赫兹实测数据验证。

04:00
arXiv cs.LG

一种用于亥姆霍兹共振器降噪频率预测的数据高效解析先验机器学习框架

提出解析先验学习框架,用低成本解析模型辅助仿真数据,在有限数据下提升亥姆霍兹共振器降噪频率预测精度,MAE降至0.371Hz。

04:00
arXiv cs.LG

Proteus:面向长上下文序列建模的增量式记忆激活

静态记忆会污染长上下文,本文提出按需扩容的增量记忆激活机制,可零成本嵌入现有模型,在长上下文检索与理解上持续提升性能。

04:00
arXiv cs.LG

这样的回答会改变你的答案吗?用反事实实验评估大语言模型行为的解释

提出CHIVE流水线,通过反事实编辑发现并解释LLM行为。发现常见可解释性技术无提升,但生成数据可训练模型并泛化。

04:00
arXiv cs.LG

批评者:用于大语言模型强化学习的特权价值函数

提出特权价值函数与TETHER基线两种策略,改进价值函数强化学习,在推理任务上优于标准基线,媲美或超越GRPO。

04:00
arXiv cs.LG

超越$L_2$:将溯因潜在解释推广至多样原型架构

将溯因潜在解释推广至非欧几里得原型架构,为球形、高斯等变体推导新边界算法,实现跨架构可解释性统一比较。

04:00
arXiv cs.LG

GEO-Flag:检测与测度面向生成引擎优化的网页内容

提出GEOFlagBench与干预配对训练(IPT),将检测F1从0.862提至0.944,实测真实搜索中GEO内容占比8.90%。

04:00
arXiv cs.LG

神经网络优化器背后的原理

论证Adam存在相变,发现Hessian近块对角结构,提出Adam-mini,内存减半性能不变。

04:00
arXiv cs.LG

基于深度学习的微流控装置中循环肿瘤细胞表型数据高效可解释分类

提出可解释且数据高效的深度学习框架,利用局部轨迹增强和激活映射提升循环肿瘤细胞分类精度。

04:00
arXiv cs.LG

基于动态模态分解的含噪低分辨率热系统表征

针对热监测中传感稀疏、噪声干扰、分辨率不足问题,研究DMD预处理与截断策略,通过算例证明适当截断可恢复主导热行为,平衡重建精度与噪声敏感度。

04:00
arXiv cs.LG

Wolff-Parkinson-White 检测中的 471:1 类别不平衡:数据瓶颈的泄漏控制研究

在471:1类别不平衡下,泄漏控制协议比较七种信号表示;最强检测器未饱和,平均精确率0.595,ROC面积0.950,属筛查预过滤器。

04:00
arXiv cs.LG

面向实时5G/6G信道估计的相位感知CNN与硬件在环验证

提出相位感知CNN,用正弦/余弦编码重构信道幅相,高精度、强泛化,支持实时边缘推理。

04:00
arXiv cs.LG

摒弃全精度索引:重新审视向量嵌入的聚类

研究表明,全精度向量聚类过度,1位编码即可达近最优聚类质量,存储降60倍且性能提升。

04:00
arXiv cs.LG

Belayer:面向LLM智能体强化学习训练的高效容错系统

Belayer高效容错LLM智能体强化学习,低开销处理生成与环境故障,恢复速度大幅提升。

04:00
arXiv cs.LG

使用Veins仿真评估对抗性交通模式对VANET通信的影响

用Veins仿真研究对抗性交通模式对VANET影响,发现攻击使分组投递率降96.55%,吞吐量降27.89%,揭示通信脆弱性。

04:00
arXiv cs.LG

演示:基于设备端意图感知语义分解的实时生成式多播

演示设备端意图感知语义分解的生成式多播:按用户意图分解信号,广播语义图,用户合成非意图部分,节省资源,实时运行于Edge TPU。

04:00
arXiv cs.LG

心脏能反映你的疼痛吗?利用自监督心电图表示学习应对X-ITE疼痛挑战

研究发现仅凭心电信号识别疼痛效果有限,多模态预训练可提升表征,但疼痛模式个体差异大,需多模态与个性化建模。

04:00
arXiv cs.LG

基于Q值的变分逆强化学习

提出QVIRL,用变分Q值分布推断奖励后验,兼顾扩展性与不确定性,多任务验证优秀,支持原始像素输入。

04:00
arXiv cs.LG

6G原生AI与信道基础模型

6G原生AI应内建,以信道基础模型为核心,三类预训练支持多任务,少标签下改善定位与波束预测。

04:00
arXiv cs.LG

离线环境光控制潜扩散:架构、遥测与设备端评估

端侧潜扩散应用由环境光驱动,本地生成并审计,输出与传感器、路径、种子绑定,验证依赖及性能。

04:00
arXiv cs.LG

硬件在环相位感知CNN用于实时5G信道估计

基于硬件在环与相位感知CNN,实时估计5G上行信道,应对实际损伤,优于LS/LMMSE。

04:00
arXiv cs.LG

PandasCorpus:真实世界Pandas工作流与使用模式的资源

提出PandasCorpus含13.9万笔记本400万API调用分析真实工作流演化并开源

04:00
arXiv cs.LG

一种低成本环境监测与嵌入式太阳预测物联网设备,支持设备端增量学习

低成本物联网设备集成传感器,设备端神经网络预测光伏电压,115天部署R²=0.9165,离线训练增量更新有效。

04:00
arXiv cs.LG

音符-和弦-声部框架:电动汽车充电数据的结构化源分离与因果推断

提出音符-和弦-声部框架,将清洗、模式发现、源分离与因果推断分层,经检验识别稳定价格敏感声部,支持反事实补贴优化。

04:00
arXiv cs.LG

你的注意力指标回答的是哪个问题?——将注意力行视为成分数据

注意力行度量是否保留汇点词元可颠倒结论;成分数据法分离汇点与内容,证明熵坍缩主要是汇点增大而非锐化。

04:00
arXiv cs.LG

跨模态超声-MRI学习用于胎儿脑室容积测量与异常筛查

提出VIFBA框架,仅用超声视频预测MRI脑室容积、分类脑室增大并筛查异常

04:00
arXiv cs.LG

仅靠提示不够:监督基线与泄漏控制在儿科医患沟通中用LLM测量共享决策

零样本提示检测共享决策不可靠;监督模型更优,且需防范数据泄漏,分组不足以保证。

04:00
arXiv cs.LG

分岔与速率诱导临界转变的Koopman早期预警信号

基于库普曼算子的统一早期预警,结合残差模态分解与深度学习,可检测分岔和速率诱导临界转变。

04:00
arXiv cs.LG

无需无偏性的CFR:持久公共机会调度的确定性保证

文章针对持久公共机会调度,建立确定性目标转移定理,无需无偏性,界定完整切点可利用性,保证遗憾匹配收敛。

04:00
arXiv cs.LG

ARISE:用于小样本生物医学组学特征选择的自适应残差信息稳定性集成

ARISE集成多信号与自适应加权,在小样本分子分类中实现稳定非冗余特征选择,全面领先现有方法。

04:00
arXiv cs.LG

混合来源大语言模型文本中的最优水印定位

提出自适应阈值法,在混合来源文本中实现最优水印发现边界,无需先验指数或分布知识。

04:00
arXiv cs.LG

STAR-FL:基于时空分析与鲁棒聚合的安全联邦学习

针对联邦学习中毒攻击,提出时空分析与鲁棒聚合框架,聚类剔除恶意更新,调整学习率抑制毒化,有效降低攻击成功率。

04:00
arXiv cs.LG

工作区拓扑作为智能编码助手的一种攻击向量

研究揭示工作区拓扑影响提示注入成功率,高模块化可显著降低攻击,上下文框架与安全提示亦有作用,测试环境需无污染。

04:00
arXiv cs.LG

机器学习交换关联改进何时能继承到密度泛函紧束缚中?

机器学习交换关联改进不能直接继承到DFTB,传递比率可预测反传递,修正在位项可移除大部分带隙误差。

04:00
arXiv cs.LG

高质量层级的本质:音乐基础模型逐层内在属性评估

系统分析12个音乐基础模型逐层表征,发现内在指标可预测多数任务性能,但在调性任务上失效,需新增移调等变性指标。

04:00
arXiv cs.LG

基于O-RAN的下一代网络的可解释性增强异常检测框架

提出可解释AI异常检测框架,用于O-RAN下一代网络,高精度且数据集复杂度降低80%,并识别攻击特征。

04:00
arXiv cs.LG

大象发声分类的无参数少样本评估

无参数最近质心分类用于大象叫声少样本评估,在低资源数据上少量示例即超训练基线,大数据集上仍不及。

04:00
arXiv cs.LG

小语言模型中的可解释跨语言对齐:探针日英双语LLM中的文化与语用推理

构建J-PragEval-v0探针日英小模型:敬语在残差流,隐主语/内群体在生成中处理,间接拒绝受长度干扰;提出推理期干预方法。

04:00
arXiv cs.LG

BRAID:利用权重共享迭代图神经网络学习相互依存安全博弈中的均衡映射

提出BRAID,用权重共享迭代GNN学习相互依存安全博弈的均衡映射,单次前向快43倍,恢复敏感性。

04:00
arXiv cs.LG

主动式道路安全干预:基于联网车辆数据预测澳大利亚危险驾驶热点

利用悉尼联网车辆数据预测高风险驾驶区域,ARIMA模型误差最低,可与深度学习媲美,助力主动安全干预。

04:00
arXiv cs.LG

MultiSigBERT:多模态与序列建模在肿瘤生存分析中的新突破

提出MultiSigBERT,融合文本与结构化数据的时序轨迹,利用路径签名建模,在肿瘤队列中C指数达0.743,超越单一模态方法。

04:00
arXiv cs.LG

Mr.Dec:用于30天再入院预测的日尺度纵向多模态建模

提出Mr.Dec,按日多模态序列预测30天再入院,用Transformer解码器整合EHR与CXR,辅以疾病对比学习,达最优性能并识别关键日。

04:00
arXiv cs.LG

混合PDE参数学习中算子误设的检测与判别:一种无参考工具,样本内判别有界

提出无参考工具,从单次拟合区分算子误设与参数不可辨识;统计量在正确设定下中位数0.19,误设时拒斥率100%。

04:00
arXiv cs.LG

文档敏感性分类中经典模型与Transformer模型的基准评测

构建泄漏受控的Strategic 16K语料,评测六种模型;BERT最优(准确率89.14%),TF-IDF+逻辑回归在经典模型中性价比最高。

04:00
arXiv cs.LG

DOW-KE:通过直接端到端权重优化的无锚点多层知识编辑

提出DOW-KE无锚点方法,端到端联合优化多层权重更新,消除锚点传播偏差,编辑与保留效果最优。

04:00
arXiv cs.LG

SW-ProxyCE:从公共脑电编码器到私有下游模型的零查询对抗迁移

脑电基础模型公开编码器带来安全风险:攻击者无需查询即可用少量标记数据生成可迁移对抗样本,攻击私有下游模型。

04:00
arXiv cs.LG

EdNet日志中的学习策略聚类反映参与度而非掌握程度

对EdNet-KT3日志聚类,学习策略可预测后续参与度而非未辅助正确率;掌握信号与行为风格几乎无关。

04:00
arXiv cs.LG

Data-DPO:面向目标模型数据选择的大语言模型后训练直接偏好优化

提出Data-DPO目标模型数据选择法,通过一步探测将激活差异转为偏好,结合质量与多样性,超越全量训练。