11582 条条目 · 106 个活跃源
2026年8月19日
04:00
arXiv cs.LG

BRAID:利用权重共享迭代图神经网络学习相互依存安全博弈中的均衡映射

提出BRAID,用权重共享迭代GNN学习相互依存安全博弈的均衡映射,单次前向快43倍,恢复敏感性。

04:00
arXiv cs.LG

主动式道路安全干预:基于联网车辆数据预测澳大利亚危险驾驶热点

利用悉尼联网车辆数据预测高风险驾驶区域,ARIMA模型误差最低,可与深度学习媲美,助力主动安全干预。

04:00
arXiv cs.LG

MultiSigBERT:多模态与序列建模在肿瘤生存分析中的新突破

提出MultiSigBERT,融合文本与结构化数据的时序轨迹,利用路径签名建模,在肿瘤队列中C指数达0.743,超越单一模态方法。

04:00
arXiv cs.LG

Mr.Dec:用于30天再入院预测的日尺度纵向多模态建模

提出Mr.Dec,按日多模态序列预测30天再入院,用Transformer解码器整合EHR与CXR,辅以疾病对比学习,达最优性能并识别关键日。

04:00
arXiv cs.LG

混合PDE参数学习中算子误设的检测与判别:一种无参考工具,样本内判别有界

提出无参考工具,从单次拟合区分算子误设与参数不可辨识;统计量在正确设定下中位数0.19,误设时拒斥率100%。

04:00
arXiv cs.LG

文档敏感性分类中经典模型与Transformer模型的基准评测

构建泄漏受控的Strategic 16K语料,评测六种模型;BERT最优(准确率89.14%),TF-IDF+逻辑回归在经典模型中性价比最高。

04:00
arXiv cs.LG

DOW-KE:通过直接端到端权重优化的无锚点多层知识编辑

提出DOW-KE无锚点方法,端到端联合优化多层权重更新,消除锚点传播偏差,编辑与保留效果最优。

04:00
arXiv cs.LG

SW-ProxyCE:从公共脑电编码器到私有下游模型的零查询对抗迁移

脑电基础模型公开编码器带来安全风险:攻击者无需查询即可用少量标记数据生成可迁移对抗样本,攻击私有下游模型。

04:00
arXiv cs.LG

EdNet日志中的学习策略聚类反映参与度而非掌握程度

对EdNet-KT3日志聚类,学习策略可预测后续参与度而非未辅助正确率;掌握信号与行为风格几乎无关。

04:00
arXiv cs.LG

Data-DPO:面向目标模型数据选择的大语言模型后训练直接偏好优化

提出Data-DPO目标模型数据选择法,通过一步探测将激活差异转为偏好,结合质量与多样性,超越全量训练。

04:00
arXiv cs.LG

RoBell-RVFL:一种鲁棒的广义贝尔随机向量功能链接网络

提出RoBell-RVFL,样本级加权抑制噪声、保留少数类,优于现有变体。

2026年8月18日
04:00
arXiv cs.LG

DumpsterCluster:从垃圾堆翻捡到用60美元GPU运行LLaMA-70B

二手GPU可组集群服务大模型,成本仅为新系统1/27,但能耗高,仅适合电价低且清洁地区。

04:00
arXiv cs.LG

分数阶优化器遇见分形激活函数:神经网络中多尺度优化的实证研究

分数阶优化与分形激活呈选择性匹配,正则化型分数缩放效果佳,自适应记忆有潜力但非通用替代。

04:00
arXiv cs.LG

用于城市系统的粗到细多分辨率扩散轨迹生成模型

提出MR-Traj多分辨率扩散框架,生成多样化轨迹,在保持全局分布相似性的同时更好建模细粒度移动模式,降低轨迹泄露风险。

04:00
arXiv cs.LG

前向传播域适应(无跨层反向传播)

前向传播微调(FPO)无需反向传播,吞吐提升2.7-3.2倍、内存降40%,域内困惑度改善且基准性能不变。

04:00
arXiv cs.LG

面向物理场的余链框架等变离散黎曼度量学习

RHMP分离拓扑与几何,学习余链度量,实现框架等变与精确复形,七项物理基准最优。

04:00
arXiv cs.LG

PIKFNO:基于物理信息核函数的可解释神经算子

提出物理信息核函数神经算子,将控制方程嵌入核函数,提升可解释性与泛化,少数据下仍高精度。

04:00
arXiv cs.LG

几何不等于鲁棒性:PGD评估的轨迹层面研究

轨迹指标不能独立衡量对抗鲁棒性,步数至失效分布区分度优于损失轨迹;应作为补充诊断而非替代。

04:00
arXiv cs.LG

校准信任,而非更精准预测:不确定性融合的实证检验

法律AI中不确定性融合不提升预测精度,反增校准误差;其真正价值是校准信任,而非更准预测。

04:00
arXiv cs.LG

解释强化学习在自适应系统中的决策

介绍EARL库,通过反事实解释(What-if场景)阐明强化学习智能体行为,支持现实自适应系统,已用于共享单车模拟验证。

04:00
arXiv cs.LG

元可塑性:增量学习的自适应梯度预条件

SynGAP用Fisher信息指数滑动平均模拟元可塑性,自适应梯度预条件,缓解灾难性遗忘,优于基线。

04:00
arXiv cs.LG

离散扩散语言模型是无需训练的多标签分类器

提出一种免训练方法,用离散掩码扩散模型对每个标签提问并比较答案概率,实现多标签分类,无需微调。

04:00
arXiv cs.LG

基于FlowBD-E1的铁铬液流电池早期循环充电轨迹生成预测与全生命周期健康管理

提出FlowBD-E1,基于早期循环生成预测铁铬液流电池全生命周期充放电轨迹,误差低于1%,实现健康管理。

04:00
arXiv cs.LG

随机初始化的自编码器:固定点与混沌边缘

通过固定点研究自编码器稳定性,提出局部与全局混沌边缘,用随机矩阵谱理论和高斯过程不等式分析。

04:00
arXiv cs.LG

基于每回合分布训练与评估道德强化学习智能体

均值指标掩盖道德违规集中爆发;ESR逐回合守约,优于拉格朗日,且不损平均性能。

04:00
arXiv cs.LG

DUET:基于同权重分歧的双教师在线策略蒸馏方法用于禁令合规

提出DUET,利用同权重双教师分歧提取禁令因果信号,通过标记级偏好学习,在保持正常能力的同时显著提升合规性。

04:00
arXiv cs.LG

面向文档抽取的有效逐字段选择性风险控制:三种失败模式、有效性阶梯与条件化何时值得

真实单据上诊断三种失效,提出有效性阶梯;条件化仅在无法合并验证时有用,提供分组PAC保证。

04:00
arXiv cs.LG

iFuzz-Meta:桥接自上而下与自下而上知识整合的可解释模糊学习框架

提出iFuzz-Meta,用可解释模糊规则保留人类推理,结合元学习与知识引导正则,实现跨域稳定泛化。

04:00
arXiv cs.LG

SMOPD:面向脏历史多轮在线策略自蒸馏的选择性词元熵掩码

提出SMOPD,用词元熵掩码去除低信息词元,稳定多轮在线自蒸馏,无参数开销,准确率提升1-2.5个百分点。

04:00
arXiv cs.LG

用于CO₂反演的基于神经网络的高效高分辨率辐射传输及其在干涉测量传感中的应用

提出MLP代理模型高效预测CO₂弱波段大气顶辐射,与NanoCarb干涉仪耦合,实现低成本卫星星座CO₂浓度反演。

04:00
arXiv cs.LG

BDIP-Net:用于双层材料性质预测的双交互图学习

提出BDIP-Net,以低成本生成DFT级双层结构,显式建模层内层间交互,预测性能优于现有方法。

04:00
arXiv cs.LG

不确定性信号有帮助吗?带回滚机制的不确定性感知解码系统研究

研究不确定性感知回滚解码,在7模型5基准上评估8种信号,显示回滚有效,信息论信号最优。

04:00
arXiv cs.LG

预测派生中到全量世界模型级联的配对精确重置评估

配对精确重置评估显示,预测派生级联路由降低含开销决策成本,但优势限于低计算价,非因果通用。

04:00
arXiv cs.LG

数据扩展推动高分辨率天气预报突破极限

提出变量超分框架,用粗分辨率再分析合成高分辨率数据,数据倍增使预报误差降约5%,突破数据瓶颈。

04:00
arXiv cs.LG

通过模态子空间激活诊断与缓解全模态大语言模型中的感知-决策错位

全模态大模型存在感知-决策错位,提出因果模态敏感度诊断与模态子空间激活方法,无需训练即可恢复多模态一致性。

04:00
arXiv cs.LG

FedImp:基于不纯度加权的联邦学习收敛增强

提出FedImp算法,基于数据不纯度量化设备贡献,加速非IID联邦学习收敛,显著减少通信轮次。

04:00
arXiv cs.LG

基于自动微分的时间推移电阻率层析成像水文动力学反演框架

提出AD-TLERT框架,基于自动微分,GPU加速,实现时间推移ERT反演,比pyGIMLi快51倍,支持直接水含量反演。

04:00
arXiv cs.LG

P2E-VQ:通过离散补丁检索实现与ECG关联的PPG表示增强

P2E-VQ通过离散补丁检索实现与ECG关联的PPG表示增强,推断仅需PPG,多项下游任务优于基线。

04:00
arXiv cs.LG

LUNG-KGMM:知识引导的多模态肺癌发病预测

提出知识引导的多模态框架LUNG-KGMM,融合多源数据预测肺癌1-6年风险,处理数据泄露与随访缺失,性能优于现有方法。

04:00
arXiv cs.LG

基于环形的空间变换器:学习建筑分布与行人流量间的非线性空间交互

环形空间变换器优于GWR,揭示中远距离区域主导行人流量预测,注意力机制显示跨区交互而非邻近开发是关键,质疑紧凑城市假设。

04:00
arXiv cs.LG

pico-type:一种150万参数的字节级多头内容分类器

150万参数字节级多任务分类器,免分词,单次前向预测七项内容属性。

04:00
arXiv cs.LG

Pre-LN Transformer中部分残差消融的可重复性研究

研究表明:去除注意力残差导致性能崩溃,而去除前馈残差在10M规模可恢复,124M规模不确定。

04:00
arXiv cs.LG

个人化处理:通用自监督表示在真实PPG情绪检测中的局限

SSL通用表示在客观任务有效,但主观情绪检测难超朴素基线;个人数据微调比群体预训练更关键。

04:00
arXiv cs.LG

量化残差神经网络的深度充分性:一阶判据

提出一阶残差深度饱和判据:激活梯度投影非零则增深有效,零则饱和;梯度范数可作为深度充分性保守诊断。

04:00
arXiv cs.LG

最佳采样温度何时随预算上升?Pass@k 的充分条件

若条件对数成功响应随当前成功率非增,则聚合 pass@k 的温度导数随 k 非降,故最优温度随采样预算上升。

04:00
arXiv cs.LG

ARGUS:基于注意力引导Transformer的Wi-Fi遥测可扩展人员识别

Argus用CSI统计特征和轻量Transformer被动识别人员,154人测试Top-1达84.85%,算力大幅降低。

04:00
arXiv cs.LG

基于同策略自蒸馏缓解LLM评判者的评分标准干扰

提出SARA法,以单准则判断为锚,自蒸馏对齐多准则推理,提升评判一致性并跨数据集迁移。

04:00
arXiv cs.LG

重新思考反向KL作为自适应熵蒸馏

重新审视反向KL蒸馏,分解为教师拟合与学生熵项,提出自适应熵蒸馏(AED),用教师熵动态调节模仿强度,性能更优。

04:00
arXiv cs.LG

面向行动受限老年人的环境感知步行适宜性评估:上下文学习应用

用TabPFN上下文学习分析建成环境对老年人步行感知的影响,优于传统模型,并揭示高阶交互作用。

04:00
arXiv cs.LG

RouteTS:面向时间序列预测的频率-时间路由

RouteTS按频谱特征路由:主频频域复值预测保周期,残差时域轻量MLP建模局部变化,兼顾精度与效率。