11392 条条目 · 106 个活跃源
2026年9月16日
04:00
arXiv cs.LG

使用机器学习预测社交媒体参与度

研究提取Facebook家具企业图片帖的视觉、文本和时间特征,用随机森林等机器学习模型预测社交媒体参与度。

04:00
arXiv cs.LG

三维周期纳维–斯托克斯流非线性族全局正则性的计算机辅助证明

提出计算机辅助框架,为三维周期纳维–斯托克斯流连续族建立全局正则性,并给出应用与神经算子评估。

04:00
arXiv cs.LG

数字说服:理解网络意见领袖对公众舆论的影响

提出FJ框架识别影响者,推特选举数据表明其显著改变社区舆论并影响间接邻居。

04:00
arXiv cs.LG

面向25场加利福尼亚野火的深度学习活跃火分割Sentinel-2基准数据集

含25场加州野火2148对Sentinel-2影像-掩膜,标注活跃火等类别,附划分与代码,支持稀有类分割研究。

04:00
arXiv cs.LG

INT8 可移植吗?嵌入式与车载加速器上量化推理的跨平台测量研究

跨七类硬件测量表明,INT8并非随处可移植:加速依赖CPU点积ISA,输出跨平台不一致,厂商NPU量化路径互不兼容。

04:00
arXiv cs.LG

大语言模型中基于置换的隐写恶意软件:威胁与对策

研究大语言模型中基于置换的隐写恶意软件攻防:可中和全部参数,也能无损植入,性能损失极小。

04:00
arXiv cs.LG

利用数据同化和机器学习改进降阶旋转爆震发动机模型

用数据同化同步降阶旋转爆震模型并记录残差,再以机器学习训练闭包,实现有界自主预测与统计恢复。

04:00
arXiv cs.LG

GPEvac:基于GNN的PPO用于枪击事件中的自适应疏散路径规划

GPEvac:用GNN-PPO为枪击事件跨布局实时规划疏散路径,降低威胁暴露,14.73ms完成。

04:00
arXiv cs.LG

岭梯度下降中计算最优的预训练—微调

固定总算力下,用岭梯度下降研究预训练-微调的最优算力分配,结果取决于预测相关的预训练与微调协方差谱。

04:00
arXiv cs.LG

AI赋能科学前沿

AI非通用替代,较传统统计常优但成本高,约四分之一更贵更差;较科学计算常弱但成本低,2020年后反超过半。

04:00
arXiv cs.LG

全国一致,地方不完整:屋顶光伏登记册的贝叶斯遥感审计

提出贝叶斯遥感框架校正法国屋顶光伏统计,全国误差3.3%,发现地方低报达61%。

04:00
arXiv cs.LG

EBL:面向分布式自适应谐波分析的高效宽度学习

EBL框架用FPGA量化加速谐波估计,半周期高精度低延迟,预测快17.4倍,在线迁移适应充放电节点。

04:00
arXiv cs.LG

语义感知神经视频编解码器:面向抗误码低延迟传输

提出语义感知多级神经视频编码,按语义重要性分包并独立解码,在丢包信道下实现抗误码低延迟传输。

04:00
arXiv cs.LG

面向数字孪生的主动脉流固耦合代理模型:跨解剖迁移与稀疏插值的对比

四例主动脉流固耦合代理研究显示:跨解剖零样本迁移效果差,稀疏场插值更强,跨解剖先验未见增益。

04:00
arXiv cs.LG

迈向基于代理模型的量子强化学习去量子化

研究基于核化拟合Q迭代的量子Q学习去量子化,在均匀生成模型下给出有限样本保证与充分条件。

04:00
arXiv cs.LG

FairLint-DL:面向深度学习软件公平性调试的IDE原生工具

FairLint-DL是一款VSCode扩展,可在训练前于IDE内直接检测表格数据偏见,并定位至具体网络层与神经元。

04:00
arXiv cs.LG

重复和谐博弈中贝尔曼最优方程的对称解

重复和谐博弈贝尔曼最优方程的对称解有三类:全合作、赢留输变及一非平凡策略,并用强化学习检验所学策略。

04:00
arXiv cs.LG

打破三值大语言模型的 1.58 比特壁垒

三值LLM权重零占比最高51.5%,提出BITCOS位图+符号向量压缩,最稀疏仅1.485比特/权重,推理吞吐最高提升1.27倍。

2026年9月15日
04:00
arXiv cs.LG

SPICE:基于聚类的简单多义特征解释

提出SPICE框架,无需预设簇数,可跨CNN与Transformer系统分析多义性的产生、深度差异及计算路径。

04:00
arXiv cs.LG

物理信息神经网络中的导数保真度失效模式:来自函数值训练的强化基准证据

PINNs仅拟合函数值即可看似准确,但自动微分所得二阶导数误差显著偏大,高曲率边界尤甚;值精度≠物理残差可靠。

04:00
arXiv cs.LG

大地艺术作为大数据气候传感器

1744幅卫星影像显示,螺旋防波堤图像复杂度可提前三年预示大盐湖水位,成为水文状态先行指标。

04:00
arXiv cs.LG

基于CDM交会分析框架的混合TCN-Transformer模型实现卫星碰撞概率早期预测

提出混合TCN-Transformer模型,利用CDM序列数据提前预测卫星碰撞概率,实现LEO交会风险早期评估。

04:00
arXiv cs.LG

大语言模型还是朴素贝叶斯?旧宝还是新路

LLM仅零样本略优且易污染;有标注时朴素贝叶斯精度比肩大模型,CPU能效吞吐高数十倍。

04:00
arXiv cs.LG

评估大语言模型生成规则在心脏病预测中的表现

比较传统机器学习与LLM生成规则用于心脏病预测,传统模型性能更优,规则模型可解释性更强。

04:00
arXiv cs.LG

BudgetBench:用于本地大语言模型智能体记忆策略评估的预算分档协议与试点评测框架

BudgetBench:单次调用token预算为自变量,评估本地大模型智能体记忆策略,暴露预算违规与非单调质量,预算对比全上下文未定。

04:00
arXiv cs.LG

面向大型音频语言模型的语音问答机器遗忘

研究大型音频语言模型语音问答的机器遗忘,采用梯度上升、任务算术与对齐微调,隐私泄露率最高降80%。

04:00
arXiv cs.LG

利用规范多项式不变量诊断强化学习模拟器与世界模型中的故障

提出规范多项式不变量诊断法,可定位强化学习模拟器与世界模型故障并归因参数,精确不变量预测增益有限。

04:00
arXiv cs.LG

学习中的算法信息动力学:面向Grokking的经认证可微复杂度控制器

可认证可微复杂度控制器将瞬态损失扰动变为控制,加速顿悟;复杂度门以少27%干预救活失败种子

04:00
arXiv cs.LG

GradRepair-ODE:面向神经常微分方程训练的可认证梯度修复

提出GradRepair-ODE框架,在优化器步中检验、修复或拒绝不可靠的ODE梯度,避免不安全更新。

04:00
arXiv cs.LG

自适应互惠知识蒸馏:发现并保留类别相关性知识

提出自适应互惠知识蒸馏,通过匹配师生类别相关矩阵重塑教师预测,缓解暗知识崩塌,在CIFAR-100和ImageNet上最高提升7.13%。

04:00
arXiv cs.LG

具有 O(d) 遗憾的高效在线逆优化

提出遗憾O(d)、每轮O(d²)时间的在线逆线性优化确定性算法,首次实现高效且proper的界,并给出鲁棒与秩自适应变体。

04:00
arXiv cs.LG

面向基于MoE大语言模型的任务感知联邦微调

提出FedTAR,用SVD提取路由任务坐标,分簇聚合,缓解异构冲突、保持专家专精,四项基准最优。

04:00
arXiv cs.LG

规范神谕

语言模型可作规范神谕:改权重比外部笔记更善用结构,7B准确率高18.5个百分点,但存储开销更大。

04:00
arXiv cs.LG

ReCAST:面向在线扩散强化学习的跨时间步奖励信用分配

ReCAST按去噪时间步为各奖励分配信用,解耦用户偏好与奖励信息量,提升多奖励扩散模型训练与泛化。

04:00
arXiv cs.LG

表格基础模型还需要特征工程吗?

特征工程收益集中在早期模型,最强表格基础模型几乎无收益;但相关数据集的上下文信息仍有帮助。

04:00
arXiv cs.LG

带异常随机数据集的相异分解与欠采样中的临界性

AI生成数据视为异常,研究随机数据集强相异分解与欠采样,揭示分解尺寸相变及欠采样尺寸临界性。

04:00
arXiv cs.LG

面向布尔任务、具有真值表泛化保证的可认证可解释 ReLU-MLP 训练

提出 MACCHIATO,联合构建可解释 ReLU-MLP 与布尔电路证书,给出真值表泛化保证。

04:00
arXiv cs.LG

基于监督嵌入的症状网络可扩展部分信息分解

提出可扩展ePID,用监督嵌入压缩症状,区分冗余与协同信息;在PHQ-9与IRI上得到相反网络特征。

04:00
arXiv cs.LG

利用CRRT机器压力波形对危重AKI患者进行滚动式逐日死亡预测

融合CRRT机器压力波形与EHR,滚动逐日预测危重AKI患者死亡,AUROC达0.766,首次将废弃床旁数据流变为连续风险信号。

04:00
arXiv cs.LG

在面向LLM的强化学习中,通过永不放弃学会解决难题

RL对LLM提升不均,难题受益小;提出NGU自适应采样,持续生成至正确,重分配算力,提升难题与编码表现。

04:00
arXiv cs.LG

基于openEO的对地观测数据立方体机器学习API

提出openEO三阶段ML规范,支持传统与深度学习模型,验证跨后端互操作,提升EO数据立方体ML可复现性。

04:00
arXiv cs.LG

论多任务学习在预测性流程监控中的潜力

首个全面实证研究:多任务学习可显著提升下一活动预测并缓解类别不平衡,低容量模型下任务平衡尤为关键。

04:00
arXiv cs.LG

面向样本高效神经接口的预训练

自监督预训练MAPA融合解剖与相对位置编码,跨受试iEEG解码仅164试次即达未预训练3500试次精度。

04:00
arXiv cs.LG

同一谱,两种资源:自回归预测中的数据—记忆扩展规律

数据与记忆两种资源同受一预测能量谱支配;提出极小极大定律,数据定分辨率、记忆定水平,实验验证。

04:00
arXiv cs.LG

分布偏移与对抗规避下LLM与经典机器学习用于网络入侵检测的三轴压力测试

同数据集持平;跨域迁移XGBoost占优,对抗规避RoBERTa-LoRA占优,选型取决于评测轴。

04:00
arXiv cs.LG

GeoTTER:利用最优传输的局部几何结构实现零样本分类

GeoTTER以图拉普拉斯平滑融入局部几何结构,并以聚类引导代价校正角度漂移,零样本分类中位提升6.82%。

04:00
arXiv cs.LG

面向通信高效的联邦LoRA微调的自适应阶段切换

反向自适应阶段切换,联邦LoRA微调省40.5%通信,损失仅增0.0063,优于FFA-LoRA。

04:00
arXiv cs.LG

光谱学中的运行范围界定:一种机器学习模型的安全笼框架

提出安全笼并行监控,融合不确定性、域外检测等指标约束运行域;拒识20%数据降误差45%–65%。

04:00
arXiv cs.LG

AttnFuse:一种将注意力编译为融合GPU内核的可组合DSL

AttnFuse:把RoPE等乘法前变换列为一等操作的注意力DSL,编译为单一融合GPU内核。

04:00
arXiv cs.LG

分布偏移下的归纳图在线贝叶斯节点分类

提出在线变分贝叶斯末层法,改善分布偏移下归纳图节点分类泛化与校准,五基准准确率和NLL最优。