11842 条条目 · 106 个活跃源
2026年7月21日
04:00
arXiv cs.LG

正则化还是局部化:训练时KV缓存几何结构在量化下的收益时机

直接对KV进行正则化可大幅降低缓存各向异性,在粗粒度量化下显著提升性能,但在精细量化下优势消失。

04:00
arXiv cs.LG

ChemFusion:用于反应产率预测的多模态交叉注意力网络

ChemFusion融合电子与3D信息,交叉注意力动态关注空间约束,精准预测产率,超越单模态并自主识别位阻。

04:00
arXiv cs.LG

Apeliotes:基于扩散模型的千米尺度多层大气场建模框架

Apeliotes基于扩散模型实现千米级多层大气场高分辨率预测,垂直风剖面误差低于3%。

04:00
arXiv cs.LG

鲁棒的阿萨姆语语音识别:通过Whisper模型受控微调实现

本文提出基于Whisper微调的阿萨姆语ASR系统,在低资源环境下显著降低错误率并提升语义评分与实时性。

04:00
arXiv cs.LG

面向大语言模型后训练的蒸馏强化学习

提出蒸馏强化学习,整合教师监督于RL目标,细粒度指导知识迁移,实验优于标准RL和在线策略蒸馏。

04:00
arXiv cs.LG

理性化玻尔兹曼理性:熵正则化策略的公理刻画

区分机遇与选择,公理推导出熵正则化策略及软贝尔曼方程,方程选择取决于是否重视自主选择权。

04:00
arXiv cs.LG

DADIR:一种密度感知的数据级不平衡回归框架

提出DADIR框架,通过密度感知划分、正则化变分自编码器和潜在空间平衡,有效生成合成样本,提升稀疏区域预测性能。

04:00
arXiv cs.LG

用人类策略解释与调优基于Transformer的大语言模型在算术任务中的表现

发现LLM算术学习模式与人类相似,通过子任务分解和认知赋能策略显著提升准确率,验证了认知过程相似性,增强模型信任。

04:00
arXiv cs.LG

DynImmune-BERT:基于神经ODE驱动的连续变换器的动态免疫库建模

提出连续时间免疫库模型DynImmune-BERT,通过神经ODE动态和事件感知机制提升纵向TCR库预测性能。

04:00
arXiv cs.LG

Node4All:超越数据集的节点表示学习

Node4All是无需数据集优化的节点表示学习器,在25个基准上排名第五,支持一次性学习和上下文学习。

04:00
arXiv cs.LG

一种优化分离超平面的迭代几何方法

提出迭代几何法,从初始超平面逐步优化至最大间隔,利用局部信息求解子问题,适用于大数据集。

04:00
arXiv cs.LG

神经网络验证的瞻前分支策略

前瞻分支策略在神经网络验证中持续加速,最多解决57%更多实例,并能生成附加引理。

04:00
arXiv cs.LG

AIGB-R1:基于分层规划器-执行器优化的自演化生成式自动出价

AIGB-R1利用LLM推理与经验驱动,通过分层规划-执行架构和D-GRPO端到端优化,实现自演化自动出价,显著提升效果。

04:00
arXiv cs.LG

切比雪夫流形适配

提出切比雪夫流形适配(ChebyMA)方法,以多项式基底叠加替代线性投影,理论保证逼近性,实验取得更优参数-精度平衡。

04:00
arXiv cs.LG

CORAL: 利用协同结合奖励学习淀粉样纤维配体对接

提出强化学习框架CORAL,通过协同堆叠奖励实现淀粉样纤维配体对接,无需实验结构,性能优于现有方法。

04:00
arXiv cs.LG

保留解码器的稀疏自编码器:哪些线性读出在稀疏压缩中幸存?

稀疏自编码器训练保留解码器,发现重构质量不决定线性读出幸存,读出任保留不同于学习基准概念或冻结行为。

04:00
arXiv cs.LG

TAPAS:面向自主系统的吞吐自适应感知

提出吞吐自适应感知策略TAPAS,利用强化学习动态分配资源,实现高吞吐满足率并节能超64%。

04:00
arXiv cs.LG

重新思考强化学习算法在实际迁移约束下的适用性

实用因素(训练时间、鲁棒性)比样本效率更重要;PPO在时钟时间上更快,领域随机化对多种算法影响相似。

04:00
arXiv cs.LG

当漂移检测器喊“狼来了”:连续机器学习监控中的误报率

研究连续监控下常见漂移检测器的误报行为,发现PSI在小样本时误报频繁,KS、MMD等更稳定,但校正误报会降低灵敏度。

04:00
arXiv cs.LG

非靶向LC-MS代谢组学可重复特征选择的多宇宙共识流程

组合多种预处理与排序方法,仅保留跨路径重复特征,实现可重复选择,验证无假阳性。

04:00
arXiv cs.LG

核化线性注意力:用对称锥突破容量墙

提出KATA框架,通过自对偶锥实现非负注意力,大幅提升线性注意力的关联记忆容量与效率。

04:00
arXiv cs.LG

基于数据验证的化学与材料推理:检测是瓶颈

化学推理验证中检测是瓶颈,门控修正错误率从22%降至4%,修复成功率80-97%。

04:00
arXiv cs.LG

CoEvoP&R: 基于大语言模型的放置目标与布线反馈协同进化

新框架利用大语言模型自动演化放置目标,显著降低布线后线长与拥塞,改善时序。

2026年7月20日
04:00
arXiv cs.LG

正则性感知的自适应避冲突方向控制的随机MGDA

提出MoRe方法,利用Lipschitz连续性改进收敛率,从O(T^{-1/4})提升至O(T^{-1/2}),并保证避冲突。

04:00
arXiv cs.LG

循环-二进卷积误差的结构

替代误差具结构性和可预测性:两位置无误差,算子近满秩,期望误差由对齐标量决定,输出能量加倍。

04:00
arXiv cs.LG

观点:量子程序生成必须优先考虑有效性而非概率扩展

主张量子程序生成应优先确保有效性,通过验证感知架构克服语法-语义差距和指数衰减问题。

04:00
arXiv cs.LG

可迁移的基于阈值的医学数据可解释分类框架

基于统计二值化的可解释分类框架,在三个医学数据集上取得高AUC和校准概率,提供显式临床决策规则。

04:00
arXiv cs.LG

qZACH-ViT:基于递归归因稳定优化的量化感知内在解释

提出qZACH-ViT和RASO,提升医学图像分类精度,模型缩小70%,速度提升达2.4倍,解释稳定性显著改善。

04:00
arXiv cs.LG

AI交易:评估大语言模型在技术市场分析中的表现

评估五种大语言模型的技术分析能力,GPT-4 Turbo表现最佳,但存在数值幻觉等缺陷,需谨慎部署。

04:00
arXiv cs.LG

从超平面到超椭球:线性和单量子比特混合态二分类模型的内在可解释性特征

单量子比特混合态模型是线性模型的椭球版,两者归纳偏差不同,为零量子背景者提供了量子ML入门路径。

04:00
arXiv cs.LG

LLM4EHR:通过大语言模型对齐临床时间序列与医疗事件序列

LLM4EHR通过对比学习对齐时间序列与事件序列,提升下游任务性能并实现跨队列迁移。

04:00
arXiv cs.LG

Who Became Financially Vulnerable After COVID-19? A Population-Level Machine Learning Analysis Using MEPS Data

04:00
arXiv cs.LG

随机重置寻径:图路径上级联赌博机的路径级遗憾

提出随机重置寻径问题及PathUCB和PathTS算法,获得路径级遗憾界,实验PathTS最优但存在对抗实例

04:00
arXiv cs.LG

相关与无关:Transformer注意力机制的重整化群分析

注意力相关性由数据谱结构决定:长相关时驱动相变,短相关时无关,重整化群提供预测。

04:00
arXiv cs.LG

递归式工具自我改进

RHI通过迭代优化工具提示,提升低推理模型性能并降低60%推理成本,核心在于改进上下文管理,实现持续学习。

04:00
arXiv cs.LG

修复洞见:利用逼真扰动提升视觉可解释人工智能

用生成式修复生成逼真扰动,改进LIME方法,提升图像可解释性质量。

04:00
arXiv cs.LG

循环潜在注意力:用于循环Transformer的跨循环KV压缩

循环Transformer每步KV缓存跨循环低秩,LLA压缩后实现21.3倍压缩,提升批容量和数学推理性能。

04:00
arXiv cs.LG

ADS-C:面向分类的反蒸馏采样

ADS-C以零精度代价实现反蒸馏,保持教师准确率不变,使学生模型精度大幅下降,并消除软标签蒸馏激励。

04:00
arXiv cs.LG

鲁棒峰值代价约束强化学习

提出鲁棒峰值代价约束RL,解决轨迹中单次大违规问题,开发代理优化框架,保证约束违规在ε内。

04:00
arXiv cs.LG

基于多导睡眠图EEG信号的睡眠呼吸暂停分类深度学习方法

对比多种深度学习模型与特征,利用儿童多导EEG检测睡眠呼吸暂停,Vision Transformer结合TDA特征最佳AUC达0.750。

04:00
arXiv cs.LG

扩散模型在评分函数不敏感时仍能恢复准确混合权重

扩散模型通过中间噪声的评分信息恢复混合权重,定义敏感度指数,证明权重估计误差与损失同阶。

04:00
arXiv cs.LG

基于多专家共识机制的无服务器环境自动伸缩方法

提出依赖感知自动伸缩框架,集成多专家共识与成本感知,预测精度99.88%,显著降低成本。

04:00
arXiv cs.LG

缓存感知的提示压缩:面向LLM API缓存的双层成本模型

提出CAPC,结合查询无关压缩与缓存控制,在多项任务中降低49%-90%成本且保持质量。

04:00
arXiv cs.LG

面向小语言模型的Kolmogorov--Arnold网络

小基函数KAN提供可审计标量变换接口,但在基准测试中无明显优势。

04:00
arXiv cs.LG

用于修正玻尔兹曼采样的神经非平衡哈密顿蒙特卡洛

提出神经非平衡哈密顿蒙特卡洛,训练后通过非平衡功修正玻尔兹曼采样,控制路径空间KL散度,实现校正估计。

04:00
arXiv cs.LG

从可行到合意:面向个性化设备端行程生成的规划-学习-适应(PLA)框架

PLA框架通过规划、学习、适应三阶段,在设备端生成个性化行程,实现100%可行性,67.8%胜率,完成率提升91%。

04:00
arXiv cs.LG

重新思考持续学习中的迁移:一种基于回放的实现

提出前向迁移的三个条件并实现TSR,通过选择性回放提升迁移效果,稳定性与性能兼得。

04:00
arXiv cs.LG

统计算法的公开可验证证书

提出统计有效性公开可验证证书(pvCSV),使学习算法结果可被公开验证,针对自适应SQ算法构建了低样本复杂度证书。

04:00
arXiv cs.LG

因果老虎机中的信息导向采样

研究不可操作变量的因果老虎机,提出因果变体的汤普森采样和IDS,实现次线性遗憾界。

04:00
arXiv cs.LG

Do Generative Models Keep Time? A Time-Aware Evaluation of Synthetic Sequential Tabular Data