11432 条条目 · 106 个活跃源
2026年9月11日
04:00
arXiv cs.LG

Testing Between the Test Cases: Proving End-to-End Steering in Conditions You Never Drove

04:00
arXiv cs.LG

A variational physics-informed graph neural network for heterogeneous solid mechanics

04:00
arXiv cs.LG

Coherent Floquet quantum reservoirs for molecular property prediction

04:00
arXiv cs.LG

CryptoL: Towards Scale Dominance and Physics Constraints Mitigation in Financial Multivariate Time Series Forecasting

04:00
arXiv cs.LG

Diversity of EML-type operators

04:00
arXiv cs.LG

DriftNet: A Dual-Head Trajectory Transformer for Detecting and Localizing Prompt Injection in LLM Agents

04:00
arXiv cs.LG

ObstaDiff: Generalizable Diffusion Policy Learning via Obstacle-aware Representations

04:00
arXiv cs.LG

The Platonic brain bridge hypothesis: human brain networks as an architectural prior for omni models

04:00
arXiv cs.LG

Enabling Knowledge Graph Understanding at Scale with the EXplore Your Graphs ENgine (EXYGEN)

04:00
arXiv cs.LG

Improving the Sensitivity of Gravitational Wave Detection with Weighted Conformal Prediction

04:00
arXiv cs.LG

A Two-Mirror Faceted Projection System for EUV Lithography

04:00
arXiv cs.LG

Published Unlearning Numbers Move Per Checkpoint, and Not Because the Removed Data Survives: An Audit of 263 Released Batch-Normalized Checkpoints

04:00
arXiv cs.LG

Deep operator learning for efficient sampling from invariant measures of stochastic differential equations

04:00
arXiv cs.LG

Predicting Train Delays in Finland Using Machine Learning and Weather Data

04:00
arXiv cs.LG

Rethinking Radiomap Blind Prediction with Limited Environment and Configuration Representations

04:00
arXiv cs.LG

Bio-inspired Learning and Decision-Making with Probabilistic In-Memory Computing Hardware: Part 1

04:00
arXiv cs.LG

Risk-Averse Decision Making with Multi-Level Reliability Guarantees

04:00
arXiv cs.LG

A Hilbert-Valued Functional Decomposition Framework for Explaining Time-Dependent Outputs

2026年9月10日
04:00
arXiv cs.LG

拓扑间隙指数 d+η 的谱起源:机制、核、分解与适用范围

由谱积分导出拓扑间隙标度 d+η,分解体积与反常维数;机制限于 d=2,核平坦,Δ 与 I 的关联主要由磁化贡献。

04:00
arXiv cs.LG

基于可验证代码世界模型的世界时间计算

将领域动态写成代码,生成可验证世界模型,以精确轨迹微调大模型,提升未见世界泛化,弱模型收益最大。

04:00
arXiv cs.LG

基于张量分解的约束感知离散黑箱优化

提出张量分解代理模型,直接融入可行性约束,以T-范数可微罚项求解,提升离散黑箱优化样本效率。

04:00
arXiv cs.LG

将训练后三值化扩展到 Qwen3-8B:能力保持、复现、无损打包与打包执行

Qwen3-8B三值化保留78.5%能力,困惑度1.361倍,8.24GiB无损打包,直接执行15.52 tokens/s。

04:00
arXiv cs.LG

面向动态稀疏专家混合模型的分布一致性推理

动态MoE减少专家激活会增大输出尺度与方差,造成分布偏移;提出轻量逐层对齐校正LDA,可恢复性能且开销极小。

04:00
arXiv cs.LG

DiffLUT-Net:可学习连接性的FPGA LUT网络可微训练

从零训练六输入LUT的FPGA原生网络,可微学习真值表与连接,导出Verilog,精度资源权衡优良。

04:00
arXiv cs.LG

基于梯度引导高斯自适应采样的物理信息神经网络(3GAS-PINNs)

提出梯度引导高斯自适应采样物理信息神经网络,均匀与高斯混合布点,提升激波等非线性问题精度,最高14倍。

04:00
arXiv cs.LG

Literati:迈向基于AO*的随时最优形状广义树

首个最优形状广义树归纳算法,以AND/OR图联合优化树结构与形状函数,AO*求解,24个数据集精度领先。

04:00
arXiv cs.LG

分布偏移下基于传感器的AI的可问责且不确定性感知的评估:设备、受试者与近三年井下数据

提出分阶段可问责评估协议,留出设备、受试者和时间,在矿井验证;用5%分位数而非均值,防分布偏移误判。

04:00
arXiv cs.LG

从局部曲率与锐度感知最小化视角解释基于 f 散度的正则化

f散度正则与SAM局部一致且曲率敏感;α-skew JSD在α=1/2曲率最强,泛化最佳。

04:00
arXiv cs.LG

将基础模型嵌入应用于城市宜居性评估

利用基础模型嵌入识别关键地理指标,提出提升数据稀缺地区城市宜居性预测的系统框架。

04:00
arXiv cs.LG

解开SAC中Tanh雅可比的束缚:关于Bang-Bang控制与MetaDrive的负结果

补偿SAC中tanh雅可比损失无益:双积分器上原版SAC已近最优,旁路却致饱和、收益骤降。

04:00
arXiv cs.LG

张量列车弱SINDy:识别高维非线性动力学

提出TT-WSINDy,结合MANDy与WSINDy,用张量列车搜索高维非线性动力学候选函数,避免维数灾难。

04:00
arXiv cs.LG

XAI-Refine:面向脑龄预测的自动化解释-知识闭环

提出XAI-Refine,以自动解释-知识闭环将可靠事后解释转为文献验证的可微约束,迭代优化脑龄预测。

04:00
arXiv cs.LG

基于多幅冰情图的不确定性感知海冰类型制图

量化多冰图标注与模型不确定性;软监督提升关联,冰边缘相关性达0.704,MC dropout校准最优。

04:00
arXiv cs.LG

梯度下降、镜像下降与跟随正则化领导者的精确形式遗憾

精确形式几何统一刻画梯度下降、镜像下降与FTRL的无遗憾偏差类,精确则次线性遗憾,非零环流则线性遗憾

04:00
arXiv cs.LG

SCCM:面向自动漂移检测与适应的流式巡航控制方法

SCCM流式巡航控制框架用于在线回归漂移检测与适应,支持早期预警、动态阈值和超参调优,提升预测性能。

04:00
arXiv cs.LG

从固定键到可读模式:面向车载智能体函数调用的小语言模型

比较功能令牌与提示内模式,车载函数调用小模型能力取决于函数表示方式而非规模。

04:00
arXiv cs.LG

留一被试评估下高效无泄漏的神经网络架构搜索

提出无泄漏分块NAS,跨被试共享搜索,BioVid上准确率升至83.39%,参数减少99.2%。

04:00
arXiv cs.LG

自动构建执行框架:代码中的自我对弈为黑盒优化蒸馏出文本框架

智能体在代码中自博弈学习搜索策略,蒸馏为文本框架,显著降低黑盒优化遗憾并跨模型迁移。

04:00
arXiv cs.LG

一种估计机器学习模型样本量的统计方法

提出用局部线性表示近似非线性机器学习模型,并通过评估各局部区域统计功效来估计样本量。

04:00
arXiv cs.LG

机器遗忘攻击下基于神经形态时序嵌入与混合SNN-XGBoost的鲁棒工业信息物理分类

提出SNN-XGBoost混合架构,固定SNN特征、仅重训XGBoost,电力数据高精度且抗投毒。

04:00
arXiv cs.LG

通过因果抽象实现文本到图像扩散模型跨引导尺度的高效公平性审计

提出因果抽象审计工具,用概率变换器跨引导尺度高效预测公平性特征,并在Stable Diffusion 1.5与StayFair上验证。

04:00
arXiv cs.LG

ALIGN-HOLD:面向滴滴大规模网约车匹配实时保留控制的经验对齐

滴滴ALIGN-HOLD经验对齐框架训练奖励模型优化保留策略,A/B实验提升完单率与司机收入。

04:00
arXiv cs.LG

面向大型产品目录中跨产品族可扩展缺陷检测的位置任务条件化

通过子任务分解和位置任务条件化,检测F1从52%升至87%,蒸馏至小模型,成本降98%,已规模化部署。

04:00
arXiv cs.LG

PELM:基于投机解码与动态电压频率调节的功耗高效端侧大模型推理

PELM结合投机解码与可变验证深度,拓展DVFS优化空间,端侧大模型推理最高提速23.1%、降能耗52.4%。

04:00
arXiv cs.LG

教师几何结构塑造教师-学生网络的可学习性

教师几何影响学生网络可学习性:节点差异越大越易收敛;内部/越界极小值解释差异,调节学习率提升成功率。

04:00
arXiv cs.LG

联邦学习中受LT码启发的剥离式级联梯度反演

将梯度反演与纠删码关联,单轮精确恢复批次及标签,被动攻击亦大量泄露数据,表明联邦学习隐私风险被低估。

04:00
arXiv cs.LG

Muon-C:面向卷积核的算子对齐 Muon

Muon-C将卷积核动量表示为频域通道传输矩阵,分块极化并精确回投有限支撑;CIFAR-10流匹配FID 9.87,优于展开Muon与Adam,且更省算力并可迁移。

04:00
arXiv cs.LG

Settling:面向非凸有效集的均衡推断

Settling将均值提议精炼为局部稳定均衡,缓解条件均值塌缩,诊断中99/100成功且轨迹更平滑。

04:00
arXiv cs.LG

EFQ-Softmax:面向 Softmax 的无指数运算量化

提出无 exp 的 Softmax 低比特量化:将注意力分数直接映射为块缩放 E2M1 概率码,替代先指数再量化,兼顾质量并降低延迟。

04:00
arXiv cs.LG

基于小梯度跳过的在线逆整数线性优化:常数遗憾与有限错误

提出小梯度跳过,使在线逆整数线性优化错误数有限、遗憾去除log T,M凸集无需重心。