11472 条条目 · 106 个活跃源
2026年9月3日
04:00
arXiv cs.LG

用于材料表征图像反问题的复合函数可扩展贝叶斯优化

用于材料图像反问题,提出可扩展复合函数贝叶斯优化,压缩输出至十一维,五十次模拟内优于标准优化,无需预训练。

04:00
arXiv cs.LG

XMerge:跨轴选择与重构式层合并实现大语言模型深度压缩

XMerge通过跨轴选择与局部重构压缩大语言模型深度,无需微调,在删除更多层时优势最大且避免崩溃。

04:00
arXiv cs.LG

TC-Next:零样本多模态热带气旋预报

多模态模型TC-Next融合大气场与卫星图像,零样本预测热带气旋路径强度,误差大幅低于传统追踪器。

04:00
arXiv cs.LG

基于LLM的在线时间序列预测的组合式频谱提示

提出CoSPOT:冻结LLM,用组合频谱提示适应在线预测,以频率基组合表示新模式,高效且泛化强。

04:00
arXiv cs.LG

周期物理信息神经网络中傅里叶谱微分与空间自动微分的计算比较

周期PINN中,傅里叶谱微分较空间自动微分提速2.9-18.5倍,节省显存68.7%-94.1%,精度相当。

04:00
arXiv cs.LG

向量量化、乘积量化与标量量化的统一率失真视角

从率失真视角统一视觉分词量化,证明最小化失真才是核心,建立公平比较条件,发现VQ失真最低。

04:00
arXiv cs.LG

BiomedCLIP跨四个国际胸部X线队列的联邦LoRA适配

四个国际胸片队列上联邦LoRA微调BiomedCLIP,AUC0.69→0.80,近集中式0.81。

04:00
arXiv cs.LG

GeoSPRINT:扩散轨迹推断中的几何冗余感知步长剪枝

GeoSPRINT免训练利用轨迹几何检测冗余步,构造非均匀采样调度,在CIFAR-10等数据集上显著提升FID,超越DDIM。

04:00
arXiv cs.LG

在线非单调DR-次模最大化匹配离线0.401因子

证明在线能达到离线0.401近似因子,遗憾O(T^{3/4}),每轮O(dT^{1/4})次查询;批处理可折衷至单次查询与O(T^{4/5})遗憾。

04:00
arXiv cs.LG

SMart:多源多阶段时间序列表示迁移框架

提出SMart框架,通过多源数据选择与多阶段递归图恢复,提升时间序列表示迁移,分类回归均超现有模型。

04:00
arXiv cs.LG

DMRL:面向广告推荐技能优化的文档中介强化学习

提出DMRL,将技能优化视为文档编辑,结合双策略与长期预测,在广告推荐中超越基线。

04:00
arXiv cs.LG

纠缠表示加剧机器遗忘中的附带损害

实验表明,表征纠缠会加剧遗忘的附带损害:解缠越好的模型在保持与遗忘间权衡更优,最高降低4倍保留成本。

04:00
arXiv cs.LG

利用神经算子和因果注意力学习材料的本构行为:塑性与损伤案例研究

提出基于神经算子与因果注意力的本构框架,以应变历史映射应力,准确预测塑性损伤,且分辨率无关、并行高效。

04:00
arXiv cs.LG

异构环境中的相似性感知个性化联邦学习

提出基于相似性加权的个性化联邦学习,双锚定全局与同伴模型抑制负迁移,异构低数据下性能领先。

04:00
arXiv cs.LG

随机投影保持几何的精确极限:高斯模型中的距离恢复、最近邻排名与协方差形状

JL保距界限不能保证几何可恢复;高斯模型中最优解码奇异值≈(m/d)^{k/2},距离、最近邻与协方差形状信息均受限于m/d的幂次。

04:00
arXiv cs.LG

CAPTURE:在个性化LLM智能体中区分偏好漂移与记忆投毒

用神经微分方程区分偏好漂移与记忆投毒,使LLM智能体胜率达71.5%,投毒率仅11.5%。

04:00
arXiv cs.LG

面向长时程离线目标条件强化学习的递归价值学习

DCRL递归分解轨迹为平衡二叉树,从叶到根学习价值,引导深度由线性降至对数,误差累积更慢,超越基线。

04:00
arXiv cs.LG

基于掩码的语义干净标签后门:去中心化联邦学习中的隐形攻击

提出掩码引导的语义干净标签后门CACTUS,在去中心化联邦学习中经拓扑聚合传播,多模态下平均攻击成功率最高达51.2%。

04:00
arXiv cs.LG

什么值得表征?面向持续模型构建的表征赋权

提出表征赋权原则,指导智能体持续构建与复用环境模型,优先扩展内部表征能力而非拟合外部世界,实验验证其优于信息增益并提升迁移与泛化。

04:00
arXiv cs.LG

AGI迷宫预测数据集:借助Transformer学习世界动态的紧凑基准

迷宫预测基准表明:结构化工作记忆比额外隐容量更有效,用于学习世界动态。

04:00
arXiv cs.LG

SEAL:通过共享专家对齐增强混合专家模型的全局安全性

提出共享专家对齐防御,增强混合专家模型安全,抵御有害提示、越狱及恶意微调,攻击成功率降低60%,能力损失仅1.4%。

04:00
arXiv cs.LG

贝叶斯最优BER与AUC:估计与估计器评估

基于软标签估计最优BER/AUC,应对类先验未知与标签噪声,扩展FeeBee评估估计器,实验验证

04:00
arXiv cs.LG

稀疏混合专家模型中共享路由几何与动力学的证据

对齐路由控制子空间后,发现跨层共享几何与线性动力学,且独立于一般表征演化,能预测路由行为。

04:00
arXiv cs.LG

优化中的渗流动力学:方差级联与离散尺度不变性

将SGD动力学建模为渗流:架构对称性迫使子网络离散同步合并引发方差尖峰,并适用Adam/AdamW。

04:00
arXiv cs.LG

覆盖而非定位:多轮智能体信用分配中的结构性机制

终态验证使信号塌缩、信息密度低,均匀覆盖奖励优于聚焦特定回合的定位奖励。覆盖而非定位,才是关键。

04:00
arXiv cs.LG

迈向连续威胁等级谱的一体化鲁棒性

提出威胁条件网络,以傅里叶嵌入和仿射调制使单模型适应连续威胁等级,仅4.6%参数开销即匹配或超越专用集成,并泛化到未知扰动预算。

04:00
arXiv cs.LG

IFW-BLS:基于直觉模糊波损失的双鲁棒宽度学习系统

提出双鲁棒宽度学习系统:波损失限制极端残差,直觉模糊分数降低不可靠样本权重,经加速梯度优化,抗噪更稳。

04:00
arXiv cs.LG

L2RPN中基于GNN的电网控制图表示比较研究

比较物理拓扑、电灵敏度等图表示用于电网控制,发现图复杂度应与任务粒度匹配,而非追求表示丰富。

04:00
arXiv cs.LG

Online Reinforcement Learning in the Met Office Unified Model through Distributed Model-Agent Coupling

分布式模型-智能体耦合下,英国气象局统一模型实现在线强化学习,训练稳定,显著降低预测误差,验证了RL偏差修正的可行性。

04:00
arXiv cs.LG

TrajMind:串联角色专用LoRA实现城市轨迹群体异常的“快慢”协同诊断

TrajMind用“快慢”双路径诊断轨迹群体异常:慢路径分角色LoRA链式验证,定位精度提升13.8%;快路径单趟筛查,延迟降41.1%,跨城市有效。

04:00
arXiv cs.LG

RINSE:面向零样本图异常检测的鲁棒目标时间正态性估计

提出鲁棒迭代目标时间正态性估算,无需标签与梯度,仅凭目标图可靠子集校准,多未见图平均异常检测精度最高。

04:00
arXiv cs.LG

可扩展克罗内克-费歇尔近似:面向十亿参数语言模型压缩的高效海森分析

提出可扩展克罗内克近似,免存完整费歇尔矩阵,实现十亿参数模型海森分析,揭示脆弱层并指导压缩。

04:00
arXiv cs.LG

向正确者学习:基于答案验证的多领域大模型多教师蒸馏

提出MT-SDPO,以答案验证代替领域标签选教师,融合多教师蒸馏,显著提升弱域性能、缩小域差距。

04:00
arXiv cs.LG

DeepAffinity:利用小型语言模型预测电商长期属性偏好

提出DeepAffinity,用小型语言模型预测用户对品牌、尺寸、颜色等属性的长期偏好,优于生成式微调,提升电商推荐质量。

04:00
arXiv cs.LG

ProbeMatchDTI:探针驱动的多尺度生化模式匹配用于药物-靶点相互作用预测

提出探针驱动框架ProbeMatchDTI,保留弱结合信号并增强多尺度生化模式匹配,提升DTI预测性能。

04:00
arXiv cs.LG

不确定知识图谱补全的谱初始化与调度图平滑

QUEST用谱特征向量初始化并施加狄利克雷能量正则化,提高不确定知识图谱补全精度、稳定性及检查点可靠性。

04:00
arXiv cs.LG

重新思考测试时适应中的教师-学生框架

反驳EMA教师权重设置,提出不更新权重的顽固教师,在更长场景下显著提升TTA性能与超参数鲁棒性。

04:00
arXiv cs.LG

语言不可读性对LLM安全的影响

LLM内部计算无法完全通过语言呈现,依赖语言自报告的安全机制不可靠,需用污点追踪等隔离技术兜底。

04:00
arXiv cs.LG

表格基础模型懂物理吗?污染、单位与确定性极限

表格基础模型在物理方程数据上优于基线,但无法表达无噪声机制与物理单位,仅插值而非物理模型。

04:00
arXiv cs.LG

LoRA-TSD:基于Muon式更新的LoRA切空间谱下降

提出切空间谱下降的低秩适配优化器,回映计算更廉价,首次给出全局收敛保证,性能优于现有方法。

04:00
arXiv cs.LG

基于后验平均的源分布估计

用期望最大化迭代训练后验并平均拟合源分布,优于固定代理模型,在洛特卡-沃尔泰拉任务中显著提升。

04:00
arXiv cs.LG

神谕,我何时能学会?——链接预测模型间的预测收敛与互补性研究

不同链接预测模型捕获互补知识,组合可提升性能,但互补性会随模型增多饱和,部分查询仍无法解决。

04:00
arXiv cs.LG

可微电力市场出清用于梯度规划

将市场出清作为可微层,反向传播梯度优化数据中心负荷分配,基本复现最优,误差小;离散站点启停松弛导致决策滞后。

04:00
arXiv cs.LG

H3DNAS:硬件感知的ONNX原生3D点云模型压缩

无需源码,直接基于计算图做硬件感知剪枝与结构变异,压缩点云模型;在基准上实现大幅减参和推理加速,精度损失小。

04:00
arXiv cs.LG

UE5M3 FP4块缩放:实现稳定的语言模型预训练

采用配对E5M3的块缩放,无需RHT与BF16末层,简化FP4预训练,降低损失并提速。

04:00
arXiv cs.LG

悬崖:从第一个错误中学习过程奖励

提出悬崖法:用通用大模型定位推理首个错误,将轨迹分为正确前缀和错误后缀,赋正负优势,提升可验证奖励强化学习。

04:00
arXiv cs.LG

展开利奇晶格:面向2比特大语言模型权重的融合多壳解码与显存布局

提出利奇晶格多壳解码与显存布局,2比特权重的4B模型达87 token每秒,质量代价随规模减小。

04:00
arXiv cs.LG

私有计算空间:农业领域可信多集群联邦学习的实践经验

面向农业数据隐私,构建私有计算空间,融合联邦学习、差分隐私与可信执行环境,在保护隐私的同时提升模型精度。

04:00
arXiv cs.LG

边际期望收入:电商搜索广告中拍卖与固定价格列表的联合排序

将拍卖与一口价商品统一排序,提出边际eCPM目标,兼顾收入与用户体验,经A/B测试验证并已上线。

04:00
arXiv cs.LG

语音脑机接口的通用通信度量

提出OVMI作为语音BCI通用度量,跨条件比较系统,避免传统指标高估性能,优化词汇选择。