11852 条条目 · 106 个活跃源
2026年7月7日
04:00
arXiv cs.LG

PhenoNEST:面向本体感知的多模态植物表型与性状发现的神经符号框架

提出神经符号框架构建多模态知识图谱,融合文本与图像,实现小麦表型监测与性状定位。

04:00
arXiv cs.LG

全局到局部:基于全球天气基础模型的高效区域天气降尺度

提出基于预训练天气模型的降尺度框架,无需重新训练,以极低计算成本提升区域预测精度。

04:00
arXiv cs.LG

过渡信息密度:形态轨迹、联觉感知与神经网络训练中的结构化插值(或:联觉AI)

提出过渡信息密度与位置身份概念,实验表明结构化插值在语音语义模态降低内在维度,视觉模态存在边界条件。

04:00
arXiv cs.LG

中文标题:迈向多样全面的互信息估计基准

中文摘要:提出基于copula理论的统一互信息估计基准,涵盖两类测试,评估三类估计器,揭示无通用最优方法。

04:00
arXiv cs.LG

面向HAR的FedAvg:探索个性化与泛化准确率之间的权衡

FedAvg用于人类活动识别,在个性化与泛化间权衡,但客户端类别分布变化时优势不明显。

04:00
arXiv cs.LG

超越欧几里得范式的统计有意义的几何(SMG)及其在生成式AI中的应用

SMG框架用信息几何与微分纤维束建模,通过联络滤除噪声,严格限制生成幻觉并消除灾难性遗忘。

04:00
arXiv cs.LG

中文标题:CSympNet-ID:用于线性阻尼哈密顿系统的共形辛映射学习

中文摘要:提出CSympNet-ID框架,学习单步流映射并内置共形辛结构,识别阻尼参数,在数据稀缺和高维测试中表现优异。

04:00
arXiv cs.LG

在LLM中摊销贝叶斯实验设计以进行序贯信息收集

ASIG将贝叶斯实验设计摊销至LLM策略,20 Questions成功率翻倍,推理成本降25倍,并泛化至医疗诊断。

04:00
arXiv cs.LG

多尺度单指标模型:一种用于层级特征学习的风格化模型

该模型研究层级特征学习,分析Wiener混沌,证明深度优势,在线SGD达到线性样本复杂度。

04:00
arXiv cs.LG

机不可失:面向LLM智能体的自主测试时训练

aTTT通过重加权重复n-gram损失抑制漂移,提升长轨迹任务成功率达5.0点。

04:00
arXiv cs.LG

路由差距中有多少是真实的?将路由器到神谕的差距分解为可复现的专家优势和单次采样的标签噪声

路由差距中单次采样噪声占少数,可通过多次采样恢复;大部分为可复现的专家优势。

04:00
arXiv cs.LG

PedestrianDiffusion:用于惯性导航的多模态生成式去噪与密集状态估计

提出频域多模态生成去噪框架,实现惯性导航密集状态估计,单步推理,鲁棒达SOTA。

04:00
arXiv cs.LG

更优N中最佳:基于上下文学习生成预对齐响应

提出BoBN方法,检索并重写高奖励示例,利用上下文学习使采样转向高奖励区域,提升对齐效果。

04:00
arXiv cs.LG

高斯混合引导的布朗桥扩散模型调度设计

基于高斯混合先验分析布朗桥扩散模型逆向动力学,提出Wasserstein和MSE调度准则,揭示感知与保真度权衡。

04:00
arXiv cs.LG

面向数字孪生中时序感知的模块化基础模型

提出模块化基础模型,利用自监督学习与门控机制动态选择编码器,经Transformer聚合,支持多下游任务,性能优异。

04:00
arXiv cs.LG

再论Adam的收敛性

证明投影Adam在任意动量参数下平均遗憾可远离零,并扩展至多个变体。

04:00
arXiv cs.LG

共适应多任务LoRA:迁移感知、无标签的域参与控制

CoDA无需标签,通过动态分配多域LoRA训练权重,促进协同抑制干扰,显著提升多任务微调效率。

04:00
arXiv cs.LG

通过p延拓的图p-拉普拉斯半监督学习近线性时间求解器

提出p延拓阻尼弦牛顿法,使p-拉普拉斯半监督学习的线性系统良态,实现近线性时间求解,比直接分解更快且内存更低。

04:00
arXiv cs.LG

对齐语言模型与选择性预测

提出RLSR框架,以风险-覆盖曲线下面积为对齐目标,优化选择性预测,提升大模型可靠性与人机协作。

04:00
arXiv cs.LG

WeightCLIP:对齐数据集与模型的权重空间学习方法

WeightCLIP利用对比学习对齐神经网络权重与数据集表示,提升检索、生成和微调性能。

04:00
arXiv cs.LG

教师监督下的表示等价类

教师表示仅等价类可识别,学生应学习类不变量而非绝对特征,能力由输出函数驱动。

04:00
arXiv cs.LG

区分评估器,而非程序:一种高效的神经符号学习运行时表示

提出NDVM运行时表示,分离符号与数值,批量反向梯度记录,实现程序-参数协同搜索加速24倍。

04:00
arXiv cs.LG

当几何对齐时:UNet、ViT与DiT架构中的二面体隐藏状态变换

通过二面体反射干预隐藏状态,一致变换提升稳定性,不一致导致架构特定失败,确立几何一致性为关键原则。

04:00
arXiv cs.LG

基于网络可用信息的图分类:从表示评估到结构选择

NetinfoGC框架无需端到端训练,利用聚类一致性和稀疏群组LASSO评估并选择结构表示,实现高效图分类。

04:00
arXiv cs.LG

LLM智能体的社交网络

SNLA框架揭示:窄注意力导致从众,宽注意力在无向正则图下实现群体智慧。

04:00
arXiv cs.LG

反射薛定谔桥匹配

提出部分免模拟框架,使反射薛定谔桥像流匹配一样训练,新采样与回归目标,性能保持或略优。

04:00
arXiv cs.LG

基于一阶损失函数的GELU与阈值传输激活的结构性解释

将GELU解释为高斯随机阈值硬线性门的期望盈余传输项,推广至阈值传输族,均匀阈值门在实验中表现优于常见激活函数。

04:00
arXiv cs.LG

多元ReLU网络中SGD的隐式偏置:有效宽度坍缩

带噪声SGD训练宽两层ReLU网络时,隐式偏置导致有效宽度坍缩,学习器复杂度受数据组合几何控制。

04:00
arXiv cs.LG

LLM引导的运输枢纽容量规划:融入文本业务输入

LLM通过链式思考构建决策表,结合优化反馈,将文本业务信息融入枢纽容量规划,实现2.8%最优性差距,优于传统模型11.0%

04:00
arXiv cs.LG

Rethinking AI-Generated Text Detection: A Strong Baseline and the Distribution-Shift Problem That Remains

04:00
arXiv cs.LG

相位保持的三模态Transformer用于光学和PolInSAR数据的热带森林生物量估算

提出TCCT模型融合光学与PolInSAR数据,通过相位保持和动态注意力克服云覆盖,在热带森林AGB估算达4.51%相对误差,满足ESA要求。

04:00
arXiv cs.LG

Validation-Induced Shapley Shifts: How Validation Structure Distorts Data Valuation

04:00
arXiv cs.LG

PIEFS:基于物理信息的可学习缩放特征函数

提出PIEFS框架,用可学习缩放和物理信息特征,实现紧凑监督谱表示。

04:00
arXiv cs.LG

SAVER:随机自适应方差驱动的探索与重建用于低剂量CT

SAVER基于数据方差实时选投影角度,优先高信息方向,提升低剂量CT重建质量与鲁棒性,最大化每单位辐射诊断收益。

04:00
arXiv cs.LG

基于保守主体不变性的肌电手势识别

提出保守多目标学习框架,联合优化分类、对抗混淆与度量学习,自适应加权,跨主体准确率相对提升49%。

04:00
arXiv cs.LG

量化与连续强彩票的统一框架

提出统一框架,通过分析离散RSSP导出量化强彩票紧界,故障概率指数级提升,统一处理近似与舍入误差。

04:00
arXiv cs.LG

FedACT:面向数据异质性下鲁棒Transformer训练的自适应坐标信任调节联邦方法

提出坐标级信任调节方法FedACT,提升联邦Transformer训练鲁棒性,缓解数据异质性影响。

04:00
arXiv cs.LG

张量列车联合建模用于少步离散扩散

针对离散扩散少步生成的并行偏差,提出张量分解显式联合分布建模,通过TTD捕捉邻近依赖,轻量微调提升性能。

04:00
arXiv cs.LG

以小博大:针对可验证多项选择任务的微型语言模型分类头微调

TLM分类头微调在多选题上优于标签生成,小模型性能媲美大模型,0.6B/1.7B达到SOTA。

04:00
arXiv cs.LG

等变深度学习基础:图神经网络与层神经网络统一框架

提出阶等变神经网络统一图与层网络,证明通用逼近定理,并推广至范畴等变网络。

04:00
arXiv cs.LG

对抗性LassoNet:基于稳定性驱动的鲁棒特征选择

提出对抗性LassoNet,结合对抗训练与层级稀疏特征选择,提升分布外鲁棒性与特征重现性,准确率提高5.3%。

04:00
arXiv cs.LG

基于单纯形指数移动平均的流混合稳定全局加权

提出AMF-VI-sEMA框架,以单纯形指数移动平均实现稳定全局加权,避免组件崩溃,提升后验推理性能。

04:00
arXiv cs.LG

NeSy-CSA:面向开放式关键场景归因的神经符号框架

提出NeSy-CSA框架,将开放式关键场景归因转化为结构化可追溯推理,实验提升归因有效性18.32%和13.67%。

04:00
arXiv cs.LG

最小MMD估计的梯度流视角

提出预条件梯度下降方案,证得渐近全局收敛,优于标准梯度下降。

04:00
arXiv cs.LG

AdaptiveSD:面向CPU受限大语言模型推理的稳定性感知、运行时自适应推测解码框架(多策略编排)

提出运行时自适应推测解码框架,通过多策略编排确保CPU受限环境下LLM推理的稳定与可靠。

04:00
arXiv cs.LG

基于Armijo回溯的方向曲率:一种低成本的锐度探测器及Adam的免校准学习率保护机制

Armijo回溯步长可低成本探测损失尖锐度,一次初始化即可为Adam提供免校准的学习率保护,防止发散且开销极低。

04:00
arXiv cs.LG

MPSelectTune: 微调中的提示类型选择改进大语言模型的概念遗忘

MPSelectTune通过选择最差提示类型微调,降低概念准确率,同时提升主任务性能2-15%,减少最坏情况概念准确率17%。

04:00
arXiv cs.LG

CDCP:基于上下文提示的条件扩散模型用于多任务离线安全强化学习

提出CDCP模型,将多任务离线安全强化学习转为条件生成,用上下文提示和成本约束,实现高安全高性能。

04:00
arXiv cs.LG

NeuroOnline:弥合预训练与在线自适应的脑电图基础模型

NeuroOnline通过多视图一致性和上下文感知调制,统一预训练与在线自适应,在脑电图分布偏移场景中表现优异。

04:00
arXiv cs.LG

基于物理信息编码和模拟推断的Transformer用于脉冲星计时阵列数据中偏心双黑洞的稳健探测

提出物理信息编码的Transformer结合模拟推断,高效从PTA数据推断偏心双黑洞,精度更高、推断更快。