11382 条条目 · 106 个活跃源
2026年9月18日
04:00
arXiv cs.LG

面向观点动力学的数字孪生:社交网络的生成式大语言模型框架

克隆真实推特网络建立数字孪生,用Mistral-7B模拟观点演化,预测误差较最优基线降低超50%。

04:00
arXiv cs.LG

基于图超网络摊销物理信息神经求解器

用算子图显式表达方程关系,由图超网络生成初始化;双场耦合问题上误差较项集与系数向量降35.7%和67.7%。

04:00
arXiv cs.LG

通过解释方法诱导的预测器评估解释方法

提出以解释重建预测器并在未见数据上复现模型来评估解释,无需拟合;PDP与SHAP优劣取决于特征独立性。

04:00
arXiv cs.LG

基于图的随机Power-UCT:采用幂均值估计的蒙特卡洛图搜索

提出GS-Power-UCT,按规划深度共享状态并分层估值,适配含环随机MDP,样本效率优于树图基线。

04:00
arXiv cs.LG

每个组件仅需一次干预:从稳态迈向线性随机动力学的可识别性

仅需每个强连通分量一次干预即可从稳态识别线性随机动力学参数至全局缩放,并提出递归与正则最小二乘估计。

04:00
arXiv cs.LG

动态广义Gromov-Wasserstein最优传输

提出免仿真的TP-DATE框架,将GW-OT动态推广,借助旅行对流匹配,更好保留空间结构并改进3D动态重建。

04:00
arXiv cs.LG

过去与未来,一瞬兼得:通过事后 JANUS 校正缓解稳定性-可塑性困境

提出事后 JANUS 校正,将更新投影至雅可比零空间,恢复历史知识且不扰微调,缓解稳定性-可塑性困境。

04:00
arXiv cs.LG

EPIG-Tree:梯度高效强化学习的计算最优分支

EPIG-Tree把分支看作策略梯度估计的计算分配,按每单位算力最大降低梯度不确定性放置分支,在控制、LLM校准和多轮游戏中提升。

04:00
arXiv cs.LG

当下正确,后续不足:审计上下文压缩中的更新充分性

配对历史审计发现:记忆当前答对却难支撑未来更新,暴露结构、标识符等失败,并提出范围化评估法。

04:00
arXiv cs.LG

MATCH:基于课程调度与分层门控奖励的模型感知工具学习

MATCH以模型感知课程调度与分层门控奖励优化工具调用,在API-Bank和BFCL V3上超越基线。

04:00
arXiv cs.LG

支持度阈值而非算法,才是共购网络中稀有关联恢复的瓶颈

top-K与NC恢复稀有高提升度关联达80-100%,远超Apriori的22-28%;瓶颈在支持度阈值而非算法。

04:00
arXiv cs.LG

SETTer:面向长期多变量时间序列预测的稀疏编码器Transformer

提出SETTer,采用解耦自注意力与混合掩码,单层Transformer建模长期依赖,88%场景超越SOTA。

04:00
arXiv cs.LG

局部稀疏性实现无监督大语言模型安全检测

借稀疏自编码器的局部稀疏性,提出无监督LLM安全异常检测框架,仅建模安全数据,用1-2%神经元即近最优。

04:00
arXiv cs.LG

面向智能汽车多模态舱内交互的QoS感知联邦学习

提出异步事件触发联邦学习框架FedQoS,双重门控平衡时延能耗,通信降76.7%、时延降26.0%

04:00
arXiv cs.LG

QUALS:通过模式量化与可学习性同步实现通用预测的语料库均衡

提出QUALS语料库均衡框架,经模式量化与可学习性同步,用少量数据即可提升零样本预测性能。

04:00
arXiv cs.LG

CARE-VI:离策略 Actor-Critic 学习中用于价值改进的保守自适应可靠性估计

提出CARE-VI框架,融合CARS、SEVA、DARE提升离策略Actor-Critic目标可靠性,在12个MuJoCo任务上平均回报最高。

04:00
arXiv cs.LG

线性时变系统的快变固有频率与阻尼比辨识

提出LSTM与EKF物理增强机器学习法,用振动数据辨识线性时变系统快变固有频率与阻尼比,经海上风机验证。

04:00
arXiv cs.LG

无回放持续学习中的噪声最优:隔离、机制与适用范围

噪声注入巩固规则使保留率呈倒U型;关键在锚增益与噪声方差耦合,且需共享任务结构,任务越多优势越弱。

04:00
arXiv cs.LG

小到足以知晓一切:完全可枚举Transformer作为延迟泛化科学的工具

全可枚举Transformer可精确研究延迟泛化;跨尺度实验显示多数规律守恒,权重衰减律随规模变形。

04:00
arXiv cs.LG

子域感知的预训练图像嵌入表示压缩

研究用PCA/LDA对预训练图像嵌入做子域压缩,既提升空间与计算效率,又提高准确率,并验证可迁移性。

04:00
arXiv cs.LG

检索何时有助于时间序列预测?

论文表明检索增益由窗口长度与主季节周期的关系决定,而非机制本身,并提出分层评估协议及两个可解释统计量以预判收益。

04:00
arXiv cs.LG

仅有准确率还不够:深度知识追踪中人口统计偏差的跨架构审计

跨四种深度知识追踪架构审计:人口偏差真实但依情境;最准模型偏差最大;常规去偏难在保精度下消除偏差。

04:00
arXiv cs.LG

使用门控图注意力网络解释短期交通预测模型中的空间信息流

提出门控图注意力网络解释短时交通预测空间信息流;门控随流量与周期变化,两层GAT冗余,轻正则略增益。

04:00
arXiv cs.LG

几乎无需通信的鲁棒联邦Q学习

多智能体共享MDP,部分对抗下提出Robust Fed-Q,保证收敛与近优协作速率,通信仅Õ(1)轮

04:00
arXiv cs.LG

LLM时代,训练经典模型还值得吗?——表格数据上的交叉点基准

表格预测中,经典模型仅需少量标签(中位约6%训练集)便胜过零样本LLM;业务表收集数百标签训练梯度提升即可。

04:00
arXiv cs.LG

SoftTri:面向自适应模糊推理系统的平滑三角隶属函数

提出可微SoftTri平滑三角隶属函数,保持局部可解释性,提供解析梯度,提升模糊神经网络优化稳定性与精度。

04:00
arXiv cs.LG

人工智能时代的金融情绪评估

评估12种模型:通用大模型分类不逊金融专用模型,但准确率不等于经济有效性,仅关联盈利惊喜,难解释短期市场反应。

04:00
arXiv cs.LG

面向城市蜂窝活动预测的场景条件化关系路由

提出场景条件化关系路由框架SCRR-Net,用城市场景控制空间依赖与跨任务迁移,提升蜂窝活动预测。

04:00
arXiv cs.LG

迈向认知负荷评估的统一模态无关多模态框架

统一模态无关Transformer融合五种生理信号评估认知负荷;EEG单模态最佳,五模态四设置平均68.08%,模型约减半。

04:00
arXiv cs.LG

通过双向行为先验蒸馏改进在线强化学习

B2PD利用动作价值先验引导CVAE生成高价值行为支持集,蒸馏入智能体,建立双向知识流,提升样本效率与稳定性。

04:00
arXiv cs.LG

具有指定不动点的阈值布尔网络学习算法

提出可微损失学习算法,从指定不动点推断阈值布尔网络;拟南芥实验中5/30次完美重构,且无伪吸引子。

04:00
arXiv cs.LG

面向偏微分方程学习的超网络参数化空间自适应神经算子

提出SANO,用坐标条件超网络生成空间变化算子参数,HNE局部插值耦合,显著提升异质PDE建模。

04:00
arXiv cs.LG

表面肌电手势解码中的健全人向截肢者迁移:训练来源与校准预算

零样本跨人群迁移失败;仅需三次标记校准,宏F1达0.779,优于个体化基线0.589,用健全人数据训练更佳。

04:00
arXiv cs.LG

小校准预算下的跨用户表面肌电编码器个性化

小预算下全微调最准;免梯度原型法无需优化器,保留全微调的52%–78%收益,支持佩戴时个性化。

04:00
arXiv cs.LG

位置无需代价,组合并非如此:拉丁方作为异构序列混合器堆栈的可证明平衡构造

拉丁方编排异构序列混合器:位置影响仅0.16%,同质化惩罚达1.68%,大规模升至2.63%。

04:00
arXiv cs.LG

通过边界感知数据增强提升离线强化学习的泛化性与鲁棒性

提出边界感知数据增强BADA,利用邻近状态构建插值边界生成保持分布的数据,提升离线RL泛化与鲁棒性。

04:00
arXiv cs.LG

SAGG:面向异构损坏下鲁棒多模态学习的样本自适应梯度门控

提出样本自适应梯度门控SAGG,用样本级在线质量测试二元保留/丢弃梯度,消除异构损坏批级偏差,鲁棒收敛。

04:00
arXiv cs.LG

8GB消费级GPU上,3B以下的开放语言模型在零样本作文评分中能走多远?

3B以下开源模型零样本作文评分最佳QWK仅0.388,远低于人工上限,仅宜作人工监督的形成性反馈。

04:00
arXiv cs.LG

面向文本、知识图谱与超图原生 Transformer 建模的标记关联结构

提出标记关联结构LIS,统一文本、知识图谱与超图的原生Transformer建模,并引入角色/关系感知注意力。

04:00
arXiv cs.LG

EviRec:面向双重冷启动POI推荐的持续证据学习

提出EviRec持续证据学习框架,为每个候选POI分别评估历史证据可信度,显著提升双重冷启动推荐效果。

04:00
arXiv cs.LG

ZeroHAT:行为条件化的零样本人类活动轨迹生成

ZeroHAT迁移源域行为并结合目标域公开上下文,零样本生成目标区域活动轨迹,十城实验下游效用达最强基线4.5–6.4倍。

04:00
arXiv cs.LG

训练神经网络以逼近密集多发射器定位中的最优贝叶斯估计器

用合成帧训练神经网络,逼近密集发射器定位的最优贝叶斯估计器,为高通量、大视场、超高时空分辨率SMLM提供依据。

04:00
arXiv cs.LG

基于有限元预训练潜在动力学的稀疏观测地震场地反应预测

提出FLARE-T,以有限元预训练潜在动力学结合稀疏记录校准,提升多深度地震场地反应预测精度。

04:00
arXiv cs.LG

使用相同前向映射的自编码器的精确重建界

研究同一前向映射自编码器,导出最小均匀重建导数误差精确界,并用激光雷达森林扫描验证;增一隐藏维误差极低。

04:00
arXiv cs.LG

常数步长下非线性双时间尺度随机逼近的偏差

研究常数步长下非线性双时间尺度随机逼近,界定两迭代的均方误差与偏差为 O(α+β²/α²) 并证其紧,揭示非线性特有的有限时间效应。

04:00
arXiv cs.LG

COMPASS:十万规模下的有序聚类路由

提出COMPASS算法求解有序聚类旅行商问题,融合搜索与学习加速,支持10万节点且性能领先。

04:00
arXiv cs.LG

在道德风险与逆向选择下学习面向公平小农户碳农业的委托—代理合同

用强化学习设计碳农业合同:利润最大化聚合商放大排斥小农户,因MRV成本随规模递减;按面积计费消除差距。

04:00
arXiv cs.LG

无限制有界契约下的极小极大最优在线契约设计

研究重复契约设计,m种结果下T轮极小极大遗憾达T^{m/(m+1)},并给出最优学习策略与下界。

04:00
arXiv cs.LG

SCGFM-ART:面向以结构为中心的图基础模型的摊销关系传输

SCGFM-ART用分摊关系传输对齐异构图到共享关系图谱,跨域14任务最优,推理快44–85倍。

04:00
arXiv cs.LG

基于深度学习的脑电信号认知与静息状态分类

提出CNN-GRU框架,结合时频特征分类EEG静息与认知状态,三任务准确率76.1%~83.4%。