11402 条条目 · 106 个活跃源
2026年9月15日
04:00
arXiv cs.LG

语言模型激活空间中的可引导性特征

简单可分性指标与语言模型下游可引导性强相关,可诊断引导向量是否有效。

04:00
arXiv cs.LG

做($x$)还是不做($x$):面向数据集增强的医学图像反事实

对比确定性、无向与因果三种条件策略生成医学图像反事实,评估下游性能与公平性,发现因果方法增益显著。

04:00
arXiv cs.LG

基于图引导混合专家的多模态肿瘤生存预测

提出图引导的混合专家框架,融合临床、病理与基因组数据,自动调度模型,提升肿瘤生存预测精度。

04:00
arXiv cs.LG

自主垂直起降飞行器故障检测、隔离与严重程度预测的机器学习框架

提出CNN框架,用真实飞行数据检测隔离旋翼故障并预测严重度,实验分类准确率超99%、严重度达96%。

04:00
arXiv cs.LG

LIMBO:面向LLM智能体的终身推理时记忆与预算优化

LIMBO首个在线框架,将记忆视为可控推理资源,按任务联合优化记忆策略与推理预算,无需重训,以约53%更低成本达领先水平。

04:00
arXiv cs.LG

T-SMART:面向工具增强型时间序列问答的机制级归因

T-SMART解耦语言推理、计算与感知,消融显示确定性计算贡献最大,较直接推理提升31.7个百分点。

04:00
arXiv cs.LG

继承的注意力头:音频语言模型借助其文本主干的注意力跟踪说话人,而基于注意力总量的排序会检索出另一组头

无需训练,偏置百个注意力头可让音频模型按指定说话人描述;这些头多继承自文本主干,注意力质量排序会选出不同组。

04:00
arXiv cs.LG

ZAPS:面向神经网络架构搜索的零成本主动代理搜索

ZAPS:离线选非冗余零成本代理,迭代投票重选,结合拓扑与UCB排序,低预算NAS基准上优于基线。

04:00
arXiv cs.LG

识别导致幻影迁移的数据集偏见

基于Sentence BERT嵌入的特征可识别此类数据集偏见的主题,已知教师模型时MCC达0.83,未知时0.46。

04:00
arXiv cs.LG

无数据在线策略蒸馏

发现OPD对训练数据近乎无感,提出无数据在线策略蒸馏DF-OPD:教师自行出题,即媲美甚至超越真实数据。

04:00
arXiv cs.LG

基于自监督预训练与保形风险控制的图Transformer欺诈检测

GTFD融合图注意力与门控Transformer,以自监督预训练和保形风险控制检测欺诈,AUROC达0.990,误报率降约29%。

04:00
arXiv cs.LG

CoArena:实时评估计算机使用与多智能体系统

真实用户提交计算机使用任务,单/多智能体双系统同沙箱并发,盲评并实时更新榜,形式化实时评估五属性与评分法。

04:00
arXiv cs.LG

基于核集成与分歧驱动采集的贝叶斯优化用于声源定位与声学反演

采用多核高斯过程加权集成与最优条件采集函数,在少样本七维空间中提升定位与地声反演的鲁棒性和精度。

04:00
arXiv cs.LG

通过离线规划学习数据源获取策略

O-MPAC通过离线规划学习数据源获取策略,推理时重评分并硬掩码成本,在多任务上优于基线。

04:00
arXiv cs.LG

非参数方差惩罚演员-评论家:面向风险敏感强化学习的统计推断

以自助法与随机缩放替代方差评论家,提出非参数方差惩罚演员-评论家框架,证明收敛并在高温超导制造中验证。

04:00
arXiv cs.LG

面向去中心化GPU网格的通信高效LLM适配

用异步双回路与频谱校正,在去中心化GPU上高效微调LLM,通信提速逾40倍且性能不降。

04:00
arXiv cs.LG

双四元数空间与复值注意力用于时序知识图谱补全

提出BSCA模型,在双四元数框架中结合圆与双曲旋转,用复值注意力融合时间与关系条件表示,性能优于基线。

04:00
arXiv cs.LG

基于光谱的多模态深度学习用于小分子结构鉴定:通过混合条件训练增强鲁棒性

融合光谱化学知识进行混合条件训练,并以专家混合提升小分子结构鉴定鲁棒性。

04:00
arXiv cs.LG

遵循几何,而非模型:冷启动半监督学习

VAST解耦伪标签生成与分类器训练,借冻结自监督嵌入几何推断信念并蒸馏为归纳分类器,冷启动半监督优于图基线。

04:00
arXiv cs.LG

知何时停、何处重启:加速多轮智能体在线策略蒸馏

提出STRIDE,以自适应早停和前缀缓存加速多轮智能体在线策略蒸馏,最高提速5.1倍且性能不降。

04:00
arXiv cs.LG

检索引导微调作为含噪估计:风险界与架构分析

检索引导微调含噪估计:可优于仅目标/全语料训练;但线性自注意力无权聚合致偏差发散,需可靠性重加权。

04:00
arXiv cs.LG

所有噪声都应同等对待吗:输入噪声变异性对神经网络鲁棒性的影响

噪声类型、尺度与复杂度影响地震神经网络泛化;大尺度与复合噪声可提升鲁棒性。

04:00
arXiv cs.LG

EdgeHAR:面向人体活动识别的边缘原生紧凑型传感器基础模型

EdgeHAR解耦活动语义、运动动态与采集上下文编码,实现边缘端跨用户/设备/位置的活动识别。

04:00
arXiv cs.LG

GNN4PPM:基于关系图卷积网络的多目标预测性流程监控

提出GNN4PPM,以异构图和R-GCN一次预测所有后续事件及完整数据,提升流程监控。

04:00
arXiv cs.LG

随机半强盗设定下选择最长路径长度最小的k条路径

网络并行传输中每步选k条路径,受容量约束且耗时随机,需最小化最大传输时间的半强盗问题,本文提出算法。

04:00
arXiv cs.LG

基于最小描述长度的多通道时间序列分类时间错位诊断

提出免标签的最小描述长度诊断法,用候选时移的编码长度变化识别多通道时序错位,可检测并校正偏移。

04:00
arXiv cs.LG

联邦学习中的路径式个体理性:机制-架构协同设计

提出机制-架构协同设计,保障联邦学习客户端路径式个体理性,避免短期损失且不损整体性能。

04:00
arXiv cs.LG

SH-WRNN:面向非对称边缘智能的隐式球谐权重场路由神经网络

权重矩阵转为球谐连续场,动态路由;单轮MNIST达91.05%和81.54%,表面烘焙加速非对称边缘。

04:00
arXiv cs.LG

对称性与奇点

利用图与注意力参数对称性,师生框架下解析估计图注意力模型局部学习系数,处理对称简并,降低估计成本。

04:00
arXiv cs.LG

结转式草稿生成:回收被拒绝状态用于投机解码

提出结转式草稿生成,回收被拒隐藏状态作临时KV上下文,提升投机解码接受长度与端到端加速。

04:00
arXiv cs.LG

WaterKron与FlipFlop Hessian:基于信息论的Kronecker因子化Hessian量化

提出WaterKron,用Kronecker-Hessian失配因子推导失真,最小化得FlipFlop Hessian,为量化选Hessian提供依据,实验改善KL与困惑度。

04:00
arXiv cs.LG

拒绝只读取模型所知的一小部分:危害键控路由及其在不同模型家族中的例外

道德理解源自预训练,拒绝门为后训练新建,仅读危害感知;约四分之三因果输入在道德子空间外,模型家族间存在差异。

04:00
arXiv cs.LG

梯度提升模型适用于间歇性需求预测吗?

研究评估多种预测方法,发现专用方法最优,梯度提升单独表现欠佳,但与专用方法结合可提升准确率至多10%。

04:00
arXiv cs.LG

WaVeFuse:基于通道级小波去噪与垂直注意力融合的市场状态自适应股指预测

WaVeFuse以通道级小波去噪与垂直注意力融合,实现行情自适应股指预测,精度高、回撤低且轻量高效。

04:00
arXiv cs.LG

OCT-FedSIR:迈向标注噪声下的可信联邦眼科学习

提出OCT-FedSIR谱框架,用于标注噪声与非IID下联邦OCT分类,可纠错且优于RoFL/FedCorr。

04:00
arXiv cs.LG

先校准可解释性工具,再信其判读

因果可解释性测量常以貌似合理数值掩盖失败;本文总结六类失败及校准协议,主张先校准再采信。

04:00
arXiv cs.LG

面向多尺度预测与治疗假说生成的免疫世界模型

AI科学家构建动作条件免疫世界模型,跨细胞、组织、个体预测干预效应并提名可验证治疗假说。

04:00
arXiv cs.LG

GRPO-QM:量子层析中的目标保持探索

该方法只学量子层析后验探索,校正保持后验不变;收益多来自物理提议和先验,目标缩放可解释采样训练差距。

04:00
arXiv cs.LG

面向风险控制的地球系统时空基础模型决策导向不确定性量化

面向决策的不确定性量化框架将预测映射为动作条件风险并做决策级校准,降低遗憾与漏报、提升效用。

04:00
arXiv cs.LG

隐私保护的 Gossip 学习

提出去中心化隐私保护学习,用TwF保留旧样本映射,差分隐私噪声建模为最坏扰动,私有push-sum gossip聚合,证明几何收敛。

04:00
arXiv cs.LG

语义纤维与交叉格拉姆干扰:过完备表示中的安全漂移演算

跨语言安全漂移可由交叉格拉姆线性刻画;校准暴露区分三类可修复性,预测相关达0.964。

04:00
arXiv cs.LG

利用无冲突梯度解决 PINNs 与 PIKANs 的失效模式

提出 Norm-PCGrad 缓解域分解梯度冲突,结合 SPINN 降低计算成本,提升 2D/3D 及 PIKAN 精度。

04:00
arXiv cs.LG

AgentKV:面向智能体LLM的阶段感知KV驱逐

AgentKV按阶段维护查询缓冲,对缓存键统一打分驱逐,任务分平均提升5.5,吞吐最高1.80倍。

04:00
arXiv cs.LG

插值并非不变性:变换审计中配对数量并不等同于覆盖度

配对计数会高估变换审计覆盖;需用有效秩、图谱间隙等评估,并提出留一轨道更新与部署门控。

04:00
arXiv cs.LG

SeqMaestro:通过可解释机器学习从核苷酸序列走向生物学假设

SeqMaestro 连接核苷酸序列与可解释模型,支持无代码分析,从序列中提出生物学假设。

04:00
arXiv cs.LG

基于图注意力驱动的分层强化学习的云工作流调度

用图注意力与分层强化学习调度云工作流,任务-容器智能体交替训练,提升容器利用率并降低能耗。

04:00
arXiv cs.LG

面向统计数据集融合的深度玻尔兹曼机跨块条件化

提出观测块多预测,使深度玻尔兹曼机可用于数据融合;增益主要来自跨块条件化,生成预训练贡献甚微且不衰减。

04:00
arXiv cs.LG

马尔可夫α-势博弈中分散式学习的高概率纳什遗憾:分幕式与全在线异步算法及其在马尔可夫拥塞博弈中的应用

提出KL投影自然策略梯度,实现马尔可夫α-势博弈分幕式与全在线异步分散学习的高概率纳什遗憾界,用于拥塞博弈。