SAGA:面向智能体文本到SPARQL生成的模式感知基础
SAGA通过模式约束的grounding,减少类型盲点,提升知识库问答准确率并降低空结果查询。
用更少标签实现机器学习力场训练与微调的全数据精度
LLPR主动学习用少量标签恢复全数据精度,适用于分子、凝聚相和电解质系统。
令牌能否与监督CNN骨干竞争?——BirdCLEF+ 2026中的令牌表示研究
在BirdCLEF+2026中,构建监督集成基线达0.936分,并探究令牌表示与语义表示的性能对比。
Riesz核斯坦变分梯度下降:重正化熵与长时间粒子极限
证明奇异Riesz核SVGD在重正化熵下,经验测度弱收敛到目标,低于对数阈值时有代数误差。
MIDI-RAE-JEPA:面向符号音乐的分层表示学习与生成
提出等变自监督方法,学习音乐层次表示,重建F1达0.995,生成匹配音高节奏,情感分类优于基线。
面向可穿戴设备的节能低功耗心律失常检测
采用近似技术降低深度学习功耗,在保持93.7%准确率下使功耗降低64.9%,延长可穿戴设备电池寿命。
主观风险分解:不确定性量化的新视角
提出主观风险分解新视角:通过严格适当损失分解导出认知与偶然不确定性,并连接学习理论。
基于结构保持神经网络和熵变量的Burgers方程亚网格尺度参数化
利用解耦神经网络学习亚网格通量,高保真再现全尺度系统特性,且对训练外参数鲁棒。
通过Metropolis-Hastings扩散距离测量空间聚类
提出扩散距离度量空间聚类,优于莫兰指数,能检测细微模式。
面向即插即用图像重建的失配近端去噪器域自适应
针对去噪器域失配导致近端步骤不精确问题,提出近端匹配自适应,在少样本下显著提升重建质量。
通过线性探测实现整流流的最优自蒸馏
提出整流流最优自蒸馏,导出闭式混合系数,证明速度风险严格改进。
通过机制可解释性与最优控制将鲁棒性引入世界行动模型
利用可解释性发现鲁棒特征线性可分,提出对比引导与WA-LQR控制器,提升模型鲁棒性。
cGAP:基于HOMALS引导热力图的高维分类数据广义关联图
cGAP框架通过HOMALS嵌入与热力图协同展示高维分类数据的原始矩阵及几何结构,揭示聚类与异常。
SMC-ES:自动合成形式化验证的控制策略
SMC-ES算法融合进化策略与统计模型检验,自动合成有形式化性能、安全、鲁棒性保证的控制策略,计算成本可控且性能领先。
Atari Pong中世界模型的概念引导空间正则化
提出CGSReg辅助损失改善世界模型在Atari Pong的闭环rollout和零样本MBRL,效果因模型而异。
混合Mamba视听导航
提出Samba混合Mamba模型,用Mamba编码器替代GRU和卷积,导航成功率提升11.3%,计算成本更低。
超越骨干网络反向传播:一种解耦策略用于高效迁移学习
解耦特征提取与分类器,预计算特征并重设计分类器头,显著减少训练时间与碳排放,精度几乎无损。
联邦可解释人工智能:角色、架构、评估与开放挑战
综述联邦可解释AI,揭示可解释性从事后工具演变为联邦学习核心,涵盖方法分类、评估缺陷及关键挑战。
模型丢弃了什么,为何要找回:基于被弃几何的掩蔽、指纹识别与隐私
提出框架量化模型丢弃的对称信息,定义零纤维与稳定子,可高效计算,应用于掩蔽、指纹与隐私保护。
自动微分从零开始:PyTorch如何计算物理信息神经网络中的梯度
本文以具体数值示例,完整揭示PyTorch自动微分在PINN中计算两级梯度的流程(计算图、反向传播、图上图机制),并用理论验证。
面向流式系统中事件触发LLM调用的不确定性感知序贯决策规则
将LLM调用建模为风险序贯停止问题,证明阈值策略最优,实验显示亚线性遗憾与92.9%高诊断质量。
从神经网络中定向恢复权重空间机制
定向参数分解(tPD)通过高秩组件处理非目标数据,仅提取特定输入的可解释计算组件,大幅降低计算成本。
TSSM:用于全球站点天气预报的三轴状态空间模型(时间-变量-历史建模)
提出三轴状态空间模型(TSSM)及历史增强范式,在最大站点天气数据集上达SOTA,准确率提升10%,极端事件指标提升61%,长期预测与缺失观测下鲁棒性优异。
基于能力与熟练度建模的知识状态解构方法
将学习行为分解为能力与熟练度两阶段,用多分支Transformer建模知识状态,有效提升预测性能。
STKAN: 用于时空预测的Kolmogorov-Arnold网络
STKAN引入泰勒多项式KAN模块,通过可学习分组和时空混合提升预测精度,性能优于MLP变体。
CoDiffGRN: 通过BEELINE-KGC基准和协同进化离散扩散重新思考基因调控网络推理
提出归纳排序中心图补全基准与协同进化离散扩散框架,显著提升新调控关系发现性能。
并发图像理解与生成:自校正耦合马尔可夫跳跃过程
提出SC-CMJP框架与CO2Jump采样器,实现跨模态实时纠错,在联合生成任务中性能最优且随去噪步数单调提升。
Accuracy-Preserving Stability Regularization for Large-Scale Retail Demand Forecasting
EMAGN: 基于学习聚类的可扩展交通预测高效多注意力图网络
通过学习聚类线性化空间注意力,EMAGN在保持近全注意力精度下,训练时间减少32%,内存降低58%,且可扩展到更多注意力头。
重新评估Muon用于矩阵分解
Muon在矩阵分解中未稳定优于AdamW,其优势对超参数选择敏感。
解构Actor-Critic:面向从业者的设计组件大规模实证研究
基于三万多次实验,发现高斯动作分布等默认配置不可靠,有界分布与自适应更新更稳健。
ShortOPD:通过短到长在策略蒸馏恢复被剪枝的大语言模型
ShortOPD通过检测重复后缀优化训练预算,使被剪枝LLM生成质量提升9倍,训练时间减少71%。
针对离散选择估计的表格基础模型
编码选择集依赖和个体异质性的表格基础模型,在离散选择估计中优于分层贝叶斯,精度高8%,速度快16倍。
SteinGate:基于Stein差异的尾部敏感安全强化学习
SteinGate用核化Stein差异检测成本尾部异常,动态调整策略,大幅减少训练中的安全违规,保持高回报。
HEDGEHOG:严格分层过滤的药物生成器评估
HEDGEHOG六阶段过滤,仅0.65%分子通过,暴露生成器难同时满足药化、合成、对接及3D要求。
PUe:通过因果推断增强有偏正-无标记学习
提出归一化逆概率加权PU框架,解决标签选择偏差,实验验证提升分类效果。
EXPLORE:利用语言模型通过引导搜索探索模拟拓扑生成
提出EXPLORE框架,结合蒙特卡洛树搜索与语言模型解码,将模拟拓扑生成成功率从12%提升至65%,均方误差降低20%以上。
统计优势是否值得付出代价?KAN与MLP在结构化数据分类中的实证对比
KAN在分类精度上优于MLP,但计算成本显著更高,适合高精度任务,MLP则适合资源受限场景。
OrDA:面向首页营销块推荐的行为习惯正交解缠框架
提出OrDA框架,通过正交解缠与因果干预消除习惯性点击偏差,提升点击率5.64%。
基于注意力头重加权的大语言模型数据高效适配
提出注意力头重加权法,仅调整模型0.0001%参数,在少量样本下性能超越LoRA。
Agora:集体且无需许可的互联网规模大语言模型预训练
首个无需许可的互联网规模大模型预训练,330节点40天训练8.6B参数模型,效率达集中式63%。
权重反馈在现代深度网络中局部计算雅可比转置
WF-Act-PC通过三项局部修正实现雅可比转置分解,免除自动梯度反向传递,在CIFAR上超越经典PC,媲美调优BP。
温度缩放并不足够:人类标签分布下的校准差距
软标签下温度缩放校准存差距,随模型规模增大且语言域更显著,多数投票标签误报可靠性。
Where Should RL Post-Training Compute Go? Model Size, Search, Learning, and Feedback
中文标题:自我改进往往是突然的:大规模模型的启蒙式微调
受人类顿悟启发,提出免训练后调优方法,通过修改快捷方式无需更新权重即可突发提升性能。
离散扩散模型:从标记化到生成的统一框架
离散扩散模型通过统一框架揭示设计权衡,从标记化到生成指明未来方向。
基于VAE的多任务卫星辅助语义通信框架,用于6G网联自动驾驶车辆
提出VAE多任务语义通信框架,以概率潜在表示实现高效编码,在卫星辅助自动驾驶中减少带宽高达98%并保持稳定性能。
强化学习中的分解谱表示
FaStR将转移核分解为三模张量,用CP分解学习独立编码器,降低样本复杂度,提升高维运动任务效果。
CDS:空间图中结构化干预的反事实方向性分数
提出CDS框架,通过反事实干预量化空间图中节点类型间的方向性影响,实验验证鲁棒有效。
ExTernD: 扩展秩三元分解——精度逼近任意量化级别的三元LLM后训练量化
ExTernD通过扩展秩三元分解,使后训练量化误差可任意减小,精度逼近bf16,有效bpw约5.2-5.7,性能接近Q4_K/Q5_K。