HyperDFlash:基于门控残差缩减的MHC对齐块推测解码
针对多超连接架构,HyperDFlash通过残差对齐和门控缩减,优化块推测解码,提升草稿质量与解码速度。
深度学习的算法基础:复杂度理论速率与通用逼近的表征
神经网络复杂性由算法复杂度决定,通用逼近需含非仿射非线性,参数可指数级优化。
关于“AlphaEdit: 语言模型的零空间约束知识编辑”的可重复性研究
复现AlphaEdit,证实其效果但发现优势不通用,长序列编辑性能下降,影响下游任务与安全。
批量不变光谱智能:鲁棒且可解释的昆虫认证
BISN框架通过可学习预处理和对抗学习抑制批次光谱差异,在三类昆虫认证中达0.93准确率,可解释AI确认依赖脂质蛋白吸收区域。
AIGP:基于大语言模型的电子商务定价长期价值对齐框架
AIGP利用大语言模型和长期价值评估器对齐定价与长期目标,在淘宝工厂测试中GMV提升13.21%,ROI提升7.59%。
数据同化中基于共形预测的不确定性量化
用共形预测量化数据同化不确定性,与集成方法比较,评估三种变体性能。
基于JEPA的世界模型泛化理论
本文提出JEPA世界模型首个泛化理论,建立预训练误差与规划后悔关联,获得有限样本界并揭示潜在维度权衡。
利用比较寻找驻点
针对非凸函数比较预言机,提出经典~O(n²/ε¹·⁵)和量子~O(n/ε¹·⁵)的ε-驻点查找算法。
辛神经网络学习广义哈密顿量
提出隐式辛积分器HNN训练,利用伴随系统高效反向传播,降低计算成本,实现混沌系统准确能量守恒与哈密顿量学习。
State Representation Matters in Deep Reinforcement Learning: Application to Energy Trading
中文标题:你有多确信?提升医疗视觉问答中言语化不确定性校准
中文摘要:提出复合损失函数微调多模态模型,含Brier校准、锚定正则化、对比对齐与KL稳定项,校准误差降60%,判别力升26%,保持精度。
联邦学习中的量化:方法、挑战与未来方向
量化缓解联邦学习通信瓶颈与异构性挑战,综述核心方法、交互行为及未来方向。
参数型先知不等式问题的渐近最优学习
针对指数型参数族先知不等式,提出置信度动态规划策略,达到渐近最优竞争比。
GEOALIGN: 用于鲁棒LLM强化学习的几何轨迹策展
Geoalign通过检测并修正方向不一致的生成轨迹,提升LLM强化学习稳定性与性能,实现高效对齐。
面向决策对齐的不确定性量化评估
提出决策对齐标准,揭示传统指标与决策效用不对齐,引入先验加权效用指标实现对齐。
无数据水库特征实现高效长周期冷启动持续学习
提出基于固定水库特征和流式线性判别的无重放增量学习方法,在长任务分割中性能优异且训练极快。
科尔莫戈罗夫-阿诺德网络(KAN)在气动预测中的应用:与MLP和GNN的比较
KAN在翼型压力预测中性能略逊于MLP,低于GNN,但复杂度低、训练快,存在训练不稳定问题。
基于Transformer与LOOCV的细菌拉曼光谱分类
本文用嵌套留一重复交叉验证证明Transformer分类细菌拉曼光谱优于传统方法,无需预处理且鲁棒性强。
基于特征诱导信息流的时序图神经网络解释
提出基于NRM框架的归因方法,分析事件诱导变量完整信息流,模块化解构架构,实验优于现有方法且更具可解释性。
Heavy-Ball Q-Learning with Residual Weighting Correction
基于逆倾向得分的交叉头注意力提升网络在未观测混杂下的应用
提出CHAUN和RA-IPS方法,解决未观测混杂下提升建模偏差,QINI提升25.6%,RA-IPS优于IPS 5.4%。
RecallRisk-BERT:用于报告后医疗器械召回分诊的多任务框架
开发多任务模型同时预测召回严重性和根因类别,准确率达0.963,风险排名与根因模式高度一致。
带模型辅助采样的随机梯度优化
提出模型辅助采样框架,结合调查采样理论降低梯度方差,提升优化效率,与现有优化器兼容。
基于视觉语言模型引导的势能奖励塑形自动化
本文提出VLM-PBRS框架,利用小型VLM偏好学习自动合成势能函数,无需专家设计,加速强化学习并提升鲁棒性。
fTNN:面向分数阶偏微分方程的张量神经网络
提出fTNN,一种确定性张量神经网络子空间方法,通过几何适应积分和边界奇异感知函数,显著提升分数阶PDE强边界奇异性问题的求解精度。
图神经网络跨领域应用:全面洞见
综述图神经网络在12个领域的应用,分析图结构计算成本的价值,提炼跨领域共通挑战与架构选择。
Beyond the Hard Budget: Sparsity Regularizers for More Interpretable Top-k Sparse Autoencoders
线性模型在时间序列预测中能有多好?
通过调整预处理而非扩大模型,线性模型可超越大多数大型模型。
可解高维生成对抗网络中的有效协方差动力学
研究高维GAN有效协方差动力学,证明训练收敛至ODE,揭示低秩相关增强弱方向、过强相关破坏恢复机制。
RSPC: 基于精神科医生标注的数字媒介关系中压力与精神状况建模基准
RSPC数据集含1799条精神科医生标注的Reddit帖子,评估模型在关系情境下的心理障碍分类与触发检测,推动情境化心理健康建模。
BetXplain: An Explanation-Annotated Dataset for Detecting Manipulative Betting Advertisements on Social Media
面向可移植查询生成的奖励信号设计:工业语义化职位搜索案例研究
RLAIF生成可移植查询,奖励塑造比优化器关键,GRPO易受虚假奖励攻击,引入规则修正提升0.147质量。
一种基于多保真度卷积自编码器-迁移学习的框架,利用大规模仿真和有限实验数据集进行导波损伤诊断
融合仿真与少量实验数据,多保真度迁移学习实现板结构损伤高精度定位(R²>0.93)与定量(R²>0.99)。
从解数据恢复控制方程:线性和非线性常微分方程的可辨识界
引入Hausdorff距离度量ODE差异,建立可辨识性界并分析样本复杂度下界。
布莱克威尔可逼近性与梯度均衡等价
证明梯度均衡与布莱克威尔可逼近性算法等价,进而与遗憾最小化等框架等价,可相互高效转换。
世界模型中的幻觉是可预测和可预防的
世界模型幻觉源于数据覆盖不足,通过覆盖感知采样和好奇奖励可预测并预防,仅需少量轨迹适应新环境。
评分并非万能:填补排序中效用与公平性权衡的鸿沟
评分无法最优权衡效用与公平性,半贪婪后处理可接近理想。
自回归玻尔兹曼生成器
提出ArBG框架,摆脱流模型限制,在肽系统显著提升性能,Robin模型将能量误差降低60%以上。
误差条件神经求解器
ENS将PDE残差场作为网络输入,学习迭代修正策略,在四类PDE上取得最高预测精度,且泛化性优于残差最小化方法。
无真实解强化学习改进LLM
RiVER框架通过校准奖励在无真实解任务上训练LLM,提升评分与精确解基准性能。
强化学习实现模拟毛细血管中自主微机器人导航与干预
开发真实毛细血管模拟,训练深度RL实现自主导航与靶向干预,恢复血流至健康水平。
输入维度在对抗样本出现与目标控制中的作用
本研究证实高输入维度使对抗样本更易构造且目标攻击额外失真有限,根源尚存争议。
复杂网络中链接预测的代码进化
代码进化自动设计链接预测算法,在580个网络上AUC达0.915,优于人工的0.783,计算高效且特征组合创新。
Interpreting "Interpretability" and Explaining "Explainability" in Machine Learning in Physics
平均场PhiBE:基于离散时间数据的连续时间平均场强化学习
提出MF-PhiBE,将离散数据融入连续PDE,实现无模型平均场控制,误差阶Δt。
MIRROR:面向智能体RAG的新颖性约束记忆引导MCTS红队攻击
MIRROR用新颖性约束记忆引导MCTS,在图像投毒达76%、编排器攻击达97%成功率,成本减半,跨面方差最低。
归因但非增量:大规模广告的蚕食修正归因
提出实验校准归因修正框架,以增量实验为锚点校正偏差,部署后蚕食率降低约15%。
像评委一样聆听:面向自动歌唱表演评估的音乐感知框架
MusicJudge框架通过多模态对齐分析歌词与音乐忠实度,实现自动歌唱评估,与专家判断高度一致。
用Transformer生成特殊三角剖分
使用Transformer生成4D自反多面体的精细正则星形三角剖分,为Calabi-Yau流形分类提供新方法。
面向PDE反问题的潜在扩散后验采样与代理似然引导
提出L-DPS框架,结合VAE与潜在扩散采样,利用代理似然引导,高效准确求解高维PDE逆问题。