白化颠倒层级:白化嵌入的范数究竟度量了什么
白化反转谱层级,平方范数由噪声主导的近退化方向决定,实为语义异常度的马氏度量而非似然,排序有效但高斯阈值失准。
具有泊松决策时刻的连续时间回合制MDP中的可证明高效强化学习
研究泊松决策时刻的连续时间回合制MDP,扩展UCRL和Q学习,证明Õ(T^{2/3})最优悔界。
困惑度代价低估了激活量化所破坏的内容
困惑度均值无法揭示激活量化破坏的计算:检索比归纳更早退化,旋转基可显著恢复归纳。
对抗式细化何时有效?将R3GAN适配到时间序列插补的负面结果与开放问题
将R3GAN适配时间序列插补得负面结果:对抗细化无一致增益,常无效或有害;原因与适用条件仍待解。
按需查询任意电器:面向非侵入式负荷监测的提示可编程基础模型
单一提示可编程基础模型FM4NILM,按自然语言请求估计指定电器功率,无需重训即可扩展监测覆盖。
保证误差界下的科学数据压缩神经残差建模
提出RVQ+U-Net+GAE框架,校正像素残差并保证块误差界,提升科学数据压缩质量与压缩比。
K-TRAIL:仿真器引导的电磁/射频电路生成式设计
K-TRAIL以扩散生成结合无导数集合卡尔曼引导,借黑箱电磁仿真反馈优化版图,实现电磁/射频电路逆向设计。
对抗性多目标赌博机中坐标对帕累托遗憾的作用
对抗性多目标赌博机中,已知最易坐标不改善帕累托遗憾最坏阶;所提算法无需此知识即达最优且与坐标数无关。
主动推理智能体中基于大语言模型的可解释性失效:触发因素与诊断
审计主动推理智能体的LLM解释器:扰动与错误动作下解释流畅却失实,元数据注入可操纵并外泄数据,须审计。
面向一致规划与实时执行的近端残差价值函数
提出近端残差价值函数,以端到端RL学习规划与实时执行一致的价值函数,电商库存仿真总成本降5%。
用于数字健康活动结果早期预测的患者世界模型:能力与局限
患者世界模型可提前预测数字健康活动处方量,误差低至0.8%–2.9%,并揭示暴露因果解读的局限。
CTRL:基于控制的时间序列预测与LLM引导的残差学习
CTRL将语义推理与数值预测解耦,借LLM控制信号修正基础预测,并支持无标签测试时自适应。
自校准的代价:自适应监控中的精确证据预算与人造盲集
自校准监控保证误报率需精确证据预算,但容错漂移会制造盲集,对差分故障盲,盲集恰为倍速类。
幽灵输出为何能教学:从核视角理解潜意识学习
提出链式跨任务核,揭示幽灵输出监督经共享表征迁移能力,并验证半正定对齐、维度瓶颈与高熵输入机制。
在线对照实验中用于分层抽样的最优多路决策树
提出OMST,用最优多路决策树优化分层抽样,提升统计功效,树浅可解释,方差降低不逊于现有方法。
重复先知不等式的最优无悔学习
前缀反馈下重复先知不等式达到 Õ(√T) 期望遗憾并匹配下界,消除对盒子数 n 的多项式依赖。
ValueDiff:面向注意力汇被抑制大语言模型的值几何KV缓存驱逐
ValueDiff按值向量偏离缓存均值的L2偏差驱逐KV缓存,在弱注意力汇模型上大幅优于现有方法。
CSC:面向大语言模型时代冲突感知社交机器人检测的校准简约框架
提出校准简约CSC:简化图专家、单纯形校准融合与不一致专家,用于LLM时代冲突感知社交机器人检测。
Rethinking Class Imbalance for Single-Cell Foundation Models: A Systematic Benchmark Across Architectures and Long-Tail Loss Functions
面向竞争性地质解释早期排序的生成式反演
将竞争性地质解释转为空间先验,借生成式反演结合水头观测评分排序,实现早期优选。
BI-Agent与BI-Bench:迈向端到端商业智能自动化
提出端到端BI基准BI-Bench与工具增强智能体BI-Agent,后训练后准确率最高提升40%。
弹性阈值注意力:面向长上下文解码的学习型上下文稀疏性
端到端可训练的弹性阈值注意力动态预测上下文阈值,在长上下文解码中保持密集质量并实现稀疏加速。
用于高效分布学习的稀疏先验
提出稀疏先验与稀疏维度,证明k-稀疏先验下分布学习贝叶斯风险下界Ω(√(k/n)),可克服维数灾难。
Bio-MF:面向混合运动想象脑机接口的低延迟高保真EEG到fNIRS跨模态生成
提出单步MeanFlow框架Bio-MF,7毫秒完成EEG到fNIRS生成,混合解码精度显著提升。
量子模型会像大语言模型一样扩展吗?
量子模型神经标度律研究:近临界点损失呈幂律且统计更近自然语言,标度行为取决于模型-数据对。
当AI评审意见训练AI审稿人:科学判断崩塌与缓解
AI生成评审进入训练致递归审稿、评分与语义多样性下降,称科学判断崩塌;TrustReviewer以净化训练和激活引导缓解。
面向时序逻辑规范的高效贝叶斯自适应强化学习
面向LTL规范,同步LDBA与BAMDP,提出贝叶斯自适应RL与BAMCP,提升策略合成与样本效率。
连续延迟记忆随机梯度下降与连续时间强化学习:源自天体物理时间序列研究史
提出连续延迟记忆SGD与连续时间策略梯度强化学习,无需解HJB,可恢复吉布斯策略;回顾类星体光变SDE建模。
从切换遗憾到动态遗憾:一种基于无偏随机序列的简单归约
提出将动态遗憾归约为切换遗憾的简单框架,借助无偏随机序列,为强凸、指数凹和一般凸损失取得最优界。
MOSAIC-SR:面向科学方程恢复的Transformer引导符号回归
提出MOSAIC-SR,用Transformer草图引导搜索,结合常数优化与符号修复,在多基准上符号解率最高、精度领先。
REFINEPPO:通过迭代动作细化学习连续控制策略
提出迭代动作细化并融入PPO,在14个连续控制任务中匹配或超越PPO,部分收敛更快。
从压力到情感:跨可穿戴传感器模态的生理情绪识别多模态深度学习
多模态可穿戴生理情绪识别中,最佳时序架构因数据集而异;多模态传感更优,4赫兹兼顾性能与成本。
论最大编码率降低在分布外泛化中的局限
最大编码率降低在分布外泛化中存在根本局限,编码最优不保证稳定预测,即使引入不变性原则亦无法消除。
通过测试时通信扩展发现能力
测试时通信可让多智能体团队在难题和科研任务中超越独立尝试,随规模提升,并在算力充足时超过已知最佳。
Stiefel-AdamW:面向线性分解块的几何感知 AdamW
Stiefel-AdamW 将一因子约束于 Stiefel 流形,缓解 LoRA 等线性分解块训练不稳定,开销极小。
FedeRage:一般客户端漂移下可证明收敛的无分布假设联邦学习
FedeRage在参与分布未知的联邦学习中嵌入CVaR风险规避,侧重高损失与低参与客户端,收敛率O(κ/√T),提升精度与公平性。
基于感知调整查询的情感识别个体层面校准
提出感知调整查询框架,估计个体最小可觉差以等化任务难度,实验证明其能均衡个体感知难度并降低反应时差异。
面向基于Transformer的时间序列预测器的轻量级即插即用门控
提出轻量即插即用预编码器门控,调节协变量表示,可嵌入多种预测模型,无需额外调参且性能近基线。
ASGARD:基于强化学习的无人机韧性动作空间防护
ASGARD用教师-学生框架训练动作纠正监控器,仅凭状态历史机载抵御动作空间攻击,且泛化到未知攻击。
MIRCID:推断的枢纽miRNA推动药物机制建模的跨任务改进
MIRCID用推断枢纽miRNA重编码转录组,提升药物机制建模,miRNA增益比TF活性更一致。
跟我说吧,Jarvis:面向自动驾驶赛车的开源可边缘部署语音助手框架
离线语音助手Jarvis基于Mistral 7B微调实现指令分类,准确率97.63%,延迟1.39秒,开源。
HMB-GAN:用于矢量形状合成的混合多贝塞尔GAN
提出HMB-GAN,以混合量子-经典GAN生成CAD矢量形状;量子生成器收敛快、参数少,但受硬件与模拟开销制约。
全连接层稳定结构化稀疏化的逐层解耦方法
提出逐层解耦的结构化稀疏化法,顺序剪枝缩减层宽;证明其与联合惩罚最优等价,较耦合更稳健,正则范围更宽。
EnSol:一种用于分子溶解度预测的环境感知图神经网络
EnSol以图神经网络与交叉注意力建模溶质-溶剂作用,结合温度调制和混合密度网络预测溶解度分布,基准与实验均领先。
M2G-LLM:通过多模态图推理与LLM上下文注入增强临床预测
M2G-LLM借图神经网络融合多模态临床数据并注入LLM中间层,在MIMIC上提升临床预测表现。
TierKV:基于预测式多层KV缓存的长上下文端侧大语言模型
TierKV提出预测式多层KV缓存,将token分至精确、低秩、闪存层,保留全上下文,吞吐最高提升17.6倍,KV内存降12.5%-34%。
面向机器学习驱动应用的信号中心遥感:基于替代预处理与声学处理
用CSV替代图像表征处理声呐实验显示处理时间降91.18%,ML检测更准,SNR/PSNR等指标提升
SWE-Proof:语言模型能否用机器校验的证明解决现实问题?
提出形式验证流水线SWE-Proof,发现测试遗漏大量错误;正确规范可将解决率从85%提升至95%,但忠实规范生成仍是难题。
以可靠性为中心的稀疏纵向CT病灶大小预测评估:保形区间校准与Gompertz启发式正则化
稀疏CT病灶预测:控制时域后增加历史收益有限,准确度、不确定性可靠性与轨迹一致性须联合评估。
多受试者预训练实现闭集语料表面肌电语音解码的短校准个性化
多受试者预训练加目标被试短校准,可在50句闭集语料上实现sEMG静音语音解码,3分钟校准即达20.5%字符错误率,接近全量校准效果。