跟我说吧,Jarvis:面向自动驾驶赛车的开源可边缘部署语音助手框架
离线语音助手Jarvis基于Mistral 7B微调实现指令分类,准确率97.63%,延迟1.39秒,开源。
HMB-GAN:用于矢量形状合成的混合多贝塞尔GAN
提出HMB-GAN,以混合量子-经典GAN生成CAD矢量形状;量子生成器收敛快、参数少,但受硬件与模拟开销制约。
全连接层稳定结构化稀疏化的逐层解耦方法
提出逐层解耦的结构化稀疏化法,顺序剪枝缩减层宽;证明其与联合惩罚最优等价,较耦合更稳健,正则范围更宽。
EnSol:一种用于分子溶解度预测的环境感知图神经网络
EnSol以图神经网络与交叉注意力建模溶质-溶剂作用,结合温度调制和混合密度网络预测溶解度分布,基准与实验均领先。
M2G-LLM:通过多模态图推理与LLM上下文注入增强临床预测
M2G-LLM借图神经网络融合多模态临床数据并注入LLM中间层,在MIMIC上提升临床预测表现。
TierKV:基于预测式多层KV缓存的长上下文端侧大语言模型
TierKV提出预测式多层KV缓存,将token分至精确、低秩、闪存层,保留全上下文,吞吐最高提升17.6倍,KV内存降12.5%-34%。
面向机器学习驱动应用的信号中心遥感:基于替代预处理与声学处理
用CSV替代图像表征处理声呐实验显示处理时间降91.18%,ML检测更准,SNR/PSNR等指标提升
SWE-Proof:语言模型能否用机器校验的证明解决现实问题?
提出形式验证流水线SWE-Proof,发现测试遗漏大量错误;正确规范可将解决率从85%提升至95%,但忠实规范生成仍是难题。
以可靠性为中心的稀疏纵向CT病灶大小预测评估:保形区间校准与Gompertz启发式正则化
稀疏CT病灶预测:控制时域后增加历史收益有限,准确度、不确定性可靠性与轨迹一致性须联合评估。
多受试者预训练实现闭集语料表面肌电语音解码的短校准个性化
多受试者预训练加目标被试短校准,可在50句闭集语料上实现sEMG静音语音解码,3分钟校准即达20.5%字符错误率,接近全量校准效果。
追溯零样本时间序列预测背后的证据:来源优先的分类体系与审计框架
提出零样本时序预测的来源优先分类与审计框架,主张审计证据边界与接口假设,避免榜单进步失真。
FairLMs:语言模型公平性的一站式工具库
FairLMs:语言模型公平性工具库,整合33项指标、14种缓解组件与14项诊断,实现可复现比较。
快速准确的文本内容文件类型识别
提出神经网络模型识别文本内容文件类型,尤其源代码,更准且比Magika快约4倍、体积小28%。
带缓冲分位数目标的深度强化学习
提出无模型分布强化学习框架Deep-BQRL,用缓冲分位数平滑风险敏感目标,并以集成分歧引导探索。
压缩驱动机器学习导论
压缩与机器学习可互相转化;本文综述形式化相关策略,提出设计框架,在恶意软件检测上显著优于基线。
常规血检在区分儿童细菌性与病毒性感染方面优于CRP
血常规联合CRP与年龄的XGBoost模型鉴别儿童细菌/病毒感染,AUC达81.7%,优于单用CRP。
中文标题:基于神经时间点过程的业务流程执行概率预测
以神经标记时间点过程对业务流程执行做概率预测,显式处理时间戳并列,单次前向即得校准良好的剩余时间分布。
知识图谱增强的 Chronos-2 用于 HEC-RAS 代理预报
将时序基础模型与工程知识图谱耦合,提升HEC-RAS水位代理预报,RMSE较冻结基线降低14.13%。
IntBMoE:将块级条件融入专家组合,实现全参与式混合专家
IntBMoE以密集专家组合+稀疏块执行解耦参与、计算与内存,超网络按码本合成全池专家;多任务优于基线,已上线高德,A/B相对UVCTR提升2.4%。
最优随机恰当在线学习
随机恰当在线学习的最优期望错误界为O(L(H)logT),此前为O(L(H)log⁶T)。
论排斥型与吸引型教师:在自蒸馏中分离正确性与行为
自蒸馏中,吸引与排斥教师会带来相反行为偏移;二者对比可抵消行为影响,留下更纯正确性信号并提升推理。
基于KKT重构的均值-方差投资组合决策聚焦学习
提出将MVO的KKT条件嵌入上层学习的单层决策聚焦学习框架,保留预算与卖空约束,ETF实证表现最优。
留一被试评估下的高效架构搜索
提出PainNAS,在留一被试评估中共享架构搜索,次数由N降至B,以更少参数和算力取得相当精度。
通过激活引导补偿与正交残差理解大语言模型量化
将量化误差分解为激活引导补偿与正交残差,指导旋转、符号与缩放,无梯度实现W4A4并媲美SpinQuant。
IncentRL:偏好引导与任务性能之间的权衡
IncentRL用KL惩罚引入偏好引导,理论刻画对原任务性能影响,实验成功率升至98%,权衡明显。
什么必须保留?资源充足学习的精确任务信息—状态前沿
任务信息可借低秩划分压缩状态,并给出精确前沿、近似边界与NP难性。
OpenMAS-GCom:图增强多智能体系统的诊断基准
提出OpenMAS-GCom诊断基准,以受控干预归因通信结构、角色分配与信息流对图增强多智能体系统性能的影响。
MACE:多智能体系统下基于自适应记忆图的记忆-智能体协同演化
MACE 借自适应记忆图协同演化记忆与智能体,在多智能体基准上达 81.11%,超越十种基线。
OneBid:面向多样化 oCPX 广告场景的统一自动出价基础模型
OneBid统一自动出价基础模型,融合双信号DT、MoE与CROP,快手部署后oCPX广告ADVV提升2.2%。
RegKT:基于IRT正则化器的可解释且鲁棒深度知识追踪
提出新正则化技术,提升深度知识追踪模型的鲁棒性与可解释性,缓解小数据过拟合,利于教育应用。
黎曼神经哈密顿流:测地辛输运与可解释性
提出黎曼神经哈密顿流,融合黎曼动能、学习势能与测地蛙跳积分,揭示可解释性,并在欧氏、双曲、球面空间取得竞争性结果。
SpecQuant:融合多父代量化与投机解码的自适应大模型推理
SpecQuant免训练结合投机解码与多父代量化,动态路由不同精度模型,提速35–43%且精度损失<2%。
超越高斯世界:潜在几何结构对JEPA至关重要
将JEPA分布匹配分析推广至黎曼流形潜变量,证明球面均匀分布同样可线性恢复,高斯唯一性并非普遍成立。
循环 Transformer 中以深度换时间
循环 Transformer 插入潜在思考令牌,以时间计算替代加倍深度,性能接近且参数少约48%。
基于测度量化的多域聚类
提出基于测度量化的多域聚类框架,学习共享聚类原型,采用Sinkhorn散度与小批量优化,在多域基准上优于基线。
GraphSkillEvo:图结构智能体技能的进化优化
提出图结构技能与种群进化优化框架,在五个智能体基准上超越SkillOpt,平均准确率提升4.01%。
GEM-MPC:通过专家引导规划平衡探索与利用
GEM-MPC用MPPI融合模仿规划器的策略与KL正则探索策略,并借门控先验蒸馏高效利用规划数据。
等价布朗RKHS表示的优化几何
RKHS坐标优化:节点/谱GD/SGD轨迹同,增量GD为布朗度量欧拉步,Adam等变性限带符号置换。
拓扑与超参数的双层优化(BOTH)
用自动微分对拓扑优化求超梯度,与主优化联合调参;仅需一两步评估即可调数千超参数,成本约几次标准优化。
超越运动学:肌肉驱动模仿学习的仿真保真度基准评测
对比HyFyDy与MuJoCo流程:运动学相近,但前者肌肉激活更贴合实验EMG,生理真实性更强。
矩阵AdaGrad:行向与列向自适应次梯度方法
提出矩阵在线镜像下降框架,导出按行/列梯度范数自适应的行向与列向AdaGrad,遗憾界更紧,实验验证有效。
面向高维异构数据的联邦深度聚类网络
提出FedDCN,联合优化重构与聚类损失,并用几何正则对齐隐空间,提升非独立同分布下聚类性能。
神经细胞自动机在其隐藏通道中学习通用特征
NCA隐藏通道解耦特征提取,习得尺度不变的通用拓扑基元,仅约9800参数即可借教师隐状态迁移实现强小样本泛化。
等待终结——消费级GPU上的交互式扩散生成
提出嵌入翻译器压缩文本编码器,梳理速度/质量/内存权衡,消费级GPU实现亚秒级首图延迟的交互式扩散生成。
从自由能视角检测大语言模型中的预训练数据
从自由能视角提出ETD,用熵校正预测损失,提升预训练数据检测,平均AUROC最高提升3.5%。
大语言模型作为文本与表格预测的特征工程师
以LLM迭代生成可解释类别特征,用模型错误反馈引导搜索,特征发现快3倍,优于TF-IDF与稠密嵌入。
ExpBoN:面向高效测试时LLM对齐的指数噪声Best-of-n
提出ExpBoN指数噪声软Best-of-n,具有限n精确分解与指数收敛;ExpGSI保持精度并降算力14%–39%,Qwen3最高45%。
干预粒度至关重要:临床世界模型反事实模拟中的连贯治疗组合
临床干预常以组合记录,完整呼吸机组合比单设置更能改变世界模型预测,干预粒度显著影响反事实模拟。
面向等权乘性粗粒化的几何平均池化
几何平均池化GMP融合符号乘积与幅值几何均值,无参数;合成任务优于均值/最大池化,效果因任务而异。
折点与光滑性:面向类拉普拉斯源的实解析非线性ICA的可辨识性
证明实解析生成函数在源密度一阶导有限间断(如拉普拉斯)时可辨识,实验验证。