通过轨迹细化实现扩散语言模型的推理时扩展
提出粒子吉布斯采样算法通过轨迹级细化实现扩散语言模型推理时扩展新增细化迭代维度提升奖励引导生成
跨链路干扰下基于波束域机器学习指纹的RIS辅助毫米波定位
提出波束域指纹法用于RIS辅助毫米波定位,免CSI;KNN最优,无干扰时角度/距离误差0.37°/4cm,干扰下1.4°/7.6cm,且干扰对角度影响更大。
面向多步预测的基于优化的在线共形预测
提出O2CP,结合在线共形预测与跨步长优化,保持长期覆盖,生成更窄预测区间与更低遗憾。
边缘匹配不足以保证因子化采样:因子化生成模型中条件风格泄漏的审计
仅匹配风格变量边缘分布无法保证类别独立;MMD近零时线性探针仍高精度恢复标签,需约束条件分布。
面向散户的新兴投资组合管理应用:基于自然语言目标的个性化税务感知强化学习
面向散户的个性化税务感知组合管理应用,用自然语言描述目标,经强化学习生成推荐,已集成测试但未上线。
PRISM:通过结构化多模态数据合成实现优先级感知的规则内化
提出PRISM框架,用四阶段数据合成生成带优先级的规则集,仅用1万样本将多模态模型严格准确率从9.5%提升至30.1%,且不损通用性能。
解耦3D建模与空间推理
解耦3D感知与推理,提出DiSR:用现成感知模型生成几何证据,LLM仅据此推理,媲美端到端且更高效可解释。
纠正特征何时有用?一种面向黑盒预测器的纠正特征发现智能体
提出纠正特征发现智能体CRAFTER,从冻结预测器残差挖掘特征,经验证门控应用;超越专用系统,误差最高降27%。
超越全模型回滚:AuroSFT用于适配器状态多任务微调
AuroSFT以可合并适配器状态替代全模型回滚,冻结骨干仅训练适配器,在五类骨干上均提升平均准确率。
超越旋转:面向表达性量化正交微调的AuroOFT
新方法在量化正交微调上加门控低秩非线性残差,超越对比方法并节省三成以上参数。
解耦感知与描述:多元时间序列与语言之间基于计算的表示对齐
提出将感知与描述解耦,计算负责感知、LLM负责描述,构建CGTime模型,在多元时间序列理解上超越更大模型。
PPDL:将基于大语言模型的流程作为概率程序
提出概率语言PPDL,量化并传播大模型流程中的不确定性,支持推理缩放试验,无需额外编码。
MS-MLB:基于血液的多发性硬化分类的开放机器学习基准
提出MS-MLB开放基准,用血液RNA表达区分多发性硬化与健康对照,梯度提升模型得分最高。
收敛时扰动敏感性:识别虚假相关样本的简单信号
收敛后,对模型输入施加固定扰动,被虚假相关拟合的样本预测更稳定,其余更易翻转,据此无需组标注即可识别并重平衡,显著提升最差组准确率。
量子结构世界模型(QSWMs):用于预测性潜在动力学
提出量子结构世界模型,以复值及密度矩阵潜变量建模,在元胞自动机验证,显示局部预测潜力但长程展开受限。
谱蒸馏:从非线性动力学到线性状态空间模型
提出谱蒸馏方法:用凸优化学习隐式谱预测器,再蒸馏为显式线性状态空间模型,实现非线性动力学的可证明压缩学习。
评估机器学习模型预测野火后泥石流
系统评估15种模型预测野火后泥石流,TabPFN最优(威胁评分0.637),短时雨强最关键,合成数据增强可提升多数模型性能。
纠正几何错位:面向类别不平衡脑电的在线无源域适应
提出OSPDIM在线无源域适应法,在黎曼流形上实时纠正类别不平衡导致的几何错位,优于标准基线。
EvoHarness-RL:为长周期LLM智能体学习自演化运行时框架
提出EvoHarness-RL,学习构建与协调外部状态,ALFWorld成功率96.9%,显现框架退火与进化。
为何第三轴是自由
探索式建模的第三轴实为自由;弱约束促进泛化,XM优化自由,按自由选择可提升分布偏移下的表现。
IFlowNets:将生成式采样器扩展到不完整信息游戏中的策略学习
提出IFlowNets,扩展生成式采样至不完整信息游戏,证明原有约束不适配;性能与速度优于对比方法。
DG-FedReuse:基于代理梯度门控的缓存更新复用与匹配稀疏上行链路核算
DG-FedReuse以代理梯度门控复用缓存更新,上行节省约85%,计入下行后仅约42%,增益有限。
QEvict:面向注意力漂移鲁棒的长上下文解码的可恢复量化KV驱逐
QEvict:三级KV缓存管理,以可恢复量化驱逐替代永久删除,适应注意力漂移,固定内存下保留更完整历史,提升长上下文任务性能
KV-Skill:在模型原生语言中锻造专长
提出KV-Skill外部算子,从文本或经验压缩任务知识,冻结模型轻量读取,效果提升且可独立加载无遗忘。
矩阵Zonotopic注意力:面向集合Transformer的上下文自适应值投影
提出矩阵带状注意力,用上下文自适应值族替代固定投影,单层可表征高复杂度目标;实验优势集中于高秩稀疏组合任务。
混合概率Zonotope用于可辨识且可精化的预测不确定性
提出HProbZ输出头区分离散有界随机不确定性闭式似然可辨识异于高斯混合共享生成器精化预测
Align-RAG:对齐是TSFM上下文学习的唯一所需
提出免训练对齐方法,无需学习参数即可让冻结时间序列模型动态利用检索示例,超越训练适配器,零样本误差降低2.5%-13.7%。
LC-GRPO:以朗之万校正弥合基于流的GRPO训练-推理差距
LC-GRPO以朗之万校正弥合流模型GRPO训练推理差距,降低Wasserstein误差,提升奖励优化与质量。
推理错误在LLM残差流轨迹中具有区域和方向性
通过融合运动、区域和方向三流信号,在未见过的推理基准上准确率提升最高12%,且泛化于事实任务,优于现有方法。
GAUGE:面向不完整多模态分类的粒度自适应反事实证据门控
提出GAUGE,用泰勒反事实评分对细粒度证据单元进行门控,不完整多模态分类中优于基线,且有理论保证。
势匹配最优传输:精确p- Wasserstein动力学的连续归一化流
提出势匹配最优传输框架,用标量势参数化CNF速度场,以自诱导匹配损失训练,零损失时恢复p-最优映射。
一致性存在可计算的盲点:视觉-语言图形阅读无标签可靠性的交换理论
基于不变性的无标签可靠性有可计算盲点;等变性匹配编辑可测仿射错误,提出等变性-一致性评分免训练检测。
共识何时意味着正确?——用语义保持的重渲染测量一致性与准确性的耦合
构建语义保持重渲染等价集测VLM:重渲染优于重采样,一致性胜基线;但用自身共识微调反降精度。
谱混叠前置任务:旋转机械自监督故障诊断的新方法
利用谱混叠前置任务,无标注振动数据预训练Transformer,学得频率域故障特征,小样本下线性探针优于全监督。
学习排序张量网络缩并计划,用于GPU加速量子电路模拟
用学习排序法预选GPU量子电路缩并计划,列表式模型决策最佳,跨GPU排序稳定,可减少搜索成本。
基于环内本体的神经符号闭环控制激光粉末床熔融
提出几何条件神经符号闭环架构,本体内置于控制环,结合符号推理与统计学习,消除悬垂浮渣,并自适应新合金。
GROM:无梯度的快速一次性机器遗忘
提出一次性精确求解的机器遗忘方法,免梯度、免迭代,秒级更新权重,抗量化攻击,遗忘与效用达最优平衡。
CircuitSteer:基于稀疏自编码器电路的几何对齐多层操控
提出CircuitSteer,利用稀疏自编码器识别多层语义电路,通过几何对齐与多点干预,实现对模型行为的稳健有效控制,优于静态单点方法。
利用基于低成本替代纳米颗粒的知情预测模型加速连续流系统中的纳米药物开发
基于形状约束的预测模型利用少量数据即可准确预测纳米粒大小与分散性,减少实验,加速纳米药物开发。
以设备为中心的近实时工件定位:基于深度学习的视觉与事件驱动有限状态机
设备中心框架:多相机深度学习识别操作,事件驱动状态机定位;检测100%,误差318mm,延迟21s
多变量时间序列预测需要跨变量损失
直接预测忽视未来值间跨变量依赖,本文提出跨变量损失,用图正则化残差,提升预测精度。
无需模拟的任务难度预测
免模拟预测任务难度,从任务描述直接预估。十七个基准中,AUC可掩盖误差,词元熵有效,残差揭示环境缺陷。
SEAM:科学机器学习中超越局部准确性的全局一致性
提出SEAM将局部解释组装为全局一致性检验,定位不一致并归因到通道与重叠区域,实现科学机器学习审计。
BioM-JEPA:单细胞中图连接基因模块的联合嵌入预测
BioM-JEPA以图连接基因模块为预测单元,优于单基因重建,嵌入质量高且计算高效。
可解释分类中带弃权的证据规则学习
FERL:可解释模糊规则学习,输出证据性信念与弃权,Lipschitz稳定,30个表格数据集上精度最优。
表格基础模型是否自洽?
提出边际一致性与分解一致性要求;所有表格基础模型在分类和回归中均违反两者。
CohortHijack:单细胞注释对伴随细胞移除的鲁棒性
提出CohortHijack审计法,发现移除少量非靶细胞可改变单细胞注释结果,多起点搜索在保留靶细胞下改变最多24.33%标签,构成靶标保持攻击面。
超越特征重要性:聚类解释中模式检测方法的比较分析
比较RF、LIME、PCA检测聚类中预设模式,均无法全面识别,凸显模式级解释工具缺失。
THBKG:面向决策对齐的临床进展预测的时间生物医学知识图谱
构建THBKG,按决策时点证据预测II期至III期推进,图传播优于直接证据模型,实现可解释预测。
简单变换在文本嵌入模型间的转换能力如何?
研究发现简单线性映射无法普遍转换不同文本嵌入模型;兼容性取决于架构、目标、池化与数据分布。