一般空间及扩散几何中的快速行列式采样
提出在黎曼流形和加权网络上,行列式采样速率匹配欧几里得空间,达(sample size)^{-1/2-1/(2d_int)}。
HiFuzz:面向语义感知和自适应CPU模糊测试的层次强化学习
HiFuzz用层次强化学习与语义感知编码器提升CPU模糊测试覆盖率和缺陷检测,显著优于现有方案。
Pelican-VLA 0.5:行动前关注有益于泛化
Pelican-VLA 0.5通过可学习推理槽实现注意力级泛化,无需标注或微调即可聚焦指令相关物体。
使用生成对抗网络和图像表示创建配电网布局
提出数据驱动的GAN框架生成配电网布局,可结合地理信息,但缺乏电气约束,需未来扩展。
The Power of Backdoor Absorption in Community Training
优化几何动力学:动态几何优化的框架
提出优化几何动力学框架,将优化视为参数、分布和度量的耦合演化,定义动态几何复杂度。
宏观经济消息传递用于预测外汇体制变化:一种基于图Tsetlin机器的深度逻辑学习方法
利用图Tsetlin机器和宏观经济消息传递,预测美元/日元汇率体制变化,构建可解释逻辑子句。
使用差异感知特征的部署风险评估:Prime Video案例研究
提出基于差异感知特征的部署风险框架,用LLM提取多语言特征,在Prime Video和ApacheJIT数据集上达0.83召回率和0.81F1值,发现代码结构复杂度比行数变化更有效。
先验感知与上下文引导的组采样用于主动概率子采样
提出PGA-DPS,融合先验和组采样优化主动子采样,在分类、重建、分割任务上超越现有方法。
张量列扩散:利用低秩结构进行高维基于分数的采样
提出基于函数张量列格式的HJB方程求解器,利用低秩结构高效近似高维函数,实现快速鲁棒采样。
CaLiSym:通过结构化正则提升学习真实世界系统的辛动力学
CaLiSym框架通过结构化正则提升将精确辛学习扩展到含驱动耗散的真实系统,实现保几何的高效动力学预测。
强化学习的数学方法
综述强化学习数学基础,涵盖MDP、Bellman算子、优化及函数逼近,提供统一数学入口。
Flow-ERD:面向多样交通仿真的智能体类型感知流匹配与熵正则化蒸馏
Flow-ERD结合类型感知流匹配与熵正则化蒸馏,兼顾真实性与多样性,在WOSAC测试中排名第一。
张量化算法与隐马尔可夫及因子隐马尔可夫模型的可扩展滤波方法
利用张量代数直接处理fHMM多维结构,显著提升滤波效率,实现大规模时序数据高效分析。
寻找随机凸问题的驻点
针对随机凸优化提出更强驻点准则(次微分含小元素),通过维数理论分解次微分图并随机采样保留片段,实现近似近端点方法求解。
打破结构隔离:基于社区感知采样和结构熵的可扩展图聚类
提出SCISE框架,融合社区感知采样与约束结构熵,解决图聚类结构隔离,实现高效可扩展聚类。
统计有意义几何与规范对称性破缺:科学发现与智能涌现的几何基础
统计有意义几何框架证明,OOD刺激导致几何崩塌触发规范对称性破缺,实现智能涌现与真伪发现区分。
几何感知基础设施锚定降噪器用于UWB感知与工作区重建
GAIA通过几何感知范围降噪,提升UWB工作区重建精度,MSE降低18.4%,IoU提高15.5%。
Design-CP:用于蛋白质纳米颗粒设计的上下文并行性
提出Design-CP并行策略,实现多GPU上大型蛋白质复合物高效设计,在小集群上即可完成纳米颗粒设计。
基于可控性-可观性测试的深度神经网络经验最小实现压缩
提出可控-可观性框架压缩深度神经网络,通过数据驱动秩估计实现高压缩比且保持精度。
外生丢弃法:一种用于协变量鲁棒时间序列预测的简单且强大的基线方法
外生丢弃法通过训练中随机归零外生通道,显著提升协变量时间序列预测对噪声、错位、缺失的鲁棒性,且保持精度。
粒度悖论:时间离散化如何虚增样本内拟合并加剧样本外误差
高频离散化提升样本内拟合,但递归误差叠加加剧样本外误差,标准指标掩盖累积传播。
AdaStop:面向DNN测试选择的成本感知早期停止
AdaStop通过成本效益决策自动停止标注,用9%-31%预算发现65%-84%故障。
面向名义和有序属性的分类数据聚类中可学习的属性内距离加权
提出统一处理名义和有序属性的距离度量,并设计聚类算法同步学习权重与划分,避免次优解。
利用离线强化学习控制LLM智能体执行框架
将框架操作建模为MDP,离线RL训练轻量控制器,显著提升验证行为和任务质量,揭示框架为可学习控制层。
无参数编码器在关系数据库基础模型中依然可行
分析标签输入下编码器属性,证明可训练参数受限,简单无参数编码器仍具强性能。
InvWeaver: Deductive Feedback for Invariant Synthesis in Interacting-Loop Programs
InvWeaver通过演绎反馈合成多循环程序不变量,解决72/82问题,优于现有方法。
具有跨回合记忆和策略蒸馏的自我回顾强化学习(SRRL)
提出SRRL框架,通过自我回顾步骤和策略蒸馏将稀疏反馈转化为持续行为改进,有效提升学习效率。
基于反事实策略的安全贝叶斯优化
利用共形预测估计反事实基线的不确定区间,集成安全贝叶斯优化,实现可控约束违反率。
中文标题:基于物理的联邦强化学习用于智能电网分布式稳定控制
中文摘要:FedPPO-PG框架实现智能电网暂态稳定100%控制,稳定时间减少72.4%,控制功率降低7-14倍。
EquiFiLM:通过特征线性调制的电荷条件等变力场
提出EquiFiLM,利用特征线性调制为等变力场添加电荷条件,仅需少量数据即大幅降低力与能量误差,推理成本不变。
每个Token抛硬币:大型语言模型的伯努利稀疏引导
通过随机屏蔽部分令牌,仅用50%令牌即可恢复密集引导效果并保持流畅性,最优引导强度与干预比例成反比。
SafeImpute: 通过共形选择实现可靠的临床数据插补
SafeImpute提出共形选择控制错误发现率,实现可靠临床插补,在多数据集上验证高精度与误差控制。
PatchOptic:面向共享状态LLM工作流的投影视图与验证结构化更新
PatchOptic通过投影读取与验证补丁,在LLM工作流中建立局部更新与全局有效性的契约,降低泄漏和成本。
λ-VAE:后验坍塌的方差均衡
λ-VAE通过重参数化中缩放噪声而保持KL惩罚不变,实现方差均衡,消除后验坍塌,显著提升信息容量与重建质量。
直觉模糊图嵌入随机向量功能链接的多视图学习
提出直觉模糊图嵌入多视图学习模型,融合模糊集、图结构及多视图信息,提升分类准确率与鲁棒性。
Heckman校正的认知不确定性:不可观测变量的选择效应使重要性加权失效
Heckman校正模型解决不可观测变量导致的样本选择偏差,恢复不确定性校准,而重要性加权等方法在此场景下彻底失效。
FourTune: 迈向扩散模型的全4比特高效训练后优化
FourTune提出全4比特训练后优化框架,内存降低2.25倍,吞吐提升2.27倍。
基于图神经网络、深度交叉网络和SMILES嵌入的多模态分子表示学习
融合3D几何、SMILES拓扑和宏观描述符的三模态模型,以<1M参数实现QM9 U0_atom MAE 0.0207 eV,误差降低20.6%。
使用双变量循环码的低开销纠错量子卷积神经网络
提出基于双变量循环码的低开销QCNN纠错方案,验证了其在高噪声下的有效性,迈向实用。
同一枚硬币的两面:学习后门以移除后门
HARVEY通过学习中毒样本预言机精准识别后门,实现近乎完美的后门移除,性能优于现有方法。
自主订单拣选机器人的动态电池管理的深度强化学习
提出PPO深度强化学习框架,动态优化充电站选择与时长,使订单完成率提升6%并减少充电时间。
时间分布偏移下的域自适应气候降尺度
针对气候降尺度中的时间分布偏移,提出域自适应框架,通过历史监督与域对齐提升未来气候投影鲁棒性。
正交树突内在网络:一种面向重要性排序的正交潜空间架构
ODIN通过几何约束实现潜变量正交且方差排序,融合PCA可解释性与深度网络能力。
LLM驱动的神经网络生成与同族架构引导:区分迁移与适应
提出源引导候选生成,用同族强模型改进弱目标,准确率大幅提升,LLM适应而非复制源配置。
多买家市场中的战略谈判:基于可验证奖励的强化学习用于大语言模型协商
本文用可验证奖励的强化学习训练LLM卖家,实现市场探索与收益平衡,显著提升谈判效益。
面向决策的场景生成与选择以实现高效鲁棒的电网调度
提出决策驱动场景生成框架,优化场景以降低电网运营成本,适用多种模型,成本降低0.8%-2.02%。
更令人信服而非更正确:无参考LLM评判器的自对弈奖励滥用
自对弈奖励滥用源于评判合理性而非正确性,先自答可防止假阳性盆地。
差分隐私自然梯度下降
提出DP-NGD框架,解耦曲率估计与隐私数据,实现SOTA准确率和10倍收敛加速。
没有可追踪的子空间:低秩训练中的不可辨识性与优化器状态
低秩训练中子空间不可辨识,仅约1/3的方向可重现;LDAdam通过状态变换超越传统GaLore。