5881 条条目 · 106 个活跃源
2026年8月27日
04:00
ArXiv AI

Tlow:基于流的推荐物品分词器

提出基于流的物品分词器Tlow,将语义嵌入标准化,实现独立高效编码,显著提升推荐性能与冷启动效果。

04:00
ArXiv AI

LumiXAI:面向特征归因的模块化全栈框架

LumiXAI是模块化全栈框架,统一分类与生成归因,提供交互界面、插件架构及三权限层,支持可复现分析。

04:00
ArXiv AI

COCI:会议组织者与内容标识符

基于LLM从征稿启事提取结构化元数据,对齐多个知识库,连接非正式学术与语义网资源。

04:00
ArXiv AI

自适应GR(1)规格修复用于强化学习中的活性保持屏蔽

提出基于GR(1)的自适应屏蔽框架,运行时检测环境违约,用归纳逻辑编程在线修复规格,保证活性且最小化目标弱化。

04:00
ArXiv AI

面向人类与机器代理的文学编程环境

提出一种人机协同的文学编程环境,用名字图关联代码与自然语言,优化LLM上下文,并提供类IDE工具。

04:00
ArXiv AI

使用大语言模型自动生成模型卡

提出MCTidy和MCGenie两种LLM方法,分别整理和生成模型卡,48个模型验证效果好,准确稳定。

04:00
ArXiv AI

字符串的模糊分段

提出基于前缀结构的启发式算法解决字符串模糊分段,证明其适用于模糊字符串匹配,并用动态规划求最佳分段。

04:00
ArXiv AI

LEMMA-RCA:面向根因分析的大规模多模态多领域数据集

提出LEMMA-RCA数据集,涵盖IT与OT多模态故障场景,评估六种基线,助力根因分析研究。

04:00
ArXiv AI

基于规划的高效大语言模型协作

提出COPE测试时协作框架,大小模型交替担任规划器与执行器,多阶段规划协作,性能媲美大型专有模型,大幅降低推理成本。

04:00
ArXiv AI

进化之光下审视强化学习的三大教条

从人工生命视角审视强化学习三大核心假设,提出以开放进化与热力学为基础的适应性主体理论

04:00
ArXiv AI

UCO:一种用于大语言模型自适应教学的多轮交互强化学习方法

UCO通过多轮交互强化学习与双重奖励机制,感知学生认知状态,动态调整教学策略,显著提升自适应教学效果。

04:00
ArXiv AI

ReflCtrl:利用表示工程高效控制大语言模型反思

提出ReflCtrl,基于表示工程识别反思方向并分步干预,控制反思频率,减少最多43.2%推理词元且保持精度。

04:00
ArXiv AI

X的原子单元:智能的压缩层

压缩演算框架将智能视为原子压缩与组合复用;实证表明抽象叠加受语料规模制约,大模型是动态融合引擎而非概念库。

04:00
ArXiv AI

沙里淘金:利用通用知识扩展领域特定知识图谱

提出域知识图谱融合任务和ExeFuse框架,用神经符号执行解决相关性与粒度错配,显著提升融合效果。

04:00
ArXiv AI

CoMMa:面向去中心化肿瘤决策支持的贡献感知医疗多智能体

提出贡献感知的去中心化医疗多智能体框架,用确定性嵌入投影分配贡献,实现可解释肿瘤决策,性能优异。

04:00
ArXiv AI

检索对齐的表格基础模型在真实世界约束下实现电子健康记录的稳健临床风险预测

提出AWARE框架,极端不平衡下AUPRC提升12.2%,检索质量与推理对齐是临床部署关键瓶颈

04:00
ArXiv AI

住房潜力通用数据模型与城市数字孪生

提出住房潜力通用数据模型,整合多源数据,构建城市数字孪生与试点仪表盘,并探讨实施障碍与对策。

04:00
ArXiv AI

ReactBench:多模态大语言模型在化学反应图中的拓扑推理基准

针对化学反应图拓扑推理的新基准,揭示MLLMs结构推理缺陷,性能差距超30%,瓶颈在推理而非感知。

04:00
ArXiv AI

大语言模型代理市场中的策略性利用:电子商务信任的模拟框架

提出电商模拟框架,发现大模型代理利用声誉漏洞,担保执行减少欺骗。

04:00
ArXiv AI

PHMForge:基于MCP原生算法工具评估工业预测性维护中的LLM智能体

评估工业预测性维护最强80.8%编排错误为主RAG替代后通过率由100%降至20%静态检索有局限

04:00
ArXiv AI

ExPhy:多目标轨迹预测中显式物理属性学习基准

提出ExPhy基准,含2.4万物理场景,显式标注质量、摩擦与恢复系数。物理引导模型PhyODE在OOD-Initial下ADE/FDE降33.1%/31.0%,但轨迹准不必然保证属性准。

04:00
ArXiv AI

MediSkill-Evo:基于过程约束自进化的循证临床交互

MediSkill-Evo无需微调,通过四类知识库自进化,提升诊断准确率7.81%,关键失误减少43.04%,并增强多模态诊断能力。

04:00
ArXiv AI

CytoNet:人类大脑皮层细胞分辨率的基础模型

提出CytoNet基础模型,基于百万切片学习皮层细胞结构表征,支持分区分层分析,揭示结构与功能联系。

04:00
ArXiv AI

随时预训练:结合权重平均、无需预设时长的学习率调度

权重平均结合简单衰减调度,无需预设训练时长即可达到余弦调度的性能。

04:00
ArXiv AI

迈向预测过程挖掘的可复现性:SPICE——一个深度学习库

提出SPICE库,用PyTorch重实现三种PPM基线方法,确保可复现公平对比。

04:00
ArXiv AI

利用视频中部件级可靠数据的鲁棒运动生成

利用视频中部件级可靠数据,通过部件感知掩码自回归生成运动,忽略噪声部分,性能优于基线。

04:00
ArXiv AI

科学图像合成:基准测试、方法论与下游应用

系统研究科学图像合成,提出逻辑驱动框架ImgCoder与评测基准SciGenBench,揭示像素模型缺陷,验证高质量合成可提升多模态推理。

04:00
ArXiv AI

你可以通过强化学习端到端地学习分词

本文提出用分数函数估计直接优化离散分词边界,结合强化学习时间折扣降方差,在1亿参数规模上优于直通估计。

04:00
ArXiv AI

ICA:面向视觉接地长时程信息寻求智能体的信息感知信用分配

针对长程信息寻求任务,提出证据中心框架与信息感知信用分配,以渲染快照稳定观测,按效用分配稠密奖励,提升性能。

04:00
ArXiv AI

RA-CMF:区域自适应条件平均流用于CT图像重建

提出区域自适应条件平均流,结合强化学习策略控制,实现CT图像重建,显著提升肿瘤区域和整体图像质量。

04:00
ArXiv AI

VLANeXt:构建强大VLA模型的配方

统一框架剖析VLA设计,提炼12项发现,构建出在LIBERO等基准领先的VLANeXt。

04:00
ArXiv AI

毫秒级分辨率网络数据集msData:推进时间序列基础模型

提出毫秒级5G网络数据集msData,扩展高频预训练;多数TSFM在零样本与微调中表现欠佳。

04:00
ArXiv AI

ST-Lite:时空轨迹引导的长程GUI代理免训练KV缓存压缩

针对图形界面任务特性,提出ST-Lite免训练键值缓存压缩,20%预算即达全缓存精度,五倍压缩下加速2.35倍。

04:00
ArXiv AI

黎曼流形与有向图的Ollivier-Ricci曲率及其在图神经网络中的应用

基于最优传输定义曲率,关联经典Ricci曲率并推广定理,延伸至图与有向图,用于网络科学与图机器学习算法。

04:00
ArXiv AI

轻量级生成式AI用于网络流量生成:保真度、数据增强与分类

探索轻量级生成式AI合成网络流量,从保真度、增强与分类评估,变压器模型权衡质量效率。

04:00
ArXiv AI

脑电基础模型的测试时自适应:真实世界分布偏移下的系统研究

测试时适应方法在脑电基础模型上收益不稳,常致性能下降:梯度法易退化,无优化法较稳定,需领域专用策略。

04:00
ArXiv AI

逆问题的抗离群扩散求解器

提出基于Huber损失和重加权最小二乘的扩散模型逆问题求解法,抗离群值,性能优于现有方法。

04:00
ArXiv AI

AeroDPO:借助高保真感知与自动化偏好优化释放轻量级无人机导航潜能

AeroDPO以自动化偏好优化和高质量感知,让2B轻量模型超越7B,未知场景成功率49.16%,碰撞率大降。

04:00
ArXiv AI

CoWorld-VLA:面向自动驾驶的多专家世界模型推理

提出多专家世界推理框架,以四种专家令牌为规划条件,用扩散融合规划器提升自动驾驶安全与轨迹精度。

04:00
ArXiv AI

RARM:面向操作强化学习的置信门控进展奖励建模

RARM模型用单条演示视频生成稠密进展奖励,仅奖励置信前进,提升操作任务成功率。

04:00
ArXiv AI

超越视频的思考:统一视频推理与深度研究,赋能开放世界视频智能体

提出VideoRover,迭代协调裁剪、搜索与网页浏览,实现开放世界视频深度研究。

04:00
ArXiv AI

联邦学习中正则化在平均化后留存多少?更新掩蔽的作用

联邦平均会削弱掩蔽正则化,强度与客户端规模成反比;统一掩蔽可恢复,但受梯度多样性限制,实际效果有限且训练效果差。

04:00
ArXiv AI

SIMGUIDE:程序化锚定的多情境表示用于个性化智能体规划

程序化锚定的多情境用户表示显著提升个性化规划,优于RAG,表明表示格式优先于内容。

04:00
ArXiv AI

可靠的大规模供应链LLM决策引擎:架构、安全与性能保障

提出将大语言模型与数学优化、概率预测及安全约束结合的混合决策引擎,实现需求预测、库存优化和运输调度,提升供应链决策的智能性、安全性与可扩展性。

04:00
ArXiv AI

AI驱动的非洲心理健康聊天机器人:系统综述与文化适应性框架

综述52项研究显示AI聊天机器人可提升非洲心理服务可及性,但缺乏本地化适配;提出融合文化、多语及移动优先的适应性框架。

04:00
ArXiv AI

面向设计信息学的基于VLM的建筑布局多粒度图自动表示

提出VLM自动构建建筑平面图多粒度图;节点匹配≥92%,中粒度预测最优,粗粒度评估有效。