Granite.Trust 策略工具:面向生成式 AI 应用的可共享、可操作策略
提出可操作策略模式与合成数据生成管道,实现生成式AI内容约束的异常追踪与全生命周期执行,开源。
当看到还不够:评测LVLM中的交互式视觉定位
现有视觉定位评估忽略交互性,新框架显示LVLM表现低于人类,且自信度过高,交互式定位仍是挑战。
更抗拒,非更判别:预执行大模型监督中的审查单元
预执行监督中,审查单元越长,零样本监控器越易误拒而非提升判别力;最优为1-2个动作,安全案例应明确单元并报告清洁系列。
递归式智能体推理
将测试时推理方法统一为递归算子,BRANCH在14设置中平均提升5.98个百分点,源于探索与截断恢复。
MARS:面向竞赛编程的多专家LLM接力系统
MARS:多专家LLM接力系统,用于编程竞赛。检索选取专家,迭代修复;通过率提高14.4个百分点,接近CodeSIM且成本更低。
Giraffe:从隐藏文本表征到视觉嵌入的映射架构,用于高效平面设计
提出用单标记将隐藏文本映射到视觉嵌入的轻量架构,双MLP训练,高效完成图文设计生成。
记忆并非总是必需:科学推理中条件记忆的特征化研究
提出知识边界感知路由器,按需激活条件记忆,抑制干扰,提升科学推理可靠性。
压缩三位一体:探索稀疏化、量化与低秩近似的大语言模型压缩
提出压缩三位一体框架,联合稀疏化、量化与低秩近似压缩大语言模型,加速训练并提升精度。
算法影响揭示对齐中隐藏的社会选择结构
将AI对齐重构为凸影响空间上的线性优化,用福利经济学工具设计防策略、一致且最大化社会福利的对齐协议。
用于词级时间戳的掩码训练相对时间间隔表示
提出相对时间戳与掩码训练,使语音大模型具备词级时间戳预测能力,提升精度且保持转写性能。
规则优先于预言机:审议式民调中可审计、用户可配置的论据选择
审议民调中论据挑选须用公开规则而非黑箱排序;可审计、用户可配置,性能逼近理想上限,且把覆盖-认同权衡交给用户。
以推理致多样:利用LLM群体智慧进行未来预测
提出行为感知框架,按推理轨迹聚类选代表模型,三模型群体超越全部25模型投票,成本大降。
投毒智能体Alpha:多智能体交易系统中跨角色与架构的对抗性漏洞
研究表明,多智能体交易系统易受低门槛对抗攻击,角色与架构均存在漏洞,无天然鲁棒设计。
超越置信度:基于检索依据的多轮搜索智能体测试时扩展
置信度投票在多轮检索中失效,源于复制文档导致概率膨胀;提出检索接地投票按词法重叠评分,显著提升准确率。
可扩展的以问题为中心的文生图评测:可靠排名、细粒度诊断与成本感知路由
提出QC-T2I-Bench框架,将提示词分解为带依赖的原子问题,支持可靠排名与细粒度诊断,并实现成本感知路由。
EMRB:评估大模型对原始电磁信号推理能力的分级基准
提出电磁推理基准EMRB,测试大模型直接分析原始I/Q数据的能力。14个模型得分24-79%,新方法ReconPilot提升3.8-17.6分。
ACE:用于多幻灯片演示自动化的自校正智能画布编辑器
ACE基于层级场景图,输入令牌减89%;无真值自校正循环提升指令遵循,速度1.75倍、成本降44%,盲评更优。
Paritok-4B:面向编码代理的意图条件上下文压缩
面向编码代理的4B抽取式压缩器,按意图条件压缩上下文至25.7%,保留86.5%求解质量,开源。
Robust Code RL via Faulty-Code-Driven Test case Synthesis and Dense Reward Shaping
AHEAD:环境增强蒸馏的自适应后见之明智能体强化学习
提出AHEAD框架,按步骤类型匹配不同监督信号,错误步骤加LLM纠正提示,仅微改GRPO,在ALFWorld、WebShop等任务上较GRPO显著提升成功率并减少训练步数。
面向GUI奖励建模的任务自适应评分标准
提出AdaptRubric框架,通过粗到细的评分标准构建,提升GUI奖励建模准确性与任务成功率。
OmniJudge还是OmniBias?通过平衡解耦视角诊断多模态裁判
提出D3-Omni基准,平衡解耦诊断多模态裁判,覆盖53维任务,发现强裁判确认满足强于检测违规,且不同属性被混为一谈,聚合准确率掩盖盲点。
缓解大语言模型对齐税的偏好数据选择
提出平衡数据选择策略BALIGN,基于三个数据特征过滤高风险样本,兼顾对齐效果与缓解灾难性遗忘。
持续知识图谱嵌入中候选集干扰的匹配超额超越正则化
MEOR通过匹配旧参考缓解候选集干扰,显著提升历史MRR,且不改变底层架构。
MetaRAG:面向智能体RAG的信念-行动对齐策略优化
提出信念-行动对齐策略优化,用于智能体检索增强生成,以验证优先与信念探针提升决策与效率。
STRIVE:面向纵向放射学报告生成的多智能体结构化时序推理与集成验证
STRIVE将临床推理分解为诊断、属性、时序变化智能体,显式生成中间证据,并用可验证奖励优化时序建模,显著提升纵向报告时序一致性。
SA-Bench:评估基于LLM的论文复现中的语义对齐
提出SA-Bench基准,评估LLM复现论文的语义漂移,最强配置仅0.301分,主要错误为实现不匹配。
超越准确性:法律基准任务中视觉语言模型的双裁判评估协议
双裁判评估协议显示:两裁判中度相关,8%非对称错误;高可见度错误率最高,严重遮挡下高质量分数最不可信。
ReproAgent:合约引导的论文到代码复现
提出四阶段复现管线,以双通道实现合约绑定文件级任务,在基准上取得最高分,消融验证有效。
为可持续地球而食:基于约束感知决策建模的个性化可持续饮食推荐
提出基于约束感知决策的个性化可持续饮食推荐模型,构建15万食谱数据集,在不牺牲个人偏好下促进可持续选择。
动态内部场能否支配Transformer的认知?稳态计算控制中的可认证性,而非优越性
动态内部场可作稳态计算调节器,稳定性可认证,但只是调制认知而非增强,不能思考。
VideoHarness-RSI:面向冻结视觉语言模型的长视频理解的递归框架自优化
仅改进可执行上下文构建程序即可提升长视频理解递归自优化在冻结视觉语言模型下持续改进且可迁移
OPDSearch+:无需教师微调的在线策略蒸馏与强化学习精炼检索增强推理
OPDSearch+无需教师微调,用在线策略蒸馏和强化学习精炼,显著提升检索增强推理表现。
SonarLLM:面向水下感知的原生声呐—光学多模态大语言模型
SonarLLM将声呐作为原生模态,结合声呐专属编码与可靠性感知融合,在声呐识别等任务上比最强基线高34.4个百分点,浑浊时融合增益显著。
交接税:延续LLM智能体中的非原生轨迹
研究智能体模型交接税:弱升强全轨迹仅收复不到半数质量差距且成本高;降级更优;最佳交接随方向反转。
菜谱也有“人设”?属性化流程图中创作者风格的刻画与生成
本研究从烹饪视频提取流程图谱,发现词汇分类易过拟合,而拓扑结构能捕捉创作者风格;提出两阶段模型生成个性化流程,并与大模型互补。
ResiSpec:利用残差分布塑形增强多候选推测采样
ResiSpec重塑提案分布,解决多候选推测采样的残差漂移,保持输出精确,防候选失效,提速高达1.92倍。
基于线性规划的因果序部分识别
利用查询本身蕴含的偏序,将反事实识别化为线性规划,得到紧界,无需完整因果图。
基于马氏距离的多头注意力用于复杂状态传播
提出MHA-CSP,用马氏距离RBF核实现无穷维注意力和树状注意力,119K参数在长序列状态追踪上超越Transformer/GCN。
神经符号对齐用于生理安全的临床语言模型
提出神经符号对齐,耦合临床LLM与生理知识图谱,安全基准CSS从69.5%提升至90.8%。
发现面向集体创新的自适应传播程序
将传播协议形式化为状态感知程序,用LLM引导进化搜索设计,集体绩效提升达37%,且跨域迁移。
面向大语言模型智能体的工具创建与使用联合优化
提出SMITH框架,统一训练工具创建与使用;4B模型在程序推理等任务上达到最优,超越未训练的30B工具编写模型。
近似交换性下的提升模型构建
提出ε-交换性处理近似可交换因子,用于提升模型构建与推理,证明误差界,兼顾精度与速度。
正确诊断,装饰性推理:医学思维链的扰动审计
医学CoT扰动审计:72.9%链条与答案解耦,破坏或移除CoT不影响准确率,CoT多为装饰性而非忠实推理。
RACE:LLM神经元功能一致性的可扩展统计估计
提出RACE框架,以前向传播统计评估Transformer神经元跨域功能一致性,领域特异性优于梯度法,计算开销低两个数量级。
StepGuard:可扩展监督与安全-效用平衡下的步骤级护栏学习
StepGuard步骤级护栏模型自动审计轨迹并预检工具调用,攻击成功率降77.3%,效用仅降2.8%。
StarHarness:面向企业环境的基于分层搜索的智能体框架进化
针对企业环境,固定模型权重进化智能体框架,分层搜索提升性能20-35个百分点,且可跨模型迁移。
CAFE:自我改进的搜索智能体需要共同演进的反馈
CAFE框架让智能体与评论家共享参数交替优化,结合在线和离线反馈,提升搜索效果并减少幻觉。
基于LLM的知识图谱问答中部分知识下的约束实体选择
提出CES-PK框架,用三值约束过滤无效候选,提升精度且保持召回率。
在统一潜在空间中渐进学习异构技能
提出HetSkills框架,在统一潜在空间中渐进学习异构技能,通过共享解码器与任务引导,实现运动追踪、文本生成等多种任务的高效适应。