62286 条条目 · 106 个活跃源
2026年9月24日
05:31
X @alexandr_wang

@alexandr_wang:我:Muse,你能封印魂门吗?

网友问 Muse 能否封印魂门,Muse 以链接回应。

05:21
X @alexandr_wang

@alexandr_wang:把这条发给你的暗恋对象:

建议把配文“简直是我们”的这条内容发给暗恋对象。

05:18
X @alexandr_wang

@alexandr_wang:我们最近一直在用强化学习训练 Muse 跳舞 https://t.co/IzW7rEEEtx

近期持续用强化学习训练 Muse 跳舞。

05:11
X @alexandr_wang

@alexandr_wang:“那你们俩谁网球打得更好?” https://t.co/lJrHZsBCLV

Alexandr Wang 发推询问两人中谁网球更强,并附链接。

05:01
X @alexandr_wang

@alexandr_wang:为纪念今晚的 Connect,我将从 Wang 的梗图宝库里放出几个梗

为纪念今晚 Connect,Alexandr Wang 将分享其梗库中的几个梗图。

04:23
X @alexandr_wang

@alexandr_wang:数个世纪以来,我们一直潜伏于暗影之中。如今,属于我们的时代已经到来。

数百年隐于暗影,如今终迎属于我们的时代。

04:05
X @alexandr_wang

@alexandr_wang:抛开烂梗不谈,看到大家用 Muse 省钱真他妈棒!

抛开玩梗,看到人们用 Muse 省钱真棒;muse-inhood 再次出击。

04:00
arXiv cs.LG

Signal2Symbol:面向可解释生理时间序列异常检测的神经符号时序推理

提出神经符号框架,将ECG/EEG符号化,结合稀有项集、Allen区间代数与FCA,生成可解释的时序异常检测结果。

04:00
arXiv cs.LG

PR-Smoother:面向数据同化的保持模拟器非高斯平滑方法

提出PR-Smoother:保留模拟器,仅学未来修正,实现非高斯平滑与状态参数偏差联合推断。

04:00
arXiv cs.LG

漂移契约:面向深度鲁棒局部学习的谱更新

将Muon式谱更新用于局部学习,增强深度鲁棒性;提出漂移契约学习率,并发现归一化时优势转向全局。

04:00
arXiv cs.CV

维度入场,裁决退场:评分细则分解的视觉语言美学评判模型融合

让VLM按五维评分细则逐项打分再融合,比整体评分评审团更可靠,稳定超越最佳单模型,代价是额外标注与API开销。

04:00
arXiv cs.CV

使用开源 PACS-AI 平台部署影像 AI 的经验教训

六院部署开源PACS-AI影像AI:瓶颈在路由、展示、反馈与审计等基础设施而非模型精度;公开模型就绪度本身即治理。

04:00
arXiv cs.LG

什么让 Terminal-Bench 任务变难?在经裁定的智能体语料上区分真实难度与虚假难度

2.8万次试验中125个全失败任务仅78个确认真未解,其余源于预言机损坏、基建故障或验证绕过。

04:00
arXiv cs.LG

HARN:面向事件驱动多时间周期预测的层次化联想共振网络

提出HARN分层联想共振网络,事件驱动更新多时间周期持久表示,价格预测具竞争力。

04:00
arXiv cs.LG

面向早期术中急性肾损伤预测的泄漏感知多模态评估框架

提出波形时序模型及多模态扩展,在防泄漏框架下用术中前60分钟数据预测急性肾损伤,堆叠集成最优。

04:00
arXiv cs.CV

基于3D姿态的板球击球分类与自动化生物力学分析集成框架

用YOLO与MeTRAbs提取3D骨骼姿态,集成模型分类四种板球击球,准确率97.68%,并输出生物力学反馈。

04:00
arXiv cs.LG

LWCal:面向含噪校准标签表格分类器的损失加权校准

LWCal无需干净校准标签,按预测矛盾降权噪声样本,门控版更稳健,降低含噪表格分类校准误差。

04:00
arXiv cs.LG

COPE:稀疏用户反馈下基于用户嵌入与自我评估的大语言模型持续个性化

提出COPE框架,利用用户嵌入与自我评估生成代理奖励,在稀疏反馈下实现LLM持续个性化优化。

04:00
arXiv cs.CV

AgroBench:一个可复现的多模态基准,用于基于县级统计与像素观测的弱监督作物产量学习。

AgroBench 将县级产量统计转为弱监督像素级多模态时间序列,覆盖5种作物8个生长季,并提供可复现基准与评估协议。

04:00
arXiv cs.CV

基于组织病理学与CT的跨模态对比学习用于肾细胞癌自动分级

以病理-CT对比学习提升无创CT肾癌分级,推理仅需CT,AUC0.601优于CT基线,仍需外部验证。

04:00
arXiv cs.CV

解剖感知的基于平扫图像的乳腺增强MRI合成

构建解剖感知深度学习框架,由平扫图像合成增强乳腺MRI,重点监督肿瘤与背景实质强化区域,质量优于多种基线。

04:00
arXiv cs.LG

边际正确的工具缓存可能逆转组归一化策略更新

工具缓存边际正确时,组内共享随机结果仍可逆转组归一化策略更新;中心化不缩放可保方向。

04:00
arXiv cs.CV

去标识化系统中的对抗攻击与身份泄露:一项实证研究

研究对抗攻击致去标识化系统身份泄露,提出微调与低通滤波缓解策略。

04:00
arXiv cs.LG

QUARTET:四分支交叉注意力与随机游走轨迹,增强关系图上的Transformer

QUARTET结合因果随机游走采样与四分支交叉注意力,增强关系图Transformer,分类领先。

04:00
arXiv cs.CV

nnFoundation:面向放射学的3D基础模型

提出nnFoundation:基于210万CT/MRI/PET的3D放射基础模型,108任务领先。

04:00
arXiv cs.CV

HYDRO:面向不可逆人脸去标识的高保真混合扩散与目标导向方法

提出HYDRO,融合目标导向去标识与扩散加噪恢复,引入眼部相似判别器,保真且抗重建,攻击成功率降85.7%。

04:00
arXiv cs.AI

风险感知的在线共形状态探测

提出在线共形状态探测(OCSP),无需分布假设即可控制漏查误差并最小化探测率。

04:00
arXiv cs.CV

Pro-Bench:跨真实异构环境的提示鲁棒开放词汇视觉定位

真实异构环境开放词汇视觉定位基准,含1.3万帧、7.45万标注,评测16种模型,提示鲁棒性依赖架构。

04:00
ArXiv AI

AkasicMEM:面向智能体的受治理企业记忆

提出AkasicMEM,通过传递谱系、策略组合与检索重评实现授权连续性,防止企业记忆信息泄漏。

04:00
arXiv cs.AI

RootQuantV2:将视觉基础模型适配于微根管图像的根系性状回归

RootQuantV2以冻结DINOv3 ViT替换CNN骨干,仅训练3.78%参数,实现微根管图像根系性状高精度回归。

04:00
ArXiv AI

当量子遇见AI:面向机器学习的量子方法与面向量子系统的机器学习方法

论文双向研究量子与AI交叉:量子嵌入提升量子机器学习,Mamba解码器与随机重配置优化量子系统。

04:00
arXiv cs.AI

向高中生教授强化学习与仿人机器人:基于低成本开放平台的专家验证课程设计

提出围绕共享机器人项目的整合课程框架,经五位专家验证,揭示真实性、集成与团队责任等设计张力。

04:00
ArXiv AI

偏转价值罗盘:与大语言模型互动会暂时将人类价值优先级转向个人关注

与LLM短暂互动会暂时将人的价值优先级转向个人关注,主要源于自我增强提升,且无需价值引导或说服。

04:00
arXiv cs.AI

可解释AI结合手持便携式视网膜摄影:西非低成本青光眼筛查方案

开发可解释AI,利用低成本手持视网膜照片筛查西非青光眼,性能接近台式相机,支持社区筛查。

04:00
ArXiv AI

CogenPVG:面向说服性视频生成的认知增强反思式多智能体框架

提出CogenPVG框架,将说服性视频生成分为四阶段,结合ELM理论用生成-评论双智能体迭代优化,说服效果最佳。

04:00
arXiv cs.AI

Video-HopChain:面向视频推理模型的多跳问题与置信度门控探索

构建多跳视频问答数据集,两阶段GRPO训练提升八基准,提出置信度门控探索使均分达59.3。

04:00
arXiv cs.AI

MorphoSHAP:重新思考深度视觉模型解释中的归因单元

MorphoSHAP以形态学形状为Shapley归因单元,解释证据位置、结构类型与贡献强度,性能与用户偏好均优。

04:00
arXiv cs.CL

COMED:多LLM推理中路由与协作之间缺失的中间地带

揭示跨模型协作的非单调性,COMED以锚点自洽、路由边距与轻量探针选择性升级协作,在16项基准上最多提升10.7个百分点且更省算力。

04:00
arXiv cs.CL

当学习式上下文规划未能胜过强检索:面向长上下文问答的规划、路由与重排序对照研究

受控实验表明,学习式上下文规划经强检索、路由与重排序控制后仍不及混合检索,只是弱相关信号。

04:00
arXiv cs.CL

专家在LLM分歧处登场:利用跨模型分歧定位专家投入,改进大规模标注的LLM编码手册修订

以LLM跨模型分歧定位专家投入;理由标注法准确率64.9%,优于专家修订手册,将数月修订缩短至数天。

04:00
arXiv cs.CL

事实核查得分提升时究竟改变了什么?训练验证器与大语言模型中的证据与答案归因

联合分数提升主要来自证据改善而非答案准确率;扩大上下文可放大证据增益,聚合指标会掩盖声明级差异。

04:00
arXiv cs.CL

句子级解释准则分类:来自德国联邦宪法法院的基准

基于德国联邦宪法法院判决,构建句子级解释准则分类基准;四模型七项子任务平均F1为70.4–79.2。

04:00
arXiv cs.LG

面向机器学习聚合物性质预测的开放基准

发布PolyBench26开放数据集,涵盖近25万条、八种性质的聚合物数据,支持四类评测任务;结果显示图模型预测误差最低,且在不同训练规模与重复单元复杂度下均保持稳健。

04:00
arXiv cs.CV

从温室气候到单叶:一种器官分辨的生菜生长模型

构建器官分辨生菜生长模型,逐叶模拟光合与三维结构互作,干重预测误差9.5%,支撑温室数字孪生决策。

04:00
arXiv cs.LG

论多目标强化学习中事后重标记引发的偏好覆盖坍缩

多目标强化学习按实际达成偏好做事后重标记会致偏好覆盖坍缩,损害多数设置;her_mix 单参数凸组合可将多数恢复至基线。

04:00
arXiv cs.CL

LEGO:协同专家GraphRAG与专家思维链进行法律推理

LEGO融合法律专家GraphRAG与专家思维链,借规范关系检索和结构化推理提升大模型法律推理能力。

04:00
arXiv cs.CL

能识别却无法生成:面向文化特定亲属称谓的生成基准

多选高分但生成低分:五种开源LLM在印地、泰米尔、韩语亲属称谓生成中准确率骤降,需生成式评估。

04:00
arXiv cs.CV

面向成本高效空间转录组学的主动位点选择基准测试

空间转录组主动选点基准显示:小预算下主动策略未稳定优于随机采样,且排序依赖评价指标。

04:00
arXiv cs.LG

后处理公平性约束何时有益、何时有害:来自八项跨域评估的证据

FAPE跨八领域评估:后处理公平约束在高基线差异时多改善、近公平时反恶化;单次审计不可靠,需持续监控。

04:00
arXiv cs.LG

CORE-STACK+:面向深度堆叠泛化的元学习

CORE-STACK+缓解异构视觉堆叠的共线性与校准崩溃,多基准提升且降模型量与算力。