Cohere发布Command A+:一款用于智能体工作流的218B稀疏MoE模型,仅需两块H100 GPU即可运行
Cohere发布开源218B稀疏MoE模型,仅需两块H100 GPU,支持48种语言及多模态推理。
一个模型,三种模态:字节跳动发布Lance,用于图像和视频理解、生成与编辑
字节跳动发布开源统一多模态模型Lance,仅3B激活参数即可处理图像视频理解、生成与编辑。
什么是前向部署工程师:OpenAI、Anthropic和谷歌2026年正在招聘的AI职位
前向部署工程师(FDE)是适应企业AI部署失败的新角色,OpenAI、Anthropic等正大力招聘,需掌握SaaS与AI结合技能。
认识 Turbovec:基于 Google TurboQuant 算法的 Rust 向量索引,支持 Python 绑定
Turbovec 将 Google TurboQuant 算法引入向量搜索,实现 16 倍压缩与零码本训练,适用于 RAG 流程。
使用kg-gen、NetworkX分析和交互式可视化从文本构建知识图谱生成管道
教程讲解使用kg-gen从文本生成知识图谱,包括依赖配置、LLM设定、实体关系抽取及长文本分块聚类处理。
英伟达AI发布Nemotron-Labs-Diffusion:三模式语言模型,前向每步处理比Qwen3-8B多6倍token
NVIDIA发布Nemotron-Labs-Diffusion模型系列,集成自回归、扩散并行、自推测三种解码模式,参数规模3B-14B。
阿里巴巴Qwen团队推出Qwen3.5-LiveTranslate-Flash:60种语言实时多模态翻译,延迟仅2.8秒
阿里发布Qwen3.5实时多模态翻译,覆盖60种语言,延迟2.8秒,支持语音克隆与视觉增强,性能领先商业方案。
谷歌在I/O 2026上推出Gemini 3.5 Flash:面向AI代理和编程的更快速、更经济的模型
Gemini 3.5 Flash在编程和代理基准测试中超越旗舰,速度快4倍、成本减半。
Upstash for Redis 对比 Supabase 对比 Neon:哪个更适配2026年的Vibe Coding工作流?
比较Upstash、Supabase和Neon的差异,选出适合2026年Vibe Coding工作流的数据库平台。
Google在I/O 2026上发布Antigravity 2.0:一个以智能体为核心的独立平台,具备CLI、SDK、托管执行和企业支持
Google推出Antigravity 2.0,以智能体为核心的独立桌面平台,配套CLI、SDK、托管执行及企业支持。
2026年最佳企业级自主人工智能平台
2026年企业自主AI从试点走向生产,本指南评估十大平台(含定价与真实数据),助力企业选型。
如何使用OpenAI API构建具备规划、工具调用、记忆与自我批评的高级智能体AI系统
教程用OpenAI API构建智能体流水线:规划、执行与批评三角色,集成工具和记忆。
认识 MemPrivacy:通过本地可逆假名化保护用户数据且不破坏内存效用的边缘-云框架
MemPrivacy 框架利用本地可逆假名化,在保护用户隐私的同时不牺牲内存效用,解决云内存数据暴露问题。
随机梯度下降的频率偏差及Adam如何修正它
SGD偏向高频词导致低频词更新不足,Adam通过自适应学习率修正此偏差。
NVIDIA推出基于NVFP4的4位预训练方法,在12B混合Mamba-Transformer上经10T Token验证
NVIDIA推出NVFP4 4位预训练法,12B模型训10T token,准确率接近FP8基线(62.58% vs 62.62%)。
用llmcompressor实现FP8、GPTQ与SmoothQuant量化:指令调优LLM压缩与基准测试编码
本教程用llmcompressor对指令调优LLM进行后训练量化,比较FP8、GPTQ、SmoothQuant策略,并基准测试磁盘、延迟等指标。
Vercel Labs 推出 Zero,一种为 AI 代理设计的系统编程语言,使其能读取、修复并发布原生程序
Zero 语言专为 AI 代理设计,发出带稳定代码的 JSON 诊断与类型修复元数据,编译时强制能力 I/O,生成小于 10 KiB 的原生二进制。
实现SHAP可解释性工作流的编码指南:解释器比较、掩码器、交互、漂移与黑盒模型
本教程实现SHAP工作流,比较多种解释器,揭示模型感知与不可知方法的精度与性能差异。
Nous Research提出灯塔注意力:一种仅训练使用的选择性分层注意力,实现长上下文1.4–1.7倍预训练加速
对称池化QKV的分层注意力,训练专用,加速长上下文预训练1.4-1.7倍,且最终损失更低或相同。
LiteLLM Agent平台:基于Kubernetes的自托管基础设施,支持生产环境隔离智能体沙箱与持久会话管理
BerriAI开源LiteLLM Agent平台,提供Kubernetes自托管基础设施,实现生产环境中隔离智能体沙箱和持久会话管理。
NVIDIA推出SANA-WM:一个26亿参数的开源世界模型,可在单张GPU上生成分钟级720p视频
NVIDIA开源世界模型SANA-WM,26亿参数,单GPU生成60秒720p视频,支持6自由度相机控制。
如何利用Repowise通过图分析、死代码检测、决策和AI上下文构建仓库级代码智能
本教程演示如何用Repowise为Python项目构建仓库级代码智能,涵盖图分析与AI上下文应用。
如何构建一个MCP风格的路由AI代理系统,具备动态工具暴露、规划、执行和上下文注入功能
从零构建MCP风格路由代理系统,融合工具发现、智能路由、结构化规划与执行
Zyphra发布ZAYA1-8B-Diffusion-Preview:首款由自回归大语言模型转换而来的MoE扩散模型,实现高达7.7倍加速
将自回归MoE模型转为扩散模型,推理提速7.7倍,性能无系统损失。
软件开发现代AI代理排行榜:基于基准测试的当前领域审视
2026年AI编码代理: Claude Code代码质量87.6%领先, GPT-5.5终端82.7%领先, 但已污染基准仍被用作排名依据。
Supertone发布Supertonic v3:支持31种语言、减少阅读失败并带有表达标签的端侧文本转语音模型
Supertone推出Supertonic v3端侧TTS,支持31种语言与表达标签,阅读更稳定,接口不变。
使用自定义模型、过滤器、操作和KPI构建Django-Unfold管理仪表盘
教程讲解构建Django-Unfold高级管理仪表盘,涵盖安装配置、自定义模型、过滤器、操作及KPI完整步骤。
Poetiq的元系统自动构建模型无关的推理框架,无需微调即可提升所有在LiveCodeBench Pro上测试的LLM
Poetiq元系统自动构建推理框架,仅用Gemini 3.1 Pro即提升包括GPT 5.5等所有测试模型性能,无需微调。