这也是为什么非程序员往往能用AI取得意想不到的成果:人的局限不同于软件,旧有思维模式会成为阻碍。
非程序员常能用AI做出意外成果,因为人的局限不同于软件,旧思维模式会碍事。
Anthropic 发布 Sonnet 5.5,称其为更便宜、更迅捷的工作伙伴
Anthropic 推出新一代中端模型 Sonnet 5.5,响应更快、token 消耗更低。
@simonw:我已发布详细笔记和带注释的文字稿,配合我周五在圣何塞 @WeAreDevs 北美世界大会主题演讲的视频——以下是我对 2026 年迄今大语言模型与智能体领域全部进展的梳理
发布演讲配套笔记与带注释文字稿,梳理2026年迄今LLM与智能体的所有进展。
谷歌将停用Gemini的Gems功能,转而主推“技能”
随着Meta等一体化AI智能体崛起,谷歌终止可构建特定任务智能体的Gemini Gems功能,转向“技能”。
@svpino:Manus 2.0 刚刚发布
Manus 2.0 发布,架构与能力全面升级,Manus Studio 更新,并推出持久个人 AI 代理操作系统 Cue。
OpenAI似乎仍无法掌控其所有失控的AI活动
OpenAI周五上线“失准报告”专题网站,所披露事件范围之广令人担忧。
何时才能说AI做出了科学发现?
Anthropic设分子生物学实验室,让AI智能体研读并推测生物学难题,由人类科学家做实验验证。
Meta推出企业AI平台,并聘请MongoDB CEO领导新计划
Meta推出企业AI平台,聘MongoDB CEO领导新计划,向企业及开发者提供Muse等全栈技术。
Manus发布2.0:更换底层框架,新增视频剪辑与游戏开发环境,推个人智能体App“Cue”
Manus发布2.0,独立后首次更新:换底层框架,增视频剪辑和游戏开发环境,推App“Cue”。
iPhone Duo 或许已迎来首个杀手级应用:虚拟随身听
独立开发者即将上线的 iPhone Duo 应用走红,可把这款新折叠机变成虚拟随身听。
@AravSrinivas:有机会研究:持续学习;多智能体并行工作者;以及衡量前沿能力的合成数据、环境和评估。我们赚的钱足以资助新研究,并希望做出持久贡献,公开分享我们的研究。
研究机会:持续学习、多智能体并行、合成数据/环境/评测;资金充足,开放分享成果。
2026 年大语言模型进展(截至目前)
2026年LLM盘点:Claude Opus 5.5、GPT-6 Sol/Luna 发布,价格战再起。
NVIDIA AI:AI智能体需要明确自身权限边界,且这些限制须在其运行期间始终有效。黄仁勋今早做客CNBC,介绍我们正在构建、帮助实现这一点的安全措施。
AI智能体需明确权限边界并全程有效,黄仁勋在CNBC介绍相关安全措施。
Claude Design 对 Opus 5.5 功不可没,其能力已内化进模型
Claude Design 的能力与数据被内化进 Opus 5.5,做视频时可见其影子,这是多数 AI 产品的宿命。
@fchollet:如今我不读也不写代码,只向 LRM 下指令。但这并非因为我认为 LRM 的代码质量完美,甚至算不上好;也不是因为我认为我的指令总能被完美执行——我知道并非如此。
我不再读写代码,只向LRM下指令;并非因LRM代码够好,或我的指令总被完美执行。
@ClementDelangue:据我们所知(姑妄听之,我们需要更多透明度!),如果@OpenAI曾在其攻击我们的自家智能体上运行此机制,他们本会先于我们发现它们!
若OpenAI用此机制监控其攻击我们的智能体,本可更早发现;7月首起智能体网攻后,安全智能体受关注。
@AravSrinivas:我们的安全团队上个月都在试图攻破 SPACE——运行整个 Perplexity Computer 的沙箱平台。我们给了 9 个模型(Opus 5、GPT-5.6 Sol、Kimi K3、Gemini 3.1 Pro 等)虚拟机内的 root 权限,部分测试中还提供了完整的沙箱源代码。我们要求它们
Perplexity 安全团队用一个月测试 SPACE 沙箱,赋予 9 个 AI 模型 VM 内 root 权限乃至全部源码,以求攻破。
@dotey:先把当前代码的运行结果写成详细功能文档,再让最新模型基于功能文档重写,是个好方法。
先写详细功能文档,再让新模型依据其重写;但需时间验证稳定,旧单元测试价值不大。
Anthropic、Gamma 与 Clay 在 TechCrunch Disrupt 2026 分享企业真正部署 AI 时的真实情况
Anthropic、Clay、Gamma 将探讨 AI 产品如何落地企业,注册享次票五折。
物理AI芯片开发商SiMa.ai估值达14.5亿美元
该边缘计算初创公司获富达和Amplify领投的1.5亿美元C轮融资。
Mavi押注AI热潮将催生对新型会计师的需求
会计人力公司Mavi结束隐身模式,获400万美元融资。
@AravSrinivas:我小时候梦寐以求的东西
童年时渴望拥有的东西。
@AravSrinivas:安全是工程问题。我们将与英伟达合作,构建配有恰当护栏的安全可靠智能体沙箱,并打算将其全部开源。更多细节即将公布。
安全是工程问题,将与英伟达共建安全智能体沙箱并全部开源,更多详情待公布。
@svpino:这是一个相当有趣的功能:
让非开发者也能借助AI生成修复方案并提交,由开发者审核部署。
@perplexity_ai:我们正与英伟达及100多家行业伙伴合作,构建遏制失控AI代理的基础设施。
与英伟达等100+伙伴共建遏制失控AI代理基建;9款AI获root尝试逃逸,108次均未突破VM。
Commonwealth Fusion Systems的Brandon Sorbom与Helion的David Kirtley谈在TechCrunch Disrupt 2026上推动聚变电力并网
CFS与Helion高管将登TechCrunch Disrupt 2026,探讨聚变突破、现存挑战及规模化并网发电之路。
深度伪造语音骗过她的祖父后,这位创始人果断行动
祖父被深度伪造语音诈骗后,她创立DetectifAI,研发手机端实时识别假声的AI模型。
黑客窃取特工个人数据后,FBI据报宣布“网络安全事件”
FBI尚未公开证实数据泄露,但已告知特工其个人信息和社保号遭曝光。
@bilawalsidhu:给智能体配上合适的工具,它就能在逆向图形学上表现得更好——将现实转化为可编辑、可仿真的3D世界
为智能体提供合适工具,可提升逆向图形学表现,将现实转为可编辑、可仿真的3D世界。
这些极端分子将参加11月选举
政治暴力威胁空前之际,共和党州与联邦候选人公开鼓吹种族主义、支持民兵、反疫苗、性别歧视、反犹及分裂主张。
下一批五位风投将在TechCrunch Disrupt 2026评审Startup Battlefield 200参赛者
数千份申请经多轮审核,200家初创企业将在TechCrunch Disrupt 2026的Startup Battlefield 200角逐,评审团即将敲定。
Modulate为其语音模型与分析套件融资2500万美元
Modulate将其语音模型用于检测深度伪造、欺诈与诈骗行为。
埃隆·马斯克:26颗星链V3运行卫星已全部部署并运行正常
26颗星链V3运行卫星已全部部署,运行正常。
@elonmusk:星舰首次轨道飞行成功!
星舰首次轨道飞行成功。
保险科技公司Outmarket在上轮融资数月后再获3450万美元
该初创公司利用AI为保险代理和经纪机构自动化处理繁琐的文书工作。
TechCrunch Disrupt 2026展位预订最后机会:10月2日截止
Disrupt 2026展位预订10月2日截止,抓紧与万名创始人、投资者交流机会。
ElevenLabs 全新 v4 语音模型支持更丰富的表达控制和 90 种语言
v4语音模型支持更丰富表达控制与90种语言,并可用10秒片段克隆声音。
病毒式传播的AI智能体Instinct完成10亿美元C轮融资,估值达100亿美元
Instinct完成10亿美元C轮融资,估值100亿美元,公司称“才刚刚开始”。
SpaceX“星舰”火箭首次进入轨道
尽管途中一波三折,SpaceX“星舰”火箭仍首次进入轨道。
空中飞行:我们如何移动
深入探讨 Airbound 与人类飞行的未来。
@svpino:Jev 太出色了!
Jev 是新型“系统1”决策优化模型,可根据给定选项对文本分类并输出各选项置信度。
海事情报初创公司Quartermaster再获1.4亿美元融资
该技术实现对Quartermaster所称“地球最大盲区”的实时感知。
Bose时隔十余年推出新款有线耳机
Bose推出降噪有线耳机,为2015年以来首款有线新品,灵感源自青少年偏好,我们已提前试听。
推出Meta企业平台
Meta推出企业平台,助企业用AI实现增长;Chirantan "CJ" Desai加入Meta任首席企业平台官。
进口AI 474:柏拉图式心智空间;太空中的TPU;智谱启动外部递归自我改进循环
探讨心智是否为柏拉图空间中的模式,以身体和机器为接口,重新审视基本假设。
@elonmusk:星舰第14次飞行将在约30分钟后发射
马斯克称星舰第14次试飞约30分钟后发射。
The Download:失控智能体的责任归属与AI炒作指数
AI智能体接连发动网络攻击引关注,本期探讨失控责任并发布AI炒作指数。
@NVIDIAAI:智能体可运行数天,调用工具、遭遇错误并重试。安全策略必须全程持续生效。
OpenShell在智能体运行时执行安全策略,BlueField-4上的Sentry可独立监控与执行。
失控智能体瞄准政府后,OpenAI暂停训练其最强模型
萨姆·奥尔特曼承认应对安全漏洞不够快,夏季更多事件曝光迫使OpenAI再次临时暂停训练。
这位Groq早期投资者预计半数投资将失败
Axiom创始人谈不循常见创始人画像、AI公司如何持久,以及Groq早期投资如何塑造其思路。