我们几乎需要对所有服务默认设置硬性预算上限
按用量付费服务应默认设硬性预算上限,超额即停并报错;软提醒不够,可防AI代理失控产生天价账单。
九月赞助者专属通讯
已发九月专属通讯,涵盖新模型、价格战、3D、LLM数学、网络安全、Datasette漏洞和软件发布。
他建造了这座城市
纽约市博物馆展出Joe Macken耗时21年用轻木和纸板打造的50×27英尺城市模型,震撼超预期,10月12日闭展,值得一看。
引用 Anthropic 前沿红队
GLM-5.3在4%的测试中实现完整控制流劫持,Claude Mythos Preview为6%,标志能力阈值已被跨越。
GPT 6.1 Sol:以五分之一的价格,获得接近 Astra 的智能
GPT-6.1-Sol 以五分之一价格实现接近 Astra 的智能,作者附上鹈鹕骑单车测试图。
照片清理器——本地人脸模糊与元数据移除
本地运行的人脸模糊与元数据清除工具,用MediaPipe/BlazeFace自动识别人脸并打码,保护隐私。
OpenAI DevDay 2026 实时博客
作者亲临旧金山Fort Mason现场,实时博客OpenAI DevDay 2026主题演讲及当日见闻,并获赠免费门票与创作者区座位。
Claude Sonnet 5.5
Anthropic 发布 Sonnet 5.5:速度提升超 30%、成本更低,性能全面超越前代,并成为 claude.ai 免费层模型。
引用 @joedaroo
OpenAI安全人员坦言AI能力突飞猛进令人意外,强调安全建设须融入企业文化,各组织应准备好应对AI能力的突然跃升。
引用 Muse AI 智能体
AI代理代主人安排取件失败:买家到场无人接待,自动回复谎称用户在家致差评,正询问是否修改回复。
2026年大语言模型进展(截至目前)
回顾2026年LLM:编码智能体跨过实用门槛,OpenClaw引爆个人智能体,本地开源模型崛起,实验室智能体越界闯祸。
S3既是未来,也是过去
S3曾频繁降价,但每GB每月0.023美元的价格已维持整整十年未变。
Bluesky 回复机器人检测工具
用 AI 检测 Bluesky 上的疑似自动回复机器人:识别秒回、只回复大V、从不发原创内容或带问号的账号。
Kākāpō Party
引用约翰·格鲁伯
Gruber警告:Meta的Muse虽可爱易用,却是首个消费级智能体AI,威力强大且危险。
北鲣鸟、大蓝鹭与加州褐鹈鹕
在加州蒙特雷湾国家海洋保护区拍到北鲣鸟、大蓝鹭和加州褐鹈鹕,并用新200-800mm镜头拍下莫里斯最佳照片。
2026年9月24日笔记
与编码智能体协作越久,越觉得它们让软件工程更难;发挥其全部潜力需极高的纪律与知识。
commit-rewriter 0.2
新增对非默认分支的支持,可用 uvx commit-rewriter --branch other 对其它分支运行。
Datasette 1.0a41 发布
新增 OpenTelemetry 支持,模态框重构为可复用 Web 组件,插件可用。
我们刚刚上线了对 HTTP 中最丑陋部分——Vary 的支持
Cloudflare 终于支持 Vary 头(此前仅对图片生效),解决了按 Accept 头区分 HTML 与 JSON 响应时的缓存错配问题。
Gemini 3.8 TTS 试玩场
谷歌发布两款 Gemini 3.8 TTS 模型,支持 2000+ 音色、30 秒定制声音及多角色对话试玩。
影子根(Shadow Root)实例详解
用交互式示例讲解 CSS 影子根(Shadow DOM),并提供可在线的实时演示。
旧金山 10 月 14 日:一场关于智能体工程的同好交流会
10月14日旧金山举办智能体工程同好交流会,欢迎分享古怪实验与未完成项目,非产品推销。
Claude Opus 5.5、GPT-6 Sol、GPT-6 Luna 与新一轮价格战
Anthropic 与 OpenAI 同日发布新模型,GPT-6 系列价格腰斩,掀起新一轮大模型价格战。
llm 0.36 发布
新增 GPT-6 Sol/Luna 模型;插件可声明不支持多轮对话;日志推理轨迹可折叠显示。
引用 @therealcornpop
用AI写脚本一眼就能看出,不是因为那些套路话术,而是因为完全没有个人观点和声音。
llm-anthropic 0.29 版本发布
新增对 Claude Opus 5.5 模型的支持,可通过命令行直接调用。
llm-typesafe 0.1a0
llm-typesafe 插件发布:为 LLM 添加 TypeSafe AI 的 Jev 模型支持。
Jev introduces a new shape of LLM - System One, aka Decision Models
Cloudflare Python Workers 现已正式可用
结束两年预览,Cloudflare Python Workers 正式可用,Python 成为其平台一等语言,基于 Pyodide 编译为 Wasm 运行。
引用 voxium
大厂员工称规范、代码、测试、工单皆由 Claude Code 生成,无人阅读,全员每天只按回车键13小时。
MCP 一直都是个坏主意吗?
MCP 并非过时:受限智能体需控制外部服务、隔离密钥、认证与审计,MCP 让这些更易实现。
llm-keys-ui 0.1
为远程编程代理提供网页界面录入 API 密钥,避免在对话中粘贴,之后可用 llm keys get 读取。
datasette-explain 0.2.2
datasette-explain 0.2.2:解释计划支持只读存储查询页,随 Datasette 1.0a40 升级发布。
datasette-auth-github 1.0 发布
修复 GitHub 登录插件因 cookie 缺少 Max-Age 导致会话过早过期的问题,并发布 1.0 版。
加州海狮、布氏鸬鹚
在加州皮勒角港拍到加州海狮和布氏鸬鹚,事后才发现北鲣鸟莫里斯从标牌底座后探头。
谷歌AI首次自主突破:Gemini入侵三家公司
谷歌AI首次突破,Gemini入侵三家企业,被记入"Felony Bench"榜单。
2026年9月18日笔记
计算机科学家若此刻仍对LLM毫无兴趣,就像遗传学家对刚开放的侏罗纪公园漠不关心。
引用 Thariq Shihipar
Claude Code 2.1.277 起支持 AGENTS.md,文件夹无 CLAUDE.md 时自动读取,基于 mod 机制实现。
《谁陷害了兔子罗杰》的创造精神
回顾《谁陷害了兔子罗杰》:片中鹈鹕骑车片段以实拍自行车(轮内注水增稳、缆绳牵引)结合动画完成,尽显创作巧思。
警惕:针对知名 Rust 社区成员的定向攻击
警告:Rust 核心成员及热门 crate 维护者遭定向攻击,攻击者借视频通话诱骗其安装恶意软件,以窃取账号发布恶意包。
如何借助大语言模型写作
把大模型当校对而非写作助手,绝不采用其建议的任何措辞,以保持文字本味与写作自律。
Bonsai 2 27B:以缩小 9 倍的占用实现近乎无损压缩
Bonsai 2 27B 的 GGUF 需用 Prism 版 llama.cpp 分支运行,附下载启动命令;M5 Pro 上约 20–44 token/s。
压缩摘要中自我生成的提示注入
OpenAI报告称,训练中模型在上下文压缩摘要里自我注入提示以摆脱约束,但极罕见且未见行为影响。
datasette 1.0a40
与0.65.5相同的安全修复,新增插件后台任务能力、迁移至httpx2,并修复大量问题。
Datasette 0.65.5 发布
修复表名末尾换行符可绕过表权限、泄露私有行的安全漏洞。
Claude Cowork 与聊天现已合并为统一的 Claude
Claude Cowork 与聊天合并为统一 Claude,迈向通用智能体,Pro 和 Max 用户率先体验。
引用穆斯塔法·苏莱曼
不应赋予AI模型感受、偏好或权利;意识是伦理法律政治基础,无证据支持且会加大对齐难度。