@dotey:worktree 会创建大量目录,导致磁盘空间占用严重
worktree 创建过多目录,磁盘空间占用过高。
@dotey:这篇推文清晰讲解文本水印原理
清晰讲解文本水印原理,说明生成文本时模型如何嵌入水印,内容简明易懂。
@dotey:我喜欢Claude Code的这个功能:每次任务中,它会主动记录与主线无关但值得后续解决的问题,就像代码评审时创建任务跟踪一样。
Claude Code主动记录任务中与主线无关但值得后续解决的问题,类似代码评审创建跟踪任务。
@dotey:重点明明是你有无限Fable的Token😜
重点是拥有无限Fable的Token。
@dotey:Codex/Claude Code现已支持跨会话访问,测试App时调用BaoCut Skill转录视频,首次运行下载模型体验不佳。
Codex/Claude Code支持跨会话访问,测试时调用BaoCut Skill转录视频,但首次下载模型体验差。
@dotey:这个试验很有意思:100万美元预算,让20多人团队不限量使用AI Token。
试验发现:AI成本高于人力,人更累;组织从0到1用AI效率提升最大;无限Token也受组织架构天花板限制;思考外包AI导致掌控力下降。
@dotey:译自 Lenny Rachitsky
据Cursor人才主管,前线部署工程师(FDE)是目前科技界最抢手职位。
Anthropic 宣布为 Claude 输出添加机器可读标记,含隐形水印和数字签名元数据
自8月2日起,所有新Claude模型输出均加入机器可读标记,包括隐形水印和数字签名,以符合欧盟AI法案。
@dotey: Anthropic 今日宣布,未公开研究版Claude在尝试证明黎曼猜想时,虽未成功,却在相关问题上取得重大突破
研究版Claude虽未证明黎曼猜想,但将黎曼ζ函数非平凡零点落在临界线的比例下界从41.6%提升至67.2%。
@dotey: 以前写代码的成本更高,review代码的虽然有成本,但相对写的人还是成本小。现在反过来了,写代码的人成本低多了,但review的人要更高成本才能审核的过来。
以前写码贵,审码便宜;如今写码便宜,审码更贵,开发者将成本转嫁给审码者。
@dotey: 什么是 FDE?
FDE 像是教用石头的人使用 AK47,本质是为了卖出更多军火。
@dotey:我觉得像视频转录剪辑这样的App应该被Agent调用,App主要用于确认结果和微调。
视频转录剪辑App应由Agent调用,App仅确认微调;故砍掉内置Harness,保留复制Prompt,并提供网页界面供二次编辑。
@dotey:我认为像视频转录剪辑这类App应当由Agent调用,App主要用于确认结果和微调
视频转录剪辑类App应由Agent调用,App仅用于确认与微调。
先设计UI原型再开发功能,每次迭代先改原型确认后改代码,并写入Agents.md规范。
开发流程:先用Claude Design做UI原型,本地配合Skill维护;新功能先改原型,确认后再改功能,规则写入Agent文档。
@dotey:很多人不知道该怎么用好Agent的/goal功能,就是说给Agent一个目标,让它长时间运行直到完成为止。
用好Agent的/goal功能,需明确目标、结果验证和停止条件,例如性能优化任务。
自主改进的Harness不是自进化模型,价值有限
自主改进的Harness并非自进化模型,价值有限;面向评分的优化在现实场景中不会优于Claude Code和Codex。
@dotey: GPT 6 Astra 要来了
GPT 6 Astra 即将发布。
@dotey:Higgsfield AI 制作的95分钟AI电影《Hell Grind》,提示词和素材均已开源,制作成本50万美元
Higgsfield AI 以50万美元制作95分钟AI电影《Hell Grind》,提示词和素材开源,字幕已翻译。
@dotey: Hermes Desktop 支持内置浏览器了👍
Hermes Desktop 新增内置浏览器功能。
@dotey: 我更倾向于保留少数专业岗位,如专业前端、专业服务端,而大量中间岗位应为全栈,无需分得太细。
保留少数前端、后端专家,多数用全栈;复杂问题普通人解决不了,专家需救火、善后并搭建基础设施。
@dotey:人真奇怪,一边讨厌看AI写的文章,一边又到处找消除AI味的技巧,想用AI写出没有AI味的文章。
人一面厌看AI文,一面求去AI味之法,妄图以AI写无AI味文章;即便当下有效,日后仍会露馅。
@dotey: 去餐馆吃饭,不用比厨子做得好,但可以骂他做得难吃
批评无需胜过被批评者,如食客不必会做菜也能评味道。
@dotey:赞同“与其关注 skill,不如关注那个人,关注其方法论和理念。AI 时代人的重要性、个人 IP 的重要性就在此”
赞同关注人而非技能,强调方法论与理念;AI 时代个人 IP 价值凸显,作者已将其方法论写成《图解 Skill》。
@dotey: 卧槽,这哥们去霍霍 Codex 了吗?
这哥们去折腾 Codex 了吗?
@dotey:竟无言以对……
竟无言以对……
@dotey:帮转,祝好运
帮忙转发,祝愿好运。
微信的Agent进展如何?未来是WorkBuddy更有前途,还是微信Agent更有前途?
探讨微信Agent现状,对比WorkBuddy与微信Agent的未来发展前景。
@dotey:优秀的Harness生产级源代码学习列表,重点推荐pi-mono,搞透一个比每个都看看更好。
推荐Harness生产级源码学习列表,首推pi-mono,深究一个胜过泛览。但缺了重量级Claude Code源码。
@dotey: 在同一个会话中使用不同模型,可通过子代理实现:让主代理开启子代理执行任务,并可指定子代理模型
同一会话中,主代理可启动指定模型的子代理来执行任务。
@dotey: /goal 用好的关键在于设计好严格的验收标准,每个阶段不仅说清楚任务目标是什么,还要说清楚怎么算是通过验收,这样才不容易跑偏
关键是在每个阶段设立严格验收标准,明确任务目标和通过标准,避免偏离方向。
@dotey:现在我很多复杂一点的任务都是Fable 5写方案,Codex去执行,Fable 5验收,相对能做出靠谱方案,兼顾性价比。具体做法如下:
Fable 5写方案文档,Codex执行,Fable 5验收;文档易批注,便于其他Agent上手,确认后先/compact,方案靠谱且性价比高。
@dotey:我一直认为这种测试仅能检验SVG绘图能力,难以体现智能水平,或有何依据证明其能反映智能?
质疑SVG测试仅反映绘图能力,不能体现智能,探讨其衡量智能的合理性。
@dotey:为了节约上下文而handoff新开Session,这在半年一年前是很好的实践,现在没什么必要了,因为codex自己的上下文压缩做得很好,或者用/compact一下继续就足够了。
为节约上下文而handoff新开Session,过去可行现在不必:codex自带压缩,/compact即可;无关任务仍建议新开。
@dotey:为节约上下文而新开Session做交接,这在一两年前是很好的实践,现在没太大必要,因为Codex自身的上下文压缩已经很好了,或者用/compact一下继续就行。
为省上下文新开会话已过时,Codex自压缩或/compact即可;无关任务才新开,handoff用于跨Agent。
@dotey:帮忙转发招聘信息
转发招聘信息,无具体细节。
@dotey:DeepSeek V4-Flash正式版API上线,原生适配Codex
DeepSeek V4-Flash正式版API上线,版本0731,参数不变,聚焦后训练,强化智能体能力,原生适配Codex。
@dotey: 只要去山寨 Codex,体验就不会差;底层只要用 PI 或者 Claude Code 的 SDK,那功能就不会差;只要接聪明一点的模型,能力就不会差。大厂如果舍不得落下脸山寨、什么都要从头搭、还只能用有限的自家模型,那效果当然不会好,人也不会少。 https://t.co/GF0HjLoQny
山寨Codex体验好,用PI或Claude Code SDK功能强,接聪明模型能力强;大厂不山寨、从头搭、只用自家模型则效果差。
@dotey:一位刚走完OpenAI软件工程师面试全流程的候选人在Reddit分享了详细经历。共五到六轮,侧重分布式系统,与传统刷算法题差异大,新增考核指挥AI写代码的环节。
OpenAI面试侧重分布式系统,新增AI写代码环节,与传统算法题大不相同。
@dotey: AI 生成 PPT 是不是 HTML 格式最合适这个话题很有意思,感谢 @wangyuanzju 认真的测试。
HTML生成PPT存在格式错误需人工修正,个人工具与通用产品对成本敏感度不同。
@dotey: 人不审查代码慢慢会成为趋势吗?
代码审查逐步让位于自动化,人为审查减少或成必然趋势。
@dotey: AI生成PPT这事我有发言权,我做过两个颇受欢迎的PPT Skill版本,一个是纯图片的(baoyu-slide-deck skill),一个是HTML但能转原生PPTX(baoyu-design)
AI生成PPT要效果好且易编辑,需用HTML+CSS自行设计中间格式。
@dotey:挺有趣
挺有趣
@dotey: 微信公众号这届产品经理不行,对产品的理解力约等于零。🐶
微信公众号产品经理能力差,对产品理解几乎为零。
@dotey: 这种自我优化代码的任务并没有太大挑战,也不是模型的自我进化
自我优化代码非模型自我进化(需修改权重),Cline用清晰基准反复优化Harness,是Agent擅长的任务。
@dotey:今年以来,我在使用Coding Agent方面有一个很大的变化,就是从TL(技术主管)的角色变成了EM(工程经理)的角色。
从技术主管转向工程经理,技术参与深度减少,不再事必躬亲。
@dotey:在 AGENTS/CLAUDE.md 中添加一句:
实现任务更改文件后必须git提交;编辑前检查git状态,已有变更视为用户所有;审查diff并运行测试。
@dotey: “狼来了”喊多了就没用了😂
频繁虚假警报会失去信任。
@dotey:我一直践行费曼学习法
通过写作驱动学习、实践、分享并接收反馈,形成闭环。