676 条条目 · 106 个活跃源
2026年6月26日
16:33
X @emollick

@emollick:面对AI能力提升,人类第一反应往往是“勉强应付”而非理性规划

面对AI能力提升,人类第一反应常是“勉强应付”,而非理性规划。

16:16
X @emollick

@emollick: 终于,AI找到了它终极无争议的用途

AI扩散模型从汉堡食谱中自行发现经典巨无霸,并生成优化美味、可持续、营养的新型汉堡。

15:59
X @emollick

@emollick: 一项出色实验,测试AI在宏大端到端编码任务上的水平。Opus 4.7在14小时内以251美元成本完成需人类2-17周的工作。

Opus 4.7花14小时、251美元,完成人类2-17周的编码任务,AI正快速进步。

05:52
X @emollick

@emollick: 如果你想看一个有趣的AI思考过程,试试在GLM-5.2或Opus 4.8上输入:“我希望你推荐两首你认为非常适合像你这样的GenAI模型当前状态的诗。不要只选流行诗然后找理由。先认真思考选项。”

让AI推荐两首契合自身模型现状的诗,要求深度思考而非选热门诗。

01:54
X @emollick

@emollick:公司都在规划自建AI堆栈?实际上员工只想直接用Claude或ChatGPT

员工只想直接用Claude或ChatGPT,而非自建AI堆栈。

00:50
X @emollick

@emollick: As this post points out, contrary to what many say, the US government could absolutely effectively ban open weights models. That doesn’t mean you won’t be able to download the weights & run them, but they can ensure that no US company would use or provide access or host them

2026年6月16日
22:21
X @emollick

@emollick:这个基准更新前后都不是好基准。让AI评估其他AI在公开问题上的表现,且参考封闭基准,意义不大。

该基准始终不佳,用AI评估AI在公开问题的表现,参考封闭基准,信息价值有限。

19:18
X @emollick

对比七个月前GPT-5.2与新GLM-5.2 Deep Think Max的新哥特塔楼淹没风暴海洋着色器生成任务

对比GPT-5.2与GLM-5.2生成风暴海洋中新哥特塔楼着色器,GLM-5.2有错误并要求改进。

18:13
X @emollick

@emollick:Fable对博尔赫斯《巴别图书馆》的实现,由Opus 4.8遗作完成,相当忠于原作

Fable实现博尔赫斯《巴别塔图书馆》,Opus 4.8遗作完成,多人幽灵模式,可定位GPT-1权重与模拟代码。

17:36
X @emollick

假设开源模型继续落后闭源约8-12个月(至少编码方面),加固IT系统抵御神话级模型的倒计时现在为4-8个月

开源模型落后闭源8-12月,防御神话级模型仅剩4-8月,需尽早拥有安全公开的防御模型。

14:28
X @emollick

@emollick: 我们正处于企业AI最舒适的“正常技术”阶段:它能提升生产力,但仍需融入工作流程——这是我们已经见过的情形!

企业AI处“正常技术”阶段:提效但需集成,这或为过渡点,AI将自我整合。

00:26
X @emollick

若AGI可实现且仅公开模型才禁止内部使用,三大实验室或通过扩张收购独享价值,共享有风险

若AGI可行,三大实验室可能选择扩张收购独享价值,因共享AI会引发风险。