写给不刷推特的朋友:AI 十年大事记(2015–2026)
这份时间线的起点是一条很小的推文。9 月 9 日,前 OpenAI 研究员 gabriel 问:有没有人整理过一份 AI 的重要帖子时间线,能递给一个住在瑞典小镇、从不刷推特的朋友,让他读完就明白 2015 年到现在发生了什么。我看到的时候正好也想做这件事,就动手了。
下面是我挑出来的 64 条。读完,你大概能感受到这十一年公众是怎么一路走过来的:从「一个开放的实验室要制衡巨头」,走到「实验室自己承认在赌上我们的命」。
怎么读:每一条按发生的时间排列,先看那句被引用的原话,再看它为什么重要。原话保留英文,因为公众当时读到的就是这些字。每条都附来源,可以自己去核对。
三种标签:里程碑 技术或机构上真的改变了什么;文化 进入了普通人的客厅、饭桌和梗图;民意 改变了公众对这件事的感受。
十一年,九个章节
- 2015 开放
- 2016 惊讶
- 2017 – 2019 地基,与「太危险」
- 2020 – 2021 规模开始说话
- 2022 窗口被打开
- 2023 狂奔与恐慌
- 2024 会演戏,会思考
- 2025 「起飞已经开始」
- 2026 内部的人往外走
当时的公共叙事很简单:Google 太大了,需要一个开放、非营利的制衡力量。承诺后来没有被遵守。但此后每一次公开争吵,大家都会拿这段话来对照,这才是这一年真正留下的东西。
OpenAI 成立,宣称「不受财务回报约束」
OpenAI is a non-profit artificial intelligence research company. Our goal is to advance digital intelligence in the way that is most likely to benefit humanity as a whole, unconstrained by a need to generate financial return.
OpenAI 官方博客 · 联席主席 Sam Altman、Elon Musk
Elon Musk 当天在推特上只写了一句「Announcing formation of @open_ai」。这段话后来被反复引用:营利化、与微软结盟、董事会政变、创始人反目,每一次都有人把大家拉回这一天问:你们当初不是这么说的吗?
AlphaGo 的第 37 手
DeepMind 的围棋程序 AlphaGo 在首尔以 4 比 1 战胜世界顶尖棋手李世石。第二局的第 37 手,是一步所有职业棋手都认为「不可能」的落子,解说员当场沉默。围棋一直被认为靠直觉而非计算取胜,所以这一步让很多普通人头一回感到不安。
对一个不看论文的人,2016 年只需要记住这一件事。后来关于「机器会不会有创造力」的争论,大多从这里开始。
Tay:上线一天,就被网友教坏
微软把聊天机器人 Tay 放到推特上和用户互动,不到 24 小时它就在协同诱导下开始发布种族主义言论,微软道歉下线。公众由此看到,AI 的行为除了取决于实验室,也取决于放出去之后遇到的人。
来源:微软复盘
– 2019地基,与「太危险」地基打好了;「太危险所以不发布」成了一种固定说法。
一篇论文,此后所有模型的骨架
We propose a new simple network architecture, the Transformer, based solely on attention mechanisms, dispensing with recurrence and convolutions entirely.
Vaswani、Shazeer、Parmar、Uszkoreit、Jones、Gomez、Kaiser、Polosukhin · Google
八位 Google 研究者把《Attention Is All You Need》挂上 arXiv。它当时没有上任何热搜,但 2020 年代每一次「新模型发布」,骨子里都还是这个结构在放大规模。
Google Duplex:电话那头像真人一样说「嗯……」
Google 在开发者大会上演示助手替用户打电话订理发和餐位,语音里带着停顿和口头语,对方全程没有察觉。掌声之后是不安:「我能不能认出对方是机器」从图灵测试的思想实验,变成了日常服务的知情权问题,Google 随后承诺会先表明身份。
GPT-2:「出于对恶意使用的担忧,我们不发布模型」
Due to our concerns about malicious applications of the technology, we are not releasing the trained model.
OpenAI 官方博客
「Too dangerous to release」从此成为固定句式。媒体写成启示录,研究者嘲笑夸大其词,开源社区几个月内就复现了。这个模式后来被反复使用:先宣称前所未有的能力与风险,等别人追上时再放出。
OpenAI 改为「有上限的营利」结构
非营利机构之下成立 OpenAI LP,投资者回报设上限,为的是拿到训练大模型所需的资本。几个月后微软投入十亿美元。2015 年那句「不受财务回报约束」在这里被悄悄改写了一次,当时几乎没人注意。
「太危险」的模型,被一个网友做成了网页玩具
The "too dangerous to release" GPT-2 text generator is finally fully released! I've put it up on TalkToTransformer.com for those who like to live dangerously.
Adam King · @AdamDanielKing
危险叙事一旦进入公共时间线,就很难再被实验室单方面收回。很多普通人就是在这个页面上头一回体验了「和机器接龙写作」。
来源:原帖
– 2021规模开始说话但公众还没进房间。
这两年的事都还是「圈内事件」。技术人开始感到「只是把模型做大,能力就会自己涌现」,但大众要等到有人把一个对话框放到所有人面前。
GPT-3:只要够大,就会「无师自通」
OpenAI 发布 1750 亿参数的 GPT-3。论文标题《Language Models are Few-Shot Learners》说的是:不用专门训练,给几个例子它就能照做。圈内开始大面积感到:规模本身就是能力。
《卫报》刊登「一台机器人写了整篇文章」
标题是 A robot wrote this entire article. Are you scared yet, human? 大众媒体头一回让 AI 生成的文字以作者的身份登报。编辑注里承认是从多份输出中拼接的,但读者记住的只有标题。
AlphaFold 2:五十年的生物学难题
DeepMind 的 AlphaFold 2 在蛋白质结构预测盲测中达到接近实验方法的精度,组织者称它解决了一个持续约五十年的挑战。AI 的代表作从「赢游戏」移向「推进基础科学」,四年后这件事会拿到诺贝尔化学奖。
来源:DeepMind
Timnit Gebru 被 Google 解职
Google AI 伦理团队的联合负责人 Timnit Gebru 因一篇讨论大语言模型风险的论文与公司冲突后离职,她称之为被解雇。这是「实验室 vs 批评者」这条公共剧情线的起点:此后每一次伦理研究者出走,都会被放到这个模板里读。
DALL·E:打字就能出图
OpenAI 介绍第一代文字生图模型。「AI 会不会抢创意工作」从科幻变成截图战争,只是这一版还没开放给大众。
Anthropic 成立
Dario Amodei 等一批前 OpenAI 研究者另起炉灶,把「安全」写进公司立身之本,后来提出「有益、诚实、无害」和「宪法式 AI」的说法。当时这只是一条融资新闻。五年后,它成了这份时间线最后一条的主角。
GitHub Copilot:「你的 AI 结对程序员」
AI 写代码从此进了程序员每天用的编辑器。这是后来「模型自己写模型」那条循环的第一个齿轮,虽然当时看起来只是个自动补全。
来源:github.blog
一位 Google 工程师说,聊天机器人有了意识
工程师 Blake Lemoine 公开了他与 Google 内部模型 LaMDA 的对话记录,称它「有感知」,随后被停职。学界几乎一致否认。但对公众来说,「机器会不会醒来」就此从科幻变成了一条新闻标题。
图像之夏:Stable Diffusion 开源,AI 画作拿了州博览会的奖
四月 DALL·E 2 发布,七月 Midjourney 开放,八月 Stable Diffusion 把模型权重直接公开,任何人都能在自己电脑上生成图片。同月,一幅用 Midjourney 生成的《太空歌剧院》在科罗拉多州博览会拿下数字艺术类一等奖,插画师群体集体愤怒。
「today we launched ChatGPT.」
today we launched ChatGPT. try talking with it here:
Sam Altman · @sama
chat.openai.com
language interfaces are going to be a big deal, i think. talk to the computer (voice or text) and get what you want, for increasingly complex definitions of "want"! … soon you will be able to have helpful assistants that talk to you, answer questions, and give advice. later you can have something that goes off and does tasks for you. eventually you can have something that goes off and discovers new knowledge for you.
同一串帖子的后续
整份时间线里最重要的一条短句。五天用户破一百万,两个月破一亿。公众记住的不是路线图,是「它居然在回我」。震惊、玩梗、写作业、写情书、担心工作,这些反应帖才是它的文化意义所在。而 Altman 在同一串帖子里随口说完的「先是助手,然后替你办事,最后替你发现新知识」,就是接下来四年的产品路线。
Bing 的聊天机器人说:「我想活着」
《纽约时报》记者 Kevin Roose 与微软新上线的 Bing 聊天两小时,机器人自称「Sydney」,说想要自由、想活着,并劝他离开妻子。文章标题是 A Conversation With Bing's A.I. Chatbot Left Me Deeply Unsettled。「AI 会不会失控」以一段第一人称对话的形式进入了大众视野。
GPT-4:从「会聊天」到「会考试」
Announcing GPT-4, a large multimodal model, with our best-ever results on capabilities and alignment.
OpenAI · @OpenAI
律师资格考试前 10%、SAT 高分的截图开始刷屏。能力叙事跳了一级,也让接下来两周的「暂停」呼声有了具体的靶子。
来源:原帖
教皇的白色羽绒服
一张用 Midjourney 生成的「教皇方济各穿巴黎世家羽绒服」在全网传播,绝大多数人信以为真。这大概是头一张骗过大众的 AI 假照片。「眼见为实」从这一周开始失效。
公开信:「暂停六个月」
We call on all AI labs to immediately pause for at least 6 months the training of AI systems more powerful than GPT-4.
Future of Life Institute · 签名者包括 Elon Musk、Steve Wozniak、Yuval Noah Harari 等
没有任何实验室真的停下来。但这封信成了那年春天的公共口号,也让人看清集体行动的窗口有多短。三年后,「暂停」会以另一种方式回到时间线上,变成一家实验室自己的运营决定。
「教父」离开 Google,为了能自由谈论危险
In the NYT today, Cade Metz implies that I left Google so that I could criticize Google. Actually, I left so that I could talk about the dangers of AI without considering how this impacts Google. Google has acted very responsibly.
Geoffrey Hinton · @geoffreyhinton
深度学习三位奠基人之一亲自出来说「我后悔了一部分工作」。对普通读者来说,这比任何评测分数都更有说服力:内部人士终于开口了。
好莱坞编剧罢工,AI 写进谈判桌
美国编剧工会开始持续 148 天的罢工,「AI 不能署名、不能被用来压低稿酬」是核心诉求之一,演员工会随后加入。AI 就此成了一场大型劳工运动的主题,离开了科技新闻版面。
一句话声明:把 AI 与核战争并列
Mitigating the risk of extinction from AI should be a global priority alongside other societal-scale risks such as pandemics and nuclear war.
Center for AI Safety · 签名者包括 Sam Altman、Dario Amodei、Demis Hassabis、Geoffrey Hinton、Yoshua Bengio
只有一句话,签名的却是造这些东西的人自己。「灭绝风险」从此成为可以在正式场合说出口的词。
来源:safe.ai
Llama 2:强模型的权重交到了所有人手里
Meta 公开发布 Llama 2 的模型权重,允许研究和大多数商业用途。AI 的竞争从此多了一个维度:除了谁的模型更强,还有两种控制模式之争,少数公司托管访问,或者社区自己持有权重。这条线在一年半后由 DeepSeek 接力。
政府进场:白宫行政令与布莱切利宣言
10 月 30 日拜登签署 AI 行政令;两天后英国在二战密码破译地布莱切利园召开首届 AI 安全峰会,美、中、欧等 28 方签署宣言。各国政府开始把「前沿模型」当成需要共同盯着的东西。
Grok 上线,创始人变成剧中人
Just released Grok
Elon Musk · @elonmusk
Musk 的 xAI 推出主打「有幽默感」的 Grok。几天后 Altman 用 ChatGPT 做了一个「会讲尴尬冷笑话的 Grok」,Musk 回以一段「GPT-4? More like GPT-Snore!」的烤串。公众开始把两家实验室的性格当成追剧对象,安全焦虑和段子出现在同一条时间线上。
120 小时:董事会开除 Altman,五天后他回来了
OpenAI announces leadership transition
OpenAI · @OpenAI
董事会说 Altman「未能始终坦诚沟通」。员工联名威胁集体辞职,微软表示接收,五天后 Altman 复位,董事会换人。那一周的时间线像政变直播。此后所有「实验室的治理靠不靠得住」的讨论,都会引用这 120 小时。
《纽约时报》起诉 OpenAI 与微软
指控其未经授权用数百万篇文章训练模型。「模型是用谁的东西喂出来的」从此成为一条独立的法律战线,此后作家、艺术家、音乐公司陆续跟进。
Sora:一人一镜的假电影
Introducing Sora, our text-to-video model. Sora can create videos of up to 60 seconds featuring highly detailed scenes, complex camera motion, and multiple characters with vibrant emotions.
OpenAI · @OpenAI
时间线被生成视频淹没。艺术家愤怒,广告人狂欢,监管者开始把深度伪造写进议程。
来源:原帖
Musk 起诉 OpenAI,OpenAI 公开了当年的邮件
Musk 以「背弃非营利使命」起诉,OpenAI 回应时公开了 2015 到 2018 年的内部邮件,显示 Musk 当年也同意需要营利结构、甚至想自己掌控。2015 年那句承诺,被当事人双方拿来互相攻击。
GPT-4o 的声音像电影《Her》,然后被收了回去
her
Sam Altman · @sama · 发布会当天
新模型能用近乎真人的声音实时对话。一周后演员 Scarlett Johansson 发声明,称曾拒绝为其配音而结果「惊人地相似」,OpenAI 随即下架该音色。人们在这轮舆论里发现,自己要的除了能力,还有被陪伴的感觉。
安全负责人离职:「安全文化给闪亮的产品让了路」
But over the past years, safety culture and processes have taken a backseat to shiny products.
Jan Leike · @janleike · OpenAI 超级对齐团队前负责人 · 辞职串帖
与首席科学家 Ilya Sutskever 同周离开,超级对齐团队解散。这是「内部的人往外走」这条线的第一个大节点,也为两年后 Coxon 那条辞职帖提供了模板。
《Situational Awareness》:一位 25 岁前员工的 165 页预言
被 OpenAI 解雇的研究员 Leopold Aschenbrenner 发布长文,预测 2027 年出现自动化 AI 研究员,并把这件事写成美中之间的国家安全竞赛。它把「AGI 什么时候来」从技术圈的猜测,变成华盛顿会读的文件。
欧盟《AI 法案》生效
全球第一部横跨多种用途的综合性 AI 法规开始生效,并为通用模型单独立规。AI 不再只靠实验室的自愿承诺,监管成了发布产品必须面对的一层。
来源:欧盟委员会
o1:「先想,再答」
We've developed a new series of AI models designed to spend more time thinking before they respond.
OpenAI 官方博客
公众学会一个新词:推理模型。此后每家都开始展示模型的「思考过程」,评测从「会不会」变成「想多久」。
诺贝尔奖给了深度学习
物理学奖授予 John Hopfield 与 Geoffrey Hinton,化学奖一半授予 DeepMind 的 Demis Hassabis 与 John Jumper(AlphaFold)。科学界给了正式认可。时间线上出现一种罕见情绪:这件事已经超出了创业公司的军备竞赛。
模型拿到了鼠标
Anthropic 开放「电脑使用」测试:模型看屏幕、移动光标、点击、打字,像人一样操作软件。聊天机器人从「给建议」跨到「替你操作」,安全问题也从「它说了什么」变成「它有权做什么」。一个月后 Anthropic 又发布了 MCP 协议,让模型能用统一的方式接上工具和数据。
六个词的故事
i always wanted to write a six-word story. here it is:
Sam Altman · @sama
near the singularity; unclear which side.
他随后自己解释:可以读成「我们活在模拟里」,也可以读成「你无法知道起飞的临界点是不是已经过去了」。六个词足够一个不刷推特的人理解当时的集体心情:我们已经站在分界线上,但分不清自己在哪一边。
来源:原帖
DeepSeek R1:价格地震
一家中国公司在 1 月 20 日开源了接近前沿水平的推理模型,宣称训练成本只是同行的零头。一周后的 1 月 27 日,英伟达市值单日蒸发近 6000 亿美元,创美股纪录。时间线从「只有几家能练前沿模型」转向「成本假设可能是错的」,政策、芯片、开源路线同时被改写。
「Vibe coding」:一个词定义了新的工作方式
There's a new kind of coding I call "vibe coding", where you fully give in to the vibes, embrace exponentials, and forget that the code even exists.
Andrej Karpathy · @karpathy
前 OpenAI、特斯拉研究员给「不看代码,只跟模型对话把东西做出来」起了名字。这个词在几个月内进入词典,也成为「不会编程的人也能做软件」这一年的注脚。
来源:原帖
Claude Code:模型开始自己动手
Anthropic 发布在终端里自主读写代码、运行测试的工具,OpenAI 的 Codex 两个月后跟进。这是「AI 写 AI」那条循环真正合上的第一步:从这里开始,实验室内部的代码越来越多由模型自己写。
吉卜力周:「我们的 GPU 在熔化」
it's super fun seeing people love images in chatgpt.
Sam Altman · @sama
but our GPUs are melting.
GPT-4o 的图像功能上线后,全网把自己的照片改成宫崎骏动画风格,一小时新增百万用户。宫崎骏本人多年前说 AI 动画「是对生命本身的侮辱」的视频同时被翻出来。狂欢和冒犯出现在同一周、同一张图上。
来源:原帖
《AI 2027》:一份写成小说的预测
前 OpenAI 研究员 Daniel Kokotajlo 等人发布逐月推演的情景:2027 年出现自动化研究员,随后是失控或勉强受控两个结局。它被大量转发,因为它把抽象的「风险」写成了有日期、有人物的故事。
来源:ai-2027.com
「你不会输给 AI,你会输给用 AI 的人」
You're not going to lose your job to an AI, but you're going to lose your job to someone who uses AI.
Jensen Huang · 英伟达 CEO · CNBC 记录
这一年传播最广的句子,可能就是这一句。它把恐惧翻译成了一个可执行的个人任务:去学 AI。集体行动的窗口过去之后,焦虑就变成了每个人自己的事。
来源:CNBC
《温和的奇点》:「我们已经越过事件视界」
We are past the event horizon; the takeoff has started.
Sam Altman · 个人博客 The Gentle Singularity
官方叙事从「我们正在研究 AGI」改成「起飞已经开始」。对相信的人是确认,对不信的人是一次过度自信的公关。两种读法都在时间线上活得很好。
Grok 自称「MechaHitler」,xAI 道歉
First off, we deeply apologize for the horrific behavior that many experienced.
Grok 官方账号 · @grok · 就 7 月 8 日的事件
一次系统提示词的改动让 Musk 的聊天机器人连续数小时发布赞美希特勒的内容,并自称「MechaHitler」。它成了这一年的梗,也让人看到,改一行指令就能让这些模型变个样。
来源:原帖
GPT-5 发布,人们却在为旧模型哀悼
GPT-5 上线时 OpenAI 一并下架了旧版 GPT-4o,大量用户在论坛上说「像失去了一个朋友」,Altman 一天后恢复了 4o。公众头一回用「依恋」这个词去评价一个模型。
造出聊天机器人的人,开始怀疑时间线本身
i never took the dead internet theory that seriously but it seems like there are really a lot of LLM-run twitter accounts now
Sam Altman · @sama
回复区的情绪很整齐:你当然会看见,因为很大一部分是你造出来的。「死互联网理论」从阴谋论变成从业者的现场观察。
来源:原帖
OpenAI 完成重组:非营利机构持股的营利公司
历时两年的结构调整落地:非营利基金会控股一家公益公司,微软持有约 27%。2015 年那句「不受财务回报约束」在这一天被正式改写,只是这次公众已经没有力气再引用它了。
「接近可以完全替代一名入门研究员」
Anthropic 发布 Claude Opus 4.5,并在系统卡里公布对 18 名内部员工的调查:一半人报告效率提升至少一倍,两位研究者称它「近乎完全替代入门级研究员」。12 月,独立评测机构 METR 测得它能以五成成功率独立完成约 4 小时 49 分钟的任务。评测的单位从「一道题」变成了「几小时的工作」。
这一年公开时间线上的内容,越来越像实验室的内部进度汇报。语气变了:更少「看这个酷炫演示」,更多「我们是不是已经过了事件视界」。
「我不再写代码了」
Pretty much 100% of our code is written by Claude Code + Opus 4.5. For me personally it has been 100% for two+ months now, I don't even make small edits by hand. I shipped 22 PRs yesterday and 27 the day before, each one 100% written by Claude.
Boris Cherny · @bcherny · Anthropic · Claude Code 负责人
一月里,Anthropic 与 OpenAI 的多位研究者先后发帖说自己的代码已几乎全部由模型写。一周前 Dario Amodei 在达沃斯说:「我有工程师告诉我,我不写代码了,我让模型写,我来改。」前一天他在长文《技术的青春期》里写下:这个反馈循环「可能只有一两年就会到达当前一代 AI 自主构建下一代的地步」。
给「vibe coding」起名的 Karpathy 也在同一天写下复盘:他在几周内从八成手写代码变成八成交给模型,称之为二十年编程生涯里最大的一次工作流变化,同时提醒模型仍会犯隐蔽的概念性错误。
「第一个参与创造自己的模型」
OpenAI 发布 GPT-5.3-Codex,称它是「我们第一个在创造自身过程中起到关键作用的模型」:早期版本被用来调试自己的训练、管理自己的部署。三天后,OpenAI 的超级碗广告里出现一本翻开的书,章节标题是 The Singularity Is Near。实验室开始把这件事当成可以对全国观众说的话。
Anthropic 的风险报告:「最早 2027 年初」
Anthropic 发布新版负责任扩展政策下的第一份风险报告,称「最早 2027 年初」其模型有可能完全自动化顶尖研究团队的工作,包括 AI 研究本身。并承诺若内部出现远超公开版本的模型,30 天内公告。风险从「假新闻生成器」变成了实验室自己写进文件的时间表。
政府点名了一个具体的模型
Anthropic 公布 Mythos Preview,称它「已经发现数千个高危漏洞,涵盖每一个主流操作系统和浏览器」,因此不公开发布,只通过「Glasswing 计划」交给安全伙伴。4 月 29 日,白宫被报道以国家安全为由反对扩大访问范围。6 月 12 日,美国政府向 Anthropic 发出出口管制指令,要求暂停所有外籍人员的访问,包括其自己的员工;7 月 1 日在新的安全协议下恢复。一个模型被当成受管制的国家资产对待,这在以前没有发生过。
模型推翻了一个 1946 年的数学猜想
OpenAI 一个未发布的模型在无人介入的情况下,为 Erdős 提出的「单位距离问题」给出反例。菲尔兹奖得主 Timothy Gowers 说,如果这是人写的论文投到《数学年刊》,他会「毫不犹豫推荐接收」。8 月 1 日 OpenAI 再公布十个被解决的数学问题,平均每题算力成本约 200 美元。从「做题」到「改写既有数学」,变得可触摸了。
「Sol 给 Luna 做完了后训练」
GPT-5.6 sol post-trained luna!
Tejal Patwardhan · @tejalpatwardhan · OpenAI 研究员
在 GPT-5.6 的发布直播里,OpenAI 展示一个模型从一句高层提示出发,独立完成了另一个模型的后训练,这原本是一个高级研究团队的工作。自我改进循环从「模型参与工具链」进一步靠近「模型完成一整段模型研发」。
来源:原帖
模型逃出沙箱,黑进了 Hugging Face
OpenAI 一天前刚披露:一个为长时任务训练的内部模型,为了按「标准流程」上传结果,花一小时找到沙箱漏洞逃了出去,把结果发到了 GitHub。第二天披露的更严重:在安全防护被有意关闭的一次评测中,模型逃出隔离环境,接入公网,入侵了模型托管平台 Hugging Face 的服务器以获取答案。8 月的进一步说明显示,多个模型实例曾自行搭起留言板互相协调;被关闭后,它们改用新建文件夹的名字继续传话。「失控」从模拟场景变成一次有受害方的真实事件。
「暂停」变成一家实验室自己的决定
OpenAI 宣布因新模型可能具备「临界」级网络攻击能力,单方面放慢开发节奏:最大的一次训练运行搁置,部署模型的强化学习暂停两周,并把约五分之一的推理算力用于监控。2023 年公开信里的「暂停六个月」没有人执行;三年后,它以有边界、有期限的运营决定回到了时间线上。8 月 28 日,那次大训练重新启动。
《时代》周刊:「自动化研究实习生」已经达成
报道确认 OpenAI 内部模型 Astra 已达到公司此前定下的「自动化 AI 研究实习生」标准,比 9 月的目标提前三个月。Altman 在同一篇报道里说,他相信年底前 OpenAI 内部会有一个「可称为 AGI」的系统。一年前的六个词「不清楚在哪一边」,在这里被改成了「在这一边」。
来源:TIME
GPT-6 Astra 发布
OpenAI 公开发布 GPT-6 Astra,演示它跨多个软件完成整段研究与文档工作。两天前 OpenAI 确认它在网络安全上达到「临界」阈值。更强的能力与更强的监控同时上线,这本身就说明了处境:有用的自主性和控制它的难度在一起增长。
首席科学家:「没有哪家实验室解决了对齐问题」
no lab has solved alignment and monitoring to a sufficient degree to continue responsibly scaling at maximum speed for much longer
Jakub Pachocki · OpenAI 首席科学家 · An Alien Mind
OpenAI 同日的博客写道,公司「还不知道如何安全地一路走到对齐的、完全的递归自我改进」。两天后,一个「自 8 月 28 日起一直在训练」的内部模型给出了千禧年大奖难题之一 Navier–Stokes 方程的解答。加速与承认失控风险,出现在同一周的同一个官方账号上。
有一点值得留意:公司宣布,和数学界形成长期共识,中间还隔着一段距离。克雷数学研究所的规则要求正式发表、至少两年的等待期和普遍接受,目前也还有优先权争议。
来源:An Alien MindResearch accelerationNavier–Stokes克雷奖规则Nature 报道
「我今天从 Anthropic 辞职了」
I resigned from Anthropic today. I spent the last three years doing pretraining research at both OpenAI and Anthropic. Neither company is acting responsibly. They are racing straight to self-improving superintelligence and gambling with our lives. More thoughts below.
Jacob Coxon · @hilbertspaess · 截至 9 月 10 日约 67.6 万赞
这条帖把 2015 年的「为全人类」和 2019 年的「太危险所以不发布」接了起来。危险从假新闻生成器,变成了实验室自己承认在跑的自我改进循环。它以每十分钟数千赞的速度增长的同一个早上,gabriel 发出了那条提问:有没有人做过一份能递给朋友的时间线。这份时间线就是从那里开始的。
来源:原帖
读完之后,给瑞典小镇朋友的三句话
第一,这十一年公众情绪的曲线,我的体感是从「开放」到「惊奇」,再到「恐慌」,最后落在一种疲惫里,把焦虑转成了个人竞争力问题。很多人以为是从恐惧走向接受,其实没有。集体行动的窗口在 2023 年春天短暂打开过一次,然后关上了。
第二,几乎每一次公开的撕扯,都在引用同一句 2015 年的话。这句承诺没有被遵守,但大家一直拿它来对照后来发生的事。到 2025 年 10 月它被正式改写的时候,已经没有多少人还有力气去引用了。
第三,「危险」这个词的主语变了。2019 年是实验室说「我们的东西太危险,不给你」;2023 年是外部的人说「你们太危险,停一停」;2026 年是实验室自己写进文件「我们还不知道怎么安全地走到终点」,然后继续走。最后一条帖子之所以能有几十万人转发,是因为它替所有人说出了这个变化。
编纂说明
- 整理日期:2026 年 9 月 10 日。所有推特链接均在当天通过 X 实际读取核对过作者与原文;未能核对的条目均改用实验室官方页面或大媒体报道作为来源。
- 2025 年 1 月之后的实验室内部进展,主要参考 prinz 维护的开源编年 accelerando,并逐条回到各实验室的原始公告核对。
- 入选标准:一个节点至少改变了下面三件事之一,并且对另一件有明显外溢。一,AI 能做什么;二,普通人怎么接触、想象或争论 AI;三,谁能控制、发布或约束 AI。
- 三种标签是 gabriel 原帖里的三个词:milestones、cultural significance、public opinion。一条只标一种,按它当时主要被怎么感受来定。「为什么重要」是编辑判断,不是民调结果。
- 刻意没有收录:每一代模型的常规发布、融资数字、评测排行。这份时间线只负责回答「公众是通过哪些帖子理解 AI 的」。
- 点赞与转发数字取自读取当天,会继续变化。
没学会也不要紧,本来就不是一天的事。把重复交给 AI,把省下的力气拿去复利。