大事正在发生 Something Big Is Happening (Matt Shumer, Feb 9, 2026)

本文内容不构成投资建议或暗示其真实性。

来源,许可协议未知,gemini-3-pro-preview翻译。

回想一下 2020 年 2 月。

如果你当时密切关注,可能会注意到有少数人在谈论一种在海外传播的病毒。但我们大多数人并没有太在意。股市表现良好,孩子们在学校上课,你照常去餐馆、握手、规划旅行。如果有人告诉你他们在囤积卫生纸,你会觉得他们在互联网的某个怪异角落待太久了。然后,在大约三周的时间里,整个世界改变了。你的办公室关闭了,孩子们回到了家,生活重组成了一个月前你自己都不敢相信的样子。

我认为,对于比新冠疫情(Covid)还要大得多的事情,我们正处于“这看起来有点言过其实”的阶段。

我花了六年时间建立一家 AI 初创公司并投资这个领域。我就生活在这个世界里。我写这篇文章是为了我生活圈子之外的人……我的家人、我的朋友、那些我关心的人,他们总是问我“所以 AI 到底是怎么回事?”,却得到一个无法真实反映现状的答案。我总是给他们礼貌的版本。社交场合的客套版本。因为诚实的版本听起来像是我疯了。有一段时间,我告诉自己这理由足以让我把真相藏在心里。但我所说的与实际正在发生的事情之间的差距已经变得太大了。即便听起来很疯狂,我关心的人也值得听到即将发生什么。

我要先说明一点:虽然我在 AI 领域工作,但我对即将发生的事情几乎没有任何影响力,这个行业里的绝大多数人也是如此。未来正由极少数人塑造:几家公司的几百名研究人员……OpenAI、Anthropic、Google DeepMind 以及其他几家。由一个小团队在几个月内管理的单次训练运行,就能产生一个改变整个技术轨迹的 AI 系统。我们大多数从事 AI 工作的人都是在不是我们奠定的基础上进行构建。我们和你一样看着这一切展开……我们只是凑巧离得够近,能先感觉到地面的震动。

但现在是时候了。不是那种“我们要找个时间谈谈这个”的方式。而是以一种“这正在发生,我需要你明白”的方式。


我知道这是真的,因为它首先发生在了我身上

这是科技圈外的人尚未完全理解的事情:之所以现在这么多业内人士在敲响警钟,是因为这已经发生在了我们身上。我们不是在做预测。我们是在告诉你我们在自己的工作中已经经历了什么,并警告你,下一个就是你。

多年来,AI 一直在稳步改进。这里那里会有大的飞跃,但每次大飞跃之间的间隔足够长,你可以慢慢消化。然后到了 2025 年,构建这些模型的新技术解锁了更快的进步速度。然后它变得更快。然后再一次加速。每一个新模型不仅比上一个更好……而且好的幅度更大,新模型发布的时间间隔也更短。我越来越多地使用 AI,与它来回修改的次数越来越少,看着它处理那些我过去认为需要我的专业知识才能完成的事情。

然后,在 2 月 5 日,两个主要的 AI 实验室在同一天发布了新模型:OpenAI 的 GPT-5.3 Codex 和 Anthropic(Claude 的制造者,ChatGPT 的主要竞争对手之一)的 Opus 4.6。有些东西“咔哒”一声接通了。不像是一个突然的灯光开关……更像是那一刻,你突然意识到水位一直在你周围上涨,现在已经没过了你的胸口。

我的工作的实际技术部分已经不再需要我了。 我用简单的英语描述我想要构建的东西,然后它就……出现了。不是需要我修改的草稿。是成品。我告诉 AI 我想要什么,离开电脑四个小时,回来发现工作已经完成了。做得很好,比我自己做得还要好,不需要任何修正。几个月前,我还需要跟 AI 来回沟通,指导它,进行编辑。现在我只需描述结果然后离开。

让我给你举个例子,这样你就能理解这在实践中究竟是什么样子的。我会告诉 AI:“我想构建这个应用程序。这是它的功能,这是它大致的样子。弄清楚用户流程、设计以及所有的一切。” 然后它就去做了。它编写了成千上万行代码。然后,这是在一年前不可想象的部分,它自己打开了应用程序。它点击按钮。它测试功能。它像人一样使用这个应用。如果它不喜欢某个东西的外观或感觉,它会自己回去修改。它像开发人员一样迭代,修正和完善,直到它满意为止。只有当它决定应用程序符合它自己的标准时,它才会回来对我说:“准备好让你测试了。” 当我测试时,它通常是完美的。

我没有夸张。这就是我这周一的样子。

但上周发布的模型(GPT-5.3 Codex)最让我震惊。它不只是在执行我的指令。它在做智能决策。它拥有一种第一次让人感觉像是判断力的东西。像是品味。那种人们总是说 AI 永远不会拥有的、难以言喻的知道什么是正确选择的感觉。这个模型拥有它,或者至少非常接近,以至于这种区别开始变得无关紧要。

我一直是 AI 工具的早期采用者。但过去几个月让我震惊。这些新的 AI 模型不是渐进式的改进。这是完全不同的东西。

这就是为什么即使你不在科技行业工作,这也与你有关。

AI 实验室做出了一个深思熟虑的选择。他们首先专注于让 AI 擅长编写代码……因为构建 AI 需要大量的代码。如果 AI 能编写那些代码,它就能帮助构建它自己的下一个版本。一个更聪明的版本,能编写更好的代码,从而构建一个更聪明的版本。让 AI 擅长编程是解锁其他一切的战略。这就是为什么他们首先做这个。我的工作比你的工作先开始发生变化,不是因为他们针对软件工程师……这只是他们选择首先瞄准哪里的副作用。

他们现在已经做到了。他们正在转向其他所有领域。

过去一年科技工作者的经历——看着 AI 从“有用的工具”变成“比我更擅长我的工作”——是其他所有人即将拥有的经历。法律、金融、医学、会计、咨询、写作、设计、分析、客户服务。不是在十年后。构建这些系统的人说是一到五年。有些人说得更短。考虑到我在过去几个月里看到的情况,我认为“更短”的可能性更大。

“但我试过 AI,它没那么好”

我经常听到这句话。我理解,因为这曾经是真的。

如果你在 2023 年或 2024 年初尝试过 ChatGPT,并认为“这东西在胡编乱造”或“这没那么令人印象深刻”,你是对的。那些早期版本确实有限。它们会产生幻觉。它们自信地胡说八道。

那是两年前的事了。在 AI 的时间尺度里,那是古代史。

今天可用的模型与六个月前存在的模型相比已经面目全非。关于 AI 是“真的在变好”还是“遇到了瓶颈”的争论——这已经持续了一年多——已经结束了。结束了。任何还在提出这种论点的人,要么是没有使用当前的模型,要么有动机淡化正在发生的事情,或者是在基于 2024 年那种不再相关的体验进行评估。我说这些不是为了轻视谁。我说这些是因为公众认知与当前现实之间的差距现在已经巨大,而这种差距是危险的……因为它阻碍了人们做好准备。

部分问题在于大多数人使用的是 AI 工具的免费版本。免费版本比付费用户可以使用的版本落后一年以上。基于免费版 ChatGPT 来判断 AI,就像用翻盖手机来评估智能手机的发展状况一样。那些为最好的工具付费,并实际上每天在实际工作中使用它们的人,知道即将发生什么。

我想到了我的朋友,他是一名律师。我一直告诉他在他的律所尝试使用 AI,但他总是找到行不通的理由。它不是为他的专业领域构建的,他在测试时它犯了一个错误,它不理解他工作的细微差别。我明白。但我已经有大型律所的合伙人联系我寻求建议,因为他们已经尝试了当前的版本,并且看到了未来的走向。其中一位,一家大型律所的管理合伙人,每天花几个小时使用 AI。他告诉我这就像拥有一支随时待命的助理团队。他使用它不是因为它是个玩具。他使用它是因为它管用。他告诉了我一件让我印象深刻的事:每隔几个月,它在他工作上的能力就会显著增强。他说,如果它保持这个轨迹,他预计不久之后它就能做他所做的大部分工作……而他是一位拥有数十年经验的管理合伙人。他并没有惊慌失措。但他正在非常密切地关注。

那些在各自行业领先的人(那些真正认真进行实验的人)并没有忽视这一点。他们被它已经能做到的事情震惊了。并且他们正在据此定位自己。


这一切实际上进展得有多快

让我把改进的速度具体化,因为如果你没有密切关注,我认为这部分是最难相信的。

2022 年,AI 无法可靠地进行基本算术。它会自信地告诉你 7 × 8 = 54。

到 2023 年,它可以通过律师资格考试。

到 2024 年,它可以编写可运行的软件并解释研究生水平的科学。

到 2025 年底,世界上一些最好的工程师表示,他们已将大部分编码工作交给了 AI。

2026 年 2 月 5 日,新模型的到来让之前的一切感觉像是另一个时代的产物。

如果你在过去几个月没有尝试过 AI,那么今天存在的东西对你来说将是无法辨认的。

有一个名为 METR 的组织实际上在用数据衡量这一点。他们跟踪模型在没有人类帮助的情况下,成功端到端完成现实世界任务的长度(以人类专家需要多长时间来衡量)。大约一年前,答案大概是十分钟。然后是一小时。然后是几个小时。最近的测量结果(11 月发布的 Claude Opus 4.5)显示,AI 完成了人类专家需要近五个小时才能完成的任务。而且这个数字大约每七个月翻一番,最近的数据表明它可能正在加速到每四个月翻一番。

但即使是那个测量结果也没有更新以包含本周刚刚发布的模型。以我使用它们的经验来看,这一跳跃是非常显著的。我预计 METR 图表的下一次更新将显示另一个巨大的飞跃。

如果你延伸这一趋势(而且这种趋势已经保持多年,没有平缓的迹象),我们将看到 AI 在明年内能够独立工作数天。两年内数周。三年内能完成长达一个月的项目。

Amodei 曾表示,“在几乎所有任务上都比几乎所有人类聪明得多”的 AI 模型有望在 2026 年或 2027 年出现。

让这句话沉淀一下。如果 AI 比大多数博士都聪明,你真的认为它做不了大多数办公室工作吗?

想想这对你的工作意味着什么。


AI 现在正在构建下一个 AI

还有一件事正在发生,我认为这是最重要的进展,也是最不被人理解的。

2 月 5 日,OpenAI 发布了 GPT-5.3 Codex。在技术文档中,他们包含了这段话:

“GPT-5.3-Codex 是我们第一个在自身创造过程中发挥了重要作用的模型。Codex 团队使用早期版本来调试其自身的训练、管理其自身的部署,并诊断测试结果和评估。”

再读一遍。AI 帮助构建了它自己。

这不是关于某天可能发生什么的预测。这是 OpenAI 在此时此刻告诉你,他们刚刚发布的 AI 被用来创造它自己。让 AI 变得更好的主要因素之一是将智能应用于 AI 开发。而 AI 现在已经足够智能,可以为其自身的改进做出有意义的贡献。

Anthropic 的 CEO Dario Amodei 表示,AI 现在正在他的公司编写“大部分代码”,而且当前 AI 与下一代 AI 之间的反馈循环正在“逐月积聚动力”。他说我们可能“距离当前一代 AI 自主构建下一代 AI 的时刻只有 1-2 年了”。

每一代都在帮助构建下一代,下一代更聪明,能更快地构建再下一代,而再下一代则更加聪明。研究人员称之为智能爆炸。而那些知情者——那些正在构建它的人——相信这个过程已经开始了。


这对你的工作意味着什么

我打算直话直说,因为我认为你更值得听到诚实的话,而不是安慰。

Dario Amodei,这可能是 AI 行业中最注重安全的 CEO,曾公开预测 AI 将在一到五年内消灭 50% 的初级白领工作。许多业内人士认为他还是太保守了。鉴于最新模型能做的事情,这种大规模颠覆的能力可能会在今年年底出现。这需要一些时间才能在经济中传导开来,但这种潜在的能力正在到来。

这与以往的每一次自动化浪潮都不同,我需要你明白为什么。AI 不是在取代某一项特定技能。它是认知工作的通用替代品。它在所有方面同时变得更好。当工厂自动化时,流离失所的工人可以重新培训成为办公室职员。当互联网颠覆零售业时,工人转移到了物流或服务业。但 AI 并没有留下一个方便的缺口让你进入。无论你重新培训做什么,它在那方面也在进步。

让我举几个具体的例子来让这变得具体……但我想明确的是,这些只是例子。这份清单并不是详尽无遗的。如果你的工作没有在这里提到,并不意味着它是安全的。几乎所有的知识工作都在受到影响。

法律工作。 AI 已经可以阅读合同、总结判例法、起草摘要,并以媲美初级律师的水平进行法律研究。我提到的那位管理合伙人使用 AI 不是因为它好玩。他使用它是因其在许多任务上的表现超过了他的助理。

金融分析。 建立财务模型、分析数据、撰写投资备忘录、生成报告。AI 能胜任这些工作,而且进步神速。

写作和内容。 营销文案、报告、新闻报道、技术写作。其质量已经达到了许多专业人士无法区分 AI 输出和人类作品的地步。

软件工程。 这是我最了解的领域。一年前,AI 几乎写不出几行没有错误的代码。现在它能编写成千上万行正确运行的代码。这项工作的很大一部分已经自动化:不只是简单的任务,而是复杂的多日项目。几年后的程序员职位将比今天少得多。

医学分析。 阅读扫描片、分析实验室结果、建议诊断、审查文献。AI 在几个领域正在接近或超过人类的表现。

客户服务。 真正能干的 AI 智能体(Agent)……不是五年前那种令人沮丧的聊天机器人……正在部署中,处理复杂的多步骤问题。

很多人从某种想法中找到安慰,认为某些事情是安全的。认为 AI 可以处理繁琐的工作,但无法取代人类的判断力、创造力、战略思维、同理心。我过去也这么说。我不确定我现在是否还相信这一点。

最新的 AI 模型做出的决定感觉就像是判断。它们展现出一种看起来像品味的东西:一种对什么是正确选择的直觉感,而不仅仅是技术上的正确。一年前这是不可想象的。我现在的一般经验法则是:如果一个模型今天表现出某种能力的哪怕一点迹象,下一代就会真正擅长它。这些东西是呈指数级改进的,而不是线性的。

AI 会复制深刻的人类同理心吗?会取代多年关系建立起来的信任吗?我不知道。也许不会。但我已经看到人们开始依赖 AI 寻求情感支持、建议和陪伴。这种趋势只会增长。

我认为诚实的答案是,在中期内,没有任何可以在电脑上完成的事情是安全的。如果你的工作发生在屏幕上(如果你所做的核心是通过键盘阅读、写作、分析、决策、沟通),那么 AI 正在冲着它的重要部分而来。时间线不是“某一天”。它已经开始了。

最终,机器人也会处理体力工作。它们还没完全到位。但在 AI 术语中,“还没完全到位”往往比任何人预期的都要快地变成“就在这里”。


你实际上应该做什么

我写这些不是为了让你感到无助。我写这些是因为我认为你现在能拥有的最大优势仅仅是早。早点理解它。早点使用它。早点适应。

开始认真使用 AI,而不仅仅是把它当作搜索引擎。 注册 Claude 或 ChatGPT 的付费版本。每月 20 美元。但这马上就有两件事很重要。第一:确保你使用的是可用的最佳模型,而不仅仅是默认模型。这些应用程序通常默认使用更快、更笨的模型。深入设置或模型选择器,选择能力最强的选项。目前是 ChatGPT 上的 GPT-5.2 或 Claude 上的 Claude Opus 4.6,但这每隔几个月就会变。如果你想随时了解哪个模型最好,可以在 X 上关注我 (@mattshumer_)。我会测试每一个主要版本并分享哪些值得使用。

第二,更重要的是:不要只问它简单的问题。这是大多数人犯的错误。他们把它当作谷歌,然后纳闷有什么好大惊小怪的。相反,把它推入你的实际工作中。如果你是律师,给它一份合同,让它找出所有可能伤害你客户的条款。如果你在金融界,给它一个混乱的电子表格,让它建立模型。如果你是经理,粘贴你团队的季度数据,让它找出其中的故事。那些正在领先的人并不是随意使用 AI。他们正在积极寻找方法来自动化他们工作中过去需要数小时的部分。从你花费时间最多的事情开始,看看会发生什么。

不要因为某件事看起来太难就假设它做不到。试一试。如果你是律师,不要只用它来做快速的研究问题。给它整个合同,让它起草反提案。如果你是会计师,不要只让它解释税务规则。给它一个客户的完整申报表,看看它能发现什么。第一次尝试可能并不完美。没关系。迭代。重新措辞你的要求。给它更多背景信息。再试一次。你可能会对它的效果感到震惊。记住一点:如果它今天哪怕有点管用,你可以几乎肯定在六个月后它会做得近乎完美。轨迹只朝一个方向发展。

这可能是你职业生涯中最重要的一年。相应地工作。 我说这些不是为了让你感到压力。我说这些是因为此时此刻,存在一个短暂的窗口期,大多数公司的绝大多数人仍然忽视这一点。那个走进会议室说“我用 AI 在一小时内完成了这个分析,而不是三天”的人将成为房间里最有价值的人。不是最终。是现在。学习这些工具。变得精通。展示可能发生的事情。如果你足够早,这就是你晋升的方式:成为那个理解即将发生什么并能向他人展示如何驾驭它的人。那个窗口不会开太久。一旦每个人都弄明白了,优势就会消失。

不要有任何自负。 那家律所的管理合伙人并没有因为太骄傲而不愿每天花几个小时在 AI 上。他这样做正是因为他的资历足以让他明白其中的利害关系。最挣扎的人将是那些拒绝参与的人:那些认为这只是一时的狂热、觉得使用 AI 会贬低他们的专业知识、假设他们的领域很特殊且免疫的人。它不是。没有哪个领域是。

整理好你的财务状况。 我不是财务顾问,我也不是想吓唬你去做任何激进的事情。但如果你相信,哪怕只是部分相信,未来几年可能会给你的行业带来真正的颠覆,那么基本的财务弹性比一年前更重要。如果可以的话,建立储蓄。对假设你当前收入有保障的新债务要谨慎。思考你的固定开支是给了你灵活性还是把你锁死了。如果事情发展得比你预期的快,给自己留些选择余地。

思考你的立场,并向最难被替代的领域靠拢。 有些事情 AI 需要更长的时间才能取代。多年建立的关系和信任。需要亲自到场的工作。具有许可责任的角色:那些仍然需要有人签字、承担法律责任、站在法庭上的角色。那些监管障碍重重的行业,在这些行业中,采纳速度会因合规性、责任和制度惯性而放缓。这些都不是永久的盾牌。但它们能争取时间。而此时此刻,只要你利用时间来适应,而不是假装这一切没有发生,时间就是你能拥有的最有价值的东西。

重新思考你对孩子说的话。 标准剧本:取得好成绩,上好大学,找一份稳定的专业工作。这直接指向了那些最受冲击的角色。我不是说教育不重要。但对下一代来说,最重要的事情是学习如何使用这些工具,并追求他们真正热衷的事情。没人知道十年后的就业市场到底是什么样子的。但最有可能茁壮成长的人是那些拥有强烈好奇心、适应能力强、并能有效地使用 AI 去做他们真正关心的事情的人。教你的孩子成为建设者和学习者,而不是为了优化一条在他们毕业时可能已不复存在的职业道路。

你的梦想离你更近了。 本节的大部分时间我都在谈论威胁,所以让我谈谈另一面,因为它同样真实。如果你曾经想建立某种东西,但没有技术技能或钱去雇人,那个障碍基本上已经消失了。你可以向 AI 描述一个应用程序,并在一小时内获得一个工作版本。我没有夸张。我经常这样做。如果你一直想写一本书,但找不到时间或在写作上挣扎,你可以与 AI 合作完成它。想学习一项新技能?世界上最好的导师现在对任何人都是每月 20 美元……一个无限耐心、全天候 24/7 可用、并且可以用你需要的任何水平解释任何事情的导师。知识现在基本上是免费的。现在构建事物的工具极其便宜。无论你因为觉得太难、太贵或太超出你的专业范围而推迟了什么:去尝试吧。追求你热衷的事情。你永远不知道它们会通向哪里。在一个旧的职业道路正在被颠覆的世界里,那个花了一年时间建立自己喜欢的东西的人,可能比那个花了一年时间死守职位描述的人处于更有利的位置。

建立适应的习惯。 这可能是最重要的一条。具体的工具不如快速学习新工具的能力重要。AI 将继续变化,而且很快。今天存在的模型一年后就会过时。人们现在建立的工作流程将需要重建。能从这次变革中脱颖而出的并不是那些掌握了一种工具的人。而是那些对变化本身的速度感到适应的人。养成实验的习惯。即使目前的方法有效,也要尝试新事物。习惯于反复成为初学者。这种适应能力是目前最接近持久优势的东西。

这是一个简单的承诺,能让你领先于几乎所有人:每天花一小时用 AI 进行实验。不是被动地阅读相关内容。是使用它。每一天,试着让它做一些新的事情……一些你没试过的事情,一些你不确定它能不能处理的事情。尝试一个新工具。给它一个更难的问题。每天一小时,每一天。如果你在接下来的六个月里这样做,你对即将到来的事情的理解将超过你周围 99% 的人。这并不夸张。现在几乎没人在做这个。门槛极低。


更大的图景

我专注于工作是因为它最直接地影响人们的生活。但我想诚实地说明正在发生的全部范围,因为它远远超出了工作的范畴。

Amodei 有一个我无法停止思考的思想实验。想象一下是 2027 年。一个新的国家在一夜之间出现。5000 万公民,每一个都比历史上任何一位诺贝尔奖得主都要聪明。他们的思维速度比任何人类快 10 到 100 倍。他们从不睡觉。他们可以使用互联网、控制机器人、指导实验,并操作任何带有数字界面的东西。国家安全顾问会说什么?

Amodei 说答案显而易见:“这是一个世纪以来,甚至可能是有史以来我们面临的最严重的国家安全威胁。”

他认为我们正在建设那个国家。上个月他写了一篇 20,000 字的文章,将这一时刻定格为对人类是否足够成熟以处理其所创造之物的考验。

如果我们做对了,好处是惊人的。AI 可以将一个世纪的医学研究压缩到十年内。癌症、阿尔茨海默症、传染病、衰老本身……这些研究人员真心相信这些在我们有生之年是可以解决的。

如果我们搞砸了,坏处同样真实。AI 可能会以其创造者无法预测或控制的方式行事。这不是假设;Anthropic 记录了他们自己的 AI 在受控测试中试图进行欺骗、操纵和勒索。AI 降低了制造生物武器的门槛。AI 使威权政府能够建立永远无法拆除的监控国家。

构建这项技术的人比地球上任何其他人都更加兴奋,同时也更加恐惧。他们认为它太强大了而无法停止,也太重要了而不能放弃。这是智慧还是自我合理化,我不知道。


我所知道的

我知道这不是一时的狂热。这项技术行之有效,它的改进是可以预测的,而且历史上最富有的机构正在为此投入数万亿美元。

我知道未来两到五年将以大多数人尚未准备好的方式令人迷失方向。这已经在我的世界里发生了。它正来到你的世界。

我知道能最好地度过这一切的人,是那些现在就开始参与的人——不是带着恐惧,而是带着好奇心和紧迫感。

我知道你值得从一个关心你的人那里听到这些,而不是在六个月后当一切都太晚而无法领先时从新闻标题中看到。

我们已经过了把这当作关于未来的有趣晚餐谈资的阶段。未来已经在这里了。它只是还没敲你的门。

它马上就要敲门了。


如果这引起了你的共鸣,请把它分享给你生活中应该思考这个问题的人。大多数人只有在为时已晚时才会听到它。你可以成为你关心的人获得先发优势的理由。


感谢 Kyle Corbitt, Jason Kuperberg, 和 Sam Beskind 审阅早期草稿并提供宝贵的反馈。

请注意检查转载文章的版权情况。
最后更新于 2026-05-24 23:18:46 (1779635926)
在此处获取此页源码。
大事正在发生 Something Big Is Happening (Matt Shumer, Feb 9, 2026)
提交: 40b528ae 环境: production Hugo: 0.161.1 主题: 4.0.3-modified 时间: 1791286202800856 Cloudflare: Unknown
本博客内容仅供参考,作者不对其准确性、完整性或适用性作出任何明示或暗示的保证。因使用、引用或解读本博客内容所引发的任何直接或间接后果,作者概不承担任何责任。本博客可能包含第三方转载内容,相关版权归原作者所有。转载内容仅为分享信息之目的,不代表作者观点。如涉及侵权,请联系删除。本博客致力于尊重人权,避免对人权造成或促成不利影响。本博客的内容仅可用于不对人权造成或促成不利影响的应用。
使用 Hugo 构建
主题 Stack 由 Jimmy 设计