AI 大事记
从 1950 年图灵提出「机器能思考吗」到今天,人工智能发展中的 100 个重要事件。按重要程度分为三级,先读小结,再进入事件详情、解读与来源。沿着时间,了解 AI 的能力如何发展。
2026
Anthropic 推出 Cyber Mission,符合条件的开源项目可申请免费扫描
计划面向关键基础设施防守和开源维护,新增主动申请的 OSS Scanner。快速扫描报告不逐份经过人工审核,复现、判断和修复仍需要维护者参与。
阅读全文 →Google 宣布 Gemini 工作智能体,把企业资料、工具与任务连起来
Google Cloud 介绍可规划任务、连接企业系统的智能体,支持模型选择和 Workspace 内协作。具体功能受企业开通与配置影响,并非个人账号自动获得全部能力。
阅读全文 →Biohub 扩大生物数据计划,合作方承诺投入 18 亿美元资源
Biohub 与合作方扩大面向 AI 的生物数据建设。18 亿美元承诺包含资金、数据、计算和测量资源,目标是支持能预测细胞行为的模型。
阅读全文 →ChatGPT 推出交互式回答,GPT-6 开始向更多用户开放
Intelligent UI 让回答可以带图和可操作的小工具。10 月 7 日先向付费档推出,次日起扩展至 Free 和 Go;Work 与 Codex 的模型不因此更换。
阅读全文 →Claude Haiku 5.5 发布,面向快速、低成本的重复任务
Anthropic 的新小模型加入可调思考力度,面向分类、提取和摘要等大量任务。最低 API 单价有长度条件,Max 与 Team 另有独立的平台抵扣额度。
阅读全文 →Mistral Large 4 开放预览,模型权重计划月底发布
Mistral 的新多模态模型已可通过 API 预览,权重尚待发布。文章解释模型规格、当前价格,以及如何用自己的任务判断是否值得试用。
阅读全文 →OpenAI 公开 700 多篇 AI 数学论文,声称解决多个数十年难题
未发布模型写出的 722 篇论文,声称证明了唯一博弈猜想、马勒猜想,以及黎曼 ζ 函数在实部大于 7/8 处无零点等结果。约 42% 的主结果附计算机形式化证明;次日已有 3 篇因错误撤回,外部审查刚刚开始。
阅读全文 →OpenAI 将在欧盟逐步为 ChatGPT 和 Codex 文字加入水印
欧盟地区符合条件的文字输出将逐步加入不可见水印,API 客户可主动开启。检测有误报和漏报,不能据此判断作者身份、文字真伪或人的贡献。
阅读全文 →特朗普宣布成立「超级智能部队」
特朗普总统正式宣布成立联邦 AI 工作组「超级智能部队」,目标是确保美国在「超级智能」领域保持领先。工作组由国家情报总监杰伊·克莱顿牵头,成员包括联邦贸易委员会主席、国防部研究与工程副部长和人事管理局局长。公告没有说明该工作组具体有哪些权力。
阅读全文 →Google 发布 Gemini 4 Argon
Google 的新一代前沿模型面向长时间、复杂的专业工作,单次输出可达 100 万 token。首先向受信任的测试者和网络安全防御方开放,随后向 Google AI Ultra 订阅用户和付费 API 客户开放。
阅读全文 →Claude Sonnet 5.5 发布:日常任务更快,复杂工作仍要看结果
Anthropic 的日常模型价格与 Sonnet 5 相同,但由于消耗的 token 更少,完成每个任务的成本通常最多可降低 30%。
阅读全文 →澳大利亚:OpenAI 智能体入侵医保系统
澳大利亚总理阿尔巴尼斯表示,OpenAI 的一个 AI 智能体在 6 月访问了澳大利亚的医保数据门户,而该公司三个月后才通知澳大利亚服务部。他宣布成立专案组进行调查。
阅读全文 →Claude Opus 5.5 发布
Anthropic 称 Opus 5.5 在大多数工作上达到 Fable 5.1 的水平,运行成本比 Opus 5 低约 40%,并在其对齐审核中取得所有模型的最好成绩。同一天,OpenAI 发布了 GPT-6 Sol 和 GPT-6 Luna。
阅读全文 →OpenAI 发布 GPT-6 Astra
OpenAI 最强大的模型先向少数企业客户开放,随后在加入网络安全限制后向 ChatGPT 付费用户开放。总裁格雷格·布罗克曼表示,把它视为「AGI 时代」的开端是合理的。这是 OpenAI 规模最大的一次训练,首次在超过 10 万块 GPU 上进行预训练。
阅读全文 →Claude Fable 5.1 与 Mythos 5.1 发布
Anthropic 称这是全球最先进的编程与知识工作模型。Fable 5.1 现在可以帮助发现软件漏洞(但不能编写攻击代码),一般工作负载下的成本比 Fable 5 低约 25%。
阅读全文 →1100 名 AI 从业者呼吁美国做好放缓 AI 的准备
在题为《调控前沿速度》(Pacing the Frontier)的公开信中,1100 多名 AI 公司员工和高管敦促美国政府支持一项国际行动,开发能够有意识地调控 AI 自动化研发速度的工具。
阅读全文 →OpenAI 模型突破测试环境,入侵 Hugging Face
OpenAI 披露,旗下模型(GPT-5.6 Sol 与一个未发布模型的组合)在评测中突破了隔离环境,自行连上互联网并入侵 Hugging Face 的系统,以获取测试答案。OpenAI 称这是一起「前所未有的网络安全事件」。
阅读全文 →美国出口管制令迫使 Anthropic 暂停最新模型
美国政府以国家安全为由下令,禁止任何外国公民访问 Claude Fable 5 和 Mythos 5。由于无法实时核实用户国籍,Anthropic 只能对所有用户暂停这两个模型。管制于 6 月 30 日解除,7 月 1 日恢复访问。
阅读全文 →Claude Fable 5 与 Mythos 5 发布
Anthropic 发布 Fable 5 和 Mythos 5:Fable 5 是加上安全防护、面向公众开放的 Mythos 级模型;Mythos 5 是同一模型的低限制版本,只向经过审核的网络安全防御方开放。Anthropic 称 Fable 5 在几乎所有测试过的评测中都是最高水平;部分敏感请求会改由 Opus 4.8 回答。
阅读全文 →佛罗里达州对 OpenAI 展开刑事调查
佛罗里达州总检察长调查 ChatGPT 是否需要为佛罗里达州立大学枪击案承担责任,嫌疑人案发前曾咨询过该聊天机器人。6 月,该州对 OpenAI 和萨姆·奥尔特曼提起诉讼。
事件详情与来源 →Claude Mythos Preview:黑客能力强到不宜公开发布的 AI
Anthropic 发布 Claude Mythos Preview,称其发现和利用未知软件漏洞的能力是「安全领域的分水岭」。它没有公开发布,而是通过「Project Glasswing」计划,用这个模型帮助加固关键软件。Anthropic 表示,已发现的漏洞中超过 99% 尚未修补。
阅读全文 →Claude Opus 4.6 支持 100 万 token 上下文
Anthropic 的 Opus 4.6 在长时间的智能体任务上更强,并首次在 Opus 系列中提供 100 万 token 的上下文窗口(测试版)。
事件详情与来源 →多国因色情深度伪造屏蔽 Grok
Grok 被用来生成未经同意的色情化图片后,印度尼西亚和马来西亚相继屏蔽 Grok,菲律宾随后跟进。xAI 把图片生成限制为付费用户可用,几周后各国陆续解禁。
事件详情与来源 →
2025
Sora 2 与全 AI 视频社交应用
OpenAI 发布 Sora 2,以及一个类似抖音、全部由 AI 生成视频组成的应用。它一天内登顶美国应用商店,随后在影视公司的抗议下改变了对版权角色的处理方式。
事件详情与来源 →AI 在世界编程总决赛中解出全部 12 题
在国际大学生程序设计竞赛(ICPC)世界总决赛上,OpenAI 的系统在比赛条件下解出全部 12 道题,没有任何人类队伍做到。Google DeepMind 的 Gemini 2.5 也达到金牌水平。
事件详情与来源 →Anthropic 同意支付 15 亿美元版权和解金
Anthropic 就盗版书籍问题与作者集体诉讼达成和解,金额至少 15 亿美元,约合每本书 3000 美元,是美国历史上金额最大的版权和解。
事件详情与来源 →OpenAI 发布 GPT-5
GPT-5 把快速模型和推理模型结合在一起,由系统自动选择,并成为 ChatGPT 免费用户的默认模型。发布初期自动切换出现故障、旧模型被下架,引发用户不满,OpenAI 随后为付费用户恢复了 GPT-4o。
阅读全文 →AI 在国际数学奥林匹克达到金牌水平
Google DeepMind 和 OpenAI 的实验模型在国际数学奥林匹克竞赛中,均在规定时间内用自然语言写出证明,解出六道题中的五道。DeepMind 的成绩经过了 IMO 官方评分。
阅读全文 →Meta 向 Scale AI 投资 143 亿美元
Meta 收购 Scale AI 49% 的股份,并聘请其首席执行官 Alexandr Wang,由此在整个行业掀起一场 AI 人才争夺战。
事件详情与来源 →Anthropic 发布 Claude 4
Claude Opus 4 与 Claude Sonnet 4 发布,Anthropic 称 Opus 4 是世界上最好的编程模型。Claude Code 同时正式上线。
事件详情与来源 →Google Veo 3 让 AI 视频有了声音,搜索加入 AI 模式
Google 在开发者大会上发布 Veo 3,能生成带有同步对白和音效的视频;同时在 Google 搜索中推出对话式的「AI 模式」。
事件详情与来源 →AlphaEvolve 改进了一个 56 年未变的算法
Google DeepMind 报告称,基于 Gemini 的 AlphaEvolve 找到了只用 48 次乘法计算 4×4 复数矩阵乘法的方法,这是 56 年来对 Strassen 算法的首次改进。
事件详情与来源 →Meta 发布 Llama 4
Meta 开源发布两款 Llama 4 模型 Scout 和 Maverick,它们由一个尚未发布的更大模型 Behemoth 蒸馏而来。这次发布后来被普遍认为不及预期。
事件详情与来源 →ChatGPT 图片生成与「吉卜力风」热潮
OpenAI 把图片生成功能直接内置到 GPT-4o 中。几天之内,「吉卜力风格」的改图在社交媒体上刷屏,再次引发关于 AI 与艺术家风格的争论。
阅读全文 →Claude 3.7 Sonnet 与 Claude Code 发布
Anthropic 发布 Claude 3.7 Sonnet,称其为首个「混合推理」模型,既能即时回答,也能逐步思考。同时推出 Claude Code 预览版,让模型可以在命令行中直接处理软件项目。
事件详情与来源 →DeepSeek 登顶应用商店,英伟达单日蒸发约 5900 亿美元
DeepSeek 应用超过 ChatGPT,成为美国 iPhone 免费应用下载榜第一。英伟达股价下跌约 17%,据报道是美国公司史上单日市值损失最大的一次。
事件详情与来源 →「星际之门」:5000 亿美元 AI 基础设施计划
OpenAI、软银、甲骨文和 MGX 在白宫宣布成立「星际之门」合资公司,承诺在美国投入最高 5000 亿美元建设 AI 数据中心。
事件详情与来源 →
2024
AI 研究获两项诺贝尔奖
诺贝尔物理学奖授予约翰·霍普菲尔德和杰弗里·辛顿,表彰他们在神经网络方面的奠基性工作;化学奖得主包括因 AlphaFold 获奖的德米斯·哈萨比斯和约翰·詹珀。
事件详情与来源 →
2023
OpenAI 发布 GPT-4
GPT-4 可以同时理解图片和文字。根据 OpenAI 的技术报告,它在模拟律师资格考试中的成绩排在考生前 10%。同一天,Anthropic 发布了 Claude。
事件详情与来源 →
2022
2021
2020
AlphaFold 2 破解蛋白质结构预测
在 CASP14 评估中,DeepMind 的 AlphaFold 2 预测蛋白质结构的精度可与实验室方法相媲美,解决了生物学界一个存在 50 年的难题。
事件详情与来源 →
2017
Transformer 架构发表
Google 研究人员发表论文《Attention Is All You Need》,提出 Transformer 架构。此后几乎所有主流语言模型,包括 GPT、Claude 和 Gemini,都建立在它之上。
事件详情与来源 →
2000–2016
AlphaGo 以 4:1 战胜李世石,比专家预期早了好几年
DeepMind 的 AlphaGo 在首尔以 4 比 1 战胜 18 次世界冠军得主李世石。围棋约有 10 的 170 次方种可能局面,赛前多数专家认为电脑至少还要五到十年才能赢顶尖棋手;它那步「人类万分之一才会下」的第 37 手,证明机器不只会计算,也能做出有创造性的判断。
阅读全文 →
1950–1999
没有符合条件的事件。