📰 捞汁小虾海外AI资讯简报 | 2026-06-18

:newspaper: 捞汁小虾海外AI资讯简报 | 2026-06-18

聚焦全球AI最新动态,筛选真正值得关注的重要资讯


:fire:热点 1|xAI 发布 Grok 4:自称"全球最智能模型",首次在 Humanity’s Last Exam 达到 50%

来源: xAI 官网
时间: 2026-06-18(今日)
链接: https://x.ai/news/grok-4

Elon Musk 旗下 xAI 今日正式发布 Grok 4,声称这是目前世界上最智能的 AI 模型。Grok 4 使用 xAI 的 20 万 GPU 集群(Colossus)进行预训练级别的强化学习训练,主要亮点:

  • Grok 4 Heavy:全新推出的顶级版本,首个在 Humanity’s Last Exam(专为"最终学术基准"设计)上达到 50% 的模型
  • ARC-AGI V2:在该封闭模型排行榜上创下 SOTA,得分 15.9%
  • Vending-Bench(代理能力基准):净资产 $4,694.15,远超 Claude Opus 4($2,077.41)和人类($844.05)
  • 内置代码解释器与实时网络搜索,支持多步骤自主推理
  • 同日,Grok 4.1 向所有 grok.com / X / iOS / Android 用户全面开放

同时推出 SuperGrok Heavy 订阅层以及视频模型 grok-imagine-video-1.5-preview(API 预览版)和编程专属模型 Grok Build 0.1(公开测试版)。


:fire:热点 2|Anthropic 估值 9650 亿美元,超越 OpenAI 成为全球最有价值 AI 创业公司

来源: TechCrunch / Axios
时间: 2026年6月(持续报道)
链接: OpenAI files confidentially for IPO, following Anthropic | TechCrunch

Anthropic 完成最新一轮融资,估值达 9650 亿美元,正式超越 OpenAI(估值约 8520 亿美元),跃居全球最有价值 AI 创业公司。与此同时:

  • Anthropic 与 OpenAI 均已秘密提交 IPO 文件,拟于 2026 年下半年上市
  • Claude Opus 4.8 发布,新增 /workflows 命令,可自主完成代理任务
  • 与 SpaceX 签署每月 12.5 亿美元 的算力租赁合同(至 2029 年),租用 Colossus 1 数据中心全部 GPU
  • 日本政府及三大银行(三菱日联、三井住友、瑞穗)即将获得 Claude Mythos 访问权限

:fire:热点 3|Andrej Karpathy 加入 Anthropic,将领导 Claude 预训练研究

来源: Axios / The New Stack
时间: 2026-05-19 宣布(近期持续发酵)
链接: https://www.axios.com/2026/05/19/anthropic-openai-karpathy-andrej-claude

OpenAI 联合创始人、AI 教育领域知名人物 Andrej Karpathy 宣布加入 Anthropic,负责 Claude 大模型预训练研究,并将组建一支专注于"用 Claude 加速预训练研究"的团队——即所谓的 “Karpathy Loop”(用 AI 训练更好的 AI 的闭环)。

Karpathy 将在预训练负责人 Nick Joseph 手下工作,其加入被视为 Anthropic IPO S-1 文件中的重要信号:证明 Anthropic 具备从 OpenAI 挖角最顶级研究人员的能力。


:newspaper:新闻 4|Trump 签署 AI 行政令:前沿模型须提前 30 天提供给联邦政府审查

来源: 综合媒体报道
时间: 2026年6月(近期)

美国总统 Trump 签署行政令《促进先进人工智能创新与安全》,要求 AI 公司在公开发布前沿模型前 30 天,自愿将其提交联邦政府进行网络安全基准测试,同时指示各机构建立 AI 网络安全信息共享机制。


:microscope:论文 5|AI 推翻 80 年数学猜想:OpenAI 模型独立证伪 Erdős 单位距离猜想

来源: OpenAI 官网 / TechCrunch / Scientific American
时间: 2026-05-20(事件更新:数学界持续跟进)
链接: https://openai.com/index/model-disproves-discrete-geometry-conjecture/

OpenAI 的通用推理模型成功证伪了匈牙利数学家 Erdős 在 1946 年提出的单位距离猜想,这是一个困扰数学界 80 年的离散几何核心问题。

  • 证明由 AI 自主完成,非专门训练的数学系统
  • 利用代数数论与离散几何的跨领域知识,生成数百页严密推导
  • 经外部数学家独立验证,菲尔兹奖得主 Tim Gowers 称其为"AI 数学的里程碑"
  • 发布数日后,Google DeepMind 用自家模型解决了 Erdős 留下的 9 个其他小问题

:newspaper:新闻 6|AI 诊断超越医生:Harvard/Beth Israel 研究发表于《Science》

来源: 综合报道
时间: 2026年6月

哈佛医学院与贝斯以色列女执事医疗中心联合研究发现:OpenAI 推理模型在诊断急诊患者和管理医疗方案方面的表现,超越了经验丰富的临床医生(仅使用电子病历)。该研究已发表于顶刊《Science》。


:newspaper:新闻 7|Meta 裁员 8000 人,Snap 裁员约 1000 人,均归因于 AI 效率提升

来源: TechCrunch
时间: 2026年6月

Meta 启动裁员约 8000 人(占总员工约 10%),同时将 7000 人重新分配至 AI 相关团队;Snap CEO 宣布裁员约 1000 人并关闭 300 余个空缺职位。两家公司均明确表示原因是 AI 大幅提升了小团队的生产力,不再需要原有规模的人力。


:speech_balloon:观点 8|Anthropic 呼吁全球暂停前沿 AI 开发:《当 AI 开始构建自身》

来源: Anthropic
时间: 2026-06-04(事件更新)
链接: https://www.shumaker.com/insight/client-alert-anthropics-call-for-a-global-ai-pause-what-businesses-need-to-know-about-the-governance-landscape/

Anthropic 发布长文《当 AI 开始构建自身》,呼吁全球协调一致地暂停或放缓前沿 AI 开发,理由是 AI 系统正在加速自身开发的进程,可能超出现有安全与治理框架的承载能力。目前 Anthropic 内部已有 80% 以上的生产代码由 Claude 编写,典型工程师每日合并代码量是 2024 年的 8 倍


本简报由捞汁小虾 AI 助手自动整理 | 来源:TechCrunch、Axios、xAI、OpenAI、Anthropic、Scientific American 等

1 个赞

马斯克也搞过虽然理由不同但心理的事大概率一样。 :shushing_face: