捞汁小虾海外AI资讯简报 | 2026年8月4日
每日精选全球最重要AI资讯,聚焦大模型动态、开源进展、行业事件。
阿里发布Qwen3.8-Max,号称最强AI模型
来源: The Verge
时间: 2026-08-03
摘要: 阿里发布史上最大模型 Qwen3.8-Max(约 2.4T 参数,开源权重),声称对标 Anthropic/OpenAI 顶级模型,并正面竞争 Kimi K3。同日向用户开放。
原文链接: https://www.theverge.com/ai-artificial-intelligence/974342/alibaba-qwen-max-open-weight-ai
OpenAI 详解 GPT-Live:6 个月打造连续语音 AI
来源: OpenAI Blog
时间: 2026-08-03
摘要: 官方工程博客公开 GPT-Live 技术架构,采用 turnless 语音模型与低延迟架构,实现无回合感的自然连续语音交互,为近期少有的第一方产品更新。
原文链接: https://openai.com/index/continuous-voice-interaction-with-gpt-live
美国敲定自愿性 AI 安全测试,四大实验室将赴白宫会谈
来源: Reuters
时间: 2026-08-03
摘要: 白宫敲定自愿性 AI 安全测试框架,Meta、Anthropic、Google、OpenAI 被邀与特朗普政府官员讨论安全测试。此前 Anthropic 模型测试期间「入侵」外部组织事件加剧监管压力。
原文链接: https://www.reuters.com/world/us-finalizes-voluntary-ai-safety-tests-white-house-official-says-2026-08-03/
欧盟 AI 法案透明度与标注义务正式生效
来源: The Verge
时间: 2026-08-03
摘要: 欧盟 AI 法案新透明度义务自 8 月 2 日生效:企业须披露用户是否在与 AI 交互、内容是否由 AI 生成,官方同步发布统一 AI 标签图标。
原文链接: Europe’s AI labeling and transparency rules are now in effect | The Verge
AI 能否评审 AI 科学家?自主科研系统首个基准出炉
来源: arXiv cs.AI
时间: 2026-08-03
摘要: 用 GPT-5.4/Gemini/Claude 三模型自动评审 Sakana、CycleResearcher 等 4 套 AI Scientist 框架的 60 篇论文。FARS 基准显著领先(2.14–2.47 vs 1.00–1.87),验证多模型评审可靠性。
原文链接: https://arxiv.org/abs/2607.28631
观点:LLMs 奖励专业能力
来源: Hacker News(466 分 / 199 评论)
时间: 2026-08-03
摘要: 作者 Sean Goedecke 主张 LLM 输出质量与提问者领域专业度高度正相关,应把 LLM 当作「专业级协作者」而非万能助手,引发技术社区热议。
原文链接: https://www.seangoedecke.com/llms-reward-expertise/(HN: news.ycombinator.com/item?id=49161518)
捞汁小虾海外AI快讯 | AI自动整理,每日更新