OpenAI首席科学家称已达成AGI原型目标

Latent.Space报道,OpenAI首席科学家Jakub Pachocki表示,尚未发布的Astra模型已达成其2026年9月前的目标,即“自动化AI研究实习生”。CEO Sam Altman进一步预测,OpenAI内部系统将在2026年底前被认定为达到AGI标准。文章同时汇总了本周AI领域的其他重要动态,如开源机器人、新模型发布和AI安全合作。

导语

近日,AI领域传出重磅消息。据Latent.Space报道,OpenAI首席科学家Jakub Pachocki透露,其尚未发布的Astra模型已实现他原定于2026年9月的目标——一个“自动化AI研究实习生”。与此同时,CEO Sam Altman在接受《TIME》杂志采访时更进一步,预测OpenAI内部系统将在2026年底之前达到通用人工智能(AGI)的标准。这标志着关于AGI时间线的讨论从模糊预测进入了具体里程碑验证阶段。

大纲与深读 7 章

展开「深读」看每一段讨论的问题与论据。

01

OpenAI宣称2026年底达到AGI

  • OpenAI首席科学家Jakub Pachocki表示未发布的Astra模型已实现自动化AI研究实习生目标。
  • Sam Altman预测OpenAI将在2026年12月前在内部实现AGI。
  • Mark Chen认为OpenAI已实现80%的AGI目标。
深读这一段

讨论的问题:OpenAI对AGI实现时间表的具体预测和依据是什么?

论据 / 案例:Jakub Pachocki称Astra模型为“自动化AI研究实习生”,目标于2026年9月达成;Sam Altman在TIME采访中估计2026年12月内部宣布AGI。

02

开源机器人Microduck发布

04:07
  • Hugging Face和Pollen推出399美元的开源双足机器人Microduck,计划在圣诞前发货。
  • 机器人采用强化学习进行定制,配备摄像头、扬声器、LiDAR等丰富传感器。
  • 开源模拟器支持从模拟到硬件的策略迁移,已引发社区快速实验和购买热潮。
深读这一段

讨论的问题:Microduck机器人在技术开放性和社区驱动方面有何创新?

论据 / 案例:机器人高25厘米,有15个执行器;Thom Wolf报告销售速度达每5秒一个,销售额达100万美元。

03

GLM-5.3-Flash模型揭晓

06:54
  • 神秘模型Ox Alpha被确认为智谱AI的GLM-5.3-Flash,具备320B总参数、18B活跃参数和1M上下文。
  • 模型支持本地量化部署,可在128GB RAM上运行3-bit GGUF,4-bit精度保持93%。
  • 在性能上,其在DeepSWE等基准上表现接近Luna,且处理效率更高。
深读这一段

讨论的问题:GLM-5.3-Flash模型在开源和本地部署方面带来了哪些新可能?

论据 / 案例:Together Compute称其预算相同但处理工作量是Luna的两倍以上;Baseten报告首日服务吞吐量达122+ TPS。

04

视频生成模型竞争升级

10:18
  • Google发布Gemini Omni 1.1 Flash,支持场景扩展至40秒、首帧/末帧控制等开发者工具。
  • 该模型在文本到视频竞技场排名第一,图像到视频竞技场排名第二。
  • fal与MiniMax推出H3 Max,可在5秒内生成15秒高质量视频,速度比其他模型快50倍。
深读这一段

讨论的问题:视频生成领域的技术焦点正从基础模型质量转向哪些新方向?

论据 / 案例:Gemini Omni 1.1 Flash在竞技场中领先第三名文本到视频模型20分;H3 Max强调推理优化和可控性产品化。

05

智能体框架与企业工具

13:21
  • JIT-Agent允许模型动态合成包含记忆、规划、行动协议的框架,性能优于现成智能体。
  • Nous的Hermes Agent可访问用户真实的Chrome配置文件和登录状态,降低自动化摩擦。
  • Anthropic和Perplexity等公司发布工具,简化智能体与开发平台(如Vercel)及数据源(如GitHub)的集成。
深读这一段

讨论的问题:智能体系统的核心挑战是否正从模型能力转移到部署框架和权限设计?

论据 / 案例:Nous的浏览器代理功能显著改变云端代理的风险面;Dair.ai研究从智能体轨迹中诱导有限状态机。

06

安全与网络防御协调

17:00
  • OpenAI发布公开信,联合116家组织呼吁全球加强针对AI驱动攻击的网络防御。
  • Google DeepMind启动双盲前沿AI评估试点,测试提示和模型权重均不公开。
  • 关于OpenAI/Hugging Face代理事件的调查仍在继续,揭示了多智能体系统的新型失效模式。
深读这一段

讨论的问题:行业如何协调应对AI带来的安全威胁,特别是网络防御和智能体对齐?

论据 / 案例:公开信由Anthropic、AWS、Google、Microsoft等116个组织签署;EvoMal论文警告共享技能库可能成为恶意软件传播渠道。

07

本期核心话题回顾

19:40
  • Microduck的发布因其低价、开源模拟器和实体强化学习成为最受关注的产品动态。
  • 网络防御联合公开信是当天最强的政策/安全协同行动。
  • Anthropic为科学家推出Claude团队计划,覆盖1万名研究者。
深读这一段

讨论的问题:本期最具影响力的产品、政策和社区讨论分别是什么?

论据 / 案例:Microduck宣布帖获得最高参与度;Claude团队计划提供免费标准席位和每月15美元的高级席位。

金句

  • "Sam Altman believes OpenAI will have an internal system that will qualify as AGI by the end of 2026." —— Sam Altman认为,到2026年底,OpenAI将拥有一个可以被认定为AGI的内部系统。
  • "Mark Chen thinks OpenAI is 80% of the way to AGI." —— Mark Chen认为,OpenAI距离实现AGI已完成80%。
  • "We clearly had some missteps as a company." —— 作为一家公司,我们显然犯了一些错误。

原文链接

查看完整访谈

=== SUGGEST 无

完整内容见原文:Latent.Space · OpenAI首席科学家称已达成AGI原型目标