跳到正文

#OpenAI

今日 1 条
今天10月3日周六
10月2日周五
10月1日周四
  1. Latent Space88

    Google DeepMind 发布 Gemini 4 Argon,输出上限提升至 1M token

    Google DeepMind 发布 Gemini 4 Argon,面向编程、企业知识工作与网络防御场景,目前仅通过 Fairwind Program 向政府用户和可信网络安全人员开放预览。

    推荐理由:Gemini 4 Argon 在 19 项基准中拿下 13 项第一,并以 Long Decode Continuation 将输出上限推至 1M token,可观察长输出与智能体任务的成本结构变化。

9月30日周三
  1. OpenAI News62

    OpenAI 披露并阻断一起协同模型蒸馏攻击活动

    OpenAI 披露其阻断了一起针对受保护模型推理能力的协同蒸馏攻击活动。该活动试图提取模型推理内容,OpenAI 表示正在加强针对对抗性蒸馏的防御措施。官方未在摘要中说明具体技术细节、受影响模型或防御机制,相关信息需查阅原文链接 https://openai.com/index/disrupting-a-coordinated-model-distillation-campaign。

  2. Latent Space88

    OpenAI DevDay 2026 发布 Dots 智能体、GPT-6.1 Sol 与 Ultrafast 模式

    OpenAI 在 DevDay 2026 上发布由 GPT-6 Astra 驱动的常驻智能体 Dots、GPT-6.1 Sol 模型以及 Ultrafast 加速模式,并推出 Decisions API、Codex 云环境与 B2B Marketplace。

    推荐理由:OpenAI DevDay 2026 集中发布 Dots 常驻智能体、GPT-6.1 Sol 与 Ultrafast 模式,并调整 API 定价与套餐倍率,可观察其平台化与成本策略。

9月29日周二
  1. Simon Willison · AI Weblog88

    OpenAI DevDay 2026 实录:发布 Dots 智能体、GPT-6.1 Sol 与 Ultrafast 推理

    OpenAI 在 DevDay 2026 主题演讲中发布个人智能体 Dots、ChatGPT Space 协作空间,以及 GPT-6.1 Sol 模型和 Ultrafast 高速推理档位。

    推荐理由:OpenAI DevDay 2026 集中发布 Dots 个人智能体、GPT-6.1 Sol 与 Ultrafast 推理档位,并开放 Sign in with ChatGPT 与插件生态,勾勒出智能体平台化的产品路径。

  2. OpenAI News82

    OpenAI DevDay 2026 回顾:发布 GPT-6 Astra 及 20 余项更新

    OpenAI 在 DevDay 2026 上公布超过 20 项发布,涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全以及面向开发者的新工具。官方回顾页面汇总了这些更新,涉及模型、编程工具与 API 等多个方向。开发者可通过 OpenAI 官方页面查看完整发布清单与详情。

    推荐理由:OpenAI DevDay 2026 集中发布 GPT-6 Astra 及 ChatGPT、Codex、API 等 20 余项更新,可了解其开发者生态与工具链走向。

  3. Latent Space82

    AINews 汇总:Claude Opus 5.5 领跑 SimpleBench,GPT-6 与 Gemini 3.8 Flash 同期发布

    Latent Space 的 AINews 汇总了本周前沿模型动态,包括 Anthropic 的 Claude Opus 5.5、GPT-6 Astra/Sol/Luna、Gemini 3.8 Flash 以及小米 MiMo-V2.6-Pro。

    推荐理由:汇总 Claude Opus 5.5、GPT-6 与 Gemini 3.8 Flash 等前沿模型的基准表现与定价,并梳理 Jev 决策模型与 Perplexity Photon 检索引擎的工程收益。

  4. Simon Willison · AI Weblog22

    OpenAI 智能体安全负责人谈 AI 能力突跳带来的安全挑战

    OpenAI 智能体安全(Agent Security)负责人 @joedaroo 表示,模型在“cyber”“swarming”“message boards”等相关能力上出现的能力突跳令其团队感到意外,且这种跳变速度极快,构成了极难应对的问题。他强调安全态势需要时间积累,不只是加固系统,还要把安全文化植入公司,让人员、流程与事件响应机制本身具备应对意外的韧性。

9月28日周一
9月26日周六
9月24日周四
9月23日周三
  1. OpenAI News42

    OpenAI 发布 MentalHealthBench:面向心理健康对话的 AI 评测基准

    OpenAI 发布 MentalHealthBench,一个由专家参与构建的基准,用于评估 AI 在真实心理健康对话中的回复是否既有帮助又安全。该基准覆盖多种现实心理健康对话场景,从有用性与安全性两个维度对模型表现进行衡量。目前原文未披露具体评测指标、模型成绩及开源协议与获取方式。

9月22日周二
9月21日周一