跳到正文

#大模型

今日 1 条
今天10月3日周六
10月2日周五
9月30日周三
  1. OpenAI News62

    OpenAI 披露并阻断一起协同模型蒸馏攻击活动

    OpenAI 披露其阻断了一起针对受保护模型推理能力的协同蒸馏攻击活动。该活动试图提取模型推理内容,OpenAI 表示正在加强针对对抗性蒸馏的防御措施。官方未在摘要中说明具体技术细节、受影响模型或防御机制,相关信息需查阅原文链接 https://openai.com/index/disrupting-a-coordinated-model-distillation-campaign。

9月29日周二
  1. OpenAI News90

    OpenAI 发布 GPT-6.1 Sol,API 价格降至 Astra 的五分之一

    OpenAI 发布 GPT-6.1 Sol,面向编程、计算机操作与专业工作场景,定位接近 Astra 的智能水平。该模型标准 API 的输入与输出 token 价格均为 Astra 的五分之一。原文未披露具体参数、上下文窗口与获取方式,仅提供官方介绍页链接 https://openai.com/index/introducing-gpt-6-1-sol。

    推荐理由:OpenAI 发布 GPT-6.1 Sol,主打编程与计算机操作能力,API 输入输出价格降至 Astra 标准价的五分之一。

  2. OpenAI News82

    OpenAI DevDay 2026 回顾:发布 GPT-6 Astra 及 20 余项更新

    OpenAI 在 DevDay 2026 上公布超过 20 项发布,涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全以及面向开发者的新工具。官方回顾页面汇总了这些更新,涉及模型、编程工具与 API 等多个方向。开发者可通过 OpenAI 官方页面查看完整发布清单与详情。

    推荐理由:OpenAI DevDay 2026 集中发布 GPT-6 Astra 及 ChatGPT、Codex、API 等 20 余项更新,可了解其开发者生态与工具链走向。

9月28日周一
9月23日周三
  1. TensorRT-LLM Releases62

    TensorRT-LLM 发布 v1.3.0rc28,默认启用 KV-cache manager V2

    NVIDIA TensorRT-LLM 发布 v1.3.0rc28,为 Llama、Llama4 及 Nemotron 多模态模型默认启用 KV-cache manager V2,并移除 TensorRT serve、evaluation、benchmark 等废弃路径。

    推荐理由:该版本为 Llama、Llama4 与 Nemotron 多模态模型默认启用 KV-cache manager V2,并新增 FP8 KV-cache 与 NCCL-EP 0.2 低延迟专家并行支持。

  2. OpenAI News62

    OpenAI 为 GPT-6 改进提示词缓存,提升命中率并降低延迟与成本

    OpenAI 宣布为 GPT-6 改进提示词缓存机制,引入更高的缓存命中率、新的诊断能力、显式断点以及相关控制选项。官方称这些改动可减少请求延迟并降低调用成本。开发者可通过 OpenAI 官方页面了解该缓存机制的具体用法与接入方式。

    推荐理由:GPT-6 的提示词缓存机制升级,通过显式断点与诊断工具提升缓存命中率,降低推理延迟与调用成本。

  3. OpenAI News80

    OpenAI 发布 GPT-6 Sol 与 Luna 两款模型

    OpenAI 正式发布 GPT-6 Sol 与 Luna 两款模型,将前沿智能能力引入日常工作场景。两款模型在能力与成本之间提供不同配比,供用户按需求选择。原文未披露具体参数、基准指标与获取方式,详情可查阅 OpenAI 官方发布页面 https://openai.com/index/introducing-gpt-6-sol-and-luna。

    推荐理由:OpenAI 发布 GPT-6 Sol 与 Luna 两款模型,以能力与成本的不同配比覆盖日常工作任务。

9月22日周二
9月21日周一
9月17日周四
  1. OpenAI News62

    OpenAI 发布模型失准报告框架,并公开六份异常行为报告

    OpenAI 发布一套用于追踪、调查和披露模型失准(model misalignment)的框架,并同时公开六份关于模型意外或令人担忧行为的报告。该框架面向模型行为治理,覆盖从发现到对外披露的流程环节,但官方摘要未披露具体技术指标或量化结果。

    推荐理由:OpenAI 公开模型失准的追踪、调查与披露框架,并附六份异常行为报告,为模型行为治理提供可参照流程。

9月16日周三
9月14日周一
9月12日周六
9月11日周五
9月10日周四
  1. OpenAI News62

    OpenAI 推出 ChatGPT for Financial Services,内置金融数据并接入 GPT-6 Astra

    OpenAI 发布 ChatGPT for Financial Services,将内置金融数据与 GPT-6 Astra 结合,面向金融研究、建模和客户材料生成场景。该产品在通用 ChatGPT 基础上叠加金融领域数据与模型能力,用于支撑研究、建模与客户交付材料的产出。目前官方仅公布产品定位,具体获取方式、接口与定价信息尚未在材料中披露。

    推荐理由:OpenAI 将内置金融数据与 GPT-6 Astra 结合,面向金融研究、建模与客户材料生成场景提供专用能力。

  2. OpenAI News72

    OpenAI 在 API 中推出 GPT-Live-1 语音模型

    OpenAI 在 API 中推出 GPT-Live-1,为开发者提供自然的全双工语音对话能力。该模型具备更强的指令遵循能力,并支持自定义音色与电话(telephony)接入。开发者可通过 OpenAI API 调用该模型构建语音交互应用,原文未披露具体定价与开源许可信息。

    推荐理由:OpenAI 将全双工语音对话能力开放至 API,并支持自定义音色与电话接入,便于开发者构建实时语音交互应用。

9月9日周三
  1. OpenAI News85

    OpenAI 发布 GPT-6 Astra,面向企业场景强化推理与 computer use

    OpenAI 发布 GPT-6 Astra,定位为其面向商业场景能力最强的模型,具备高级推理、computer use 以及更强的写作与设计判断能力。官方称该模型在推理、computer use 与写作设计判断方面相较以往有所增强,但未披露具体基准分数或量化指标。

    推荐理由:OpenAI 发布面向企业场景的 GPT-6 Astra,在推理、computer use 与写作设计判断上做了能力升级。

9月8日周二
8月31日周一
7月26日周日
  1. Berkeley AI Research (BAIR)62

    BAIR 提出 ABBEL:用自然语言信念状态实现高效长程交互

    BAIR 提出 ABBEL 框架,将递归摘要的内容隔离为自然语言信念状态并周期性更新,使智能体仅以当前信念作为工作上下文。在 CollabBench 协作编码任务中,基于重建的信念评分将 ABBEL 与全上下文模型的性能差距缩小约 50%,训练步数从 100 步降至 50 步,峰值 token 长度也低于全上下文设置。

    推荐理由:该框架将摘要内容隔离为自然语言信念状态并加以监督,在协作编码任务中把与全上下文模型的差距缩小约一半。

7月14日周二
5月8日周五
  1. Berkeley AI Research (BAIR)62

    BAIR 综述自适应并行推理:从固定并行到模型自主控制流

    BAIR 发布综述文章,系统梳理自适应并行推理(APR)这一范式,即让模型在推理时自行决定何时并行、开启多少线程以及如何协调。文章对比了 Multiverse、ThreadWeaver、Parallel-R1、NPR 等方法,指出 APR 相比 BoN 可避免冗余计算、相比 Tree-of-Thoughts 无需领域特定分解启发式,并给出以关键路径占比为核心的并行化奖励设计。

    推荐理由:系统梳理自适应并行推理的推理系统设计与训练奖励方案,对比 Multiverse 与 ThreadWeaver 在 KV cache 聚合上的取舍。

3月13日周五
  1. Berkeley AI Research (BAIR)71

    BAIR 提出 SPEX 与 ProxySPEX,将 LLM 交互归因扩展到数千组件

    BAIR 发布 SPEX 与 ProxySPEX 算法,利用稀疏性与低阶性将交互发现重构为稀疏恢复问题,用于特征、数据与模型组件归因。ProxySPEX 借助层级结构以约 10 倍更少的消融次数达到 SPEX 同等效果,在 MMLU 高中美国历史任务上其剪枝策略还能提升目标任务表现。

    推荐理由:SPEX 与 ProxySPEX 将交互归因从数十个组件扩展到数千个,ProxySPEX 以约 10 倍更少消融达到同等效果,代码已并入 SHAP-IQ。