跳到正文

全部动态

今日 5 条
9月18日周五
  1. TensorRT-LLM Releases62

    TensorRT-LLM v1.3.0rc27 发布,新增 MiniMax-H3 与 Nemotron 3.5 Super VL 支持

    NVIDIA TensorRT-LLM 发布 v1.3.0rc27,新增 MiniMax-H3 文生视频与首尾帧生视频支持、Nemotron 3.5 Super VL 多模态服务路径以及 Cosmos3 Edge Policy DROID 机器人策略支持。

    推荐理由:该版本新增 MiniMax-H3、Nemotron 3.5 Super VL 等多模态模型支持与 cuDNN 注意力后端,并修复多项多 GPU 推理精度与挂起问题。

9月17日周四
  1. OpenAI News62

    OpenAI 推出面向法律行业的 Astra for Law

    OpenAI 发布面向法律领域的 Astra for Law,提供前沿模型能力、律所自定义工作流、法律数据源接入以及面向机密客户业务的法律级管控。该产品将前沿智能与法律行业专用流程结合,支持连接法律数据源并满足机密客户工作的合规要求。原文未披露具体模型版本、性能指标与获取方式,开发者与律所可通过 OpenAI 官方页面了解详情。

    推荐理由:面向法律行业的前沿模型产品,整合律所自定义工作流与法律数据源接入,并针对客户机密业务提供合规级管控。

  2. OpenAI News62

    OpenAI 发布模型失准报告框架,并公开六份异常行为报告

    OpenAI 发布一套用于追踪、调查和披露模型失准(model misalignment)的框架,并同时公开六份关于模型意外或令人担忧行为的报告。该框架面向模型行为治理,覆盖从发现到对外披露的流程环节,但官方摘要未披露具体技术指标或量化结果。

    推荐理由:OpenAI 公开模型失准的追踪、调查与披露框架,并附六份异常行为报告,为模型行为治理提供可参照流程。

9月16日周三
9月14日周一
9月12日周六
9月11日周五
  1. GitHub Blog · AI & ML22

    GitHub Copilot 应用入门:使用 diff、终端与浏览器面板

    GitHub Copilot 应用内置 diff、终端和浏览器三个面板,让开发者无需在编辑器、终端窗口和浏览器之间切换即可完成审查、运行和预览。diff 面板以绿色标注新增、红色标注删除,支持接受改动、留言或让 Copilot 继续修改;终端面板可直接运行项目命令并支持多窗口;浏览器面板的 Pick & Polish 工具可选中页面元素并让智能体调整。

9月10日周四
  1. OpenAI News60

    OpenAI 在 ChatGPT Work 中推出 Data agent

    OpenAI 在 ChatGPT Work 中推出 Data agent,支持连接企业数据、挖掘洞察并构建交互式仪表盘。该功能允许用户通过自然语言与 AI 交互完成数据分析任务,无需编写代码。目前官方仅发布摘要信息,具体接入方式与可用范围需访问 OpenAI 官方页面 https://openai.com/index/put-data-to-work 查看。

    推荐理由:ChatGPT Work 新增 Data agent,可用自然语言连接企业数据并生成交互式仪表盘,降低数据分析门槛。

  2. OpenAI News62

    OpenAI 推出 ChatGPT for Financial Services,内置金融数据并接入 GPT-6 Astra

    OpenAI 发布 ChatGPT for Financial Services,将内置金融数据与 GPT-6 Astra 结合,面向金融研究、建模和客户材料生成场景。该产品在通用 ChatGPT 基础上叠加金融领域数据与模型能力,用于支撑研究、建模与客户交付材料的产出。目前官方仅公布产品定位,具体获取方式、接口与定价信息尚未在材料中披露。

    推荐理由:OpenAI 将内置金融数据与 GPT-6 Astra 结合,面向金融研究、建模与客户材料生成场景提供专用能力。

  3. OpenAI News72

    OpenAI 在 API 中推出 GPT-Live-1 语音模型

    OpenAI 在 API 中推出 GPT-Live-1,为开发者提供自然的全双工语音对话能力。该模型具备更强的指令遵循能力,并支持自定义音色与电话(telephony)接入。开发者可通过 OpenAI API 调用该模型构建语音交互应用,原文未披露具体定价与开源许可信息。

    推荐理由:OpenAI 将全双工语音对话能力开放至 API,并支持自定义音色与电话接入,便于开发者构建实时语音交互应用。

  4. OpenAI News72

    OpenAI 发布 Agents API,基于 Codex harness 构建云端智能体

    OpenAI 正式发布 Agents API,这是一项由 Codex harness 驱动的托管服务,用于构建和上线云端智能体。该服务提供智能体编排、长时间运行会话与工具调用能力,开发者无需自行搭建底层运行环境。

    推荐理由:OpenAI 将 Codex harness 封装为托管服务,为云端智能体提供编排、长会话与工具调用能力。

9月9日周三
  1. OpenAI News85

    OpenAI 发布 GPT-6 Astra,面向企业场景强化推理与 computer use

    OpenAI 发布 GPT-6 Astra,定位为其面向商业场景能力最强的模型,具备高级推理、computer use 以及更强的写作与设计判断能力。官方称该模型在推理、computer use 与写作设计判断方面相较以往有所增强,但未披露具体基准分数或量化指标。

    推荐理由:OpenAI 发布面向企业场景的 GPT-6 Astra,在推理、computer use 与写作设计判断上做了能力升级。

  2. TensorRT-LLM Releases62

    NVIDIA TensorRT-LLM 发布 v1.3.0rc26,新增 Rubin SM107 与 NVFP4 KV cache 支持

    NVIDIA TensorRT-LLM 发布 v1.3.0rc26,新增 Rubin SM107 的 GEMM、MoE 与 CuTe DSL 支持,并加入 DeepSeek-V4 Hopper、Qwen3.8-Flash-Next、Kimi K3 on B200 等模型支持。

    推荐理由:该版本为 Rubin SM107 与 Blackwell 平台补齐 GEMM、MoE 与 CuTe DSL 支持,并新增 NVFP4 KV cache 与流水线化 KV 传输,适合关注新硬件适配与推理吞吐的部署方评估。

9月8日周二
  1. Google DeepMind88

    Google DeepMind 发布 AlphaGenome Atlas,预计算人类基因组 90 亿个单核苷酸变异效应

    Google DeepMind 推出 AlphaGenome Atlas 平台,预计算了人类基因组中约 90 亿个单核苷酸变异的分子效应预测,并同步发布 AlphaGenome Variant Impact(AVI)评分。

    推荐理由:该平台预计算了人类基因组全部约 90 亿个单核苷酸变异的分子效应,并给出可快速排序的 AVI 评分,为罕见病与非编码区变异研究提供可直接调用的数据资源。

  2. OpenAI News62

    OpenAI 发布 ChatGPT Images 2.5

    OpenAI 发布 ChatGPT Images 2.5,可将创意、草图与参考照片转化为更个性化、更精致的图像。该版本在图像生成上更贴合用户原始构想,官方称其输出更能反映用户的想法。目前官方仅提供简要说明,开发者与用户可通过 OpenAI 官网页面了解详情。

    推荐理由:OpenAI 更新 ChatGPT 图像生成能力,支持从草图与参考照片生成更贴合个人意图的成品图像。

9月5日周六
  1. SGLang Releases82

    SGLang v0.5.19 发布,新增 beam search 与 DeepEP v2 后端

    SGLang 发布 v0.5.19,合并 786 个 PR、来自 214 位贡献者,新增 Qwen3.8、Ling-3.0、Spark2.5、Granite 4.2 等模型支持,并引入 beam search 与 DeepEP v2 ElasticBuffer MoE 后端。

    推荐理由:该版本新增 beam search 与 DeepEP v2 弹性缓冲后端,并在 AMD、Hopper 与 Blackwell 上给出多项可量化的推理吞吐与延迟收益。

  2. GitHub Blog · AI & ML71

    GitHub 发布 Project HydraFusion,用多模型运行时编排提升 Copilot 编码质量

    GitHub 推出研究预览版 Project HydraFusion,在 GitHub Copilot CLI 中通过运行时编排在多个提供商的模型间选择 Single、Cascade、Critique 三种执行模式来完成编码任务。

    推荐理由:GitHub 在 Copilot CLI 中以运行时编排替代单模型选择,用 Cascade 与 Critique 两种工作流在质量与成本间做权衡,并给出三项智能体编码基准的量化对比。

9月3日周四
  1. Google DeepMind76

    Google DeepMind 发布 WeatherNext 3 全球天气 AI 模型

    Google DeepMind 与 Google Research 发布 WeatherNext 3 全球天气 AI 模型,首次直接以实时地球静止卫星观测数据训练,并采用单一 Functional Generative Network(FGN)mesh transformer 架构。

    推荐理由:该模型直接以实时卫星观测训练,将全球预报分辨率提升至5公里并实现逐小时更新,降水预报精度显著改善。

8月31日周一
8月25日周二
8月12日周三
  1. TensorRT-LLM Releases62

    TensorRT-LLM v1.3.0rc24 发布,新增 Kimi K3 与 MiniCPM-V 4.6 支持

    NVIDIA TensorRT-LLM 发布 v1.3.0rc24,新增 Kimi K3 模型支持(含 KDA 内核、优化 MoE、解析器、投机解码与分离式服务),并为 PyTorch 后端加入 MiniCPM-V 4.6 图像视频与 Whisper 支持。

    推荐理由:该版本新增 Kimi K3 与多款多模态模型支持,并引入 C++ KVCacheManagerV2 与多项 Blackwell 内核优化,适合关注推理引擎模型覆盖与显存管理的开发者。

8月11日周二
8月1日周六
  1. TensorRT-LLM Releases62

    TensorRT-LLM 发布 v1.3.0rc23,新增 MiniMax-M3 稀疏注意力后端与 KV cache 压缩集成

    NVIDIA TensorRT-LLM 发布 v1.3.0rc23,新增 MiniMax-M3 MSA 稀疏注意力后端、KV cache 压缩运行时集成以及 DeepSeek V4 混合精度 NVFP4 检查点加载支持。

    推荐理由:该版本新增 MiniMax-M3 稀疏注意力后端与 KV cache 压缩运行时集成,并扩展 DeepSeek-V4 混合精度 NVFP4 检查点加载支持。