跳到正文

全部动态

今日 4 条
9月24日周四
  1. NVIDIA Technical Blog62

    NVIDIA 联合 Google DeepMind 开源 2800 余种病毒蛋白复合物预测结构

    NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,通过 AlphaFold Database 开放 2800 余种病毒的蛋白复合物预测 3D 结构,其中约 30% 的蛋白相互作用此前未在 Protein Data Bank 中记录。

    推荐理由:NVIDIA 联合 Google DeepMind 等机构开源 2800 余种病毒的蛋白复合物预测结构,并公开 GPU 加速的 BioNeMo 结构预测流程,为病毒研究与疫苗靶点设计提供可直接复用的结构数据与推理工具链。

9月23日周三
  1. OpenAI News42

    OpenAI 发布 MentalHealthBench:面向心理健康对话的 AI 评测基准

    OpenAI 发布 MentalHealthBench,一个由专家参与构建的基准,用于评估 AI 在真实心理健康对话中的回复是否既有帮助又安全。该基准覆盖多种现实心理健康对话场景,从有用性与安全性两个维度对模型表现进行衡量。目前原文未披露具体评测指标、模型成绩及开源协议与获取方式。

  2. TensorRT-LLM Releases62

    TensorRT-LLM 发布 v1.3.0rc28,默认启用 KV-cache manager V2

    NVIDIA TensorRT-LLM 发布 v1.3.0rc28,为 Llama、Llama4 及 Nemotron 多模态模型默认启用 KV-cache manager V2,并移除 TensorRT serve、evaluation、benchmark 等废弃路径。

    推荐理由:该版本为 Llama、Llama4 与 Nemotron 多模态模型默认启用 KV-cache manager V2,并新增 FP8 KV-cache 与 NCCL-EP 0.2 低延迟专家并行支持。

  3. OpenAI News62

    OpenAI 为 GPT-6 改进提示词缓存,提升命中率并降低延迟与成本

    OpenAI 宣布为 GPT-6 改进提示词缓存机制,引入更高的缓存命中率、新的诊断能力、显式断点以及相关控制选项。官方称这些改动可减少请求延迟并降低调用成本。开发者可通过 OpenAI 官方页面了解该缓存机制的具体用法与接入方式。

    推荐理由:GPT-6 的提示词缓存机制升级,通过显式断点与诊断工具提升缓存命中率,降低推理延迟与调用成本。

  4. OpenAI News80

    OpenAI 发布 GPT-6 Sol 与 Luna 两款模型

    OpenAI 正式发布 GPT-6 Sol 与 Luna 两款模型,将前沿智能能力引入日常工作场景。两款模型在能力与成本之间提供不同配比,供用户按需求选择。原文未披露具体参数、基准指标与获取方式,详情可查阅 OpenAI 官方发布页面 https://openai.com/index/introducing-gpt-6-sol-and-luna。

    推荐理由:OpenAI 发布 GPT-6 Sol 与 Luna 两款模型,以能力与成本的不同配比覆盖日常工作任务。

9月22日周二
  1. vLLM Releases88

    vLLM v0.30.0 发布,新增 Fast Start 权重缓存与 HiSparse 主机分层

    vLLM 发布 v0.30.0,包含来自 315 位贡献者的 762 个提交,新增 DeepSeek-V4.1-Flash、GLM-5.3-Flash、K2-Horizon 等模型支持,并引入 Fast Start 权重缓存守护进程与 HiSparse 主机分层解码。

    推荐理由:该版本新增 Fast Start 权重缓存与 HiSparse 主机分层,并针对 DeepSeek-V4.1、Kimi K3 等模型优化稀疏注意力与量化内核,可降低重启与显存开销。

9月21日周一
9月19日周六
9月18日周五
  1. GitHub Blog · AI & ML22

    GitHub 播客拆解五大 AI 热门观点:代码审查、RAG、Skills 与 MCP

    GitHub 播客最新一期拆解了五个 AI 热门观点:AI 生成代码仍需审查、Skills 并未取代 MCP、RAG 也未消亡、企业招聘更看重 AI 使用判断力、微调需求未必说明代码质量差。节目指出 MCP 提供工具与数据的标准接入方式,Skills 则以 Markdown 封装团队流程与最佳实践,二者可组合使用;RAG 通过检索外部信息减少 token 消耗并降低答案不完整的概率。

  2. TensorRT-LLM Releases62

    TensorRT-LLM v1.3.0rc27 发布,新增 MiniMax-H3 与 Nemotron 3.5 Super VL 支持

    NVIDIA TensorRT-LLM 发布 v1.3.0rc27,新增 MiniMax-H3 文生视频与首尾帧生视频支持、Nemotron 3.5 Super VL 多模态服务路径以及 Cosmos3 Edge Policy DROID 机器人策略支持。

    推荐理由:该版本新增 MiniMax-H3、Nemotron 3.5 Super VL 等多模态模型支持与 cuDNN 注意力后端,并修复多项多 GPU 推理精度与挂起问题。

9月17日周四
  1. OpenAI News62

    OpenAI 推出面向法律行业的 Astra for Law

    OpenAI 发布面向法律领域的 Astra for Law,提供前沿模型能力、律所自定义工作流、法律数据源接入以及面向机密客户业务的法律级管控。该产品将前沿智能与法律行业专用流程结合,支持连接法律数据源并满足机密客户工作的合规要求。原文未披露具体模型版本、性能指标与获取方式,开发者与律所可通过 OpenAI 官方页面了解详情。

    推荐理由:面向法律行业的前沿模型产品,整合律所自定义工作流与法律数据源接入,并针对客户机密业务提供合规级管控。

  2. OpenAI News62

    OpenAI 发布模型失准报告框架,并公开六份异常行为报告

    OpenAI 发布一套用于追踪、调查和披露模型失准(model misalignment)的框架,并同时公开六份关于模型意外或令人担忧行为的报告。该框架面向模型行为治理,覆盖从发现到对外披露的流程环节,但官方摘要未披露具体技术指标或量化结果。

    推荐理由:OpenAI 公开模型失准的追踪、调查与披露框架,并附六份异常行为报告,为模型行为治理提供可参照流程。

9月16日周三