GitHub:AI 正在改变开发者工作,这三项技能值得加强
GitHub 博客指出,AI 正在改变开发者的工作方式,写代码仍属基本功,但定义问题、提供上下文、评估 AI 生成代码与做技术决策的能力愈发关键。
GitHub 博客指出,AI 正在改变开发者的工作方式,写代码仍属基本功,但定义问题、提供上下文、评估 AI 生成代码与做技术决策的能力愈发关键。
vLLM 发布 v0.31.0rc4,针对 HiSparse 场景修复了 FULL graphs 下 MTP 接受率崩溃的问题。该版本为候选发布版(rc),主要聚焦上述 Bugfix,未披露其他功能改动或性能数据。
Ollama 发布 v0.35.1-rc2 候选版本,该提交在 GitHub 上创建并通过签名验证。此版本主要修复了 CI 中缺失构建上下文的问题(#18742)。
Ollama 发布 v0.35.1-rc1,该版本在 models 模块新增 clef 支持(#18741)。提交 e4c0d18 已通过 GitHub 签名验证,具体性能指标与获取方式原文未披露。
Ollama 发布 v0.35.1-rc0,为 Modelfile 新增 CAPABILITY 声明,并在 create 请求中加入可叠加的 capabilities 字段,该声明可在 GGUF 与 safetensors 的创建、继承及 Modelfile 导出过程中保留。
NVIDIA TensorRT-LLM 发布 v1.3.0rc29,为 Qwen3.5 全局 FP8 检查点、Kimi K3 NVFP4 SiTU 的 CuTeDSL MoE 后端以及 DeepSeek V4 的 NVFP4 MLA 残差开关提供支持。
推荐理由:该版本为 Qwen3.5、Kimi K3、DeepSeek V4 等模型补齐 FP8/NVFP4 量化与 MLA 推理路径,并移除 AutoDeploy 等破坏性接口。
AMD 以 82 亿美元收购 World Labs,后者自 2024 年成立以来构建了图像、视频与空间重建的模型训练团队,并收购 SceniX 布局机器人仿真。
Ollama 发布 v0.35.0-rc0,新增 System One 评分 API(#18606)。该版本为候选发布版,提交 ffb6f22 已通过 GitHub 签名验证。
GitHub Copilot 应用推出 canvas(画布扩展)功能,这是一种由用户与智能体共享的可定制界面,可做成看板、issue 分诊板、发布清单或仪表盘。
GitHub 博文提出,聊天框并非与 LLM 交互的最佳界面,多数任务更适合可定制 UI。GitHub Copilot app 中的 canvas 是运行在应用内的全栈小程序,可与 agent 双向通信、调用第三方 API 并在本地执行代码,例如用 canvas 管理 Winget 包或操作 SQLite 数据库,避免把 agent 本身当工具而浪费 token。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向 GitHub 仓库即可自动识别入口点、编写 harness、运行 AFL++ 并分诊崩溃。
推荐理由:该流水线把 harness 编写、覆盖率分析与崩溃分诊交给 LLM 智能体,并保留工具执行与决策的职责分离。
GitHub Copilot 应用重建了 pull request 视图,以应对超大 diff 与评论对话带来的渲染压力。其测试的最大开源 PR 包含 2,200 个文件、超 100 万行改动和 400 多条行内评论,方案将文档高度拆分为确定性的代码几何与按需测量的动态块几何,避免滚动跳变。
vLLM 发布 v0.30.1rc0,在 ROCm 平台新增 MI355 密集 NVFP4 支持及 MoRI kernel 镜像。该版本由 Andreas Karatzas 提交,OpenAI Codex 参与共同署名,相关改动已合入 CI 流程。
NVIDIA TensorRT-LLM 发布 v1.3.0rc28,为 Llama、Llama4 及 Nemotron 多模态模型默认启用 KV-cache manager V2,并移除 TensorRT serve、evaluation、benchmark 等废弃路径。
推荐理由:该版本为 Llama、Llama4 与 Nemotron 多模态模型默认启用 KV-cache manager V2,并新增 FP8 KV-cache 与 NCCL-EP 0.2 低延迟专家并行支持。
GitHub 播客最新一期拆解了五个 AI 热门观点:AI 生成代码仍需审查、Skills 并未取代 MCP、RAG 也未消亡、企业招聘更看重 AI 使用判断力、微调需求未必说明代码质量差。节目指出 MCP 提供工具与数据的标准接入方式,Skills 则以 Markdown 封装团队流程与最佳实践,二者可组合使用;RAG 通过检索外部信息减少 token 消耗并降低答案不完整的概率。
NVIDIA TensorRT-LLM 发布 v1.3.0rc27,新增 MiniMax-H3 文生视频与首尾帧生视频支持、Nemotron 3.5 Super VL 多模态服务路径以及 Cosmos3 Edge Policy DROID 机器人策略支持。
推荐理由:该版本新增 MiniMax-H3、Nemotron 3.5 Super VL 等多模态模型支持与 cuDNN 注意力后端,并修复多项多 GPU 推理精度与挂起问题。
GitHub 官方披露将 Copilot agent runtime 从 TypeScript/Node.js 完全重写为超过 80 万行生产级 Rust,横跨 128 个 PR 并增量上线。
推荐理由:GitHub 官方复盘将 Copilot agent runtime 从 TypeScript 迁移到 80 万行 Rust 的工程路径,含跨语言 FFI 与多智能体协作细节。
GitHub 日本和韩国区营销负责人把活动运营流程写成 runbook 交给 GitHub Copilot,用对话方式生成自动化,让活动从单个 GitHub Issue 自动完成搭建、每日筛选报名者并在结束后清理。