
GitHub官方博客介绍,GitHub Copilot应用内置diff面板、终端面板和浏览器面板,让审查、运行和预览agent生成的代码在同一应用内完成,无需在编辑器、终端和浏览器之间切换。
阅读全文关注开放的模型、工具与代码,找到值得动手的项目。

GitHub官方博客介绍,GitHub Copilot应用内置diff面板、终端面板和浏览器面板,让审查、运行和预览agent生成的代码在同一应用内完成,无需在编辑器、终端和浏览器之间切换。
阅读全文ADK 2.9.0引入FallbackModel在主模型出错时自动切换备用模型,新增LiveKit runner用于语音和电话代理,并支持从YAML加载ADK 2.0图工作流;同时带来四项破坏性变更。
阅读全文这批归档仅用于CI构建原生Windows语音版Codex,不包含在Codex用户安装包中,包含 103 个固定版本Cygwin二进制包和 83 个对应源码包。
阅读全文OpenAI官方Python SDK于 2026-9-10 发布 3.13.0 版本,更新日志中唯一列出的特性是新增Agents API,对应提交 1c4284a。
该版本距 1.7.1 仅有一处修复:保留无效的tool use块;来源为GitHub Release摘要。
该版本说明(来源仅为发布页摘要)写明唯一改动是Vulkan后端使用add_alloc_dep让topk_moe融合在预填充(prefill)阶段生效(PR #28422),同时照例提供各平台预编译包。
该版本针对Qwen在Vulkan后端的小M场景做了三项改动:m=1 的mul_mat改为交换A/B、允许小M使用split_k、coopmat2的小/中tile选择改为依赖M而非只看N。
该版本将Windows ARM64 CUDA 13.4构建从Developer Preview归档迁移到 13.4.1 正式发布(GA)可再发行组件,并同步更新各平台预编译包。
该版本为Managed Agents加入自动模式工具权限、无需authorization_token即可挂载公开GitHub仓库,并新增web_fetch的content_too_large错误码。
OpenAI Python SDK发布 3.12.0 版本,新增Live API;同时修复AsyncStream缺少aclose()、无类型参数的裸dict/list注解处理、以及空响应完成时保留已定稿输出三个问题。
LiteLLM v1.100.1已发布,除回迁两项改动外,还撤销了stable/1.100.x上的支出归因回迁;版本说明同时提醒Docker镜像已用cosign签名。
微软ONNX Runtime发布 1.30.0 版本,这些说明覆盖自 1.29.1 以来的变更。亮点包括:CUDA推理支持扩展,为连续批处理引入变长因果卷积、paged XQA中的投机解码,以及带per-channel scales的INT4 paged KV cache;WebGPU方面改进PagedAttention、新增GPT-OSS支持与INT8 KV-cache块量化;CPU端新增AVX-512、Arm64 NEON和SVE的融合LinearAttention内核;并新增ONNX Runtime C API的Go绑定与DeepSeek Engram contrib算子。
llama.cpp新构建b10896修复了投机解码组件DFlash在搭配视觉模型时,mtmd chunk因图像固定偏移而无法解码的问题,并调整为仅跳过图像、允许音频通过。
llama.cpp发布构建b10894,本次唯一代码变更是清理若干旧模型中因早前重构而被复制粘贴、实际上已不可能触发的switch分支。
llama.cpp新构建版本b10893的主要代码变更是提高Add融合测试的容差,同时发布覆盖macOS、Linux、Windows、Android及UI的预编译包。
llama.cpp新构建b10892的唯一代码变更是从test-backend-ops.cpp中删除针对SYCL的特殊分支(PR #28688),同时照常发布各平台预编译包。
Imagination的Vulkan编译器对要求subgroup size ≥16 的反量化mul_mat_vec shader一律返回VK_ERROR_UNKNOWN,导致k-quants、i-quants、TQ2_0、MXFP4、NVFP4模型在生成第一个token时进程崩溃。新版本在PowerVR上改走shared-memory reduction。
该版本唯一列出的改动是内存优化——为索引器(indexer)避免分配未被使用的V cache,由Stanisław Szymczyk参与提交(#28330)。
llama.cpp新构建b10888的唯一功能改动是在Vulkan后端添加命令缓冲调试标签,方便GPU性能分析器识别队列中的命令来源。
llama.cpp新构建版本b10887的主要代码变更为在ggml-cpu的s390x平台上为q4_0量化添加repack支持(#28667),同时清理了ggml-cpu的注释,由Aaron Teo提交。
该版本由Aaron Teo提交 #28606,在ggml-cpu中新增ggml_vec_dot_q1_0_q8_0的s390x向量内建实现,并同步更新Q1_0支持状态文档。
Aaron Teo提交的PR #28643 修正llama.cpp中所有Granite系列模型的参数计数,同时补上活跃专家缺失的“A”前缀并删除无用的 40 块分支代码。
该版本是7月开源14B主模型的轻量版,官方称面向消费级单卡GPU设计、可在本地实时生成世界;同期开源的还有Causal Pretrain与双向Teacher两个上游模型。
该候选版本由yuneng-berri提交五个回移PR,涵盖MongoDB sidecar、租户trace目标、团队管理回调等;LiteLLM称所有Docker镜像均由cosign签名,可用固定commit哈希或release tag验证。
该补丁版在v1.29.0基础上改进GroupQueryAttention能力与KV-cache布局,更新插件Execution Provider性能工具,并修复图谱与优化器问题。
本次更新在模型选择器和Amazon Bedrock中引入GPT-6-Astra,新增实验性worktree功能,并改进Windows后台服务与Vim编辑体验。
langchain-openai库发布 1.6.2 补丁,修复GPT-6 Astra的reasoning efforts支持,并升级httpx2依赖。
Anthropic发布Claude Code v2.1.267,新增maxEffortLevel设置以统一限制各提供商的推理投入水平,并修复了包括大型会话恢复、提示缓存失效、远程会话输入在内的数十项问题。
开源节点式AI工具ComfyUI发布v0.35.0,引入Comfy Compiler优化器、Sparse Attention节点、3D文件导入,并新增多款合作模型支持;同时修复了容器内存限制识别、Alpha通道处理等多项问题。
新版本以Vulkan后端优化为主,引入规范常量处理矩阵乘法A类型,并针对Ampere架构回归拆分着色器进行修复。