本次更新在模型选择器和Amazon Bedrock中引入GPT-6-Astra,新增实验性worktree功能,并改进Windows后台服务与Vim编辑体验。
阅读全文开源项目
关注开放的模型、工具与代码,找到值得动手的项目。
LangChain OpenAI集成更新至 1.6.2,新增GPT-6 Astra推理力度支持
langchain-openai库发布 1.6.2 补丁,修复GPT-6 Astra的reasoning efforts支持,并升级httpx2依赖。
阅读全文Claude Code v2.1.267发布:新增maxEffortLevel设置,修复多项会话恢复与提示缓存问题
Anthropic发布Claude Code v2.1.267,新增maxEffortLevel设置以统一限制各提供商的推理投入水平,并修复了包括大型会话恢复、提示缓存失效、远程会话输入在内的数十项问题。
阅读全文ComfyUI v0.35.0发布:新增Comfy Compiler、Sparse Attention节点,扩展多模型支持
开源节点式AI工具ComfyUI发布v0.35.0,引入Comfy Compiler优化器、Sparse Attention节点、3D文件导入,并新增多款合作模型支持;同时修复了容器内存限制识别、Alpha通道处理等多项问题。
llama.cpp b10883发布:Vulkan矩阵乘法改用规范常量并修复Ampere回归
新版本以Vulkan后端优化为主,引入规范常量处理矩阵乘法A类型,并针对Ampere架构回归拆分着色器进行修复。
Hugging Face Transformers 5.17.0发布:新增HYV4、VibeVoice、NeoMME等模型支持
更新加入Hy4-Preview 780B MoE模型、阿里Fun-ASR-Nano语音识别等六个新模型,并统一视觉旋转嵌入、优化生成性能。
llama.cpp b10881发布:修复Intel GPU运行Qwen3时Vulkan FILL越限问题
新版本将FILL工作负载改为二维分布,解决Intel显卡在运行Qwen3时因超出Vulkan工作组数量上限导致的报错,并同步更新多平台二进制。
OpenAI Python SDK v3.11.0发布:新增服务账户密钥过期控制
OpenAI Python SDK发布v3.11.0,新增服务账户密钥过期控制功能,于 2026-09-09 发布。
Hugging Face accelerate v1.15.0发布:削减FSDP2长序列激活内存并改进DTensor
新版本修复了FSDP2激活检查点导致的高内存占用问题,新增显存卸载选项,并支持Neuron动态编译后端。
llama.cpp发布b10878:调整采样器链计数函数返回类型
llama.cpp最新版本b10878将llama_sampler_chain_n的返回类型改为int32_t,并同步更新了各平台的预编译二进制文件。
llama.cpp b10877发布:改进RDNA3显卡上路由MoE模型的CUDA性能
新版本调整了CUDA中routed MoE模型在AMD RDNA3显卡上的MMQ内核tile尺寸选择,并发布了各平台预编译二进制。
llama.cpp b10876发布:用GGML_FA_QUANTS替换GGML_FA_ALL_QUANTS,细粒度控制CUDA编译
新版本允许用户选择要编译的Flash Attention量化组合,未编译的组合将在运行时回退并给出警告。
llama.cpp b10875发布:--mmap、--mlock等命令行参数正式弃用
该版本将 --mmap、--mlock和 --dio参数标记为正式弃用,同时提供面向macOS、Linux、Windows、Android及多种硬件加速后端的新预编译包。
llama.cpp b10874发布:修复Granite3 MoE未知参数计数问题
llama.cpp发布b10874版本,主要修复Granite3 MoE模型中未知参数数量统计错误的问题。
llama.cpp b10873发布:修复mtmd视频ID传递问题
llama.cpp发布b10873版本,主要修复了mtmd模块中视频ID传播到位图的问题,同时提供了多平台预编译二进制文件。
llama.cpp b10872发布:修复Jinja模板中in运算符对null值的报错
最新版本将null左操作数的in视为普通查找,与Jinja行为一致,并更新多平台预编译二进制。
llama.cpp b10871发布:为RDNA4显卡新增Vulkan专用iq4_xs矩阵-向量着色器
新版为dmmv路径加入专用mul_mat_vec_iq4_xs着色器,取代通用回退逻辑,据称可在RDNA4上带来约 6% 到 17% 的token生成速度提升,具体取决于模型。
llama.cpp b10870发布:Vulkan后端新增f16 B型矩阵乘法管线
该版本为Vulkan后端引入f16 B型矩阵乘法管线,并针对Intel coopmat1调整warp tile大小;密集矩阵乘法在所有厂商GPU上启用,MoE仍限于Intel。
llama.cpp发布b10869:优化测试数据初始化线程使用,更新各平台二进制
本次更新主要重构测试数据初始化逻辑,根据元素数量动态调整线程数以提高测试效率;同时提供覆盖macOS、Linux、Windows、Android等多平台的预编译二进制。
llama.cpp b10868发布:为MoE模型添加IQ量化类型处理支持
新增PR #28476,为专家混合(MoE)架构添加IQ量化类型的处理逻辑;同时发布多平台预编译二进制文件。
gemini-cli夜间版v0.61.0发布:修复NTFS路径、沙箱隔离与工具输出安全问题
该版本包含多项修复,包括NTFS 8.3短文件名路径处理、沙箱容器内设置目录隔离,以及对不受信任工具输出的信封元数据来源强制执行。
OpenAI Python SDK v3.10.0发布:新增GPT Image 2.5模型支持与服务账号密钥过期字段
新版SDK增加GPT Image 2.5系列模型及图像生成选项,并引入服务账号API密钥过期时间字段。
Claude Code发布v2.1.266,修复 2.1.265 网关回归:LLM-gateway配置不再被强制要求云登录
Anthropic的Claude Code更新至v2.1.266,修复了 2.1.265 引入的一个回归:未文档化的环境变量CLAUDE_CODE_USE_GATEWAY此前会单独强制触发Cloud-gateway登录,导致使用API密钥或自定义认证的代理与网关配置请求全部失败。
Langflow发布 1.12.1,修复MCP连接超时、内存嵌入提供方识别等多项bug
开源低代码AI工具Langflow发布 1.12.1 补丁版本,共 15 项修复,涵盖前端渲染、组件构建、知识库删除、MCP连接、日志OOM及Langfuse追踪命名等问题。
Google发布gemini-cli v0.59.0,修复MCP OAuth与工作区信任安全问题
新版本通过两项核心修复防止SSRF攻击,并强制在受限模式下默认拒绝不受信任的工作区,过滤mcpServers。
gemini-cli v0.60.0-preview.0发布:强化OAuth与路径安全检查,移除硬编码CrUX API密钥
本次更新包含多项安全修复,涵盖MCP OAuth流程的RFC 9207发行者识别、扩展加载器的路径边界校验、macOS沙箱临时目录隔离,以及移除chrome-devtools-mcp中硬编码的Google CrUX API密钥。
Claude Code发布v2.1.265:新增插件目录支持、1GB工具结果磁盘上限及多项修复
最新版本为 --plugin-dir增加文件夹支持,限制工具结果磁盘存储,并修复提示缓存、远程控制及Windows沙箱等问题。
Sierra开源hyper-𝜏-bench:评估AI模型构建客服智能体的能力
Sierra发布新基准测试,衡量模型从模拟业务记录中自主构建完整客服智能体的能力。

llama.cpp b10867发布:默认在集成显卡上禁用懒张量加载以修复回归
llama.cpp发布b10867版本,引入懒加载模式AUTO,并在AUTO模式下禁用iGPU的懒张量加载,以修复集成显卡回归问题。
OpenAI Python SDK发布v3.9.0:新增提示缓存诊断并修复多项API问题
该版本为API增加了提示缓存诊断功能,修正了函数调用完成事件字段,并修复了网络搜索状态处理与服务器重试延迟溢出等问题。