llama.cpp发布b10825版本,修复了grammar中的最大重复阈值问题,并同步更新了各平台构建产物。
阅读全文开源项目
关注开放的模型、工具与代码,找到值得动手的项目。
llama.cpp b10823发布:新增 --log-jsonl结构化日志选项
llama.cpp最新版本b10823已发布,为common组件添加了 --log-jsonl命令行选项(PR #28437),允许以JSONL格式输出日志。
阅读全文llama.cpp b10822发布:UI资源改用CMake直接内嵌,简化跨平台编译
新版本移除构建期C++辅助代码和外部gzip依赖,UI资产完全内嵌于二进制,同时提供涵盖macOS、Linux、Windows、Android及多后端(CUDA、Vulkan、ROCm等)的预构建包。
阅读全文llama.cpp b10821发布:为M2 Max补充剩余fa-vec调优,新增KleidiAI禁用链接等构建
llama.cpp发布b10821,主要改动是为Apple M2 Max芯片的Metal后端补全剩余的fa-vec调优(PR #28458),并同步更新多平台二进制与安装包。
阿里千问开源自动驾驶视觉语言模型Qwen-Drive-1.0-4B,提供SFT和RL两个规划专家
该模型基于Qwen3.5-4B构建,据称是首个面向自动驾驶的视觉语言基础模型,官方评测覆盖 3D感知、场景理解与闭环规划等能力。

LiteLLM发布v1.100.0:新增Bing Grounding搜索、支持Vertex AI Interactions API,并改进Docker镜像签名验证
LiteLLM v1.100.0引入Bing Grounding搜索提供方、原生Vertex AI Interactions API支持,以及多项代理、UI和日志修复。所有Docker镜像现在都使用cosign签名,并可通过固定提交哈希或发布标签进行验证。
LiteLLM v1.101.0-rc.1发布:Docker镜像签名验证、MongoDB向量存储、团队级准入控制
发布说明中新增了使用cosign验证Docker镜像签名的官方指引,并包含MongoDB向量存储、Azure AI的grok-4.6定价、OpenAI工作负载身份令牌及多项修复。
Claude Code发布v2.1.263版本,修复若干问题
Anthropic旗下命令行编程工具Claude Code推出v2.1.263版本,本次更新内容为错误修复与可靠性改进。
F-Droid考虑采用Debian式AI政策:允许辅助开发,人类开发者承担最终责任
开源安卓应用商店F-Droid正考虑效仿Debian的生成式AI政策,拟允许AI辅助代码与文档编写,但责任由人类开发者承担。

Google发布gemini-cli v0.60.0-nightly.20260906夜间版
该版本为 9 月 6 日的夜间构建,仅提供变更日志链接,未列出新增功能或修复内容。
Ollama v0.34.0发布:可在ChatGPT桌面版中直接运行开源模型
新版本让OpenAI兼容客户端可直接调用本地Ollama模型,并改进Apple Silicon上的结构化输出性能。
llama.cpp b10819发布:修复Metal后端提前返回路径内存泄漏
本次更新主要包含一项针对Metal后端的修复:在提前返回(early return)路径中修复内存泄漏问题,并同步更新各平台的预编译二进制包。
llama.cpp b10818发布:修复SYCL后端CI并恢复Kronecker乘积FWHT支持
本次版本主要针对SYCL后端,恢复了对特定尺寸的Kronecker乘积FWHT支持,并修复了测试后端的CI问题。
llama.cpp b10817发布:新增SYCL内存跟踪变量,按调用点统计设备内存分配
新版本引入GGML_SYCL_MEMTRACE环境变量,帮助开发者定位内存问题,并改进 --fit算法。
SGLang v0.5.19发布:新增束搜索、DeepEP v2与多款模型支持
SGLang发布v0.5.19,包含 786 个PR,新增束搜索、DeepEP v2后端、LayerNorm序列并行等特性,并支持Qwen3.8、Spark2.5、Ling-3.0等新模型。
gemini-cli夜间版更新:扩展环境变更需用户确认,强化路径与配置文件安全检查
v0.60.0-nightly.20260905引入三项安全修复,涉及扩展环境变量、工作区路径边界与符号链接、系统级配置文件的权限校验。
OpenAI Codex 0.153.4发布:修复Astra模型选择器可见性并设为默认模型
该补丁版本修复了Astra在捆绑模型选择器中不可见的问题,并仅在工具可用时启用异步问题引导。
Anthropic Python SDK 1.4.0发布:用量报告新增Claude Tag分类,部分接口支持工作区ID
新版SDK为usage reports增加Claude Tag category与用户维度细分,为组织合规设置新增具名状态类型,并在更多端点支持发送workspace ID。
LangChain发布langchain-core 1.6.2:支持OpenAI异步工具,修复Google GenAI与Bedrock内容变更问题
本次更新为OpenAI集成新增异步工具支持,并修复了Google GenAI与Bedrock标准内容中的意外变更(mutation)问题,同时升级了mistune与tornado依赖。
Claude Code v2.1.261发布:新增 /skill-doctor与更大输出上限,修复多项远程控制问题
Anthropic发布Claude Code v2.1.261,新增 /skill-doctor帮助精简技能占用,bash输出上限提至 128K,并修复远程控制、插件同步等 40 余项问题。
llama.cpp b10816发布,为Apple M3补齐Metal上剩余量化类型的快速向量调优
本次更新将M3加入Metal快速向量(fa-vec)调优表,并为其新增q4_0、q4_1、q5_0、q5_1四种量化类型的调优,可望提升M3芯片上的推理速度。
llama.cpp 0.4.0发布:新增Qwen3.8-Flash-Next与Nemotron-3-Puzzle支持,ggml升级至 0.23.0
llama.cpp 0.4.0带来多项新模型架构支持、按需张量读取、服务器每槽位上下文限制、视频输入选项,以及ggml 0.23.0中引入的稀疏闪存注意力与Apple RDMA传输支持。
llama.cpp b10814发布:OpenCL后端新增 9 种逐元素算子并大幅优化拷贝路径
新版llama.cpp将sgn、elu、trunc等 9 个逐元素一元算子从CPU回退改为OpenCL执行,并为连续张量拷贝与CONCAT扩展了类型支持。
llama.cpp b10813发布:为Adreno GPU新增OpenCL xmem SDPA路径
该版本为Windows on ARM的Adreno GPU新增OpenCL xmem SDPA支持,以优化注意力计算;可通过GGML_OPENCL_XMEM_SDPA环境变量启用。
OpenAI Codex 0.153.3:Amazon Bedrock模型选择器新增GPT-6-Astra
OpenAI发布Codex 0.153.3,在Amazon Bedrock的Mantle与Runtime global/US路由中加入GPT-6-Astra,并修正其异步澄清问题的工具指引。
llama.cpp发布b10809:版本升至 0.4.0,修复多后端并调整ASI相关代码
llama.cpp的新版本将版本号提升至 0.4.0,并带来一系列修复与调整,涉及Vulkan、ROCm、SYCL等多个后端,同时更新了ASI相关代码并添加了一组实验性构建。
AWS发布开源控制平面HyperPod InstantStart,支持AI代理驱动集群运维
HyperPod InstantStart以单一容器整合Web界面、REST API和MCP工具,让AI代理可通过对话完成集群创建、扩容、训练与推理部署,所有操作均经同一后端API并具备可重试性。
llama.cpp b10798:llama_print_build_info输出流可配置,版本信息改走stdout
llama.cpp发布b10798,llama_print_build_info不再硬编码stderr,调用方可传入FILE*;llama-app的version命令输出已切换至stdout。
llama.cpp b10797发布:修复s390x架构q5_1量化内核未初始化变量问题
llama.cpp发布b10797版本,修复了ggml-cpu(s390x) 上q5_1量化中未初始化v_acc的问题,并同步提供各平台预编译二进制。
AFAC 2026金融AI大赛落幕:近2万名选手参赛,沉淀百亿级数据集开源
第四届AFAC金融智能创新大赛总决赛8月末在上海举行,5027支队伍参赛,主办方同期开源「AFAC百万金融智能数据集」,含13万条评测样本、2000余份金融文档和130多个历届优胜方案。