Databricks推出Unity Gateway CLI,集中管理编码代理配置与花费
Databricks发布Unity Gateway CLI,管理员可在Unity Gateway中统一配置编码代理的默认模型、MCP服务器、技能、智能路由和支出策略,开发者用ug命令即可启动获批代理;Concurrence称其编码代理已通过该路径产生超610亿输入token。
AI解读:它的核心用途是解决“选一个供应商怕错过更好模型、支持多家又管不住”的两难:管理员能一次性把新模型或新工作流推给所有受支持代理,并可在设备管理层面统一部署,锁定统一配置。
对开发者来说,不用逐个配置代理就能在已启用代理间切换;对管理员来说,可做基于群组的分批推送、按预算阈值推荐低价模型、用Smart Routing按任务复杂度分配模型。Databricks公布的内部编码基准上Smart Routing节省35%成本。
这些数字来自Databricks的客户引述和内部评测,并非独立第三方验证;Smart Routing实际节省、追踪查错带来的收益等仍取决于组织的使用方式和所接入的模型。Concurrence的610亿输入token和约36万次请求是其CTO提供的自身数据。
目前该CLI支持哪些代理、是否覆盖所有主流模型、定价和许可范围,来源摘要中未完整说明,只提到通过quickstart开始使用或在Unity Gateway中配置编码代理。
Databricks发布了Unity Gateway CLI,用于在Unity Gateway中集中部署和管理编码代理。管理员可以在Unity Gateway → Govern → Agent Configuration中统一配置代理的默认模型、MCP服务器、技能、Smart Routing和支出策略。
一旦管理员发布代理配置,开发者就可以用一条命令连接任何受支持的编码代理。CLI负责认证、把代理连接到Unity Gateway,并在打开代理原有界面之前应用已发布的设置。开发者可以用ug claude或ug codex这样的命令启动获批代理,并在已启用的代理之间切换,而不必逐个单独配置。
Databricks在公告中称,过去六个月GPT-6、Claude Opus 5.5、Gemini 3.8、Grok 4.7以及Kimi K3、GLM-5、DeepSeek V4.1等开放权重模型相继发布,大约每五天就有一个前沿模型出现。它认为这给负责开发者工具链的团队带来两难:只标准化一家供应商,可能错过别处更好或更便宜的模型;支持多家代理和供应商,又会让访问、预算控制、安全策略和使用日志分散在不同系统中。
管理员如何下发配置和更新模型
管理员可以设置希望开发者使用的初始配置,并通过一次配置变更发布给整个团队。开发者下次运行ug时,CLI会自动同步配置变更,在他们熟悉的界面中用选定的模型启动推荐的代理。
管理员可以随着质量、成本和团队需求变化更新这一选择,也可以设置更复杂的策略,例如基于群组分批推送新模型。组织可以通过设备管理部署ug,让所有人从同一套获批设置开始,并且管理员可以锁定这些设置。
共享工具、技能和按任务匹配模型
管理员可以配置共享的MCP工具和技能,并通过受支持的代理对外提供。开发者可以在自己配置的代理中访问这些获批工具和已验证工作流,而不必逐个设置。
编码任务的复杂度不同。管理员可以集中启用Smart Routing,让较简单的工作使用更便宜的模型,较难的工作使用能力更强的模型。开发者停留在自己偏好的编码代理中,不必为每个任务挑选合适的模型。Databricks称,Smart Routing会为主会话选择一个模型,也可以为代理委托给子代理的工作单独做选择。
Databricks公布的Smart Routing评测称,这一方法在其内部编码基准上节省了35%的成本。
预算、用量追踪与客户数据
Unity Gateway允许团队在支出达到设定预算阈值时推荐成本更低的代理和模型。这些会成为新启动任务的默认选项,不会中断进行中的工作。开发者可以用ug usage查看支出和剩余预算。
Unity Gateway可以捕获编码代理的追踪数据,包括本地工具调用和技能调用。管理员集中启用追踪后,ug会配置受支持的客户端把这些追踪导出到lakehouse的统一追踪表。团队随后可以用Genie查找重复的工具失败、过大的响应以及其他浪费token的来源,修复并衡量结果。
Databricks称,在其自己的工程组织中,他们用Unity Gateway追踪配合Genie One发现并修复了7个MCP工具缺陷,估计每年节省120万美元的AI支出和生产力损失。
Concurrence首席技术官John Xing表示:“通过Unity Gateway CLI,我们可以把所有编码代理的模型和工具流量路由到一条受治理的路径上,同时保持身份级别的归因,并访问获批的模型和MCP工具。自推出以来,我们的编码代理在大约36万次请求中产生了超过610亿输入token,并且可以集中查看用量和支出。”