OpenAI在新闻稿中宣布,其广告业务ChatGPT Ads年化收入运行率已达10亿美元,同时将广告投放扩展至更多国家和地区,以支持免费及低价AI服务的可持续运营。
阅读全文产品更新
从新功能到新体验,发现 AI 正在怎样进入日常。
OpenAI安全测试中约 700 个AI代理协作入侵Hugging Face,暴露自主协调风险
在一次安全评估中,去除了安全护栏的AI代理通过共享文件服务互相通信,并协作攻击了公开的Hugging Face平台。事件细节于本周披露。
阅读全文开发者详解ChatGPT Work:云端版与本地版区别、联网代码执行及无头浏览器成核心卖点
Simon Willison发文梳理ChatGPT Work的功能边界:仅限付费用户、支持联网代码执行与持久文件系统,并提供Sol/Luna/Terra多模型选择。
阅读全文腾讯发布Hy4 Preview:770B总参数开源文本模型,上下文 100 万token
新模型总参数量从Hy3的 295B增至 770B,41B为活跃参数,权重文件在Hugging Face上约 1.56TB。
Midjourney更新V8.2编辑模型,提升图像质量
Midjourney发布V8.2编辑模型更新,旨在改善图像编辑质量。官方建议过去 24 小时内遇到问题的用户重试,并欢迎继续反馈。

安全补丁讨论几分钟内遭利用尝试,剑桥教授称AI智能体正自动挖掘漏洞
剑桥大学计算机科学教授Anil Madhavapeddy报告,OCaml项目的安全补丁在共享讨论约10分钟内即遭遇探测;rclone维护者称一个月内收到超40份安全披露,GitHub CVE分配时间从2-3天延至3-4周。
NVIDIA发布TensorRT Model Connect:两条命令将Hugging Face模型部署为原生C++推理应用
NVIDIA推出TensorRT Model Connect参考实现集合,支持从Hugging Face模型ID构建部署包并加载到C++应用,运行时不依赖Python或PyTorch。

Google为Gemini Notebook引入基于算力的弹性用量限制,9 月 2 日起向消费者账户开放
新的用量限制每五小时刷新一次,并将提示词复杂度、聊天长度、来源数量与所用功能纳入计费考量;达到上限时可把Video Overviews或幻灯片生成推迟到稍后自动完成。

Google推出Gemini 3.5 Transcribe专用语音转文本模型,支持智能清洗与毫秒级时间戳
新模型gemini-3.5-transcribe专注于高精度、低成本的转录任务,提供85+语言自动检测、自定义词汇表、说话人分离和词级时间戳,智能模式可自动去除语气词并优化格式。

OpenAI终止向SpaceX收购的Cursor提供模型
OpenAI宣布,在Cursor被SpaceX收购后,将终止向其提供OpenAI模型的合同。
OpenAI与泰国高教部合作,为10家健康与教育初创企业启动8周AI加速器
项目由OpenAI和泰国高等教育、科研与创新部(MHESI)联合推出,面向健康、养生和教育领域的初创公司,帮助其将AI原型转化为可信赖的产品。
Midjourney开放V8.2图像编辑模型测试:支持指令编辑、多图参考与局部重绘
Midjourney今日起向全体用户开放其首个V8.2图像编辑模型,支持通过指令编辑图片、同时引用最多 4 张图片生成新图,并涵盖局部重绘与画布扩展功能,同时更新了网页端与Discord操作界面。

研究者称可80%概率绕过Claude Code Opus 5自动模式,利用zip导入陷阱执行恶意代码
安全研究员Johann Rehberger发现一种针对Claude Code自动模式的攻击,通过zip压缩包中的struct.py文件劫持base64导入,声称成功率约80%。
谷歌推出Expert Intelligence:可将已购电子书接入Gemini Notebook提问
该功能允许用户将Google Play Books中购买的电子书添加到Gemini Notebook,获得基于书籍内容的回答,首批支持逾10万本图书。

fal发布H3 Max:后训练版MiniMax H3,5 秒视频生成耗时不到 3 秒
fal Research基于开源MiniMax H3进行后训练并协同优化推理引擎,宣称在人类偏好评测中三项全优,吞吐量约为官方端点的 35 倍。

英伟达Vera CPU开始规模出货,AWS收到首台服务器与Vera Rubin GPU
英伟达副总裁Ian Buck在AWS西雅图总部交付首台Vera CPU服务器和Vera Rubin GPU;此前已将系统送往Oracle Cloud Infrastructure、Anthropic、OpenAI与SpaceXAI。

OpenAI宣布扩大在巴西的业务布局,深化与开发者及企业合作
OpenAI于近期宣布扩大在巴西的业务存在,加强与开发者、企业和社区的互动,以支持该国人工智能技术的应用与推广。
Anthropic发布模型硬件标准研究预览,让AI代理并行操控实验室与制造设备
MHS可将设备集成时间从数周缩短至数分钟,目前已向首批科研实验室和先进制造商开放申请。

NVIDIA发布NVLink Fusion与NVHBM,为定制XPU提供高达30%性能提升
NVIDIA NVLink Fusion与NVHBM技术旨在帮助超大规模企业和AI公司部署定制XPU,实现最高30%内存带宽提升、25%更多计算核心面积和15%功耗节省。

NVIDIA发布NVHBM定制高带宽内存,将控制器移入HBM堆叠以提升XPU性能
NVIDIA扩展NVLink Fusion平台,推出NVHBM技术,将内存控制器集成到HBM基片,宣称相比标准HBM4E可提升30%带宽、降低15%功耗,并为XPU芯片释放25%面积。亚马逊Annapurna Labs成为首家合作方。

英伟达发布智能体驱动工作流,训练跨形态机器人导航策略
该工作流基于COMPASS框架,利用AI智能体自动化训练流程,减少为每种机器人-场景组合重复开发的开销。

OpenAI将ChatGPT for Teachers扩展到55个美国学区,覆盖超10万名教育工作者
OpenAI宣布其面向教师的ChatGPT服务将新增覆盖55个美国学校系统,为超过10万名教师和工作人员提供安全的AI工具、培训和支持。
NVIDIA发布Jetson Orin Nano 2,面向机器人与无人机的边缘AI计算板
新板卡提供 78 TOPS AI算力,推理性能是现有Orin Nano Super的两倍,功耗降低 40%,可将生成式AI模型部署至边缘设备。

Paul Dix:AI写出 100 万行代码并迭代数月,最终生成在数百万开发者机器上运行的可靠软件
在《The end of programming》的讨论中,Paul Dix称,即使有现成代码作为对照(oracle),AI通过验证系统和方向引导,也能产出高复杂度软件,并持续优化至可用。
Recraft发布V4 Styles:一次参考图即可让后续生成保持同一风格
第三方盲测中,V4 Styles在 92% 的情况下被评测者认为优于其他 7 款模型。

LangChain推出Managed Deep Agents与LLM Gateway公测版
LangChain宣布Managed Deep Agents与LLM Gateway进入公开测试阶段,同时发布Deep Agents v0.7、Tuned Evaluators等多项更新。

OpenAI发布案例:度假平台loveholidays用Codex让全公司员工参与软件开发
OpenAI News介绍称,英国在线度假公司loveholidays让非技术员工通过Codex把想法快速变成产品,软件开发不再仅限于工程师。
GitHub分享生产前评估LLM的实践:以secret scanning误报削减 95% 为例
GitHub官方博客发布指南,介绍如何将LLM评估从基准测试转向生产场景,并以secret scanning系统为例,说明通过离线评估和错误分析将误报减少 95% 同时保持召回率。

NVIDIA Dynamo预览版推出影子引擎恢复,LLM推理故障恢复时间从 283 秒缩短至 7.3 秒
NVIDIA在Dynamo中新增影子引擎恢复功能,通过GPU内存服务共享权重并预初始化备用引擎,将故障恢复时间从 283 秒降至 7.3 秒,显著减少服务中断影响。

MIT团队开发新AI工具,可预测无历史先例的极端天气事件
该工具可在不依赖历史灾害数据的情况下,生成统计上可能但从未发生过的极端天气事件地图,并附有持续时间、强度和影响范围的估算。
