DECOHACK

Juya AI Daily · 橘鸦 AI 早报

AI 早报 2026-07-10

内容来自橘鸦 AI 早报,经作者同意转载阅读原文 ↗视频版哔哩哔哩YouTube
AI 早报 2026-07-10

要闻

1

OpenAI 正式向公众发布 GPT-5.6 模型系列

OpenAI宣布GPT-5.6模型系列全面开放,包含旗舰版Sol、均衡版Terra和高性价比Luna三款模型。旗舰版Sol在编码与网络安全等多项基准测试中达到SOTA,新增ultra模式默认协调四个Agent并行处理复杂任务。该系列在前端设计、文档生成和端到端知识工作方面均有提升,正逐步向全球上线,各类用户在各个产品中拥有不同的访问权限。

OpenAI 发布 GPT-5.6 模型系列并进入全面开放阶段。

该系列包含旗舰版 Sol、均衡版 Terra 与最高性价比的 Luna 三款模型。

根据官方提供的数据,GPT-5.6 Sol 在编码、知识工作与网络安全等多项基准测试中达到 SOTA。

它新增了 ultra 设置,以默认协调四个 Agent 并行处理复杂任务,同时引入支持零数据留存兼容的 Programmatic Tool Calling。

该系列现正逐步向全球推行。

API 定价按每百万 token 计费(Sol 5/30 美元、Terra 2.5/15 美元、Luna 1/6 美元)。

ChatGPT 与 Codex 各订阅层对不同模型及 ultra 设置设有不同访问权限。

安全方面,官方称 GPT-5.6 Sol 的网络防御机制阻止的潜在有害活动约为此前模型的十倍。

且网络安全的高级防御能力仅限受信任访问项目的合格对象使用。

相关链接:

2

Meta 发布 Muse Spark 1.1 模型及 API

Meta Superintelligence Labs 发布 Muse Spark 1.1 多模态推理模型及 API 预览版。该模型具备 百万 token 上下文窗口,官方称其在涉及大型复杂代码库的真实任务上有显著改善,并能编排多 Agent 系统跨应用界面导航。开发者现可通过该 API 构建应用,模型也已上线 Meta AI 应用与网站。

Meta Superintelligence Labs 发布 Muse Spark 1.1 多模态推理模型。

该模型具备 100 万 token 上下文窗口,并能主动管理与压缩上下文。

它还原生支持视频等多模态理解与音频检测。

官方称其在涉及大型复杂代码库的真实任务上有显著改善,支持诊断修复、新功能实现与大迁移。

此外,模型兼容规划模式与子 Agent 委派等主流设置。

开发者首次可通过进入公开预览的 Meta Model API 构建应用。

该模型亦已在 Meta AI 应用及网站上线。

相关链接:

3

OpenAI 发布 ChatGPT Work

OpenAI发布由Codex和GPT-5.6驱动的ChatGPT Work智能体。该智能体支持跨应用操作、生成交互式站点、定时任务与计算机使用能力。目前桌面端已向全套餐用户开放,网页和移动端正逐步向付费用户推出。

OpenAI 发布 ChatGPT Work 智能体,该智能体由 Codex 和 GPT-5.6 驱动,可在网页、移动端和桌面端跨应用操作、创建成品文档和站点,并支持定时任务与计算机使用能力。

网页与移动端正逐步向付费用户开放,Enterprise 和 Edu 工作区有两周默认关闭的预览期。

桌面端则面向所有套餐用户开放,包含免费套餐。

原有的独立 Codex 应用已并入新版桌面应用,应用目录也已全面替换为统一的插件目录。

相关链接:

4

OpenAI 发布整合三大功能的新版 ChatGPT 桌面应用

OpenAI发布新版ChatGPT桌面应用,将Chat、Work与Codex三大功能合并,支持macOS与Windows系统。现有 Codex 应用更新后即可变为新版应用,现有任务与项目保留,且可在设置中将 Codex 保持为默认启动界面并选用 Codex 图标。

OpenAI 发布新版 ChatGPT 桌面应用,将 Chat、Work 与 Codex 三大功能合并,支持 macOS 与 Windows 系统。

现有 Codex 应用用户更新后即可变为新版应用,现有任务与项目保留。且可在设置中将 Codex 保持为默认启动界面并选用 Codex 图标。

现有 ChatGPT 桌面端用户需按应用内提示下载新版并使用原账号登录。

原 ChatGPT 桌面应用将保留为 ChatGPT Classic 并继续获得模型与安全更新。但新的 Agent 功能仅在新版应用提供。

相关链接:

5

Codex 升级支持文件编辑与 PR 审查,新增 Pro 与 Ultra 模式

ChatGPT Codex 发布新的功能升级,现在可直接编辑 Markdown 和代码文件、在应用内审查 GitHub Pull Request,并新增 Pro 与 Ultra 两种执行模式。

OpenAI 为 ChatGPT Codex 带来一系列面向开发者的功能更新。

开发者现在可直接在应用内编辑 Markdown 和代码文件、通过内联注释让 Codex 修订选中内容,并在侧边栏查看和审查 GitHub Pull Request 及其反馈差异。

同时新增 Pro 模式 与 Ultra 模式 以分别应对常规与高复杂度任务。

一套全新文档也已上线,并支持在一个项目内跨多个仓库工作。

性能方面,GPT-5.6 驱动下的 Computer Use 速度得到提升,任务活动与进度追踪更清晰。

插件管理入口统一至 Settings,此外还改进了移动连接可靠性与 SSH 项目的视频渲染问题。

开发生态

8

Google Cloud 正式推出基于 Gemini 的 Agent AlphaEvolve

Google Cloud 联合 Google DeepMind 开发的 AI 代码优化 Agent AlphaEvolve 现已正式发布,所有客户可通过 Gemini Enterprise Agent Platform 使用。

AlphaEvolve 是一款由 Gemini 驱动的 AI 代码优化 Agent,现已在 Google Cloud 上全面可用。

该 Agent 并非从头重写代码,而是作为进化协作者,根据用户提供的基线算法和目标自动搜索更优解,并返回人类可读的优化代码。

所有 Google Cloud 客户目前均可通过 Gemini Enterprise Agent Platform 使用该功能。

相关链接:

9

ElevenLabs 推出 ElevenAgents Spotlight

ElevenLabs 推出 ElevenAgents Spotlight,作为 ElevenAgents 的观察与改进层,通过实时监控对话、自定义评估及提供主动建议,支持 Agent 持续优化。

ElevenLabs 发布 ElevenAgents Spotlight,定位为 ElevenAgents 的观察和改进层。

该功能实时审查语音与聊天对话,跟踪 成功率、延迟 等指标并检测异常。

同时自动将对话分组、评分 情感,并支持用自然语言编写 评估标准 对对话进行自动评分。

Spotlight 还能基于 Agent 配置 和 对话历史 提供主动改进建议。

并支持将数据流式传输至 Datadog、Grafana 等监控工具。

目前该功能已可用。

相关链接:

10

腾讯开源 BrowserSkill

腾讯开源了 BrowserSkill 项目,能通过 CLI 与扩展让 AI Agent 操作用户已登录的浏览器且不中断工作,目前支持主流桌面系统及 Chromium 浏览器。

腾讯在 GitHub 开源 BrowserSkill 项目,允许支持 Shell 的 AI Agent 通过本地桥接层操作用户已登录的浏览器。

该项目由 bsk CLI/daemon 与浏览器扩展组成,Agent 任务在独立窗口运行,需显式借用用户标签页并内置 human-in-loop 机制。

BrowserSkill 目前支持 macOS、Linux 和 Windows x64,兼容 Chrome 与 Edge。

并对 Cursor、Claude Code 等多种 Agent 提供一键安装支持。

相关链接:

11

Bun 发布从 Zig 的 Rust 重写版本

Bun 官方宣布已将其运行时从 Zig 语言重写为 Rust 语言并合并至主线,Bun v1.4.0 将成为首个 Rust 版本,目前可通过 canary 版本获取。

Bun 官方宣布已完成将其运行时核心从 Zig 向 Rust 语言的全面重写,相关代码已合并至主分支,即将发布的 v1.4.0 将是首个 Rust 版本。

此次重写由项目作者使用预发布版 Claude Fable 5 模型与 Claude Code 的 64 个并行工作流在 11 天内完成。旨在利用 Rust 的所有权机制从编译器层面系统性消除原有 Zig 代码中频发的 use-after-free、double-free 及内存泄漏问题。

官方数据显示,Bun v1.4.0 修复了此前版本的 128 个 bug,二进制体积在 Linux 与 Windows 上缩减约 20%,部分 HTTP 吞吐量与应用构建速度提升 2% 至 5%,且修复了所有已知的内存泄漏。

该版本目前处于 canary 阶段。

相关链接:

12

TypeScript发布7.0版本Go原生移植版

TypeScript 团队发布 Go 原生移植版 TypeScript 7.0,官方称构建达10倍提速;因程序化 API 仍未就绪,暂不支持Vue等嵌入式语言框架。

TypeScript团队正式发布 TypeScript 7.0,该版本是使用 Go 语言重写的原生移植版,官方称其完整构建通常可实现 8 至 12 倍提速。

新版引入共享内存多线程,新增 --checkers 等实验性并行配置,重写了基于 Parcel 的 --watch 模式,并默认开启 TS 6.0 的严格模式与多项破坏性变更。

尽管已可通过 npm 获取并支持主流编辑器,但 TS 7.0 目前程序化 API 仍未就绪,导致 Vue、Svelte 等嵌入式语言工作流无法使用其语言服务。

官方建议相关项目继续使用 TS 6.0 兼容包。

相关链接:

模型发布

13

MOSI 开源 MOSS-Transcribe-Diarize 0.9B 端到端音频理解模型

MOSI官方开源MOSS-Transcribe-Diarize 0.9B端到端音频理解模型。该模型支持最长约90分钟音频输入,能一次性输出含时间戳和标签的结构化文本。

MOSI 官方宣布开源 MOSS-Transcribe-Diarize 0.9B 模型。

该模型采用 Whisper 编码器与 Qwen3-0.6B 解码器架构,以端到端方式替代传统级联系统,一次性输出包含时间戳与说话人标签的结构化转录文本。

该模型支持 128k 长上下文转录、最长约 90 分钟 音频输入、多语言转录及热词提示。

官方称其在 NVIDIA RTX 4090 上推理速度约 100 token/s,并在多项基准测试中取得领先指标。

性能更强的 MOSS-Transcribe-Diarize Pro 版本尚未开源,计划通过 API 访问。

相关链接:

14

Reve 推出 Reve 2.1 图像模型

Reve 官方发布图像模型 Reve 2.1,该模型在 Arena.ai 排名第二。官方称其通过结构化布局替代纯文本提示,实现更细致的图像规划与精确渲染,视觉智能和推理能力显著提升。

Reve 官方发布图像模型 Reve 2.1,距 Reve 2.0 发布仅 一个月。

官方宣称其视觉智能与推理能力显著提升,以结构化布局替代纯文本提示实现更细致的规划与精确渲染。

官方称其仍为全球顶级 4K 模型且训练算力少于常规 十倍。

Reve 2.1 在 Arena.ai 与 Design Arena 评测中均列第二并刷新分数。

但有社区用户指出其 API 尚不可用。

相关链接:

产品应用

15

OpenAI 将 Atlas 能力转入 ChatGPT 桌面端及扩展

OpenAI 宣布弃用 Atlas 浏览器,将其 Agent 能力转移至 ChatGPT 等产品;Atlas 于 2026 年 8 月 9 日 停用,数据不自动迁移。

OpenAI 官方宣布弃用 Atlas 浏览器,将基于浏览器的 Agent 能力整合至 ChatGPT 和 Codex。

Atlas 计划于 2026 年 8 月 9 日 停止工作。官方表示 ChatGPT 桌面应用将支持更强大的浏览器式 Agent 工作流,同时推出 ChatGPT Chrome 扩展提供网页辅助。

现有 Atlas 的书签、打开的标签页及浏览器历史记录均不会自动转移。

报道称 Chrome 扩展支持网页内容总结等,而桌面端包含在服务器远程运行的云浏览器供 Agent 执行任务。

各项功能的可用性取决于用户的套餐、地区、设备及工作区设置。

相关链接:

16

OpenAI宣布停用ChatGPT群聊功能

OpenAI宣布即日起停用ChatGPT群聊的创建与加入,现有群聊仍可使用,后续将转为只读状态,单人对话不受影响。

OpenAI发布更新说明,宣布将于当地时间 7月9日 起停止 ChatGPT 群聊相关功能。

届时 Web、iOS 和 Android 平台用户将无法创建新群聊、将现有对话转为群聊或通过邀请链接加入群聊。

现有群聊暂时可继续使用,后续转为只读状态后用户仍可访问历史消息、文件与图像。

独立对话不受影响。

相关链接:

17

OpenAI推出ChatGPT Sites公开测试版

OpenAI宣布ChatGPT Sites进入公开测试,允许部分付费用户将工作或想法转化为交互式网站或轻应用,支持公开发布及URL分享。

OpenAI发布 ChatGPT Sites 公开测试版。

该功能允许用户在 ChatGPT Work 网页端或桌面端 Work 与 Codex 模式下,通过描述需求生成交互式网站或轻应用并进行预览、修改和发布。

可用性方面,Pro、Pro Lite、Enterprise及Edu用户率先获得访问权限,Plus和Business用户将在随后几天内推出,Free和Go计划不可用。

Enterprise工作区默认关闭公开发布,需管理员启用。

公开测试期间用量受计划限制,不支持 数据驻留 和 推理驻留,且Enterprise工作区暂不支持自定义域名。

相关链接:

18

Anthropic 推出测试版 Claude Reflect 功能

Anthropic推出测试版Claude Reflect功能,用于追踪和可视化用户使用Claude的方式。看板展示使用高峰时段、主题及协作模式。

Anthropic 发布测试版 “Reflect” 功能,旨在帮助用户追踪和审视其使用 Claude 的方式。

该功能提供月度回顾,展示用户的使用高峰时段、讨论主题及常用模式。它支持用户设置免打扰和休息提醒,以促进更健康的使用习惯。

同时,Reflect 基于 4D AI Fluency Framework 分析用户与 Claude 的互动,并提供个性化的建议,以帮助用户更有效地利用人工智能。

目前,该功能要求用户开启 Memory 功能才能生成完整的洞察报告。生成的报告中不包含无痕对话的内容,也暂未与第三方健康工具关联。

相关链接:

19

1X Technologies推出NEO机器人25自由度手部

1X Technologies宣布推出专为NEO人形机器人平台设计的25自由度绳索驱动手部,具备原生力控与高分辨率触觉感应,该手部将随每台NEO出货,官方称今年产能可达1万只。

1X Technologies宣布推出专为NEO人形机器人平台设计的25自由度绳索驱动手部。

该手部包含手指与手掌的22个完全驱动自由度及腕部3个自由度。它采用了约5:1至15:1的低齿轮比与专有的1X Tendon Drive设计。

该手部具备原生力控与完全反向驱动能力,定位精度可达 ±0.2 mm。其指尖与表面配备了可进行实时防滑检测的高分辨率触觉感应系统。

手部已通过IP68防水认证与食品安全材质认证。其腕关节在超高负载下成功通过了超过 200万次 循环测试。

这款手部将随每台NEO机器人出货。1X 表示其专有产线在今年的产能预计可达 1万只。

相关链接:

技术与洞察

20

Artificial Analysis 发布 EnterpriseOps-Gym-AA 排行榜

Artificial Analysis 与 ServiceNow 合作发布 EnterpriseOps-Gym-AA 独立排行榜,测试 AI Agent 在实时企业系统中执行多步骤操作的能力。

Artificial Analysis 与 ServiceNow 联合推出 EnterpriseOps-Gym-AA 排行榜,将原 EnterpriseOps-Gym 基准适配至 Stirrup agent harness 运行。

该基准要求 Agent 通过实时 MCP 服务器调用 512 个工具,在 8 个业务领域执行不可逆的有状态多步骤操作,并以 SQL 验证最终数据库状态。

官方数据显示,在 1117 项 oracle 模式任务中,Claude Fable 5 (max) 以 51% 完成率居首。

模型必须通过所有验证检查才算任务成功,且各模型单任务成本与交互轮次差异极大。

相关链接:

21

谷歌发布LiteRT.js 支持浏览器本地ML推理

谷歌发布 LiteRT.js,将该端侧推理库引入网页端,支持在浏览器中本地运行ML模型并提供硬件加速,初始版本已可用。

谷歌宣布发布 LiteRT.js,将端侧推理库 LiteRT 的 JavaScript 绑定引入网页,使开发者能在浏览器中本地运行 .tflite 模型。

该工具通过 WebAssembly 提供原生跨平台运行时,并支持基于 XNNPACK 的 CPU 加速、ML Drift 与 WebGPU 的 GPU 加速,以及目前处于实验阶段的 WebNN 的 NPU 加速。

初始版本已发布 npm 包及示例。

官方称其在经典模型上较其他 Web 运行时性能最高提升 3 倍,同时支持通过 LiteRT Torch 进行 PyTorch 模型单步转换及通过 AI Edge Quantizer 进行定制量化。

相关链接:

行业动态

22

Anthropic 发起倡议征集AI“hard questions”

Anthropic 发起 “hard questions” 新倡议,邀请公众提交关于AI影响的难题,并承诺公开追踪报告针对这些问题的应对行动及不足之处。

Anthropic 于官方博客宣布发起 “hard questions” 新倡议。

正式向公众征集关于 AI 在就业、社会、家庭及科学医学等方面的影响与潜力的难题。

公众可通过专属网站提交问题。

Anthropic 承诺将公开追踪并报告针对这些问题的具体应对行动,同时明确说明未达目标的领域。

Anthropic 此前已通过 Anthropic Public Record 调查了 5.2万 名美国人。

并借助 Anthropic Interviewer 访问了 159 个国家的 8.1万 名 Claude 用户,为该倡议奠定基础。

相关链接:

23

Anthropic 任命前美联储主席 Ben Bernanke 为长期利益信托成员

Anthropic 宣布任命前美联储主席 Ben Bernanke 为长期利益信托新成员,该独立机构旨在监督其负责任地开发高级 AI 并有权任命董事会成员。

Anthropic 宣布任命布鲁金斯学会杰出研究员、前美联储主席 Ben Bernanke 为其长期利益信托(LTBT)的最新成员。

Bernanke 的加入为 LTBT 带来经济学专业视角,将为 Anthropic 评估 AI 对经济的影响及相关研究提供洞察。

LTBT 成员独立于公司管理层和投资者,不持有股权且不分享利润。

该机构有权任命 Anthropic 董事会成员并对关键决策提供建议。

相关链接:

24

Meta宣布在加拿大建设1GW数据中心

Meta 宣布将在加拿大阿尔伯塔省斯特金县建设 1GW 数据中心,投资超 130亿加元,此为其在加拿大的首个数据中心。

Meta宣布将在加拿大阿尔伯塔省斯特金县建设一个 1GW 的数据中心。

官方称投资将超 130亿加元。

该数据中心预计建设高峰期需约 3000 名工人,运营后支持超 300 个岗位。

Meta另将投资约 6000万加元 用于当地基建。

据 Bloomberg 报道,这是 Meta 在加拿大的首个数据中心,且将主要由天然气发电提供动力。

但 Meta 官方称计划增加足够清洁能源以匹配该中心 100% 用电量。

该中心还将采用无运行用水的 闭路循环液冷 加 干冷系统。

相关链接:

25

Cerebras宣布欧洲扩张:2027年底算力扩至200MW

Cerebras 计划在法国和北欧建设数据中心,首批容量将于2026年底上线,2027年底总容量预计扩至200MW,部分将用于支持OpenAI的工作负载。

Cerebras Systems宣布扩大其欧洲基础设施规模,计划在法国和北欧地区进行建设。

该公司将于 2026年底 上线首批欧洲数据中心容量,并计划在 2027年底 将总容量扩展至 200 MW,其中部分容量预计将用于支持 OpenAI 的工作负载。

此次扩张旨在将 Cerebras 的高速 AI 推理基础设施部署至离欧洲用户更近的位置,以降低复杂工作负载的响应时间。

Cerebras 首席执行官 Andrew Feldman 表示,目前已在挪威和芬兰规划数据中心并正积极建设。

相关链接:

26

Ollama 宣布融资 8800 万美元,将推进无缝混合推理与云服务

Ollama 官方宣布完成 8800 万美元 融资,该平台目前服务 890 万 开发者,财富 500 强 中 85% 的公司使用其产品,未来将推进无缝混合推理与 云服务。

Ollama 官方宣布完成 8800 万美元 融资,投资方包括 Benchmark、Theory Ventures、8VC 等机构及多名个人投资者。

该平台目前服务 890 万 开发者,面向 财富 500 强 中 85% 的公司提供服务。

其云服务已上线 GLM、Nemotron、DeepSeek、Kimi、MiniMax 等模型,且官方称 Token 容量平均每月翻倍。

Ollama 计划推进无缝混合推理、新开源模型发布当天的同步支持以及面向团队的云服务。

相关链接:

27

阶跃星辰将发布AI终端品牌及智能体手机

据报道,阶跃星辰即将发布AI终端品牌、AI Agent系统及AI Agent手机,相关产品将于下周在2026世界人工智能大会亮相。

据报道,阶跃星辰 即将发布 AI 终端品牌、AI 智能体系统及 AI 智能体手机。

中兴通讯 高级副总裁、努比亚 总裁 倪飞 发文称这款量产旗舰 AI 智能体手机来自 努比亚。

官方称其为全球首款,该机将于 下周 在 2026世界人工智能大会 首次公开亮相。

阶跃星辰 官方社交账号预告称将带来 Agent 时代的新答案和新的物种,但未公布具体参数。

相关链接:


提示:内容由AI辅助创作,可能存在幻觉和错误。