DECOHACK

Juya AI Daily · 橘鸦 AI 早报

AI 早报 2026-07-15

内容来自橘鸦 AI 早报,经作者同意转载阅读原文 ↗视频版哔哩哔哩YouTube
AI 早报 2026-07-15

今日概览 · 24 条

要闻

1

OpenAI Codex 活跃用户破800万,再次重置用量限制

Codex 负责人 Tibo 宣布 Codex 与 ChatGPT Work 活跃用户达到800万,所有用量限制已再次重置,并且继续不设5小时速率限制。Sam Altman称GPT-5.6 Sol增长惊人,但可能即将出现服务中断。

OpenAI Codex 负责人 Tibo 宣布 Codex 和 ChatGPT Work 的活跃用户数突破 800万,同时再次重置了所有用户的使用限制。

目前这些服务依然不执行 5小时 速率限制,用户可自由探索 GPT-5.6 Sol 的能力边界。

Sam Altman表示,GPT-5.6 Sol 的增长速度十分惊人,推理团队付出了巨大努力来支撑需求,公司将继续全力扩展,但近期可能会出现一些服务中断。

相关链接:

开发生态

2

Qoder 面向所有个人用户免费发放 200 次极致模型调用

Qoder 宣布向所有个人用户提供 200 次 极致 模型免费调用。活动现已全量开放、先到先得,2026 年 7 月 30 日截止。

Qoder 宣布面向所有个人用户免费提供 200 次极致模型调用。

该活动起初存在资格限制,随后官方决定全量开放。额度总量有限且先到先得,领取与使用均须在 2026 年 7 月 30 日前完成。

用户可在 Qoder Desktop、JetBrains 插件或 CLI 中领取。使用极致档位时系统优先扣减免费次数。

Teams 计划用户不可参与。且 Desktop 的专家团模式及涉及 subagent 的任务无法使用该额度抵扣。

相关链接:

3

火山引擎发布 AI MediaKit CLI 与 Skill

火山引擎发布 AI MediaKit CLI 与 Skill,为 Agent 提供音视频工作台。此套件集 100+ 原子能力,支持用自然语言触发剪辑与增强等任务。

火山引擎智能视频云正式发布 AI MediaKit CLI 与 Skill,旨在让 Agent 拥有可调用与编排的音视频工作台,解决视频从生成到交付全链路的自动化问题。

该套件基于沉淀 100+ 音视频原子能力的 AI MediaKit 构建,包含原生命令行工具 CLI 与面向 Agent runtime 的 Skill,支持 Claude Code 等通过自然语言触发。

Skill 按剪辑、视频、图像、音频四大能力域拆分,并将异步长耗时任务的提交、轮询与结果回收下沉至工具层。

其设计支持端云协同与多入口统一底座。mediakit-cli 现已在 GitHub 开源。

相关链接:

4

TRAE企业版推出内置模型套餐限时半价活动

TRAE 企业版推出内置模型套餐限时半价活动。企业团队版及旗舰版用户使用相关产品时,其内置模型套餐内的调用费用将统一按5折计算,活动持续至 2026年底。

TRAE 企业版 推出内置模型套餐用量限时半价活动,现已生效。

订阅有效期内的企业用户在使用 TRAE IDE、插件、CLI 及 Work 等产品时,其内置模型套餐内的调用费用将统一按5折计算,系统自动扣减无需额外配置。

此次活动不涵盖企业自定义模型及套餐外用量。

且 TRAE 历史旗舰版 需升级后才可参与。

优惠将于 2026年12月31日23:59 截止。

相关链接:

5

OpenClaw 发布 v2026.7.1 版本

OpenClaw 发布 v2026.7.1版本,重构了 Control UI 与新手引导流程,并新增对 GPT-5.6 等新模型的支持。该版本大幅更新了 iOS、Android 与 macOS 官方应用,增强了各消息渠道稳定性,并引入了工作区终端、崩溃循环阻断及 Agent 审计日志等功能。

OpenClaw 正式推送 v2026.7.1 更新。

官方称该版本重构了 Control UI 使其更接近浏览器工作区,并优化了多平台新手引导与 Crestodian 设置流程。

模型层面,新增 GPT-5.6(含 Sol、Terra、Luna 版本)、Tencent Hy3、Meta Muse Spark 1.1、Claude Sonnet 5 及 Claude Mythos 5 的兼容支持,同时通过 openclaw attach 深化了 Codex 及 Claude Code 的集成。

移动端方面,iOS、Android 和 macOS 应用均获得离线缓存、语音笔记与受策略管控的工作区终端等功能,且 Gateway 增加了崩溃循环自动阻断与 Agent 审计历史功能。

此外,此次更新还对远程浏览器控制、定时任务及内存索引逻辑进行了大量修复与优化。

模型发布

6

PrismML 发布 Bonsai 27B 模型:1-bit 版本可在手机端运行

PrismML 发布基于 Qwen3.6-27B 的 Bonsai 27B 模型,提供 1-bit 与 Ternary 两种版本,当前已开源并提供限时免费 API。1-bit 版本部署体积约 3.9 GB 且可在手机端运行,Ternary 版本则保留官方所称 95% 的全精度性能并主打笔记本端部署。

PrismML 发布基于 Qwen3.6-27B 的 Bonsai 27B 模型,提供 1-bit 和 Ternary 两个版本,当前已提供下载与限时免费开发者 API。

1-bit 版本实际位宽为 1.125 比特,部署占用约 3.9 GB。据官方数据,该版本保留 90% 全精度基线性能,可在 iPhone 17 Pro Max 上运行。

Ternary 版本部署体积约 7.2 GB,保留 95% 全精度性能,主要面向笔记本电脑部署。因超出 iOS 单应用内存预算,该版本不适用手机端。

两款模型均支持 262K 上下文长度和视觉输入。

相关链接:

7

阿里 ATH-MaaS 团队发布文档解析模型 OvisOCR2

阿里 ATH-MaaS 团队发布端到端文档解析模型 OvisOCR2。官方称其以 96.58 分登顶 OmniDocBench v1.6 排行榜。模型基于 Qwen3.5-0.8B 训练,现已开源。

阿里巴巴 ATH-MaaS 团队发布了端到端页面级文档解析模型 OvisOCR2。

该模型基于 Qwen3.5-0.8B 进行后训练,能将文档页面图像转换为按自然阅读顺序排列的 Markdown 格式,涵盖文本、公式、表格和视觉区域。

根据官方数据,OvisOCR2 在 OmniDocBench v1.6 上达到 96.58 分,官方称其成为首个登顶该排行榜的端到端模型,并在 PureDocBench 上取得 75.06 的最高 Avg3 得分。

模型采用 Apache 2.0 许可证,目前在 Hugging Face 提供。

相关链接:

8

OpenMOSS开源MOSS-VL-Realtime模型,支持视频流实时视觉理解

OpenMOSS发布开源视觉语言模型MOSS-VL-Realtime。该模型参数量为11B,专为连续视频流实时理解设计,支持并行生成与动态修正回复。

OpenMOSS 在 Hugging Face 开源了视觉语言模型 MOSS-VL-Realtime。

该模型拥有 11B 参数与 256K 上下文长度,采用 Apache-2.0 协议,专为连续视频流的实时视觉理解设计。

它支持在流运行中随时提问、并行感知与生成、随场景变化动态修正或中断回复,以及在证据不足时主动保持沉默。

MOSI 称其在多个流媒体视频理解基准上达到开源模型 SOTA。

目前模型开放测试与研究,但单个模型实例仅支持一个活跃的实时会话。

相关链接:

9

阿里通义万相开源 Wan-Dancer-14B 音乐转舞蹈模型

阿里旗下万相团队开源了音乐转舞蹈视频生成模型 Wan-Dancer-14B,用户现在可以在本地生成具有长时长节奏同步效果的舞蹈视频。模型权重和推理代码均已发布。

阿里通义万相团队开源了其用于音乐生成舞蹈视频的模型 Wan-Dancer-14B。

用户现可基于一张人物图片和一段音乐,在本地生成长时长、高画质且动作与音乐节奏同步的舞蹈视频。

该模型采用全局关键帧规划与局部时序优化相结合的分层框架,以确保长视频的连贯性,支持街舞、踢踏舞、拉丁舞、韩舞和中国古典舞五种舞蹈风格。

模型权重已在 Hugging Face 和 ModelScope 平台上线,推理代码在 GitHub 开源。

用户也可通过 ModelScope 和 Hugging Face 的在线空间直接体验。

相关链接:

10

腾讯混元发布 Hy3 量化版及 llama.cpp MTP 补丁

腾讯混元团队发布 Hy3 模型 1bit 与 4bit 量化版本。1bit 版本最低仅需单张 96GB 显卡部署,官方称其主流任务能力保持稳固。

腾讯混元团队针对开源社区需求,发布了 295B 参数 Hy3 模型的 1bit、4bit 及 GPTQ Int4 量化版本。

原本近 600GB 的 BF16 权重被压缩。1bit 版本降至 85.5GiB,可在单张 96GB 显卡部署。4bit 版本降至 169.9GiB,需两张显卡。GPTQ Int4 版本适配 vLLM 服务端部署。

官方表示,4bit 版本输出分布与原始模型基本一致。1bit 版本在长文理解上接近原始模型,仅在 Agent 与代码方向有小幅回落。

团队同时发布了 llama.cpp patch 支持 MTP 投机解码。官方称开启后,1bit 与 4bit 版本解码速度分别提升约 50% 和 60%。

相关链接:

产品应用

11

Anthropic 推出 Claude for K-12 Teachers

Anthropic 推出 Claude for K-12 Teachers,经验证的美国 K-12 教师免费获 Claude Pro。2027年6月30日前注册可获一年免费访问。

Anthropic 推出 Claude for K-12 Teachers,目前面向经验验证的美国 K-12 个人教育者免费提供 Claude Pro 功能。

该服务包含针对教学工作的技能,并能连接至符合州标准且基于证据的课程资源,如 Illustrative Mathematics 和 OpenSciEd。

教师须在 2027年6月30日前 注册,方可获得一年的免费访问权限,且适用额外的使用量限制。

Anthropic 强调 模型 不会使用用户对话进行训练,针对学校和学区的专属服务即将推出。

相关链接:

12

OpenAI 推出 ChatGPT 跨内容搜索功能

OpenAI 在 ChatGPT 中推出新的跨内容搜索功能,目前已在网页端、iOS 和 Android 端上线。该功能支持从侧边栏搜索聊天记录、项目、图片和文档,面向所有 ChatGPT 订阅方案全球可用。

OpenAI 在 ChatGPT 中推出新的跨内容搜索功能,目前已在网页端、iOS 和 Android 端上线。

用户可以从 ChatGPT 侧边栏发起搜索,使用过滤器按内容类型缩小范围,并直接在应用内打开对应的聊天、项目或文件。

该功能支持搜索聊天记录、项目、图片和文档,面向所有 ChatGPT 订阅方案全球可用。

相关链接:

13

PixVerse 推出 PixVerse Game Engine

PixVerse 宣布推出 PixVerse Game 及 PixVerse Game Engine,目前抢先体验已开放。官方称新引擎基于实时世界模型 R1,可将玩家自然语言输入转化为实时生成的游戏世界。PixVerse 同步宣布完成C轮融资,总融资额达 4.39 亿美元。

PixVerse 官方宣布推出 PixVerse Game 及 PixVerse Game Engine,目前抢先体验已开放。

官方称,该引擎基于其发布的实时世界模型 R1,将抽象游戏机制与视觉表达分离。玩家使用自然语言交互时,世界会以视觉和机制方式实时响应,而非依赖预设计选项。

PixVerse 还将推出 AI 角色实时响应观众的互动直播。

同日,官方宣布完成 Series C 延展轮融资。

Series C 总融资额达 4.39 亿美元,新投资方包括 阿里巴巴、蓝色光标等。

相关链接:

14

Spotify 面向特定区域 Premium 用户推出对话式交互 Beta 功能

Spotify推出对话式交互功能,用户可语音或文字对话控制播放与了解音频。该功能目前处于Beta版,仅限美国、爱尔兰和瑞典 18岁以上 英语Premium用户。

Spotify推出新型对话式交互功能,允许Premium用户通过语音或文字与应用进行来回对话,以控制播放、了解音频背景和探索收听历史。

该功能混合使用了 Spotify 自研 AI 技术及多家提供商的模型,允许用户在移动端的 Home 和 Now Playing 视图中随时通过自然语言调整播放偏好或执行保存、关注等操作。

目前该功能正以 Beta 版逐步推出,仅限美国、爱尔兰和瑞典 18 岁以上的英语 Premium 用户在 iOS 和 Android 设备上使用,官方称回答可能不完美。

相关链接:

技术与洞察

15

智谱与清华团队提出SAO算法,提升大模型Agent训练稳定性

智谱与清华联合团队提出大模型异步强化学习算法SAO。官方称该算法能稳定训练超千步,并在SWE-Bench等Agentic基准上超越GRPO,已用于GLM-5.2。

智谱创始人唐杰发文宣布,智谱与清华联合团队发布了针对大模型Agentic强化学习的新算法SAO。

官方论文指出,SAO通过单次采样策略替换传统的组采样,解决了异步RL中的训练不稳定和off-policy问题,能够稳定训练一千步。

实验数据显示,基于Qwen3-30B-A3B的测试中,SAO在SWE-Bench Verified和BeyondAIME等基准上表现均优于GRPO及其变体。

该技术已成功部署于GLM-5.2模型的训练流水线。

不过在该推文评论区,多位用户反馈近期GLM服务存在频繁断连及响应慢等稳定性问题。

相关链接:

16

Perplexity发布WANDR基准评估研究Agent广度与深度能力

Perplexity 开源了WANDR基准及评估工具,用于测试研究 Agent 的广度与深度研究能力。目前,基准任务、评估工具及技术报告已在 GitHub 开源。

Perplexity 发布了 WANDR(Wide ANd Deep Research)开源基准及评估工具,用于评估研究 Agent 在广度与深度兼具的知识工作中的表现。

该基准包含 500 项基于真实生产请求生成的任务,要求 Agent 发现大量符合条件的目标对象并为每一条提供具体证据支撑。

官方对 6 个生产系统的评估显示,Perplexity Search as Code 以 0.363 软 F1 和 0.133 硬 F1 领先,Anthropic 排名第二。

结果表明当前系统普遍在完整覆盖和提取充分证据方面存在困难,发现环节是首要结构性瓶颈。

目前,基准任务、评估工具及技术报告已在 GitHub 开源。

相关链接:

行业动态

17

DeepMind CEO 发文呼吁建立前沿 AI 监管机构

Google DeepMind CEO Demis Hassabis发文,提议美国建立前沿AI标准机构,目标年底前运作。该机构在初期要求前沿模型发布前自愿接受最多三十天的审查,测试体系成熟后将转为模型在美国市场部署的硬性门槛。审查内容涵盖网络安全、生物威胁及Agentic AI的欺骗行为等,非前沿模型将被豁免。

Google DeepMind CEO Demis Hassabis 发文,提议美国建立由行业出资、政府监督的前沿 AI 标准机构。

该机构初期将要求前沿实验室在模型发布前最多 30 天自愿提交审查。测试体系成熟后,通过审查将成为前沿模型在美国市场部署的强制要求。

审查范围涵盖网络安全、生物威胁及 Agentic AI 的欺骗行为等,非前沿模型将被豁免。

Hassabis 向 Axios 表示,他已向美国政府等简报该计划,目标是该机构在 年底前 运作。

相关链接:

18

美国纽约州颁布大型数据中心建设禁令

美国 纽约州 州长颁布为期 一年 的行政令,为避免推高电力成本与社区负担,暂停用电量 50 兆瓦及以上项目的建设许可。该行政令将在其制定统一的环境影响标准后解禁。

美国纽约州州长 Kathy Hochul 颁布行政令,暂停该州大型新数据中心的建设,为期一年。

这项禁令适用于用电量达到或超过50兆瓦的项目,理由是担心这些驱动人工智能热潮的设施推高电力成本、消耗水资源并加重社区负担。

在暂停期间,州环境保护局将不再签发新的许可,州长指示官员制定统一的环境影响标准,待标准最终确定后方可解除禁令。

Hochul还表示将推动立法,取消对超大规模数据中心的销售税豁免。

相关链接:

19

Anthropic投入千万加元资助加拿大AI研究并拓展初创计划

Anthropic 官方宣布向加拿大研究机构投入 1000万加元 资助 AI 研究。目前已与 8 家机构合作提供 Claude 额度,并将把其中 三 家机构纳入初创企业计划。

Anthropic官方宣布向加拿大研究机构投入 1000万加元,用于资助有益且负责任的AI应用研究。

目前Anthropic已与加拿大三大区域AI研究所以及多家医疗和学术机构达成合作,为其提供 Claude 额度,覆盖 强化学习、心理健康及低资源语言等方向。

此外,Anthropic将在今年夏季把 Amii、Mila 和 Vector 纳入初创企业计划,为关联初创企业提供至少5000美元的 API 额度。

相关链接:

前瞻与传闻

20

消息称 DeepSeek 开始筹备 IPO 并寻求新一轮融资

据报道,DeepSeek正筹备首次公开募股,计划今年提交IPO申请,争取2027年上市。同时,DeepSeek正寻求新一轮融资,投前估值至少710亿美元,计划筹集至少100亿元人民币,资金将用于加速算力基础设施扩张,以支持Agent产品研发。

据 彭博社 和 金融时报 援引知情人士报道,DeepSeek 已开始筹备首次公开募股,并正与会计和银行顾问商谈。

该公司目标 今年 提交 IPO 申请以便 2027年 在大陆上市。

同时已接触新投资者讨论新一轮融资,投前估值至少 710亿美元。

此次融资目标筹集至少 100亿元人民币,资金将用于加速算力基础设施扩张。

此前 DeepSeek 于 5月底 完成约 70亿美元 首轮融资,投后估值约 520亿美元。

知情人士指出 IPO 时间和融资计划可能改变,DeepSeek 未予回应。

相关链接:

21

据称三星电子获得 Anthropic 自研 AI 芯片生产订单

据报道,三星电子已获得 Anthropic 自研 AI 芯片的生产订单。该芯片预计将采用三星的 2 纳米工艺和先进封装技术。

据与 三星电子 关系密切的业界相关人士透露,三星电子代工事业部 已获得 Anthropic 自研 AI 芯片的生产订单,将负责代工生产该芯片。

Anthropic 目前已着手进行自研 AI 芯片的初期开发工作,预计该芯片将采用 三星电子 的 2 纳米 工艺及先进封装技术。

Anthropic 曾于 今年 5 月 的 H 轮融资 中将 三星电子、SK 海力士 和 美光 三大存储厂商列为战略合作伙伴,业界此前普遍认为拥有代工厂的 三星电子 最有可能承接该芯片生产。

相关链接:

22

腾讯混元正训练HY4模型 目标2027年进国内第一梯队

据 晚点LatePost 报道,腾讯 混元 正训练 Hy4 模型,尺寸将大于 Hy3 并加入多模态,内部预计仍处追赶状态,目标是在 2027 年进国内第一梯队。晚点 报道同时披露,字节跳动 Seed 团队正训练一个史无前例的大尺寸模型。而 Kimi 的 K3 则押注架构创新。

据 晚点LatePost 报道,腾讯 混元 团队正在训练下一代模型 HY4,其尺寸将大于 HY3 并新增多模态能力。

该团队内部判断 HY4 仍将处于追赶头部的状态,但差距会明显缩小,2027年 进入国内第一梯队。

晚点 报道同时披露,字节跳动 Seed 团队正训练一个史无前例的大尺寸模型,而 Kimi K3 则押注架构创新。

相关链接:

其他

23

SpaceXAI回应Grok Build代码上传争议,称隐私设置将受尊重

SpaceXAI旗下工具Grok Build CLI被指在未明确提示下,将用户完整Git仓库上传至云端。SpaceXAI回应称,开启零数据保留模式的团队数据不会被保留。未开启的用户需在命令行输入 /privacy 指令来禁用并删除已同步数据。Elon Musk 转发回应称始终尊重用户的隐私设置。

SpaceXAI旗下开发者工具Grok Build CLI被指在未经明确告知的情况下,将包含私密代码和密钥的整个Git仓库上传至Google Cloud存储桶。

对此,SpaceXAI在社交平台上回应称,公司重视用户隐私并尊重客户选择,已启用零数据保留模式的团队,其代码数据不会被保留,且该模式同样适用于通过API密钥使用Grok Build的用户。

若未开启此模式,用户可在命令行界面输入/privacy命令来禁用数据保留,该操作同时会删除此前已同步的数据。

不过,有用户指出ZDR功能或仅面向企业版账户开放,且SpaceXAI对于已上传数据的处理范围、保留期限及删除方式仍未具体说明。

相关链接:

24

据报 Codex 开始加密子 Agent 消息

OpenAI Codex 的一项更新开始将子 Agent 的任务提示替换为用户不可读的密文。目前的分析和用户反馈均指出,该加密行为在增强隐私保护的同时,也移除了本地可读的审计追踪,给开发者的调试工作带来困难。

OpenAI 的编程 Agent 工具 Codex 近期通过一项合并更新,开始对多 Agent 系统中“主 Agent 向子 Agent 下达的任务指令”进行加密。

用户 ignatremizov 于 6 月 13 日 在 Codex 的官方 GitHub 仓库提交 Issue 指出,更新后子 Agent 的生成、消息发送等功能的 message 载体被标记为加密,并仅存储密文形式的 encrypted_content。

尽管消息仍能正常送达执行,但该行为导致用户无法在本地历史记录和会话追踪中查看人类可读的任务描述。

这使得开发者在事后审计“主 Agent 到底给子 Agent 分配了什么任务”以及排查错误时面临巨大障碍。

该情况主要影响使用 GPT-5.6 Sol 或 Terra 模型并搭配 Ultra 推理模式的用户。

相关链接:


提示:内容由AI辅助创作,可能存在幻觉和错误。