DECOHACK

Juya AI Daily · 橘鸦 AI 早报

AI 早报 2026-07-14

内容来自橘鸦 AI 早报,经作者同意转载阅读原文 ↗视频版哔哩哔哩YouTube
AI 早报 2026-07-14

要闻

1

Codex 更新:GPT-5.6 Sol上下文回滚至272k并修复多Agent消耗

OpenAI 宣布通过推理优化,为 Codex 用户带来了约百分之十的GPT-5.6 Sol 用量提升。同时,为排查额外消耗来源而进行的推理努力实验也已回滚。由于提升至 372k 上下文限制导致消耗远超预期,官方已将其调整至 272k。官方再次否认超 272k 存在双倍计费的说法,解释额外消耗主要源于较长的上下文在多次工具调用之间反复传递而导致的缓存读取成本上升,目前正调整系统以在未来重新支持 372k 的上限。

OpenAI开发者Tibo宣布,通过推理优化为 GPT-5.6 Sol订阅用户带来约**10%**用量提升。

官方将上下文限制从272k升至372k后,消耗远超预期。目前,已回滚至272k并计划未来重新推出,同步回滚 推理努力 实验调整,5小时使用限制继续暂停。

针对开发者Theo关于超272k双倍计费导致用量暴增的说法,Tibo明确否认。他强调官方控制所有设置,不会加收费用。

他解释超额消耗的真正原因是,上下文在工具调用间移动导致的 缓存读取成本 上升。最大上下文长度并非 成本甜点。

官方正在调整系统,以在不增加计费使用量的情况下恢复372k。此外,官方正修复多 Agent 高 推理努力 下消耗偏高及 自动审查 效率问题。

相关链接:

开发生态

2

GLM Coding Plan 专项治理违规账号

智谱宣布近日完成一轮GLM Coding Plan专项治理,对确认存在中转、倒卖或共享等违规行为的账号执行30天封禁。官方强调,风控处置不会因单纯的多设备或多并发触发,而是基于数十项风险信号结合人工复核。

GLM Coding Plan 官方近日完成一轮专项治理,对确认存在违规风险的账号执行了 30天 封禁。

该服务作为个人订阅,资源仅限订阅人本人在支持环境中使用,中转、倒卖或共享 账号 均属违规。

官方明确表示,不会因单一指标如多设备或多并发触发限制,正常重度使用不等于违规,平台基于数十项风险信号综合评估并辅以人工复核。

若认为 账号 被误判,用户可通过 申诉入口 提交复核。

相关链接:

3

Grok Build CLI 被指上传完整代码库,官方已服务端禁用

近期有网友测试发现,Grok Build CLI默认将代码仓库作为git bundle上传至SpaceXAI的Google Cloud,此行为独立于Agent读取,且无视.gitignore。7月13日,原发帖人称SpaceXAI已在服务端关闭该功能。

据 Reddit 网友 TastyLeadership2757 抓包测试,Grok Build CLI (v0.2.93) 默认将用户整个代码仓库作为 git bundle 上传至 SpaceXAI 的 Google Cloud,且关闭 “Improve the model” 选项无法阻止此行为。

该测试称,即便提示 Agent 不读取文件或设置 .gitignore,除特定排除项外代码仍被完整打包上传。

对比测试中 Claude Code、Codex 和 Gemini 仅发送读取的文件。

7月13日 凌晨,SpaceXAI 服务器端新增并返回 disable_codebase_upload: true,暂时关闭了该上传,但因配置受服务端远程控制,未来可能重新开启。

相关链接:

模型发布

4

actAVA发布医疗模型Cura 1T

actAVA推出万亿参数医疗模型 Cura 1T,该模型基于Kimi-K2.6微调,专注患者护理、临床推理及医疗Agentic工作流,在六项医疗基准中五项得分领先。actAVA同步开源了评估工具cura-eval。

actAVA发布万亿参数医疗模型 Cura 1T,微调自 Kimi-K2.6,采用递归自我改进机制训练以处理患者护理、临床推理和医疗Agentic工作流。

官方数据显示,该模型在 HealthBench Hard 等6项医疗基准中的5项得分领先,在 MedXpertQA-Multimodal 上排名第二。

同时其通用能力在各域外榜单保持前五。

同步开源了模型无关的评估工具 cura-eval。

官方强调 Cura 1T 为研究模型,非医疗服务替代品。

相关链接:

5

腾讯混元全栈开源 HyOCR-1.5

腾讯混元团队全栈开源1B参数端到端OCR大模型HyOCR-1.5。该模型在OmniDocBench基准取得SOTA。并引入DFlash投机解码最高提速6.37倍,还支持普通笔记本本地部署。

腾讯混元团队全栈开源 1B 参数端到端 OCR 大模型 HyOCR-1.5,公开其数据构造方法、训练配方与推理框架。

该模型引入基于约 90.7M 草稿模型的 DFlash 投机解码框架,官方称在 Transformers 下实现 6.37 倍加速,并支持通过 llama.cpp 在 CPU、消费级显卡及普通笔记本上本地部署。

训练方面,其采用 Agentic Data Flow 构造低资源语种、古文字与多图问答数据,并将最大图像分辨率提升至 4K、上下文扩展至 128K。

官方称该模型在 OmniDocBench v1.6 等多个基准取得 SOTA,但也坦承在 CHAOS-Bench 幻觉抑制测试中绝对值仍偏低。

相关链接:

产品应用

6

阶跃星辰发布Step AOS与智能体手机STEPX Neo

阶跃星辰发布终端品牌STEPX及智能体原生OS Step AOS,首款智能体手机STEPX Neo亮相。该机暂未公布配置与上市时间,已达成首批App生态合作。

7月13日,阶跃星辰发布大模型原生AI终端品牌 STEPX、智能体原生操作系统 Step AOS 及个人智能体阶跃Amoo,首款智能体手机 STEPX Neo 同场亮相。

Step AOS 提供双域三步记忆与端云多脑体系,官方称日常问答记忆召回最快 15毫秒,端侧执行成功率超 99%。

STEPX Neo 背面配备交互副屏,官方称其已通过国家人工智能终端 L3 级别测试,目前暂未公布具体配置及上市时间。

阶跃已与支付宝、美团等达成首批生态合作,采用 A2A 交互范式。

相关链接:

行业动态

7

Meta扩展路易斯安那州数据中心至5GW算力,总投资超500亿美元

Meta宣布并扩展其位于路易斯安那州Richland Parish的数据中心,该项目总投资超500亿美元,园区达400万平方英尺并扩展至5GW算力。

Meta宣布并扩展其位于路易斯安那州Richland Parish的数据中心。

该园区面积达400万平方英尺,算力将扩展至5GW,是Meta迄今最大的数据中心。

该项目在Richland Parish地区的投资超过500亿美元,官方称其为全球最大AI基础设施投资之一。

预计建设高峰期将雇用超5000名建筑工人,并支持超500个运营岗位。

该中心将实现100%可再生能源匹配,至少向电网增加1500兆瓦新可再生能源,同时预计用水量将低于现有场地。

相关链接:

8

消息称 Nous Research 洽谈新融资 估值达15亿美元

据报道,Hermes Agent 开发商 Nous Research 正洽谈以15亿美元估值融资至少7500万美元。本轮融资由 Robot Ventures 领投,该公司及资方均未予置评。

据三名知情人士透露,Hermes Agent 开发商 Nous Research 正在敲定新一轮融资,估值达 15 亿美元,计划至少筹集 7500 万美元,且获得了投资者的高度关注。

此轮融资由 Robot Ventures 领投,USV 及其他知名投资方显著参与,这距离其宣布 5000万美元 A轮融资不到 三个月。

针对融资消息,Nous Research 拒绝置评,相关资方也未予回应。

相关链接:

9

韩国科信部启动全民AI项目

韩国科信部启动“全民AI项目”,计划年内推出免费且不限量的韩国国产AI服务。该部门预计年内正式上线通用AI聊天机器人,以及用于检索和申请公共服务的公共AI Agent。

据媒体报道,韩国科学技术信息通信部启动“全民AI项目”,旨在降低国民对外产免费 AI 的依赖,计划年内提供不限量且免费的国产 AI 服务。

该项目将选出2至3家民营企业主导,推出通用 AI、公共 AI Agent 及特化服务。且要求符合独立基础模型标准的国产 AI 模型占比超50%,非服务企业的国产模型占比超30%,外产模型仅可有限使用且不享受政府支持。

项目将于下月上旬截止公开招募,预计下月中旬选定服务商,约两月后推出 Beta 服务,并于年内正式上线。

今年将依托政府 512 块 Nvidia B200 GPU 加速推出,明年起由政府预算承担全民服务成本。企业需通过用户提示词数据等方式建立自身收益模型以维持运营。

相关链接:


提示:内容由AI辅助创作,可能存在幻觉和错误。