DECOHACK

Juya AI Daily · 橘鸦 AI 早报

AI 早报 2026-07-16

内容来自橘鸦 AI 早报,经作者同意转载阅读原文 ↗视频版哔哩哔哩YouTube
AI 早报 2026-07-16

要闻

1

SpaceXAI 开源 Grok Build、重置额度并关闭默认数据留存

SpaceXAI宣布开源编程Agent Grok Build,公开了涵盖Agent循环、工具实现和扩展系统的Rust源码。官方同时重置所有用户额度,关闭数据留存默认设置并删除此前留存的编码数据。

SpaceXAI 宣布开源编程 Agent 及终端交互界面 Grok Build,公开了包含 Agent 循环、工具实现、终端界面及扩展系统的 Rust 源码。

SpaceXAI同步重置了所有用户的用量额度,并将 Grok Build 的数据留存默认设置改为关闭,同时删除了此前留存的所有编码数据。

SpaceXAI 称早期测试版对非零数据留存用户默认开启了数据留存,但强调用户始终可在命令行界面禁用数据上传且该选择受到尊重。

用户可编译源码配置自有本地推理运行 Grok Build。

相关链接:

开发生态

模型发布

3

Thinking Machines Lab 发布多模态开源模型 Inkling

Thinking Machines Lab 发布开源多模态模型 Inkling,当前已开放完整权重并可在 Tinker 平台微调。该模型采用混合专家架构,总参数 975B 且激活 41B,原生支持文本、图像与音频输入,并支持调节推理算力。官方称其在 VoiceBench、MMAU 和 AudioMC 上位列开源权重模型前列。

Thinking Machines Lab 发布了多模态混合专家模型 Inkling 并开放完整权重,当前可通过 Tinker 平台 进行微调。

该模型总参数 975B、激活参数 41B,支持最高 1M 上下文窗口,原生处理文本、图像和音频,并支持通过可调节推理算力来平衡性能与成本。

模型权重已在 Hugging Face 上提供原始及适配 NVIDIA Blackwell 的 NVFP4 版本,支持 SGLang 和 vLLM 等框架本地部署,并由多家第三方平台提供 API。

同系列轻量版模型 Inkling-Small 目前仅提供预览,完整权重将在测试完成后发布。

相关链接:

4

字节Seed模型升级:支持1M上下文并推出成本优惠

字节跳动Seed团队升级了Doubao-Seed-Evolving模型,正式支持百万Token超长上下文。此次更新还增强了长程任务能力并优化了Tokens消耗效率,官方同时推出了调用成本立减**20%**的体验奖励计划。

字节跳动Seed团队宣布对 Doubao-Seed-Evolving 模型进行三大升级。

该模型已支持 1M 超长上下文,可处理大型代码仓库及长篇文档。

其长程任务能力在开发者众测中评分超越 Doubao-Seed-2.1-pro,且 Tokens 消耗更少、工具调用轮次更简洁。

目前,参与“体验奖励计划”可享调用成本立减 20%。

该模型已上线火山 Agent Plan,单月套餐限时 9.9元 起。

相关链接:

5

OpenAI发布内部自动化红队模型GPT-Red

OpenAI发布内部自动化红队模型GPT-Red,用于大规模发现模型的提示注入漏洞。该模型目前仅限内部使用,并已用于对抗性训练GPT-5.6 Sol以提升其鲁棒性。

OpenAI发布内部自动化红队模型GPT-Red,用于发现其模型的提示注入漏洞。

GPT-Red通过自我对弈强化学习训练,能够攻破包括GPT-5.5在内的几乎所有内部和生产模型,并已被用于对抗性训练GPT-5.6 Sol。

根据官方数据,与四个月前的最佳生产模型相比,GPT-5.6 Sol在最难的直接提示注入基准上的失败率降低了6倍。

为防止恶意能力泄露,GPT-Red与部署模型保持隔离,目前仅限内部使用。

相关链接:

产品应用

6

OpenAI 与 Work Louder 联合推出 Codex Micro 键盘

OpenAI 与 Work Louder 联合推出 Codex Micro 键盘,目前已开放在线订购。该产品为限量发售,售价 230 美元。

OpenAI Supply Co. 与 Work Louder 联合设计的 Codex Micro 键盘目前已开放在线订购。

该键盘售价 230 美元,预计 7 月 24 日 发货,Thomas Ricouard 表示此次发售为限量版。

键盘具备实时显示 Agent 状态的 RGB 灯效,并配备用于调整推理级别的旋钮、触发常见工作流的摇杆以及专属命令键。

产品兼容 Mac 和 Windows,支持蓝牙与 USB-C 连接。

相关链接:

技术与洞察

7

Arena.ai推出结合人类偏好与事实性的模型新排名

Arena.ai宣布引入了整合人类偏好与事实性的新模型排名,目前作为非默认选项提供。根据新排名,GPT-5.5在文本竞技场中上升幅度最大,跃升13位至第7名,而Muse Spark下降最多,从第7跌至第20名。

Arena.ai 正式在其文本和搜索竞技场中推出了一个结合人类偏好与事实准确性的新模型排名系统。

该功能目前作为一个非默认开关在排行榜界面中提供,其默认的事实性权重为 25%。为驱动这一排名,Arena 团队标记了超过 200 万条由大语言模型在真实对话中生成的声明,其中超过 130 万条来自文本竞技场,超过 70 万条来自搜索竞技场。

在文本竞技场中,启用事实性权重后的主要变化包括:Claude Fable 5 略微下降至第 2 名,GPT-5.5 跃升 13 个名次至第 7 名,成为排名上升最多的模型,而 Muse Spark 则从第 7 名跌至第 20 名,成为下降最多的模型。

相关链接:

行业动态

8

知网宣布对AI署名论文做下架处理

知网宣布已对将人工智能列为作者的论文做下架处理。知网明确不接受AI作为论文署名作者,要求使用AI须在方**法或致谢中说明。

知网发布声明,已对将人工智能列为作者的论文做下架处理,明确不接受AI工具被列为论文署名作者。

知网指出AI不具备民事主体资格且无法承担学术责任,将其署名不符合法律规定与出版伦理。

作者如使用AI工具,必须在研究方法或致谢段落明确说明。

违背该原则的论文知网有权不予上线传播。

相关链接:

9

Anaconda 收购开源 AI 编程 Agent Kilo Code

Anaconda 宣布收购开源编程 Agent Kilo Code,将其整合进自身平台。官方称该 Agent 目前拥有超 300 万 开发者,收购后仍向个人及团队开放。

Anaconda 收购开源的 AI 编程 Agent Kilo Code,将其整合至自身平台以覆盖 AI 原生开发全生命周期。

官方数据显示,Kilo Code 目前拥有超 300 万开发者,每月调度接近 10 万亿个 token,其模型网关支持超过 500 个模型。

收购完成后,Kilo Code 仍向个人构建者、团队和组织提供,支持在 VS Code、CLI 和 JetBrains 等工具中使用。

相关链接:

前瞻与传闻

10

Kimi官方疑似发布K3预热视频,反复出现数字3

月之暗面旗下Kimi账号发布了一段反复出现数字3的视频,疑似暗示Kimi K3即将推出。

月之暗面旗下的 Kimi 今日通过官方社交媒体账号公布了一段反复出现数字“3”的预告视频。

视频中,“3”以多种方式反复出现,被外界普遍解读为暗示下一代大型语言模型 Kimi K3 即将发布。

目前,官方并未透露 K3 的具体推出时间、模型规格与能力范围,仅凭这段预告片引发用户对新模型的关注与猜测。

相关链接:

11

Elon Musk称 𝕏 完成安全审查后将开源整个代码库

Elon Musk称,完成安全漏洞审查后,𝕏将开源整个代码库且无例外。𝕏还将邀请第三方审查运行系统以确认开源代码即为实际代码。

Elon Musk表示,在完成安全漏洞审查后,𝕏 将开源其整个代码库,且不作任何例外。

为确保透明度,𝕏还将邀请第三方审查员检查运行中的系统,以确认开源代码与实际运行的代码一致。

该开源计划目前需等待安全审查完成后方可实施。

相关链接:


提示:内容由AI辅助创作,可能存在幻觉和错误。