DECOHACK

Juya AI Daily · 橘鸦 AI 早报

AI 早报 2026-07-18

开发生态

1

ClaudeDevs 修复 Fable 模型无法选中问题并补偿扣费

Fable模型在Claude Code中出现了三十分钟无法选中的故障。ClaudeDev宣布现已修复该问题,针对期间被超额扣费的用户,将退还额度并赠送等额补偿。

ClaudeDevs 宣布,Fable 模型在 Claude.ai 和 Claude Code 中无法选中的问题现已解决。

此前该故障持续了 30 分钟,期间开启额外用量的用户可能被超额扣费。

ClaudeDevs 表示,将为受影响用户退还被扣额度,并额外赠送等额的补偿额度。

用户目前可能需要重启 Claude Code,若 Fable 未恢复为默认模型,需使用 /model 命令重新选择。

相关链接:

2

国家超算互联网发布智能体共创计划并招募开发者

国家超算互联网发布了为期 半年 的智能体共创计划,正面向高校、企业及个人开发者招募智能体、MCP工具与Skill等成果。加入该计划的开发者,可获得算力支撑,以及 现金加词元 的激励。

国家超算互联网在2026世界人工智能大会上发布科学计算智能体生态共创与开发者招募合作计划,目前正向高校、个人开发者及企业研发团队招募智能体、MCP工具与Skill等成果。

该计划为期半年,加入者可享受基于全国首个十万卡AI超集群提供的算力、数据与工具支撑,并获得现金加词元的多元化激励。

平台目前已汇聚超1.6万项内容组件并提供低代码开发环境,支持多智能体协作。

相关链接:

模型发布

3

InternLM 发布 Intern-S2-Preview-397B 多模态模型

InternLM 发布 Intern-S2-Preview-397B 多模态基础模型。官方称该模型在开源模型中实现领先的通用推理性能,引入了直接从科学文献原始页面学习的新预训练范式,并强化了长程 Agent 能力。

InternLM 发布 Intern-S2-Preview-397B 多模态基础模型,主要面向科学智能与长程 Agent。

该模型实际参数量为 403B,采用直接从科学文献原始页面进行视觉预训练的新范式,联合建模符号语义与视觉关系。

官方称其在开源模型中实现了领先的通用推理性能,并在生物分子交互设计等专门科学任务中取得强劲结果。

模型支持最大 256K 文本和 64K 多模态推理长度,默认开启思维模式,支持工具调用与时间序列推理。

目前模型权重已在相关平台开源。

相关链接:

4

Google 推出 Gemma 4 更新,启用 FA4 并修补工具调用

Google推出Gemma 4更新,支持 Flash Attention 4,修补了工具调用与聊天模板,需重新下载新版本以应用修复。

Google 推出 Gemma 4 更新,目前已在 Hugging Face 提供下载。

官方称此次在 NVIDIA Hopper GPU 启用 Flash Attention 4,预填充吞吐量提升 25-70%,首个词元时间降幅最高达 31%,并修补了工具调用与聊天模板。

Unsloth AI 表示需重新下载 GGUF、MLX 和 NVFP4 量化版本以获取修复。

对于官方称已修补的工具调用,有用户反馈数轮后仍生成无意义内容。

相关链接:

5

中国气象局开源“风和”气象服务大语言模型

中国气象局发布并开源 “风和” 气象服务大语言模型,该模型由公共气象服务中心联合智谱等机构研发,基于 GLM-4.5-Air。使用超 5000 万 tokens 气象语料和 49 万指令微调示例训练。

中国气象局发布 “风和” 气象服务大语言模型并启动全球开源计划。

该模型由 公共气象服务中心 联合 智谱 等研发,基于 GLM-4.5-Air 的 MoE 架构,上下文长度 128K。

模型使用超 5000 万 tokens 气象语料和 49 万 指令微调示例训练,官方称其在 MetsEval-1k 评估中得分高于主流通用大模型。

目前模型权重已在 Hugging Face、GitHub 和 ModelScope 开放,采用 MIT License。

模型已完成生成式 AI 备案,国际版已上线提供服务。

相关链接:

产品应用

6

ChatGPT桌面端应用推出更新:侧边栏加入历史记录与项目

OpenAI 宣布更新 ChatGPT 桌面端。已将Work模式名称改为ChatGPT,同时ChatGPT模式的侧边栏现可显示历史对话与项目,支持在顶部切换聊天与工作模式。

OpenAI 宣布 ChatGPT 桌面端应用已根据用户反馈推出更新。

主要更新内容包括:首先,应用侧边栏现已加入历史对话与云端项目;其次,聊天模式与工作模式现支持并列显示与切换,不再仅限于快捷聊天功能,该布局已与网页端及移动端体验保持一致。

在数据同步方面,聊天与工作记录现支持在网页端、移动端与桌面端之间跨平台同步,但本地任务依然仅保留在用户的本地电脑上,不上传云端。

此外,当前 Codex 模式的界面与功能未作更改,保持原样。

团队目前正继续修复各类细节问题,并致力于持续提升应用的性能、可靠性与运行效率。

相关链接:

7

Google WeatherLab 更新加入 WeatherNext 2 与 MetNet 预报

Google DeepMind 宣布交互式 AI 天气模型网站 Weather Lab 迎来重大更新,加入 WeatherNext 2 和 MetNet 全球预报。本次更新新增定点预报与气旋追踪等功能。

Google DeepMind 团队成员 Peter Battaglia 宣布,AI 天气模型的交互式网站 Weather Lab 发布重大更新。

此次更新引入了 WeatherNext 2 和 MetNet 模型的全球天气预报。

新功能包括最长 15 天前的历史预报、特定地点定点预报。

以及与天气预报同屏的气旋追踪。

用户还可以查看温度、降水、气压和风速等气象地图。

相关链接:

8

1Password 发布 1Password for Claude 集成及 Agentic Mode

1Password发布 1Password for Claude 集成,允许 Claude 使用但不暴露凭据。该集成目前已在 Mac 端上线。

1Password 发布 1Password for Claude 集成。

此集成基于零暴露架构,旨在让 Claude 能够完成那些需要登录的浏览器任务,而用户的凭据不会进入模型。

具体流程是:在用户的生物识别批准后,1Password 会直接将所需凭据注入到相应页面中,且访问范围被严格限定于当前任务。

与此同时,1Password 浏览器扩展新增了 Agentic Mode。该模式能够在 Agent 接管浏览器时,自动锁定扩展,仅允许其使用用户明确授权的登录信息。

1Password for Claude 目前已面向 Mac 平台的商业、家庭和个人方案用户上线。

相关链接:

9

LM Studio 发布 AI Agent 应用 Bionic

LM Studio 发布独立 AI Agent 应用 LM Studio Bionic,专为开放模型设计。该应用专注编码与文档处理,并支持离线语音转录。目前该应用已开放下载。

LM Studio 正式发布 AI Agent 应用 LM Studio Bionic,专为开放模型打造,目前可作为独立应用下载使用。

Bionic 专注于编码和文档处理,支持离线语音转录,允许用户在本地运行模型或通过 LM Studio Secure Cloud 调用前沿开放模型。

官方承诺对所有用户实行零数据保留且绝不使用用户数据进行训练,使用云端模型需创建账号并设置计费。

Bionic 与现有 LM Studio 应用相互独立,高级底层配置仍可继续使用 LM Studio。

相关链接:

10

阶跃发布STEPX Neo及Step AOS 与支付宝达成系统级合作

阶跃正式发布了智能体手机STEPX Neo与Step AOS操作系统。该系统重构了记忆与执行能力,最快十五毫秒即可召回记忆。阶跃还与支付宝达成AI Agent系统级合作。

在世界人工智能大会期间,阶跃正式发布大模型原生智能体手机 STEPX Neo,搭载智能体原生操作系统 Step AOS及个人智能体阶跃Amoo。

Step AOS重构了记忆、执行和安全能力,官方数据显示其简单问答记忆召回最快达15毫秒,复杂任务平均响应约1.2秒。

支付宝与阶跃宣布达成 AI Agent 系统级合作,Step AOS 通过支付宝 AHA方案接入阿宝服务网络。

STEPX Neo 成为首批通过人工智能终端智能化分级国家标准 L3级测试的设备,官方称其端侧基座模型在29项基准评测中位列同类全球第一。

相关链接:

11

千问推出智能体眼镜与首款智能体耳机

千问推出升级版 千问AI智能体眼镜 及首款 千问AI智能体耳机。千问AI智能体眼镜 新增 全双工语音、眼动追踪 及 体征实时监测 等技术。千问首款 AI智能体耳机 采用 耳夹式设计,支持 同声传译 与 会议纪要 等功能。

千问在 2026 世界人工智能大会推出升级版 千问AI智能体眼镜 及首款 千问AI智能体耳机。

升级后的 千问AI智能体眼镜 可通过智能体强化服务与决策能力,并按需调用第三方 Skill 和 Agent。同时新增 全双工语音、眼动追踪 与 体征实时监测 等硬件技术,相关技术将在年内应用。

千问 首款 AI智能体耳机 由 千问 与 Bose 联合打造,采用耳夹式设计,支持 同声传译 与 会议纪要 等功能。

已发售的 千问AI眼镜S1 和 G1 将通过 OTA 引入 Agent 能力。

相关链接:

技术与洞察

12

OpenAI 提出 AI 时代投资回报计分卡:衡量每美元有用智能产出

OpenAI 首席财务官 Sarah Friar 提出了一套评估 AI 时代投资回报的计分卡框架。该框架围绕 有用智能产出、成功任务成本、结果可靠性 与 计算资源回报 四项指标,帮助企业衡量 AI 支出的实际价值。

OpenAI 首席财务官 Sarah Friar 在官方博客中正式提出了一套名为“有用智能产出”的 AI 投资回报衡量计分卡。

该框架包含四项核心指标:AI 实际完成的有用工作量、每个成功任务的完整成本、产出的可靠性以及计算资源随规模扩大的回报效率。

她指出,单纯关注 Token 单价具有误导性,前沿模型可能因一次完成而降低总成本。

相关链接:

13

Anthropic 发文介绍 Claude Code 大规模代码迁移方法论

Anthropic 发文介绍了一套使用 Claude Code 进行大规模代码迁移的方法论。该流程利用 AI Agent 实现了高度并行化,核心观点是“不修复代码,而是修复产生代码的流程”。

Anthropic 发文介绍了一套使用 Claude Code 执行大规模代码迁移的六步流程,并分享了成功案例。

该方法论的核心是建立一个高度并行的、由代理驱动的循环,遵循规则而非直接修复代码。

Bun 的联合创始人 Jarred Sumner 利用此流程,在不到两周内用一百万行 Rust 代码重写了 Bun,全部现有测试在合并前在 CI 中通过。

该项目在 API 定价上花费约 16.5 万美元。

Anthropic 还发布了配套的入门工具包。

该方法强调将人工审查前置,重点在于修正产生代码的流程而非个别错误。

相关链接:

14

Anthropic 副 CISO 发布 Agentic AI 风险管理指南

Anthropic 副首席信息安全官发布面向企业安全负责人的 Agentic AI 风险管理指南,提出一个四问题评估框架,旨在帮助安全团队将 Agentic AI 风险控制在可理解、可管理的范围内。

Anthropic 通过其官方博客正式发布了一份由副首席信息安全官 Jason Clinton 撰写的《CISO 的 Agentic AI 指南》。

该指南为企业安全负责人提供了评估和管理内部 Agentic AI 系统风险的核心框架。

即以“摄取何种不可信内容、能执行哪些操作、失控影响范围多大、可观测性如何”这四个问题作为审查起点。

指南强调,对 Agentic AI 的治理并非追求零风险,而是通过落实最小权限、身份隔离、沙箱执行、出口网络白名单及遥测接入 SIEM 等七项控制措施,将风险控制在可理解、可管理且可审计的范围内。

相关链接:

15

AI Security Institute 分析显示开放模型网络能力差距缩至4-7个月

AI Security Institute 发布分析指出,开放权重模型与前沿闭源模型的网络能力差距,已从6-10个月缩至4-7个月。以GLM-5.2为例,其相关表现已与Opus 4.5持平。

AI Security Institute 首次公开分析了开放权重与封闭权重模型在前沿网络能力上的差距,当前差距为 4-7个月。

以 GLM-5.2 和 DeepSeek V4-Pro 为例,较 2025年 大部分时间的 6-10个月 明显缩小。

GLM-5.2 在 AISI 的长期网络靶场 “The Last Ones” 上的表现相当于 Opus 4.5。

在较窄的短期任务中则与 Opus 4.6 水平相当。

该研究所指出,先进网络能力正在更快地进入受保护较少的开放模型。

相关链接:

16

美团 LongCat 团队发布 LoHoSearch 搜索 Agent 基准测试

美团 LongCat 团队发布 LoHoSearch 搜索 Agent 基准测试,当前已开源。该测试基于 760 万实体维基百科知识图谱自动生成问题。

美团 LongCat 团队发布名为 LoHoSearch 的搜索 Agent 基准测试,目前数据集与论文已开源。

由于现有 BrowseComp 基准分数已趋近饱和,LoHoSearch 不再使用人工标注,而是基于包含 760 万 实体和 2.65 亿 边的维基百科知识图谱自动生成 544 个覆盖 11 个领域的问题。

对 11 个前沿模型的测试结果显示,最高分仅为 34.74%,最佳上下文策略仅提升 6.8 个百分点,显示其难度大幅高于现有基准。

相关链接:

行业动态

17

Linus Torvalds 明确表态:Linux 不是反 AI 项目

Linus Torvalds 在邮件列表声明 Linux 不是反 AI 项目,反对他人使用 AI 者将被无视。他同时指出,未经人工审查的 AI 自动反馈会增加维护者负担。

Linus Torvalds 近日 在 Linux 内核邮件列表明确表示,Linux 不是反 AI 项目。

AI 是有用的工具,任何反对其他开发者使用 AI 解决方案的人都会被无视。

建议反对者分叉项目或离开。

此次争议起因是 AI 代码审查工具 Sashiko 是否应在人工审查前自动向补丁作者发送反馈。

Torvalds 强调,开发者仍需对代码负责。

而当前未经监督的 AI 邮件属于给维护者增加负担。

开发者 Omar Cornut 提醒该表态并非鼓励盲目提交 AI 生成代码。

相关链接:

18

Databricks宣布新一轮融资 估值达1880亿美元

Databricks宣布新一轮融资,公司估值达 1880亿美元。此轮融资尚未交割,预计将在今年 夏天晚些时候 完成。

Databricks 宣布新一轮融资,公司估值达到 1880亿美元。

此轮融资由 Coatue 领投,官方未披露具体融资金额。

但其他媒体报道称金额约为 30亿美元。

目前该轮融资尚未交割,资金未到账,预计将于 今年夏天晚些时候 完成。

此前在 2026年2月,Databricks 曾完成 50亿美元 融资,当时的估值为 1340亿美元。

相关链接:

19

国家发改委发布《人工智能合作发展行动计划》

国家发改委发布《人工智能合作发展行动计划》,提出涵盖数据供给、算力普惠、开源共享等八项行动。该计划强调面向发展中国家提供普惠智算服务与数智能力建设支持。

国家发展和改革委员会发布《人工智能合作发展行动计划》,规划了全球人工智能合作路径。

计划包含优质数据供给、智能算力普惠、开源生态共享、深度赋能、数智人才共育、规则标准共建、安全治理协作及向善八大行动。

重点提出推进数据跨境流动与面向发展中国家提供普惠智算服务,支持各国基于开源模型开展本土化创新。

计划还强调协同制定开源合规与安全准则,共建人工智能伦理准则体系,并服务联合国2030可持续发展目标。

相关链接:

前瞻与传闻

20

报道称,智谱ARR突破10亿美元,半年增长15倍

据报道,智谱的年度经常性收入已突破 10亿美元 大关,实现这一里程碑仅用了 5 个月。智谱官方目前对此未予置评。

据《智能涌现》报道,智谱的年度经常性收入(ARR)近期突破 10亿美元。

其 ARR 从 1亿美元 增长至 10亿美元 仅耗时约 5个月,同期增长率高达 15倍。

该高速增长主要受市场对其模型编程能力的强劲需求驱动,期间其 API 虽有多次提价,但调用量依旧激增。

智谱因此成为全球 ARR 增速最快的大模型公司之一。

相关链接:

21

ZCode预告Agent浏览器与电脑控制能力

ZCode宣布即将推出浏览器控制和电脑控制功能,Agent将能导航、点击、输入与运行任务。

ZCode官方宣布即将引入浏览器控制和电脑控制功能。

官方称功能上线后Agent将能进行导航、点击、输入和运行任务。

目前该功能尚未发布。

针对用户提出的“缺乏视觉能力如何实现电脑控制”的疑问,官方尚未回应。

相关链接:

22

Anthropic 或向 Meta 租赁算力,双方仍在谈判中

据报道,Meta 正与 Anthropic 谈判出租数据中心算力。该交易两年内价值或达 100 亿美元,目前 Meta 仍在评估,双方均可能退出。

据 《纽约时报》 报道,Meta 与 Anthropic 正在就 算力租赁 进行谈判,Anthropic 于 6 月 提出该安排。

交易 两年内 价值或高达 100 亿美元,但 Meta 目前仍在评估,双方均有可能退出。

Anthropic 因 Claude Code 需求激增需要额外算力,而 Meta 首席执行官 马克·扎克伯格 此前曾表示可出售过剩算力。

相关链接:


提示:内容由AI辅助创作,可能存在幻觉和错误。

内容来自橘鸦 AI 早报,经作者同意转载阅读原文 ↗视频版哔哩哔哩YouTube