DECOHACK

Juya AI Daily · 橘鸦 AI 早报

AI 早报 2026-09-02

要闻

1

Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1

Anthropic 发布了 Claude Fable 5.1 和 Claude Mythos 5.1。Fable 5.1 已全面开放,强化编程、知识工作、计算机操作和长时间 Agent 任务;Mythos 5.1 则通过可信访问计划开放。Fable 5.1 输入、输出单价较前代不变,缓存读取价格下降 75%,官方称典型工作负载预计节省约 25%。与此同时,Anthropic 调整了安全机制,Claude Code 的网络安全防护干预约减少 60%,基础生物和医疗正常请求的安全触发约减少 85%;此外还加入企业 EFS、反蒸馏机制和文本水印,发布当天重置了所有用户的 5 小时及每周额度。

Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1,两者使用同一模型,但安全限制不同:Fable 5.1 已全面开放,Mythos 5.1 则面向经过验证的网络安全和生命科学机构,通过可信访问计划提供。

Fable 5.1 重点提升编程、知识工作、计算机操作和长时间 Agent 任务,能在需要人工介入前持续执行更久,更容易主动说明受阻状态,写作风格也更自然;Terminal-Bench 4.0 得分从 Fable 5 的 42.0% 提升至 55.8%,Terminal-Bench-Science 0.1 达到 52.6%。

科研方面,Anthropic 展示了模型设计高亲和力蛋白质结合物、生成更高分辨率金星地形图,以及将 7 个开源生物学模型最高加速 2.5 倍等成果。

价格方面,输入、输出单价较前代不变,缓存读取价格下降 75% 至每百万 token 0.25 美元,典型工作负载预计节省约 25%,高度 Agent 化任务最高约 45%。

安全机制也更精细:Fable 5.1 可用于发现软件漏洞,Claude Code 的网络安全干预预计减少约 60%,基础生物和医疗正常请求的安全触发减少约 85%,同时加强新 API 账户的反蒸馏限制。

此外,Anthropic 推出 Enterprise Frontier Safeguards(EFS),让企业数据保存在自身控制的云基础设施中,并将从今年秋季起分阶段上线。

新模型还按欧盟 AI 法案相关要求加入不可见文本水印,并推出检测 API 私有预览。配合 Fable 5.1 发布,官方同时重置了所有用户的 5 小时和每周使用额度。

相关链接:

2

OpenAI 宣布 Astra 即将发布

OpenAI 宣布新模型 Astra 很快将开放使用,但将限制其最先进网络安全能力的初期开放,后续再通过 Daybreak Blue 扩大防御性使用。官方称,这是其首个达到网络安全“Critical”门槛的模型,可发现未知漏洞并开发利用方式;官方测试中,它在 ExploitBench 获得 100%,还发现两个零日漏洞,并完成浏览器沙箱逃逸和系统提权链。OpenAI 已强化拒答、监控和对齐机制。

OpenAI 宣布正准备发布新模型 Astra,并发布博文《Path to Astra》介绍称,Astra 是其首个达到 Preparedness Framework 网络安全 “Critical”门槛 的模型,在配合相应工具和权限时,可发现未知安全漏洞并开发利用方式。

官方评测中,Astra 在 ExploitBench 获得 100%,内部测试还发现并利用了两个 零日漏洞。

专家测试中,它完成了 浏览器沙箱逃逸 以及从普通用户到 root 的 操作系统提权链。

为准备发布,OpenAI 推迟了 Astra 的部分开发和发布工作,并强化模型拒答、系统安全分类、训练基础设施隔离、跨会话监控及未授权行为检测。

对齐测试中,Astra 更能遵守安全限制和授权范围,并将配套推理与行为监控用于生产环境。

Astra 计划 近期 开放,但最先进的网络安全能力初期仅提供给部分测试者,随后通过 Daybreak Blue 扩大防御性使用。

安全系统也可能暂停或终止被判定存在风险的正常任务。

相关链接:

3

Gemini 3.7 Flash 等三款模型上线 Agentic 视频理解

Google 宣布为 Gemini 3.7 Flash 等模型上线 Agentic 视频理解,模型可自主决定观看哪些片段、以什么方式观看。官方称长视频分析 token 最高减少 88%、成本最高降低 66%,功能现已开放 API 调用。

Google 官方宣布为 Gemini 3.7 Flash、Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 推出 Agentic 视频理解能力,目前已通过 Gemini API 在 Google AI Studio 和 Gemini Enterprise Agent Platform 上线,支持视频上传和 YouTube 视频。

与默认以 1 FPS 固定帧率整体读入视频的静态处理不同,模型可自主决定观看哪些片段、以什么速度、通过视觉帧、音频还是字幕获取信息。

根据官方公布的评测数据,token 消耗最高减少 88%,分析成本最高降低 66%,准确度最高提升 7%,且在长视频上收益尤为明显。

开发者只需在 API 配置中将视频的 processing 参数设为 agentic 即可启用,按标准 token 计费,无额外功能费用。

该能力即将面向 Gemini 应用所有用户推出,并将在未来数月内支撑 YouTube 视频观看页的 Ask YouTube 功能。

相关链接:

开发生态

4

智谱庆祝 GLM Coding Plan 一周年向订阅用户发放重置卡

智谱宣布为庆祝 GLM Coding Plan 上线满一周年,已向每位当前订阅用户发放一张重置卡。用户可在控制台用量统计页面查收使用,有效期至 2026 年 10 月 1 日。

智谱 旗下 GLM Coding Plan 上线满一周年,官方宣布向每位当前订阅用户发放一张重置卡。

这张重置卡可用于补满周配额和 5 小时配额。

智谱 官方运营表示这次不用赶时间,什么时候执行重置由用户自行决定。

用户可在「控制台 - 用量统计」中查收重置券,有效期至 2026年10月1日。

相关链接:

5

Ollama 订阅方案改按 token 计费

Ollama宣布订阅套餐改为按token计费,Pro月付20美元含60美元用量,Max 每月 100美元 含 300美元用量。老用户可随时升级至新计费方式。

Ollama 宣布 Pro、Max 和 Team 订阅方案改用透明按 token 计费。

每个方案每月附带一池用量额度,按定价页公示的每百万 token 价格消耗。

Pro 每月 20 美元含 60 美元用量。

Max 每月 100 美元含 300 美元用量。

Team 每月 500 美元含不限人数共享的 1000 美元用量。

免费方案每月含少量入门模型用量,充值后可按需解锁全部模型。

现有 Pro、Max、Team 用户原方案继续有效,可随时在账户设置中升级。

新注册用户直接使用新方案。

官方称新定价无服务费、无 5 小时或每周限制,额度用完后可按相同 token 价格继续使用。

Ollama 还表示正在开发错峰定价。

相关链接:

模型发布

6

World Labs 发布世界模型 Atlas,统一架构覆盖生成、重建与时空模拟

World Labs 发布世界模型 Atlas,原生支持文本、图像、视频与 3D 输入。官方称其视频生成与 3D 重建超越多个专用模型,将在未来几周开放早期访问。

World Labs 发布新一代世界模型 Atlas。

该模型从零预训练,原生处理文本、图像、视频和 3D,采用 多模态自回归扩散 Transformer 架构,将所有输入整合进共享空间上下文并生成与已见内容保持 3D 一致的输出。

Atlas 支持以精确相机控制从一到六张输入图像生成最长 1 分钟 的 1440p 视频,也能以少至两三张图像重建真实场景并输出点云或 3D Gaussian splats。

它还支持视频重新取景、机器人 Real-to-Sim 以及文生图与 360 全景。

官方基准显示,其在相机控制生成和稀疏视角 3D 重建上均超过多个专用模型。

目前 Atlas 正面向特定合作伙伴进入早期访问,官方称将在未来几周开放早期访问,并将在未来驱动 Marble 等产品。

相关链接:

7

Meta 发布实时音频感知模型 Muse Voice Transcribe

Meta 超级智能实验室推出首个实时音频感知模型 Muse Voice Transcribe,官方称其流式语音转写与公开说话人分离基准均排名第一。模型现已在 Meta Model API、Meta AI for Mac 和 Muse Code 上线。

Meta 超级智能实验室发布旗下首个实时音频感知模型 Muse Voice Transcribe,现已正式推出。

该模型在单一模型内原生提供实时流式 ASR、支持 20 多名说话人的分离以及端点检测,支持多语言与句内语码转换,并可通过语言、关键词和上下文偏置提升准确率。

官方称该模型在 Artificial Analysis 流式语音转文字榜及公开说话人分离基准上排名第一。

模型已在 Meta Model API 上线并提供零数据保留层级。 Meta AI 与 Muse Code 中的语音听写也已由其驱动,用户通过 Meta AI for Mac 和 Muse Code 即可使用。

相关链接:

8

讯飞星火开源星火X2.5端侧模型

讯飞星火开源了星火X2.5-4B和1.7B两款端侧模型,官方称基于全国产算力平台完成训练,原生支持最长100万Token上下文,对应模型API已上线讯飞星辰MaaS平台并提供限时免费调用。

科大讯飞词元星火正式推出并开源 星火X2.5-4B 和 星火X2.5-1.7B 两款端侧通用大模型,模型权重、代码仓库和部署文档已在 Hugging Face、GitHub 等平台开放。

官方称这是端侧模型中首个原生支持最长 100 万 Token 上下文的模型,采用混合注意力架构,围绕智能体、代码、数学和指令遵循等能力优化。

根据官方数据,星火X2.5-4B 在 SWE-Bench Pro、AIME 2026 等多项测试中取得同尺寸领先成绩。

两款模型基于全国产算力平台完成训练,支持 英伟达、华为、海光、后摩 等硬件,兼容 vLLM、SGLang、llama.cpp 等推理框架,可通过 Ollama、LM Studio 部署,许可证为 Apache 2.0。

对应模型 API 已上线 讯飞星辰 MaaS 平台,限时免费。

相关链接:

9

Celeris 推出混合扩散模型 Celeris-1 Magnus

Celeris 发布混合扩散模型 Celeris-1 Magnus,官方称其基于 qwen3.8-27b 衍生、针对 Agent 工作负载优化,现已上线 API。

Celeris 发布了面向 Agent 工作负载的 Celeris-1 Magnus 模型。

Celeris 官方称,Magnus 是一款基于 qwen3.8-27b 衍生的混合扩散模型,在此基础上针对 Agent 场景进行了优化。

其重点支持原生推理、多步工具调用、代码执行以及需要持续获取外部信息的复杂任务。

官方称其在 τ³-Banking 基准解决率 41.2%,超过 gpt-5.6-sol。

现已面向所有 API 用户开放。

相关链接:

10

Abliteration.ai 发布 GLM-5.3 abliterated 版模型

Abliteration 发布并上线基于 GLM-5.3 的 abliterated-model-large-v2,官方称该模型移除了拒绝行为、保留编码与 Agent 能力,现已提供API。

Abliteration.ai 发布基于 GLM-5.3 的 abliterated-model-large-v2,目前已上线并以 API 形式提供服务。

官方介绍,Abliteration.ai 会定位模型激活中产生拒绝的方向并从权重中移除。

编码、网络安全和 Agentic 能力保留,模型不会再在任务链中途拒绝。

相关链接:

11

腾讯混元发布 Hy4 preview 轻量版(量化版)

腾讯混元为旗舰模型Hy4 preview推出轻量版(量化版),用自研Sherry稀疏三值量化算法和混合精度策略,把约1.5TB的权重压缩到约214GB,能力基本保持,量化GGUF已开源。

腾讯混元为旗舰模型 Hy4 preview 推出轻量版。

通过 Sherry 稀疏三值量化算法和 MIX-STQ1_0 混合精度策略,把约 1.5TB 的模型权重压缩到约 214GB,压缩幅度约 86%。

腾讯混元的测试结果显示,压缩版在长文理解、多轮长上下文检索上与原版基本处于同一水平,数学有小幅回落,多个主流评测集与 BF16 原版差距在一两分以内,整体领先社区常用的 UD-IQ1_M 量化方案。

量化 GGUF 已发布在 Hugging Face 的 AngelSlim 仓库,共三个版本。

其中 STQ1_0 版体积 213.66 GiB。

仓库明确这些文件无法在原版 llama.cpp 上直接运行,需先应用仓库提供的补丁。

STQ1_0 版全量驻留显存约需 214GB。

相关链接:

产品应用

12

Google 推出图像创作与编辑工具 Google Pics

Google 推出图像创作与编辑工具 Google Pics,基于 Nano Banana 模型。该工具将在未来几周内面向 Google AI Pro 和 Ultra 订阅用户及多数 Workspace 商业客户推出。

Google 在官方博客宣布,来自 Google Workspace 的图像创作与编辑工具 Google Pics 目前正陆续推出。

Google Pics 基于 Nano Banana 图像生成与编辑模型构建,将同时以独立产品和 Workspace 应用集成两种形式提供,集成率先覆盖 Docs 和 Slides,Drive 将在未来几周内跟进。

功能上,Google Pics 支持对象分割、图像内文字编辑与翻译、多人协作编辑,以及单次提示生成多个图像选项。

根据官方说明,该工具将在 未来几周内 覆盖所有 Google AI Pro 和 Ultra 订阅用户以及大多数 Workspace 商业客户,用户可通过 pics.new 试用。

相关链接:

13

OpenAI 上线 ChatGPT 礼品卡:仅限美国美元账户网页端兑换

OpenAI 上线了OpenAI礼品卡,目前可在部分授权零售商购买数字版。兑换仅限美国地区美元结算账户,余额只能用于 ChatGPT 网页端订阅、续费和购买额度。

OpenAI 在官方帮助中心说明 ChatGPT 礼品卡的购买与兑换规则。

礼品卡为美元计价、不可充值的储值卡,目前可在部分授权零售商购买数字版。

兑换和使用仅限美国地区、美元结算的 ChatGPT 账户,余额可用于订阅、续费、升级和额度购买,但不能支付 Apple App Store 或 Google Play 的交易。

ChatGPT Free、Go、Plus、Pro 以及 Business 工作区所有者可使用兑换,兑换需受账户余额和每日充值上限约束。

相关链接:

行业动态

14

Manus 宣布正式恢复独立运营,创始团队继续领导公司

Manus 官方宣布正式恢复独立运营,创始团队继续领导公司,持续投入产品创新并面向全球用户推进通用 AI Agent。

Manus 在官方博客和官方账号宣布,公司已正式恢复独立运营,创始团队将继续领导公司,持续投入产品创新并面向全球用户推进通用 AI Agent。

Manus 表示,作为独立 agent lab,接下来会让 Manus 更深度地嵌入用户日常工作流程、更直接地与世界交互,并更主动地代表用户行动。

此前过渡期间,部分用户需要备份和恢复数据,并经历了访问的临时中断。

已备份但尚未恢复的用户可通过恢复门户完成恢复,官方称没有截止期限,未受影响的用户无需采取任何操作。

相关链接:

15

Anthropic 推出 Enterprise Frontier Safeguards

Anthropic 官方宣布推出 Enterprise Frontier Safeguards,一套结合零数据保留与自动化滥用监测的企业级安全方案,将自今年秋季起分阶段向客户开放。

Anthropic 发布企业前沿安全防护方案 Enterprise Frontier Safeguards(EFS),官方称其将零数据保留的隐私性与用于检测滥用的安全防护相结合。

该方案与超过 100 家金融、医疗、制造、电信、法律、零售及公共部门领域的客户,以及 AWS、Google Cloud 和 Microsoft Azure 共同开发。

EFS 的核心是活动数据存储在客户自有云账户中,由客户管理加密密钥、访问策略和审计日志;自动监测发现可疑信号后直接发送给客户,由客户团队进行复核,无需 Anthropic 员工进行人工审查。

客户自有的存储、客户托管加密密钥和全自动审查均为可选功能,不会改变模型行为、API 定价或速率限制;Anthropic 不对 EFS 收费,客户自行承担云存储及读写、数据流出费用。

EFS 将支持 Claude Code、Claude Enterprise、Claude Platform、Amazon Bedrock、Claude Platform on AWS、Google 的 Agent Platform 和 Microsoft Foundry,计划自今年秋季起分阶段推出并逐步扩大可用范围。

相关链接:

16

消息称 Anthropic 与 Lambda 签署 350 亿美元云计算协议

据知情人士透露,Anthropic与受英伟达投资的云服务商Lambda签署350亿美元云计算协议,租用得克萨斯州容量约350兆瓦的数据中心,以扩大AI算力应对Claude需求增长。

据知情人士透露,Anthropic 已与获 英伟达 投资的云服务商 Lambda 签署价值 350 亿美元 的云计算协议,以快速扩大自身 AI 算力。

该协议对应位于得克萨斯州努埃塞斯县、由 Hut 8 开发的数据中心,容量约 350 兆瓦。

报道还提到,Lambda 将部署 英伟达芯片 为 Anthropic 提供云服务,以应对 Claude 需求增长。

相关链接:


提示:内容由AI辅助创作,可能存在幻觉和错误。

内容来自橘鸦 AI 早报,经作者同意转载阅读原文 ↗视频版哔哩哔哩YouTube