DECOHACK

Juya AI Daily · 橘鸦 AI 早报

AI 早报 2026-10-03

内容来自橘鸦 AI 早报,经作者同意转载阅读原文 ↗视频版哔哩哔哩YouTube
AI 早报 2026-10-03

要闻

1

Tibo 已为所有付费 ChatGPT 账户进行重置

Tibo 表示,已面向所有付费 ChatGPT 账户执行了全局重置。此前 GPT-6.1 Sol 发布后的最初两天因负载激增而运行缓慢,该模型目前已恢复至预期速度。

Codex 负责人 Tibo 表示,面向所有付费 ChatGPT 账户的全局重置已全部生效。他此前预告这项重置将于 10 月 2 日上午 10 时(PST)落地,并为 GPT-6.1 Sol 发布后最初两天因负载激增运行缓慢致歉。他表示,该模型目前已恢复至预期速度。

相关链接:

2

Gemini 未订阅用户将仅可用 Flash-Lite

Google 将调整个人账号在 Gemini 应用中的模型访问。未订阅 AI 方案的用户自 10 月 9 日起仅可使用 Flash-Lite,Flash 模型需 AI Plus 订阅,Pro 模型需 AI Pro 或 AI Ultra。

Google 在 Gemini 应用帮助文档中说明,自 2026 年 10 月起,个人账号访问 Gemini 应用时的模型可用情况将变更,未订阅 AI 方案的用户自 10 月 9 日起仅可使用 Flash-Lite。

AI Plus 订阅者此后可使用 Flash-Lite 与 Flash,Pro 模型需 AI Pro 或 AI Ultra 订阅,AI Plus 用户将收到邮件说明变更对其生效的时间。

相关链接:

3

Andrej Karpathy 分享理解语言模型输出的技巧

Andrej Karpathy 发文称,随着语言模型自主完成越来越多工作,人们会花更多时间理解模型的输出,工作重心也会更多地转向监督和理解这些结果。他建议让模型用ASD-STE100 受控语言解释问题,或者用图表、网页和讲解视频等形式帮助理解模型输出。

Andrej Karpathy 在 X 发文表示,随着语言模型能力提升,人们会花多得多的时间理解模型的输出,工作重心也会更多地转向监督和理解这些结果。

他建议让模型用 ASD-STE100 受控语言解释问题。这套规范最初用于航空航天维护文档,要求较严格,因此他有时只要求模型向规范靠拢八成。

他还建议让模型生成图表和交互网页,最看好能按任意主题定制的讲解视频,并称这种做法已开始见效。

他认为,随着智能和代码越来越充足,可以让模型生成网页应用、讲解视频等大型一次性定制产物,而这些产物以前往往不值得专门制作。

相关链接:

开发生态

4

Claude Code 新增 You should Know 插件

ClaudeDevs 宣布为 Claude Code 添加新插件 You should Know。该插件会派生一个 sideagent 观察 Claude 的输出,提示用户可能漏看的重要信息。

Anthropic 开发者账号 ClaudeDevs 宣布为 Claude Code 添加新插件 You should Know。

据其介绍,插件会扫描 Claude 的输出,找出用户可能忽略的重要信息,帮助用户掌握进展。

You should Know 以 mod 形式实现,通过派生一个 sideagent 观察 Claude 的输出来工作。

用户可在 Claude Code 中运行 /plugin enable cc-plugin-you-should-know@builtin 启用。

相关链接:

5

CodeBuddy 国内独家接入 Space Bunny

CodeBuddy 与 WorkBuddy 宣布在国内独家接入 Space Bunny,将其作为内置模型提供。2026 年 10 月 2 日至 10 月 7 日期间可享限时折扣。

据微信公众号文章介绍,CodeBuddy 与 WorkBuddy 在国内独家接入 Space Bunny,将其作为内置模型提供。

文章称,Space Bunny 是一款匿名 Flash 大模型,推理速度快,编码能力强,原生支持文本、图像和视频输入,思考深度可调,上下文长达 1M。

文章还提到,2026 年 10 月 2 日至 10 月 7 日期间可享限时折扣0.03x倍率。

相关链接:

6

OpenCode 宣布 Ling-3.1-flash 免费开放

OpenCode 宣布,Ling-3.1-flash 现已在其平台免费提供。OpenCode 介绍,这是 inclusionAI 的最新模型。

OpenCode 宣布,inclusionAI 的模型 Ling-3.1-flash 现已在 OpenCode 上免费提供。OpenCode 介绍,这是 inclusionAI 的最新模型。

参数方面,该模型总参数量为 560B,激活参数为 25B,免费期间上下文窗口为 262K。

相关链接:

7

Cua Spaces 上线 macOS:供 AI agent 操作的沙箱应用

Cua 推出桌面应用 Cua Spaces,已上线 macOS 版,免费且源码可用。它用来创建和管理叫作 Space 的沙箱虚拟电脑,AI agent 可在其中直接执行任务。

Cua 在 X 上宣布推出桌面应用 Cua Spaces,当天在 macOS 上线,可从官网下载,免费且源码可用。

它用于创建和管理 Space,即运行 cua-spacesd 的沙箱虚拟电脑,AI agent 可在其中直接操作,权限预先授予、工具预先安装,macOS 镜像在本机构建,Linux 镜像也可运行。

Teleport 功能把本地应用的会话移入 Space,agent 无需重新登录;读取任何内容前需用户确认,敏感项目需 Touch ID,传入数据默认锁在本机的 Keyvault 中,可指定交给每个 Space 的站点和文件并删除其余。

用户与 agent 共享同一桌面、各有独立光标,可随时介入或交还。

Space 可在本机 Mac、自有的 Mac mini 或 Linux 机器上运行,也可接入自己的云并统一列出、以实时桌面流查看。

相关链接:

8

Meta 开源 Muse Gadgets 硬件项目

Meta 推出开源项目 Muse Gadgets,开放 ESP32 固件和 Linux 设备 SDK,开发者可以把现成开发板或树莓派变成接入 AI 助手 Muse 的自制设备。

Meta 推出开源项目 Muse Gadgets,提供 ESP32 与 Linux 设备 SDK 及配套固件,让开发者自制接入个人 AI 助手 Muse 的硬件,把 Muse 连接到显示屏、按键、传感器和执行器上。

代码以 Apache 2.0 许可证开源,按原样提供、不含担保;每个自制设备需先在官网申请 SDK token,再在 iOS 或 Android 版 Muse 应用中开启开发者模式,与 MuseGadget 前缀的设备配对。

Meta 超级智能实验室产品负责人 Nat Friedman 同步公布了 USB-C 供电的 Home Link,它让 Muse 接入家庭网络并与电视、音箱等设备通信,一批 5000 台预计几周后发货,Muse 订阅者可在官网免费领取,送完即止。

相关链接:

9

llama.cpp 支持决策模型,接口沿用 System One 格式

llama.cpp server 新增决策模型支持,通过新的 systemone 端点提供服务。接口沿用 TypeSafe Jev 模型引入的 System One 格式,现有客户端只需更换 base URL。

llama.cpp server 现已支持决策模型,新增 v1/systemone 端点,ggml-org 发文介绍了这一更新。

开发者发送状态(文本、JSON 或截图)和若干问题,模型单次前向传播即返回各选项的概率,问题分为 choice、score、noul 三类。接口沿用 TypeSafe Jev 模型引入的 System One 格式,现有客户端只需更换 base URL。

官方同时提供 Julia-1、Laya、Kev-4B、lev、OpenJev 五款 GGUF 模型,其中 OpenJev 支持图像输入,采用 CC BY-NC 4.0 许可,其余四款为 Apache 2.0。

用户可从 llama.app 获取最新版,或运行 llama update 更新。

相关链接:

产品应用

10

ChatGPT Finances 功能向美国 Free 和 Go 用户推出

ChatGPT 宣布 Finances 功能正在向美国的 Free 和 Go 用户推出。用户可以通过 Plaid 和 Experian 安全连接账户,让 ChatGPT 基于自己本人的财务信息回答资金和信用方面的问题。

ChatGPT宣布Finances in ChatGPT功能正在向美国的Free和Go用户推出。用户可以通过Plaid和Experian安全连接账户,ChatGPT会基于用户自身的财务信息,帮助其理解资金和信用状况。

官方列举的功能包括查找忘记仍在付费的订阅、发现陌生扣款或可能的重复付款、查看哪些经常性账单上涨、每周收到财务更新,以及了解每月支出的构成。

用户还可以基于实际支出制定预算、追踪信用分并了解其影响因素、探讨还债计划、测算应急基金投入,或用语音讨论换工作对财务的影响。

该功能也支持查看跨账户的投资组合构成,并探讨一笔大额购买是否合乎预算。

相关链接:

技术与洞察

12

剑桥 CASP 发布研究:评估智能爆炸的证据与政策应对

剑桥大学 AI 科学与政策项目 发布研究文章,评估自动化 AI 研发是否会触发智能爆炸,Geoffrey Hinton、Yoshua Bengio 等多位研究者署名。文章称初步证据显示这有可能发生,并预计 AI 系统几年内将自动化大部分研发工作,甚至可能是全部。

剑桥大学 AI 科学与政策项目 CASP 发布研究文章,评估自动化 AI 研发触发智能爆炸的证据、潜在影响与政策应对,署名作者包括 Geoffrey Hinton、Yoshua Bengio、Dawn Song 等人。

文章称,与一年前相比,AI 系统现在已编写构建这些系统的公司内部的大部分代码;随着研发流程更多被自动化,AI 进展可能在智能爆炸中急剧加速,数年进展被压缩为数月或更短,而初步证据显示这有可能发生。

文章称 AI 系统正走向在几年内自动化大部分 AI 研发工作,甚至可能是全部;若因此触发智能爆炸,可能大幅提前 AI 的益处,但也带来极端风险,包括能力增长远超社会跟进速度、人类失去对超人 AI 系统的控制,以及国家、公司和政府各部门内部及相互之间的权力制衡被严重侵蚀。

作者表示其中仍有很大不确定性,但高风险值得认真关注,建议政策制定者紧急掌握 AI 研发自动化的更多情况,开发引导和约束智能爆炸的方法,并让社会准备适应其影响。

Geoffrey Hinton 10 月 2 日发帖称,递归自我改进引发智能爆炸的想法由来已久,此前并不显得迫近,而现在许多领先研究者认为它可能很快发生。

相关链接:

13

OpenRouter 推出模型路由基准测试页

OpenRouter 上线模型路由基准测试页面,并排比较 7 个模型路由在 6 项基准上的质量、速度和成本。

OpenRouter 推出 Model Router Benchmarks 页面,对 7 个模型路由在 6 项基准上的质量、速度和成本做并排比较,最近一轮测试于 2026 年 10 月 1 日 13:34 UTC 运行。

上线初期覆盖模型混合、模型选择器和模型切换器三类路由,包括 Jev Router、Unbiased Pareto、NVIDIA Switchyard 等。Router Index 按质量 60%、单任务用时 20%、成本 20% 加权为 0 到 10 分,页面滑块可调整权重。

跨基准平均后,路由中 Jev Router 与 Pareto 并列 9.1,每任务成本分别为 0.39 美元和 0.33 美元;参照单模型 GPT-6-Sol 为 9.4。

OpenRouter 提醒路由并非总是更优,切换模型需重建输入缓存,选择逻辑也会增加延迟。

相关链接:

行业动态

14

报道称东芝拟投约 600 亿日元扩建菲律宾 HDD 工厂

据报道,东芝计划投资约 600 亿日元扩建菲律宾生产基地,目标是在 2027 财年内将用于 AI 数据中心的机械硬盘产能提高一倍。

据日经亚洲报道,AI 热潮带动数据存储需求激增,东芝计划在 2027 财年内,将用于 AI 数据中心的机械硬盘 HDD 产能提高一倍,并投资约 600 亿日元扩建菲律宾生产基地。

报道称,这是东芝近五年来首次对 HDD 进行重大投资。除新增产线外,东芝还将引入全新产品线,使单盘存储容量最高提高 40%。

报道还称,按存储容量计算,东芝目前的市场份额仅略超 10%,中期目标是提高到 30%。东芝计划于 2030 年量产 65 TB 级硬盘,并最终推出 100 TB 级产品。

相关链接:

15

AWS CEO 发长文呼吁支持 AI 数据中心建设

AWS 首席执行官 Matt Garman 发文,呼吁公众支持 AI 数据中心建设。他称,全美正在审议超过 100 项数据中心暂停令;如果获批,美国可能输掉 AI 竞赛。亚马逊同时公布数据中心建设承诺,未来五年先在美国新增超过 10 亿美元投入,不再与政府机构签署项目保密协议,每年公开能耗和用水数据等。

AWS 首席执行官 Matt Garman 在亚马逊官网发表逾 3000 词的博文,呼吁公众支持 AI 数据中心建设。他称,全美正在审议超过 100 项数据中心暂停令,若获通过,美国可能输掉 AI 竞赛,后果将持续数代。

博文将亚马逊的既有做法汇总为数据中心建设承诺,包括不再与政府机构签署保密协议,以及每年公开能耗和用水数据。据 The Verge 报道,民主党议员 Jamie Raskin 此前曾就这类保密协议提出追问。

亚马逊同日公布社区投资框架 Built Together,首先在美国推出,未来 五 年新增投入超过 10 亿美元,用于免费社区大学、技能培训、学校和家庭的节能改造,以及由社区自行决定用途的灵活资助。其中,免费社区大学计划预计在未来几个月启动。

相关链接:

16

Anthropic 投入 1 亿美元推出 Claude Frontier Academy

Anthropic 宣布推出 Claude Frontier Academy 培训项目,计划投入 1 亿美元,在 2027 年底前培养 1 万名前沿部署工程师。首批学员来自埃森哲、德勤、麦肯锡、摩根士丹利等企业和咨询公司。

Anthropic 于 10 月 2 日宣布推出 Claude Frontier Academy 培训项目,投入 1 亿美元,目标在 2027 年底前培养 1 万名前沿部署工程师。

首批学员来自埃森哲、贝恩、凯捷、德勤、麦肯锡、摩根士丹利、诺和诺德和澳大利亚联邦银行,培训班已在旧金山、纽约和伦敦开展。

学员先完成为期数天的线下培训和模拟企业部署考核,通过后进入 12 周驻训,回到所在机构主导真实 Claude 项目,期末考核通过可获得认证,首批认证预计 2027 年初产生。

项目面向有 LLM 构建经验的软件工程师,不要求有构建 AI Agent 的经验,由机构提名参加,可向 Anthropic 客户团队或 Partner Account Manager 询问资格。

相关链接:

17

苹果将为 macOS 完全磁盘访问加设额外授权管控

苹果宣布,将为 macOS 的完全磁盘访问权限引入额外管控,用户只有在进行非常明确的操作时才能把这项权限授予应用。苹果表示,部分开发者正以可能危及用户安全的方式使用该权限。苹果还称,随着 AI 智能体的能力与自主性不断增强,这类高级别访问带来的风险将大幅增长。

苹果 10 月 2 日在开发者网站发布通告,宣布将为完全磁盘访问权限引入额外管控,用户只有在非常明确的操作下才能把这项权限授予应用。

苹果表示,该权限本用于支持备份应用在 Mac 上正常运行,但会在很大程度上绕过系统的常规隐私控制;部分开发者正以可能危及用户安全的方式使用它,应用获得授权后可访问文件、邮件、信息甚至浏览历史,通讯类应用还可能影响用户通讯对象的隐私。

据 IT之家报道,此次调整涉及macOS 27等系统,苹果未公布新管控的具体形式、上线时间和适用范围。

苹果称,随着AI 智能体的能力与自主性不断增强,这一级别访问带来的风险将大幅增长,其目标是让用户在充分理解风险后再授权。

相关链接:

18

arXiv 更新限额:提交者每自然月最多两篇

arXiv 在官方博客宣布,自 2026 年 10 月 1 日起更新论文提交限额,每位提交者每个自然月最多提交两篇论文。arXiv 表示,此举是为了公平分配志愿审核员的时间,应对 AI 工具推动下迅速增长的投稿量。

arXiv 在官方博客宣布,自 2026 年 10 月 1 日起更新论文提交限额,适用于所有提交者和所有类别:每位提交者每个自然月最多提交 两篇论文;自 2024 年起实施的三篇有效提交上限继续保留。

arXiv 称,今年 9 月收到 40,363 篇投稿,投稿量在两年内翻倍,并产生近 9,000 张面向员工和审核员的支持工单;审核员观察到,大量 AI 生成的低价值论文和拆分投稿正在涌入。

官方 FAQ 说明,被拒论文也计入当月额度,跨类别投稿一并计算,限额只约束提交者本人,不影响合作者的额度。

相关链接:

前瞻与传闻

19

据报道博通为 Anthropic 筹集 600 亿美元芯片融资

据彭博报道,为博通安排融资的华尔街银团开始筹集 600 亿美元资金,用于为 Anthropic 等公司提供 AI芯片融资。知情人士称,这笔交易尚未正式公布,参与银行即将就其中 420 亿美元的高级担保份额发出银团分销函。

据彭博 10 月 2 日援引知情人士报道,为博通安排融资的华尔街银团开始筹集 600 亿美元,用于为 Anthropic 及其他公司提供 AI 芯片融资,这笔交易尚未正式公布。

报道称,参与银行即将就债务包中 420 亿美元的 A 类高级担保份额发出银团分销函。黑石集团牵头安排 180 亿美元的 B 类次级份额,旗下多只基金已承诺出资 90 亿美元,其余部分计划分销。

相关链接:


提示:内容由AI辅助创作,可能存在幻觉和错误。