DECOHACK

Juya AI Daily · 橘鸦 AI 早报

AI 早报 2026-08-25

开发生态

1

MiniMax与GMI Cloud合作开放M3等模型14天免费访问

MiniMax与GMI Cloud官方宣布,8月24日至9月6日提供14天免费无限制访问,涵盖MiniMax M3及M2.7等模型。

MiniMax 与 GMI Cloud 官方宣布,在 8月24日至9月6日 期间推出为期 14天 的免费无限制访问活动(有反滥用及速率限制机制)。

此次活动涵盖 MiniMax M3 和 MiniMax M2.7 模型,以及 Speech 2.8 和 Music 3.0 功能。

开发者可通过 GMI API 密钥参与。 活动期间内,上述服务不设使用量限制。

相关链接:

2

阿里云云工开物面向高校学生发放Qoder CN专业版

高校学生完成支付宝学生认证后,可在阿里云云工开物领券免费兑换1个月Qoder CN个人专业版Pro,支持多款国内模型,限领1次。

阿里云云工开物面向高校学生推出开学季福利,学生完成支付宝学生认证后可领取300元代金券,用于免费兑换1个月 Qoder CN 个人专业版 Pro。

该专业版支持 Qwen3.8、GLM-5.3、DeepSeek-V4 等多款国内模型服务。

该福利仅限在阿里云下单页面使用代金券抵扣,在 Qoder CN 官网下单无法抵扣。且同一阿里云账号完成认证、领券与下单仅限抵扣 1次。

相关链接:

模型发布

3

Agnes AI 开源 Agnes 2.5 Pro Alpha 多模态推理模型

Agnes AI 开源了 Agnes 2.5 Pro Alpha多模态推理模型,该模型基于 Qwen3.5-397B后训练,支持1M上下文

Agnes AI 发布多模态推理模型 Agnes 2.5 Pro Alpha 模型权重。

该模型为 Qwen3.5-397B 的后训练衍生版本,参数量为 397B,采用 Apache 2.0 许可证。

模型支持 1M token 上下文窗口、65536 输出 token、图像理解、扩展推理与工具调用。

官方称其在八项 Artificial Analysis 评测中有六项优于 Qwen3.5-397B。

相关链接:

4

阿里视频模型Wan3.0正式上线 API限时7折

阿里宣布视频生成模型Wan3.0正式上线,用户可在阿里云百炼、万相官网及千问等 8 个平台体验,API同步开启限时优惠。

阿里视频生成模型 Wan3.0 结束公测正式上线,在生成时长、全能参考与真实世界还原等维度实现升级。

该模型单次视频生成时长达 30秒,首次支持输入 doc、xls、ppt、pdf 及 md 格式文档,并在指令遵循与跨镜头一致性等方面有所提升。

用户可在 阿里云百炼、万相官网及 千问 等 8 个平台体验,API 按分辨率定价为 0.3 至 1.2元/秒,部分平台正推行限时 7折 优惠。

井英科技、美图旗下 RoboNeo 等多家企业已接入该模型。

相关链接:

产品应用

5

OpenAI 推出美国大学生四个月免费 ChatGPT Plus

近期,OpenAI 宣布向符合条件的美国大学生提供四个月免费的 ChatGPT Plus,需在10月31日前验证领取。

OpenAI 推出面向美国大学生的优惠活动,提供价值80美元的四个月免费 ChatGPT Plus。

符合条件美国学位授予机构的全日制与兼职学生需在 10月31日 前通过 SheerID 验证领取。

新用户需添加付款方式激活且免费期内不扣费。

相关链接:

6

Anthropic 升级 Claude 流式渲染器

Anthropic 重建了 Claude 网页端与桌面端流式渲染器,官方称长回答流式输出平滑度现已提升约 4 倍,同时降低了设备卡顿。

Anthropic 重建了 Claude 网页端与桌面端的流式渲染器,使长回答流式输出平滑度提升约 4 倍。

官方称该渲染器目前仅处理仍在变化的内容,从而让慢速笔记本上的长回复卡顿减少 9 倍、最长冻结时间缩短 4.5 倍。

在 120Hz MacBook 上,该功能可维持从头到尾 120fps 的帧率。

相关链接:

行业动态

7

字节整合TRAE与扣子至豆包体系

据媒体报道,字节跳动将TRAE与扣子团队及产品整体并入豆包体系,其中TRAE Work与扣子将与豆包工作场景能力整合,TRAE IDE及CLI作为编程产品线。报道称豆包最快将于本周内推出面向AI办公场景的统一产品和品牌“豆包工作”。

据媒体报道,字节跳动 已完成办公AI产品团队整合。

TRAE 与 扣子 团队整体并入 豆包 体系并向 豆包 产品负责人汇报。

其中 TRAE Work 与 扣子 将与 豆包 工作场景能力整合,TRAE IDE 及 CLI 作为编程产品线。

报道称 豆包 最快 本周内 推出统一AI办公产品 “豆包工作” 并与 飞书 深度整合。

字节 方面回应称调整旨在协同资源且现有用户权益不受影响。

相关链接:

8

小米发布玄戒三款自研芯片并展出AI Cube原型机

小米发布 O3、O100及D100 三款芯片,其中O3已开启规模量产,O100与D100研发完成并计划于明年商用。O3将搭载于小米 18 Fold与小米平板 9 Pro Max并于9月上市或发布,同时官方展出了集成三芯的 AI Cube Prototype原型主机。

在 玄戒芯片 技术沟通会上,小米 发布了 O3、O100 及 D100 三款芯片,均已通过回片验证。

其中 O3 已开启规模量产,O100 与 D100 研发完成并计划于 明年 商用。

据官方数据,O3 作为AI旗舰 SoC,安兔兔跑分达 522万 且首发支持 LPDDR6。O100 为行业首颗 6nm 3D 晶圆级堆叠 AI 加速芯片,且具备 1.22TB/s 近存带宽。D100 为国内首款 3nm 智驾芯片,且最高支持 160GB 统一内存。

O3 将搭载于 小米18 Fold 与 小米平板9 Pro Max 并于 9月 上市或发布。

同时,官方展出了集成三芯且支持 150W 性能释放的 AI Cube Prototype 原型主机,该主机未公布售价与上市时间。

相关链接:

9

SpaceXAI部署NVIDIA Vera CPU并计划发射太空版NVL72

SpaceXAI宣布将部署NVIDIA Vera CPU加速Agent AI,并计划明年四季度发射搭载Vera Rubin NVL72的Starmind卫星入轨。

NVIDIA宣布 SpaceXAI 将部署 NVIDIA Vera CPU 加速其 Agent AI 应用,并扩展支撑 Grok 的 AI 基础设施。

此外,SpaceXAI 正计划将优化后的 Vera Rubin NVL72 延伸至太空。

其首颗 Starmind 卫星预计 明年四季度 发射入轨,并于 2028年 显著扩规。

此举旨在适应轨道环境的同时,保持与地面相同的架构与软件生态。

相关链接:

10

NVIDIA 发布 Vera Rubin NVL72 性能数据

NVIDIA 官方博客发布 Vera Rubin NVL72 系统实测数据,称其在 Agent 工作负载下较 GB300 NVL72 每兆瓦吞吐量提升最高达 30 倍,每百万 token 成本降低最高达 35 倍。

NVIDIA 官方博客公布了 Vera Rubin NVL72 系统的最新实测性能数据,显示该系统在运行 Agent 工作负载时,较 GB300 NVL72 实现最高 30 倍 的每兆瓦吞吐量提升与最高 35 倍 的每百万 token 成本下降。

该测试通过 SemiAnalysis AgentX 工作负载中的真实 Agent 编码轨迹完成,主要针对 DeepSeek V4 Pro 模型测得。

NVIDIA 强调这些结果为早期数据,目前正等待 SemiAnalysis 审查,且尚未反映用于工具调用的 Vera CPU 性能。

官方称 Vera Rubin 已进入全面量产阶段,并正跨生态系统扩展规模。

相关链接:

11

NVIDIA发布全面投产的Groq 3 LPX扩展Vera Rubin推理

NVIDIA 宣布 Groq 3 LPX 全面投产以扩展 Vera Rubin 平台 Agent 推理,并发布网络与基础设施更新。

NVIDIA 宣布交互式 AI 推理加速器 Groq 3 LPX 全面投产。

作为 Vera Rubin NVL72 平台的扩展,该加速器专为 Agent 系统提供超快 Token 生成。

官方基准测试显示,运行 Gemma 4 31B 模型及 10万 Token 上下文时,其输出达每秒 3400 个 Token。

其速度为最接近替代平台的 4 倍。

Nebius 成为首个采用该加速器的 AI 云服务商。

相关链接:

12

传Nvidia拟投资Perplexity AI数十亿美元

据媒体援引消息人士报道, Nvidia 正商谈向 Perplexity AI 投资数十亿美元并磋商技术授权,该轮融资估值超 300 亿美元。

据媒体报道,Nvidia正商谈在Perplexity AI最新股权融资轮中向其投资数十亿美元,双方还在磋商技术授权协议。

此轮融资对Perplexity AI的估值超过300亿美元,其年化营收已从2026年初的不到2.5亿美元增至7.5亿美元以上。

相关链接:

13

Mistral AI 与 HUMAIN 布局中东主权 AI 基建

Mistral AI与HUMAIN宣布战略协作,将在沙特及中东开发阿拉伯语前沿模型与部署AI基建,合作规模达数亿欧元。

Mistral AI与沙特阿拉伯公共投资基金全资子公司HUMAIN宣布达成战略协作,涵盖AI基础设施、先进模型开发及AI解决方案在沙特及中东地区的部署。

双方将本地化先进AI模型,初期聚焦网络安全与语音,并计划开发阿拉伯语表现强劲的前沿模型。

合作规模达数亿欧元。

Mistral AI将探索使用HUMAIN的数据中心,并计划在沙特针对受监管行业制定联合市场战略。

官方声明此为前瞻性表述,实际结果可能存异。

相关链接:

14

Thinking Machines Lab发布开源模型安全资助

Thinking Machines Lab发布Tinker资助计划,为开源权重模型安全研究提供最高5万美元算力额度。

Thinking Machines Lab 启动 Tinker 资助计划,为开源权重模型的安全研究提供最高 5 万美元 的算力额度。

该计划重点关注三大领域:使模型更安全地开源、理解 对齐失败模式 以及测量与预测风险。

具体涵盖 防御主导能力训练、危险数据分类器构建、防篡改安全训练 及 涌现性不对齐 等方向。

相关链接:


提示:内容由AI辅助创作,可能存在幻觉和错误。

内容来自橘鸦 AI 早报,经作者同意转载阅读原文 ↗视频版哔哩哔哩YouTube