AI 早报 2026-08-25

本页合并来源:Juya AI 早报 + AI HOT 日报。Juya 保留完整精选,AI HOT 作为补充来源;已按链接和标题做基础去重。

概览

Juya · 开发生态

  • MiniMax与GMI Cloud合作开放M3等模型14天免费访问 #1
  • 阿里云云工开物面向高校学生发放Qoder CN专业版 #2

Juya · 产品应用

  • OpenAI 推出美国大学生四个月免费 ChatGPT Plus #3
  • Anthropic 升级 Claude 流式渲染器 #4

Juya · 模型发布

  • Agnes AI 开源 Agnes 2.5 Pro Alpha 多模态推理模型 #5
  • 阿里视频模型Wan3.0正式上线 API限时7折 #6

Juya · 行业动态

  • 字节整合TRAE与扣子至豆包体系 #7
  • 小米发布玄戒三款自研芯片并展出AI Cube原型机 #8
  • SpaceXAI部署NVIDIA Vera CPU并计划发射太空版NVL72 #9
  • NVIDIA 发布 Vera Rubin NVL72 性能数据 #10
  • NVIDIA发布全面投产的Groq 3 LPX扩展Vera Rubin推理 #11
  • 传Nvidia拟投资Perplexity AI数十亿美元 #12
  • Mistral AI 与 HUMAIN 布局中东主权 AI 基建 #13
  • Thinking Machines Lab发布开源模型安全资助 #14

AI HOT 补充

  • GPT-5.6 登陆 Kiro,为开发者提升性价比 #A1
  • NVIDIA Vera Rubin NVL72 树立 AI 智能体效率新标准:每瓦特工作量提升至 30 倍 #A2
  • MetaRoCE:为 AI 规模以太网打造的全新 RDMA 传输协议 #A3
  • NVIDIA 如何用 NVLink Fusion 让定制 XPU 融入世界级 AI 工厂 #A4
  • MTIA 300:Meta 首款内置 NIC 与通信卸载引擎的训练芯片 #A5
  • NVIDIA 扩展 Vera Rubin 推理能力,Groq 3 LPX 全面投产支持智能体系统 #A6
  • Mistral 与 HUMAIN 达成战略合作,推进沙特及中东主权 AI #A7
  • 丰田北美如何用 Deep Agents 和 LangSmith 规模化企业 AI #A8
  • Beyond Visual CoT:Internalized Visual Thinking 实现主动视频推理 #A9
  • OpenAI 正为一切构建 AI 智能体,但用户会愿意交出控制权吗? #A10
  • ADK 如何评估实时语音智能体 #A11
  • Databricks 如何从本地 IDE 运行、调试和扩展工作负载 #A12

Juya 早报精选

开发生态

MiniMax与GMI Cloud合作开放M3等模型14天免费访问 #1

MiniMax与GMI Cloud官方宣布,8月24日至9月6日提供14天免费无限制访问,涵盖MiniMax M3及M2.7等模型。

MiniMax与GMI Cloud官方宣布,在8月24日至9月6日期间推出为期14天的免费无限制访问活动(有反滥用及速率限制机制)。此次活动涵盖MiniMax M3和M2.7模型,以及Speech 2.8和Music 3.0功能。开发者可通过GMI API密钥,活动期间内上述服务不设使用量限制。

相关链接:


阿里云云工开物面向高校学生发放Qoder CN专业版 #2

高校学生完成支付宝学生认证后,可在阿里云云工开物领券免费兑换1个月Qoder CN个人专业版Pro,支持多款国内模型,限领1次。

阿里云云工开物面向高校学生推出开学季福利,学生完成支付宝学生认证后可领取300元代金券,用于免费兑换1个月Qoder CN个人专业版Pro。该专业版支持Qwen3.8、GLM-5.3、DeepSeek-V4等多款国内模型服务。该福利仅限在阿里云下单页面使用代金券抵扣,在Qoder CN官网下单无法抵扣,且同一阿里云账号完成认证、领券与下单仅限抵扣1次。

相关链接:


产品应用

OpenAI 推出美国大学生四个月免费 ChatGPT Plus #3

近期,OpenAI 宣布向符合条件的美国大学生提供四个月免费 ChatGPT Plus,需在10月31日前验证领取。

OpenAI 推出面向美国大学生的优惠活动,提供价值80美元的四个月免费 ChatGPT Plus。符合条件美国学位授予机构的全日制与兼职学生需在10月31日前通过 SheerID 验证领取。新用户需添加付款方式激活且免费期内不扣费。

相关链接:


Anthropic 升级 Claude 流式渲染器 #4

Anthropic 重建了 Claude 网页端与桌面端流式渲染器,官方称{长回答|"常回答"}流式输出平滑度现已提升约 4 倍,同时降低了设备卡顿。

Anthropic 重建了 Claude 网页端与桌面端的流式渲染器,使长回答流式输出平滑度提升约 4 倍。官方称该渲染器目前仅处理仍在变化的内容,从而让慢速笔记本上的长回复卡顿减少 9 倍、最长冻结时间缩短 4.5 倍。在 120Hz MacBook 上,该功能可维持从头到尾 120fps 的帧率。

相关链接:


模型发布

Agnes AI 开源 Agnes 2.5 Pro Alpha 多模态推理模型 #5

Agnes AI 开源了 Agnes 2.5 Pro Alpha多模态推理模型,该模型基于 Qwen3.5-397B后训练,支持1M上下文

Agnes AI 发布多模态推理模型 Agnes 2.5 Pro Alpha 模型权重,该模型为 Qwen3.5-397B 的后训练衍生版本,参数量为 397B,采用 Apache 2.0 许可证。模型支持 1M token 上下文窗口、65536 输出 token、图像理解、扩展推理与工具调用。官方称其在八项 Artificial Analysis 评测中有六项优于 Qwen3.5-397B。

相关链接:


阿里视频模型Wan3.0正式上线 API限时7折 #6

阿里宣布视频生成模型Wan3.0正式上线,用户可在阿里云百炼、万相官网及千问等8个平台体验,API同步开启限时优惠。

阿里视频生成模型Wan3.0结束公测正式上线,在生成时长、全能参考与真实世界还原等维度实现升级。该模型单次视频生成时长达30秒,首次支持输入doc、xls、ppt、pdf及md格式文档,并在指令遵循与跨镜头一致性等方面有所提升。用户可在阿里云百炼、万相官网及千问等8个平台体验,API按分辨率定价为0.3至1.2元/秒,部分平台正推行限时7折优惠。井英科技、美图旗下RoboNeo等多家企业已接入该模型。

相关链接:


行业动态

字节整合TRAE与扣子至豆包体系 #7

据媒体报道,字节跳动将TRAE与扣子团队及产品整体并入豆包体系,其中TRAE Work与扣子将与豆包工作场景能力整合,TRAE IDE及CLI作为编程产品线。报道称豆包最快将于本周内推出面向AI办公场景的统一产品和品牌“豆包工作”。

据媒体报道,字节跳动已完成办公AI产品团队整合,TRAE与扣子团队整体并入豆包体系并向豆包产品负责人汇报,其中TRAE Work与扣子将与豆包工作场景能力整合,TRAE IDE及CLI作为编程产品线。报道称豆包最快本周内推出统一AI办公产品“豆包工作”并与飞书深度整合。字节方面回应称调整旨在协同资源且现有用户权益不受影响。

相关链接:


小米发布玄戒三款自研芯片并展出AI Cube原型机 #8

小米发布 O3、O100及D100 三款芯片,其中O3已开启规模量产,O100与D100研发完成并计划于明年商用。O3将搭载于小米18 Fold与小米平板9 Pro Max并于9月上市或发布,同时官方展出了集成三芯的AI Cube Prototype原型主机。

小米在玄戒芯片技术沟通会上发布O3、O100及D100三款芯片,均已通过回片验证,其中O3已开启规模量产,O100与D100研发完成并计划于明年商用。据官方数据,O3作为AI旗舰SoC安兔兔跑分达522万且首发支持LPDDR6,O100为行业首颗6nm 3D晶圆级堆叠AI加速芯片且具备1.22TB/s近存带宽,D100为国内首款3nm智驾芯片且最高支持160GB统一内存。O3将搭载于小米18 Fold与小米平板9 Pro Max并于9月上市或发布,同时官方展出了集成三芯且支持150W性能释放的AI Cube Prototype原型主机,该主机未公布售价与上市时间。

相关链接:


SpaceXAI部署NVIDIA Vera CPU并计划发射太空版NVL72 #9

SpaceXAI宣布将部署NVIDIA Vera CPU加速Agent AI,并计划明年四季度发射搭载Vera Rubin NVL72的Starmind卫星入轨。

NVIDIA宣布SpaceXAI将部署NVIDIA Vera CPU加速其Agent AI应用,并扩展支撑Grok的AI基础设施。此外,SpaceXAI正计划将优化后的Vera Rubin NVL72延伸至太空,其首颗Starmind卫星预计明年四季度发射入轨并于2028年显著扩规,旨在适应轨道环境的同时保持与地面相同的架构与软件生态。

相关链接:


NVIDIA 发布 Vera Rubin NVL72 性能数据 #10

NVIDIA 官方博客发布 Vera Rubin NVL72 系统实测数据,称其在 Agent 工作负载下较 GB300 NVL72 每兆瓦吞吐量提升最高达 30 倍,每百万 token 成本降低最高达 35 倍。

NVIDIA 官方博客公布了 Vera Rubin NVL72 系统的最新实测性能数据,显示该系统在运行 Agent 工作负载时,较 GB300 NVL72 实现最高 30 倍的每兆瓦吞吐量提升与最高 35 倍的每百万 token 成本下降。该测试通过 SemiAnalysis AgentX 工作负载中的真实 Agent 编码轨迹完成,主要针对 DeepSeek V4 Pro 模型测得。NVIDIA 强调这些结果为早期数据,目前正等待 SemiAnalysis 审查,且尚未反映用于工具调用的 Vera CPU 性能。官方称 Vera Rubin 已进入全面量产阶段,并正跨生态系统扩展规模。

相关链接:


NVIDIA发布全面投产的Groq 3 LPX扩展Vera Rubin推理 #11

NVIDIA宣布Groq 3 LPX全面投产以扩展Vera Rubin平台Agent推理,并发布网络与基础设施更新。

NVIDIA宣布交互式AI推理加速器Groq 3 LPX全面投产,作为Vera Rubin NVL72平台的扩展,专为Agent系统提供超快Token生成。官方基准测试显示,运行Gemma 4 31B模型及10万Token上下文时,其输出达每秒3400个Token,速度为最接近替代平台的4倍。Nebius成为首个采用该加速器的AI云服务商。

相关链接:


Mistral AI 与 HUMAIN 布局中东主权 AI 基建 #13

Mistral AI与HUMAIN宣布战略协作,将在沙特及中东开发阿拉伯语前沿模型与部署AI基建,合作规模达数亿欧元。

Mistral AI与沙特阿拉伯公共投资基金全资子公司HUMAIN宣布达成战略协作,涵盖AI基础设施、先进模型开发及AI解决方案在沙特及中东地区的部署。双方将本地化先进AI模型,初期聚焦网络安全与语音,并计划开发阿拉伯语表现强劲的前沿模型,合作规模达数亿欧元。Mistral AI将探索使用HUMAIN的数据中心,并计划在沙特针对受监管行业制定联合市场战略,官方声明此为前瞻性表述,实际结果可能存异。

相关链接:


Thinking Machines Lab发布开源模型安全资助 #14

Thinking Machines Lab发布Tinker资助计划,为开源权重模型安全研究提供最高5万美元算力额度。

Thinking Machines Lab启动Tinker资助计划,为开源权重模型的安全研究提供最高5万美元的算力额度。该计划重点关注使模型更安全地开源、理解对齐失败模式以及测量与预测风险三大领域,具体涵盖防御主导能力训练、危险数据分类器构建、防篡改安全训练及涌现性不对齐等方向。

相关链接:


提示:内容由AI辅助创作,可能存在幻觉错误

AI HOT 补充资讯

模型发布/更新

GPT-5.6 登陆 Kiro,为开发者提升性价比 #A1

来源:AI HOT:OpenAI:官网动态(RSS · 排除企业/客户案例)

GPT-5.6 模型家族现已登陆软件开发智能体 Kiro,包含 Sol、Terra 和 Luna 三款模型。在 Terminal-Bench 2.1 测试中,GPT-5.6 Terra 在 Kiro 内完成任务成本降低约 82%。该更新由 OpenAI 与 AWS 合作优化,旨在以更少迭代和更高 token 价值帮助开发者产出更高质量的代码。

产品发布/更新

NVIDIA Vera Rubin NVL72 树立 AI 智能体效率新标准:每瓦特工作量提升至 30 倍 #A2

来源:AI HOT:NVIDIA Blog(RSS)

NVIDIA 实测数据显示,Vera Rubin NVL72 在智能体工作负载下每兆瓦吞吐量较 GB300 NVL72 最高提升 30 倍,每百万 token 成本降低至 35 倍。

MetaRoCE:为 AI 规模以太网打造的全新 RDMA 传输协议 #A3

来源:AI HOT:Meta Engineering Blog(RSS)

Meta 设计并开源了 MetaRoCE,一个专为 AI 工作负载在通用以太网上打造的 RDMA 传输协议,已通过 Open Compute Project(OCP)发布规范、参考软件实现和合规测试套件。该协议将智能移至端点,原生支持乱序交付、多路径、无损容忍和双向拥塞控制,无需 PFC,可在百万 GPU 规模下提供高吞吐、低尾延迟。现有 RDMA Verbs API 和软件栈无需修改即可运行。

来源:AI HOT:NVIDIA Blog(RSS)

NVIDIA 推出 NVLink Fusion,将定制 XPU 接入其 NVLink 扩展域,使 XPU 间端到端延迟比基于现成以太网的方案低 3 倍、数据包速率高 10 倍。

MTIA 300:Meta 首款内置 NIC 与通信卸载引擎的训练芯片 #A5

来源:AI HOT:Meta Engineering Blog(RSS)

Meta 发布 MTIA 300,这是其自研加速器家族中首款针对推荐与排序模型训练优化的芯片。芯片封装内集成 12 个 800 Gbps RDMA NIC,提供 1.2 TB/s 总 I/O 带宽,并通过 16 个专用消息引擎卸载通信,使大规模 GEMM 与集合通信并发时计算吞吐损耗低于 0.5%。

NVIDIA 扩展 Vera Rubin 推理能力,Groq 3 LPX 全面投产支持智能体系统 #A6

来源:AI HOT:NVIDIA Blog(RSS)

NVIDIA 宣布 Vera Rubin NVL72 扩展快速 token 生成能力,以支持智能体系统。其机架级系统 NVIDIA Groq 3 LPX 已全面投产,旨在通过 AI 工厂各层协同工作来定义下一代 AI 推理,而非依赖单一芯片、网络或系统的突破。

行业动态

Mistral 与 HUMAIN 达成战略合作,推进沙特及中东主权 AI #A7

来源:AI HOT:Mistral AI:News(网页)

Mistral 与 HUMAIN 宣布达成战略合作,覆盖 AI 基础设施、先进模型开发及 AI 解决方案部署,聚焦沙特阿拉伯及更广泛地区。双方将合作开发本地化 AI 模型,初期重点包括网络安全和语音,并计划开发在阿拉伯语上表现强劲的前沿模型。该合作金额达数亿欧元,Mistral 将探索使用 HUMAIN 的数据中心基础设施,并计划在沙特针对受监管行业制定联合市场策略。

丰田北美如何用 Deep Agents 和 LangSmith 规模化企业 AI #A8

来源:AI HOT:LangChain:Blog(RSS)

丰田北美借助 Deep Agents 和 LangSmith 运行 50 多个生产环境 AI 智能体,将交付周期从 6 个月缩短至 4 天。文章展示了其如何通过 LangSmith 追踪 AI 投资回报率(ROI),并以此支撑企业级 AI 的规模化落地。

论文研究

Beyond Visual CoT:Internalized Visual Thinking 实现主动视频推理 #A9

来源:AI HOT:Apple Machine Learning Research(RSS)

多模态大语言模型常用视觉思维链(Visual CoT)进行空间、时间与具身环境推理,但生成中间推理图像带来大量推理开销。新提出的后训练框架 Internalized Visual Thinking(IVT)在训练阶段内化视觉思考,推理时直接进行文本预测与优化,从而在不增加推理成本的前提下实现主动视频推理。

技巧与观点

OpenAI 正为一切构建 AI 智能体,但用户会愿意交出控制权吗? #A10

来源:AI HOT:TechCrunch:AI(RSS)

OpenAI 推出 ChatGPT Work,将 Codex 改造为面向非工程师的智能体产品,最低订阅档每月 20 美元即可使用,旨在让白领通过 LLM 自主完成多步骤工作。OpenAI 内部 6 月有 98% 员工使用 Codex,但组织订阅者仅 17%、个人订阅者不足 1%。公司正通过简化界面扩大采用,以支撑其巨额训练投入。

ADK 如何评估实时语音智能体 #A11

来源:AI HOT:Google Developers Blog(RSS)

Google 为 ADK 带来原生实时评估能力,可用模拟用户以音频驱动实时语音智能体、对语音回复打分,并在与文本智能体相同的评估循环中完成。示例采用三个基于 gemini-live-2.5-flash-native-audio 的智能体组成工作流,支持对话场景与固定对话两种测试用例,内置 NOVICE 等用户人设,并以 max_allowed_invocations 限制总轮数。

Databricks 如何从本地 IDE 运行、调试和扩展工作负载 #A12

来源:AI HOT:Databricks:Blog(RSS)

Databricks 工作区专为数据分析和数据工程而构建,现支持从本地 IDE 直接运行、调试和扩展工作负载。该功能旨在弥合本地开发环境与云端 Databricks 平台之间的差距,让开发者无需切换上下文即可完成编码、测试和部署。

你的alt文本能通过自动化检查,不代表它真的合格 #A13

来源:AI HOT:GitHub Blog

WebAIM Million报告显示,主流网页中16.2%的图片缺少alt文本,另有10.8%的alt文本模糊或重复。GitHub为Accessibility Scanner构建了alt文本插件,采用五条确定性规则检测缺失、文件名、占位符、泛化词及相邻重复,并引入基于布局的重复检测和可选视觉模型审查,以平衡误报率与实用性。

Anthropic 市场人员如何用 Claude Code 每周为每位销售代表发送个性化更新 #A14

来源:AI HOT:Claude:Blog(网页)

Anthropic 市场团队成员 Adam Ward 分享如何用 Claude Code 将每周销售报告转化为每位客户经理的个性化周一简报。他通过 MCP 连接 BigQuery 和 CRM 数据,并依据销售与经理反馈迭代提示词,加入“绝不编造 URL”等九条内容规则。该简报现已推广至所有销售团队,每周一自动发送三条优先行动项及账户相关活动。


提示:内容由 AI 辅助整理,可能存在错误,请以原始出处和官方信息为准。