2026-08-12
AI 早报 2026-08-12

本页合并来源:Juya AI 早报 + AI HOT 日报。Juya 保留完整精选,AI HOT 作为补充来源;已按链接和标题做基础去重。
概览
Juya · 要闻
- OpenAI 正式推出 ChatGPT 桌面应用 Linux 预览版 ↗
#1 - SpaceXAI 发布 Grok Bot,Elon Musk预告本周推出Grok 4.6 ↗
#2 - 研究人员称主流大模型存在漏洞,可跨模型越狱提取明文隐藏推理 ↗
#3 - Bilibili IndexTeam 发布开源 IndexTTS-2.5 语音克隆模型 ↗
#4 - 智谱 ZCode :达成100万用户并重置全体订阅用户额度 ↗
#5 - ChatGPT桌面应用和Codex CLI上线从其他Agent导入功能,支持自动同步 ↗
#6 - Google:Gemini月活破10亿,Gemma模型下载量破10亿 ↗
#7
Juya · 模型发布
- LTX 发布 LTX-2.5 开源世界模型 ↗
#8 - NVIDIA 推出 Nemotron 3.5 Lightning 模型 ↗
#9 - 商汤发布 SenseNova 6.8 Flash Lite Preview 预览版 ↗
#10 - 微软 MAI-Code-1.1-Flash 模型在 GitHub Copilot 推出 ↗
#11
Juya · 开发生态
- Unsloth 正式发布开源桌面应用 Unsloth Desktop ↗
#12 - NVIDIA开源NeMo Switchyard模型路由库,按任务分发Agent请求 ↗
#13 - Anthropic 拓展面向 Enterprise 客户的 Compliance API ↗
#14
Juya · 产品应用
Juya · 行业动态
- Manus 官方宣布恢复独立运营,部分用户数据因监管要求将被删除 ↗
#17 - Mistral AI 推出区域推理端点并引入第三方开放模型 ↗
#18 - 通义千问前负责人林俊旸创立语用科技进军具身智能 ↗
#19 - 深度求索注册“Deepseek Harness 团队”微信公众号
#20
Juya · 技术与洞察
Juya · 前瞻与传闻
- 消息称OpenAI将为美国大学生提供一年免费ChatGPT Plus ↗
#23 - 字节跳动成立新一级部门“AI数据与安全”攻坚大模型数据 ↗
#24 - Riot Platforms与Anthropic达成91亿美元数据中心租赁协议 ↗
#25
AI HOT 补充
- NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务 ↗
#A1 - SGLang 宣布 Day-0 支持 NVIDIA Nemotron 3.5 Lightning ↗
#A2 - Ling-3.0-tiny 正式开源:1.3B 激活参数如何进入真实任务 ↗
#A3 - Runway Seedance 2.5 上线,支持50角色参考 ↗
#A4 - Gemini 助力 Database Migration Service 加速 PostgreSQL 迁移 ↗
#A5 - ZCode全面升级:Goal、Subagents、Remote Control与闲时任务四大功能上线 ↗
#A6 - ChatGPT 桌面端支持导入其他智能体工作数据 ↗
#A7 - Databricks 开源 Metals v2:面向数百万行代码库的 Java 和 Scala 语言服务器 ↗
#A8 - 研究人员发现可读取ChatGPT等模型加密推理过程的API漏洞 ↗
#A9 - 消息称 Anthropic 最快今年 9 月上市,向投资者淡化 AI 模型竞争等挑战 ↗
#A10 - Gemini月活破10亿,成谷歌增长最快产品 ↗
#A11 - 消息称英伟达开发万亿参数开源 AI 模型 Nemotron 4,目标挑战全球顶级 ↗
#A12
Juya 早报精选
要闻
OpenAI 正式推出 ChatGPT 桌面应用 Linux 预览版 #1
OpenAI 宣布 ChatGPT 桌面应用现已推出 Linux 预览版,支持 ChatGPT、ChatGPT Work 和 Codex 功能。用户可在 Debian 和 Fedora 等指定发行版上使用,涵盖 x64 和 ARM64 架构。
OpenAI 正式宣布 ChatGPT 桌面应用的 Linux 版本进入预览阶段,该应用集成了 ChatGPT、ChatGPT Work 和 Codex,支持用户在已支持的 Linux 系统上处理项目和使用浏览器工作流。预览版目前覆盖 Ubuntu 24.04 LTS 与 26.04 LTS、Debian 13 以及 Fedora 43 和 44 的桌面版本,用户可通过 .deb 或 .rpm 安装包进行安装,同时支持 x64 和 ARM64 两种架构。

相关链接:
SpaceXAI 发布 Grok Bot,Elon Musk预告本周推出Grok 4.6 #2
SpaceXAI推出Grok Bot早期测试版,这是拥有独立云端计算机的Agent,能登录已有工具及无公开API的平台,端到端完成多步骤任务。目前面向SuperGrok Heavy等{订阅用户|"订阅用户"}开放桌面和iOS版,Elon Musk称修复基本问题后会扩大测试范围,并计划于本周发布Grok 4.6。
SpaceXAI正式推出Grok Bot早期测试版,这是一款能完成实际工作的AI队友。Grok Bot拥有独立的云端计算机,可登录用户已有的工具和应用,端到端完成多步骤任务。官方称,用户可以像给同事发消息一样向Bot派发任务,Bot能够记住对话内容、学习用户偏好,并在多次协作后提升表现。用户可以同时运行多个Bot,它们能够互相通信、共享上下文,并在群组聊天中自主协调工作。目前Grok Bot面向SuperGrok Heavy、Cursor Ultra和Cursor Teams Premium订阅用户开放,支持桌面端和iOS平台,企业用户可加入候补名单。Elon Musk表示,将在修复早期测试版基本问题后扩大测试范围,并计划于本周晚些时候发布Grok 4.6。



相关链接:
研究人员称主流大模型存在漏洞,可跨模型越狱提取明文隐藏推理 #3
近日有研究人员发表论文称,利用专有大语言模型 API 的漏洞,可将强模型的加密推理块注入弱模型进行越狱,进而提取出明文隐藏推理。研究人员表示已向相关公司进行负责任披露。
一个研究团队发表论文称,发现主流大模型 API 存在漏洞,导致加密推理块可在同一提供商的不同会话、用户和模型间复用。研究人员通过将强大模型的加密推理块注入较弱的兼容模型并实施越狱,成功迫使弱模型逐字解密并输出了强模型的原始明文推理,该方式适用于 Anthropic、OpenAI 和 Google 的模型。研究人员表示,他们已按负责任披露程序向各 AI 实验室通报,实验室已修补了由该漏洞引起的多个问题,并正在继续修复。此外,研究还从公开的推理轨迹中扫描出了 API 密钥和密码等敏感数据,并观察到模型内部真实推理过程与展示给用户的摘要存在明显差异。

相关链接:
Bilibili IndexTeam 发布开源 IndexTTS-2.5 语音克隆模型 #4
Bilibili 正式发布 IndexTTS-2.5 {零样本|"零样本"}语音克隆模型权重,支持中英日西阿五语跨语种迁移。模型重构架构提升推理效率,增强发音与情感控制,支持0.5至2倍语速调节,代码与权重已在相关平台发布。
Bilibili 旗下 Index SpeechTeam 正式开源了零样本文本转语音模型 IndexTTS-2.5。该模型参数量为 0.8B,支持中文、英语、日语、西班牙语和阿拉伯语的语音克隆及跨语种迁移。相比上一代版本,IndexTTS-2.5 重构了推理架构以提升运行效率,并新增了 0.5 倍至 2.0 倍的语速控制功能。目前,该项目的完整代码、模型权重及论文已在相关平台发布,采用 Bilibili Model License。

相关链接:
- https://github.com/index-tts/index-tts
- https://huggingface.co/IndexTeam/IndexTTS-2.5
- https://index-tts.github.io/index-tts2-5.github.io/
智谱 ZCode :达成100万用户并重置全体订阅用户额度 #5
智谱宣布旗下 Harness 产品 ZCode 用户数突破一百万,并已于8月11日13点重置了全体 GLM Coding Plan 用户的额度。官方同时宣布 ZCode 上线了低峰时段自动执行且不扣额度的闲时任务等功能。
智谱宣布旗下 Harness 产品 ZCode 用户数突破一百万,并已于8月11日13点重置了全体 GLM Coding Plan 用户的额度。官方同时宣布 ZCode 重大升级,上线了低峰时段自动执行且不扣额度的闲时任务、Goal 自主交付模式、Subagents 并行协作、Remote Control 移动端控制等功能。


相关链接:
ChatGPT桌面应用和Codex CLI上线从其他Agent导入功能,支持自动同步 #6
OpenAI推出Agent导入功能,ChatGPT桌面应用和Codex CLI现可从Claude Code、Claude Cowork及Cursor导入{配置|"配置"}、{项目|"项目"}和{近期工作|"近期工作"}。ChatGPT桌面应用还支持开启自动更新与原始Agent同步。
OpenAI宣布ChatGPT桌面应用和Codex CLI新增从其他Agent导入工作内容的功能。ChatGPT桌面应用支持从Claude Code、Claude Cowork和Cursor导入,Codex CLI支持从Claude Code和Cursor导入,可迁移指令文件、设置、技能、插件、项目文件夹、MCP服务器配置、hooks、subagents及最近30天的聊天记录等。ChatGPT桌面应用还支持开启自动更新以保持导入内容与原始Agent同步。

相关链接:
Google:Gemini月活破10亿,Gemma模型下载量破10亿 #7
Google CEO Sundar Pichai宣布,Gemini应用月活用户突破10亿,成为谷歌历史上增长最快的产品。同期,Gemma模型家族下载量也已突破10亿次。
Google CEO Sundar Pichai宣布,Gemini应用月活跃用户已超过10亿,成为谷歌历史上增长最快的产品,也是谷歌第14个达到10亿用户里程碑的产品。根据谷歌数据,63%的用户使用语音与Gemini交互,用户每天生成超过1.5亿张照片,超过1亿人在iOS上使用Gemini。同一时期,谷歌官方账号Google Gemma确认,Gemma模型家族下载量也已突破10亿次。


相关链接:
- https://x.com/sundarpichai/status/2087222656819241292
- https://x.com/googlegemma/status/2087209342160552253
模型发布
LTX 发布 LTX-2.5 开源世界模型 #8
LTX发布开源世界模型LTX-2.5,能从图文和视频生成高保真音视频,实现原生多镜头场景与角色一致。模型引入{扩散保真渲染|"扩散保真渲染"}提升细节,开放权重且最低16GB显存即可本地运行。
LTX.io 正式发布了开源世界模型 LTX-2.5,支持从文本、图像和视频输入生成高保真的音视频内容。新版本引入了原生多镜头生成、扩散保真渲染以及定制的 Gemma 4 12B 文本编码器,提升了画面细节和提示词遵循度。模型提供开放权重,最低 16GB 显存即可在本地运行,并允许用户使用自有数据进行微调。官方称,此前基于 LTX-2.3 训练的大多数 LoRA 可以直接在 LTX-2.5 上运行。

相关链接:
NVIDIA 推出 Nemotron 3.5 Lightning 模型 #9
NVIDIA 发布开源模型 Nemotron 3.5 Lightning,30B MoE 架构仅激活 3B 参数,专为长期运行 Agent 的高频执行任务设计,已上线 OpenRouter 和 OpenCode 免费使用。
NVIDIA 发布开源大模型 Nemotron 3.5 Lightning,采用 Mamba-2 + MoE + Attention 混合架构,总参数量 30B,每个 token 仅激活 3B 参数。该模型从 Nemotron 3 Ultra 蒸馏而来,专为长期运行 AI Agent 的高频执行层设计,支持高达 1M tokens 上下文长度。模型采用 OpenMDW-1.1 开放协议,权重、训练数据和配方均已公开,支持 DGX Spark、H100、GB200 等多种硬件部署,同时已上线 OpenRouter 和 OpenCode 免费使用。


相关链接:
- https://developer.nvidia.com/blog/nvidia-nemotron-3-5-lightning-delivers-fast-accurate-specialized-task-execution-for-long-running-agents/
- https://huggingface.co/nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4
商汤发布 SenseNova 6.8 Flash Lite Preview 预览版 #10
商汤宣布上线多模态模型 SenseNova 6.8 Flash Lite Preview 。用户目前可通过 SenseNova Token Plan 抢先体验,享受每5小时1500次的限时免费使用额度。官方表示,性能进一步提升的 {6.8|六点八} Flash Lite 正式版及 6.8 Flash 模型预计将于本月发布。
商汤日日新全新多模态智能体模型 SenseNova 6.8 Flash Lite Preview 预览版目前已在 SenseNova Token Plan 正式上线并开放体验。该模型主打轻量敏捷,具备自主规划、多 Agent 协作与动态纠偏能力,向用户只需给出目标、AI 自主走完全流程的“委派智能”方向演进。用户目前可享受每5小时1500次的限时免费使用额度。商汤官方表示,性能进一步提升的 6.8 Flash Lite 正式版及 6.8 Flash 模型预计将于8月发布。


相关链接:
- https://mp.weixin.qq.com/s/wed28P0G0zIqKKtIv72pTA
- https://www.sensenova.cn/token-plan
- https://github.com/OpenSenseNova/SenseNova6.8
微软 MAI-Code-1.1-Flash 模型在 GitHub Copilot 推出 #11
微软代码模型MAI-Code-1.1-Flash正在GitHub Copilot推出。官方称该模型新增原生视觉支持,优化了CLI和.NET任务,所需token减少且传输提速。
微软最新小型代码模型 MAI-Code-1.1-Flash 目前正在 GitHub Copilot 中推出。该模型在上一代基础上新增了用于图像理解的原生视觉支持,优化了CLI和.NET任务,并在代码质量、指令遵循和工具使用等方面带来改进。官方数据显示,该模型完成任务所需的 token 减少了 25%,流式传输速度提升 25%。

相关链接:
- https://microsoft.ai/news/mai-code-1.1-flash-br-better-faster-at-a-quarter-of-the-cost/
- https://github.blog/changelog/2026-08-11-mai-code-1-1-flash-available-in-github-copilot/
开发生态
Unsloth 正式发布开源桌面应用 Unsloth Desktop #12
Unsloth 团队发布了开源桌面应用 Unsloth Desktop。该应用支持用户在 Mac、Windows 和 Linux 系统上,本地运行和训练 LLM 等多种 AI 模型,支持 NVIDIA、AMD、Intel 和 Apple Silicon 等多类芯片。
Unsloth 团队正式发布开源桌面应用程序 Unsloth Desktop 的 Beta 版本,支持 macOS、Windows 和 Linux 系统。该程序允许用户在本地硬件上运行和训练 LLM、图像与视频扩散、音频、MLX 及 GGUF 等多种模型,覆盖 NVIDIA、AMD、Intel 和 Apple Silicon 等多类芯片及 CPU、多 GPU 设置。应用内置私有 Web 搜索、深度研究、RAG 和 MCP,并允许用户通过 unsloth start 命令将本地模型连接至 Claude Code、Codex 等 Agent。

相关链接:
NVIDIA开源NeMo Switchyard模型路由库,按任务分发Agent请求 #13
NVIDIA发布开源模型路由库NeMo Switchyard,支持LLM分类器、阶段路由、升级路由等算法。该项目目前处于pre-alpha阶段。
NVIDIA正式发布并开源NeMo Switchyard模型路由库,用于在AI Agent工作流中跨模型分发请求,支持LLM分类器、阶段路由、升级路由和预填充路由器等算法。官方称其可在GitHub获取,但项目标记为pre-alpha、不可用于生产环境。
相关链接:
- https://developer.nvidia.com/blog/route-ai-agent-workloads-across-models-with-nvidia-nemo-switchyard/
- https://github.com/NVIDIA-NeMo/Switchyard
- https://huggingface.co/collections/nvidia/nvidia-nemotron-v3
Anthropic 拓展面向 Enterprise 客户的 Compliance API #14
Anthropic将Compliance API扩展至Claude Cowork和Claude Code,并向Enterprise客户开放Beta测试。合规团队能拉取两产品的会话内容与元数据用于审计取证,无需单独集成。
Anthropic 官方宣布,Claude 的 Compliance API 覆盖范围已扩展至 Claude Cowork 和 Claude Code。安全与合规团队现在可以通过现有的 Compliance API 接口,从 Cowork 的桌面应用、网页端及移动端,以及 Claude Code 的 CLI 和桌面端中提取会话内容与元数据。这项新功能目前处于 Beta 阶段,面向 Claude Enterprise 客户开放。
相关链接:
- https://claude.com/blog/compliance-api-cowork-and-claude-code
- https://platform.claude.com/docs/en/manage-claude/compliance-api
产品应用
WorkBuddy上线多端同步功能,支持手机远程控制电脑Agent #15
WorkBuddy上线多端同步,打通PC、APP和小程序。登录同一账号即可用手机远程控制电脑Agent,支持锁屏操作与双端协同。
腾讯WorkBuddy推出多端同步功能,实现了PC、APP、小程序三端的任务、对话记录与产物的实时同步。用户可以通过手机远程授权或停止电脑端Agent的任务,并支持一台手机连接多台电脑进行切换。还支持手机端负责采集信息,电脑端Agent可直接处理提取,实现双端协同。
相关链接:
OpenAI 推出 ChatGPT 工作区 Agent 功能 #16
OpenAI 推出了工作区 Agent 功能,允许用户在 ChatGPT 中创建可共享的 Agent 来处理跨工具的复杂多步骤工作流。该功能目前处于研究预览阶段,仅向 ChatGPT Business、Enterprise、Edu 和 Teachers 订阅方案开放。
OpenAI 在 ChatGPT 中引入了工作区 Agent。用户只需描述工作内容,ChatGPT 即可协助将其转化为一个能够在团队间共享的可用 Agent,用于自动执行诸如审查潜在客户、生成报告和研究供应商等长期的多步骤工作流。这些 Agent 能够跨 Slack、Google Drive 和 Microsoft SharePoint 等工具提取上下文信息,并在获批后执行更新工单或发送消息等操作。目前,该功能处于研究预览阶段,面向 ChatGPT Business、Enterprise、Edu 和 Teachers 订阅方案的用户提供。

相关链接:
行业动态
Manus 官方宣布恢复独立运营,部分用户数据因监管要求将被删除 #17
Manus 官方宣布即将恢复作为独立公司运营,作为与 Meta 分拆的一部分,部分用户在特定日期之后产生的数据将于 {8 月 23 日至 24 日(新加坡时间)|8 月 23 日至 24 日}删除。受影响用户需提前备份,并可在 8 月 25 日起恢复数据。
Manus 官方发布致用户公开信,宣布 Manus 即将恢复以独立公司的形式运营。根据官方说明,2025 年 12 月 29 日 Meta 收购了 Manus,为遵守特定司法辖区的监管要求,部分用户在收购当天或之后产生的数据将被删除。受影响用户可从即日起至 2026 年 8 月 23 日 07:59(新加坡时间)前使用官方备份工具进行数据备份,数据将于 8 月 23 日至 24 日(新加坡时间)被删除,用户可从 8 月 25 日 08:00(新加坡时间)起恢复数据并恢复正常使用。未受影响用户无需采取任何行动,可照常使用 Manus。

相关链接:
Mistral AI 推出区域推理端点并引入第三方开放模型 #18
Mistral AI 推出区域推理端点,允许客户选择在欧洲或美国运行以满足数据驻留需求。此外,Mistral 平台将支持第三方开放模型,首批引入智谱 GLM-5.2。
Mistral AI 官方宣布,通过区域控制、开放模型选择和长期算力承诺来加强客户的 AI 主权。在推理层,Mistral Regional Endpoints 现已正式可用,允许客户选择在欧洲或美国运行推理以满足数据驻留、监管和延迟需求。此外,Mistral 平台将支持第三方开放模型,首批引入智谱的 GLM-5.2,这些模型将运行在与 Mistral 自有模型相同的基础设施和区域控制下。
相关链接:
通义千问前负责人林俊旸创立语用科技进军具身智能 #19
通义千问前负责人林俊旸宣布创立语用科技,专注于研发跨越数字和物理世界的下一代 Agent。林俊旸表示,公司已获得红杉中国与高榕创投等机构的投资支持。
通义千问前负责人林俊旸宣布在上海创立 Pragmatik Labs(语用科技),致力于研发跨越数字和物理世界的下一代 Agent。据官网信息,公司将构建能够执行知识工作的数字 Agent,以及能在真实环境中执行长程任务的物理或具身 Agent。林俊旸确认,公司本轮融资由红杉中国和高榕创投领投,腾讯和上海未来产业基金提供支持。

相关链接:
- https://pragmatik.com/
- https://x.com/JustinLin610/status/2087214239643730227
- https://x.com/pragmatik_labs
深度求索注册“Deepseek Harness 团队”微信公众号 #20
近日,有网友发现,DeepSeek 官方注册了“Deepseek Harness 团队”微信公众号。相关信息显示,该账号于七月初注册完成,截至目前该公众号暂未有发文。
据社区消息,北京深度求索人工智能基础技术研究有限公司于7月初注册了名为“Deepseek Harness 团队”的微信公众号。目前该账号处于已注册状态,但尚未发布任何内容。


技术与洞察
Google AMIE在模拟咨询测试中达到临床基准 #21
Google 宣布,其医疗AI系统AMIE现在可以进行实时视频咨询。在一项使用模拟咨询的随机研究中,AMIE达到了临床表现基准,但目前仍是一个研究系统。
Google 正在推进其医疗AI系统AMIE,使其具备实时临床视频咨询能力。该系统基于Gemini和Project Astra构建,采用多智能体架构,能够解读视觉和听觉线索,引导虚拟体检,并实时进行诊断推理。在一项使用患者演员和初级保健医生进行模拟咨询的随机研究中,临床评估人员对AMIE在病史采集的全面性、诊断准确性、管理适当性和沟通质量等核心临床能力方面给予了良好评价。患者演员也更倾向于视频体验,而非文本聊天。目前AMIE仍是一个研究系统,在进行负责任的现实临床部署之前还需要进行更多研究。

相关链接:
- https://blog.google/innovation-and-ai/models-and-research/google-research/amie-video-consultations/
- https://x.com/GoogleForHealth/status/2087224970329944422
腾讯混元发布 WorldClaw 框架 #22
腾讯混元发布了名为WorldClaw的Agentic框架。该框架能将文本提示词转化为可自由探索、完全由可编辑3D资产构成的大规模3D开放世界场景。
腾讯混元推出了名为 WorldClaw 的 Agentic 3D 开放世界生成框架。该框架并非生成视频或高斯泼溅,而是将开放式文本提示词转化为由可编辑、可直接用于游戏的 3D 资产构建的大规模场景。WorldClaw 通过由粗到细的 Agentic 规划,在保持全局地形连贯的同时生成丰富的局部细节。生成的场景支持自由视点探索、对象级编辑和复用,并能直接对接渲染、动画制作和游戏引擎工作流。

相关链接:
前瞻与传闻
消息称OpenAI将为美国大学生提供一年免费ChatGPT Plus #23
有消息称,OpenAI将向美国大学生免费提供一年的ChatGPT Plus。该福利将覆盖220多所美国参与高校的在读学生,需通过SheerID验证身份后激活。目前上述信息未获得官方确认。
据爆料博主透露,OpenAI正在筹备一场新的“重返校园”活动,将ChatGPT定位为备考和学习工具。作为活动内容,目前就读于美国的大学生将能够免费领取为期一年的ChatGPT Plus服务。该优惠的适用范围限于220多所参与该活动的美国高校的在读学生。符合条件的学生需要通过验证合作伙伴SheerID来验证学生身份。目前上述信息未获得官方确认。

相关链接:
字节跳动成立新一级部门“AI数据与安全”攻坚大模型数据 #24
据报道,字节跳动近期成立新一级部门“AI数据与安全”,该部门整合多个分散团队,主要为字节所有大模型提供跨模态数据服务。
据智能涌现报道,字节跳动近期成立了新的一级部门“AI数据与安全”,与Seed、Flow等部门平行,负责人为此前的TikTok平台责任负责人王赢磊。该部门整合了Global Data、集团数据中台DMC以及Flow下属的AI数据平台AIDP等团队,核心职能是为字节所有大模型提供跨模态数据服务,覆盖标准制定、寻源采购、合成清洗和质量评测等流程。
相关链接:
Riot Platforms与Anthropic达成91亿美元数据中心租赁协议 #25
据报道,Riot Platforms与Anthropic达成约91亿美元的20年数据中心租赁协议。报道称,该协议覆盖191兆瓦算力,含两次五年续约选项,总潜在价值约161亿美元。
Riot Platforms此前在季度财报中宣布,与一家"前沿AI实验室"签署为期20年的数据中心租赁协议,在得克萨斯州Rockdale园区提供191兆瓦关键IT算力,预计初始合同期产生约91亿美元收入。据彭博社援引知情人士报道,该租户为Anthropic,Riot与Anthropic均未正式回应。协议包含两次各五年的续约选项,若全部行使,总合同价值可达约161亿美元。

相关链接:
- https://www.bloomberg.com/news/articles/2026-08-11/anthropic-strikes-9-billion-deal-with-cloud-computing-firm-riot
- https://www.riotplatforms.com/riot-platforms-reports-second-quarter-2026-financial-results-and-strategic-highlights/
提示:内容由AI辅助创作,可能存在幻觉和错误。
AI HOT 补充资讯
模型发布/更新
NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务 #A1
来源:AI HOT:NVIDIA Blog(RSS)
NVIDIA 发布 Nemotron 3.5 Lightning,一款可定制的开源 30B 混合专家(MoE)模型,专为常驻智能体设计。相比同类开源模型,其 token 生成速度最高提升 4 倍,任务完成时间缩短 30%。该模型采用开放权重,支持用户微调以匹配特定任务,并可在 RTX PC、DGX Spark 及 Jetson 等设备上运行。
SGLang 宣布 Day-0 支持 NVIDIA Nemotron 3.5 Lightning #A2
来源:AI HOT:LMSYS:Blog(Chatbot Arena 团队)
SGLang 宣布对 NVIDIA Nemotron 3.5 Lightning 提供 Day-0 支持,该开源模型为 30B 总参数、3B 激活参数的混合专家架构,支持最长 1M token 上下文,可从 Hugging Face 下载 BF16 和 NVFP4 权重。模型支持 MTP、DFlash、DSpark 三种投机解码技术,并可通过 OpenAI 兼容 API 接入智能体工作流。
Ling-3.0-tiny 正式开源:1.3B 激活参数如何进入真实任务 #A3
来源:AI HOT:公众号:蚂蚁百灵(Ling)
蚂蚁百灵开源 Ling-3.0-tiny,一款总参数 7.9B、推理时仅激活 1.3B 参数的原生混合推理模型,同步提供 BF16、FP8 和 INT4 三个版本。
产品发布/更新
Runway Seedance 2.5 上线,支持50角色参考 #A4
来源:AI HOT:X:Runway (@runwayml)
完整阵容,完整曲目,一次生成一个。 Seedance 2.5 已在 Runway 上线,支持 50 个独特角色参考,以及最长 30 秒、与音乐同步的片段。点击下方链接即可开始使用。
Gemini 助力 Database Migration Service 加速 PostgreSQL 迁移 #A5
来源:AI HOT:Google Cloud:Databases(RSS)
Google Cloud 在 Database Migration Service(DMS)中推出由 Gemini 驱动的 AI 辅助代码转换,可将 Oracle 或 SQL Server 的存储过程、触发器和自定义函数转换为 PostgreSQL PL/pgSQL 代码。
ZCode全面升级:Goal、Subagents、Remote Control与闲时任务四大功能上线 #A6
来源:AI HOT:公众号:智谱(GLM)
ZCode针对GLM深度优化,今日上线Goal、Subagents、Remote Control与闲时任务四大功能。在Z.ai Code Bench测试中,GLM-5.2搭配ZCode较搭配Claude Code任务整体通过率高2.39%;ZCode缓存命中率超98%,叠加1.5倍限时额度加成后,GLM Coding Plan整体使用量接近常规额度的1.8倍。
ChatGPT 桌面端支持导入其他智能体工作数据 #A7
来源:AI HOT:X:OpenAI Developers (@OpenAIDevs)
你现在可以将其他智能体的工作内容与 ChatGPT Work 和 Codex 保持同步。 可导入项目、聊天记录、技能和插件,查看导入历史,并可在设置中选择开启自动更新。 现已在 ChatGPT 桌面应用中提供。
Databricks 开源 Metals v2:面向数百万行代码库的 Java 和 Scala 语言服务器 #A8
来源:AI HOT:Databricks:Blog(RSS)
Databricks 开源 Metals v2,这是其面向数百万行代码库的 Java 和 Scala 语言服务器。Metals v2 专为智能体驱动的开发场景设计,旨在提升大规模代码库中的编辑与导航性能。目前 Databricks 的大部分代码已由智能体编写,该工具服务于工程师仍需要手动介入的环节。
行业动态
研究人员发现可读取ChatGPT等模型加密推理过程的API漏洞 #A9
来源:AI HOT:The Decoder:AI News(RSS)
Alexander Panfilov团队发现OpenAI、Anthropic、Google等主要AI提供商API存在漏洞,可读取推理模型的加密思考过程。扫描约7000条公开会话发现62个API密钥、33个邮箱和33个密码。通过越狱,Anthropic的Haiku 4.5可逐字转写Opus 4.8的原始推理;解码10000条推理轨迹的API成本约720美元。
消息称 Anthropic 最快今年 9 月上市,向投资者淡化 AI 模型竞争等挑战 #A10
来源:AI HOT:IT之家(RSS)
Anthropic 正与潜在投资者接触,为可能成为史上规模最大的 IPO 做准备,计划今年 9 月或 10 月初正式上市。公司估值高达 9,650 亿美元,年化收入已超 470 亿美元,并淡化来自中国 AI 企业的竞争影响。Anthropic 还计划拓展 AI 在医疗和生物学领域的应用,但尚未公布具体 IPO 定价方案。
Gemini月活破10亿,成谷歌增长最快产品 #A11
来源:AI HOT:X:Sundar Pichai (@sundarpichai)
每月已有超过 10 亿人使用 @Geminiapp 激发新想法、完成工作。这是我们有史以来增长最快的产品,也是第 14 个达到 10 亿用户里程碑的产品。 感谢 @JoshWoodward 和整个 Gemini 团队,也感谢每一位与我们同行的伙伴——未来还有更多精彩!
消息称英伟达开发万亿参数开源 AI 模型 Nemotron 4,目标挑战全球顶级 #A12
来源:AI HOT:IT之家(RSS)
英伟达正在研发新一代开源 AI 模型系列 Nemotron 4,规模最大的模型预计至少拥有 1 万亿个参数,旨在与全球最先进的开源模型竞争。英伟达尚未确定发布日期,最终训练也未完成,员工认为该模型最早可能在今年秋末准备就绪。此举意在通过开放模型生态扩大 AI 应用范围,并推动市场对其 GPU 算力的需求。
NVIDIA 为何需要新供电架构以扩展 AI 算力性能 #A13
来源:AI HOT:NVIDIA Blog(RSS)
NVIDIA 主张以 800 VDC 直流配电替代传统交流多次转换,以降低损耗、支撑 AI 算力扩展。NVIDIA 与 Google、Microsoft 通过 OCP 联合制定该架构,已发布白皮书及 LVDC 固态变压器规范 v0.3,超 80 家设备商正据此开发产品。
论文研究
Apple Silicon 与 macOS 虚拟机:借助 Llama.cpp 实现 11–16 倍的 LLM 推理加速 #A14
来源:AI HOT:Hacker News 热门(buzzing.cc 中文翻译)
研究团队为 macOS 虚拟机中的 Metal 能力查询构建进程级兼容层,使 llama.cpp 能选用更新的 Metal 内核。在 M1 Ultra 上,TinyLlama 1.1B 的提示处理速度提升 11.08 倍、token 生成提升 16.36 倍,接近裸机性能的 98%;Gemma 4 12B 的提示处理与生成速度分别提升 7.20 倍和 14.54 倍。
统一 Radix 缓存:为混合模型前缀缓存构建单一树结构 #A15
来源:AI HOT:LMSYS:Blog(Chatbot Arena 团队)
LMSYS 团队提出 Unified Radix Cache,用单一 token 键控 radix 拓扑统一管理混合模型的 FULL、SWA 和 MAMBA 组件缓存,各组件独立执行路径、滑动窗口和检查点复用语义。
AMIE 研究医疗 AI 系统首次展示实时临床视频问诊能力 #A16
来源:AI HOT:Google Blog:AI(RSS)
Google Research 与 Google DeepMind 推进医疗 AI 系统 AMIE,实现实时临床视频问诊,首次在此场景展示专家级 AI 能力。该系统基于 Gemini 和 Project Astra 构建,可解读视觉与听觉线索、引导虚拟体格检查并实时诊断推理。随机研究中,临床评估者对 AMIE 的病史采集、诊断准确性等核心能力给予好评,患者演员也更偏好视频体验。
技巧与观点
OpenAI 用 Astra 模型攻克 10 道数学难题,数学家既兴奋又担忧 #A17
来源:AI HOT:The Verge:AI(RSS)
OpenAI 宣布其未发布的 Astra 模型解决了 10 道长期悬而未决的数学难题,涵盖球体堆积、纠错码、非 sofic 群存在性等领域,并发布超 250 页论文及 Lean 验证结果。
用 ComfyUI API 实现 MiniMax-H3 多模态视频与音频生成流水线 #A18
来源:AI HOT:MarkTechPost(RSS)
本教程演示如何以 ComfyUI 为无头推理后端,构建端到端的 MiniMax-H3 视频生成工作流。通过 Python 直接构建执行图,支持文生视频、首尾帧条件生成和参考图像条件生成,并自动根据 GPU 显存选择 quality、balanced、squeeze 三种权重配置。流水线涵盖模型自动下载、节点模式校验、音视频联合解码与进度监控,无需图形界面即可复现实验。
将 GitHub Copilot 置于中间人(MitM)代理之后后,我学到了什么 #A19
来源:AI HOT:Hacker News 热门(buzzing.cc 中文翻译)
作者通过 mitmproxy 对 VS Code 中的 GitHub Copilot 进行中间人代理拦截,逆向分析其网络流量与内部架构。文章指出这些 AI 应用普遍基于 Electron 构建,共享相似的网络栈,因此探测结果可迁移至其他同类应用。作者借此揭示了 Copilot 的运行时行为,并分享了配置代理的具体步骤。
编写智能体时,哪种编程语言最合适? #A20
来源:AI HOT:Hacker News 热门(buzzing.cc 中文翻译)
针对“动态语言比静态语言更省 LLM token”的流行说法,作者用 GPT-5.6 Sol 让智能体实现 zstd 解码器进行实测。结果显示,medium 努力度下动态语言表现更好,ultra 下静态语言反而更优,且此前评测存在测试路径错误等缺陷。作者认为,琐碎任务上的性能无法推广到更大问题。
微信小微AI帮写与AI点评内测:朋友圈最后一点人味正在消失 #A21
来源:AI HOT:公众号:数字生命卡兹克
微信基于小微推出朋友圈AI帮写与AI点评内测功能,前者可根据图片和已写文字生成3条朋友圈文案,后者可长按文字生成评价或快捷评论。作者认为这两个功能将AI置于社交核心位置,可能鼓励AI内容、破坏朋友圈自2012年确立的“记录美好生活”基调。公众号端小微还常驻首位,自动总结常看公众号文章,作者担忧这会反向影响创作者内容生产。
提示:内容由 AI 辅助整理,可能存在错误,请以原始出处和官方信息为准。