2026-08-04
AI 早报 2026-08-04

本页合并来源:Juya AI 早报 + AI HOT 日报。Juya 保留完整精选,AI HOT 作为补充来源;已按链接和标题做基础去重。
概览
Juya · 要闻
Juya · 开发生态
- Qoder一周年:Qwen3.8-Max全端上线,新老用户可领免费调用 ↗
#3 - 阿里云百炼 Token Plan 上线 Qwen3.8-Max 正式版, 重置周限 ↗
#4 - Ant Ling 延长 OpenRouter 平台 Ling-3.0-flash 免费期限 ↗
#5 - TRAE 为老用户加送积分并推进多项功能升级 ↗
#6 - Kiro 推出统一 Kiro agent harness,已上线全部四个客户端 ↗
#7 - OpenRouter发布Ori Eval,支持对比模型并给出量化推荐 ↗
#8 - Interconnects AI上线Artifacts Hub与Adoption Dashboard,分析开源模型趋势与采用 ↗
#9 - Cloudflare 推出开源 Agent 运行时 @cloudflare/computer ↗
#10 - Cloudflare 发布 Billable Usage API,自助服务账户可程序化查询成本与用量 ↗
#11
Juya · 产品应用
- NousResearch 发布 Hermes Agent v0.20.0 ↗
#12
Juya · 行业动态
- 据报道美国已完成AI监管框架,邀请主要科技公司审阅 ↗
#13
Juya · 技术与洞察
Juya · 前瞻与传闻
- 智谱GitHub仓库及ZCode文档出现GLM-5.3相关内容 ↗
#16
AI HOT 补充
- Qwen3.8-Max 发布:开源最强编码与协作模型,2.4T 参数 ↗
#A1 - 商汤发布 SenseNova U1.5-Lite-Preview 开源模型 ↗
#A2 - Cloudflare 推出 Billable Usage API:为自助账户提供按产品与计费周期的程序化成本可见性 ↗
#A3 - OpenRouter 推出 Ori Eval 简化评估流程 ↗
#A4 - Cloudflare 推出 @cloudflare/computer 预览版:为智能体提供虚拟文件系统与多执行环境 ↗
#A5 - GPT-Live实时音频新架构发布 ↗
#A6 - 微软开源 Orchard 智能体训练框架 ↗
#A7 - 欧盟《人工智能法案》透明度规则生效,违规最高罚 1500 万欧元 ↗
#A8 - Databricks 完成对 Panther 的收购,加速安全湖仓时代 ↗
#A9 - 多模态大语言模型对齐的全面研究:Apple 团队独立拆解偏好对齐各环节 ↗
#A10 - AirLLM 实现单块 4GB GPU 运行 70B 模型推理 ↗
#A11 - Palantir 强劲季度后,CEO Alex Karp 称 AI 行业“马克思主义” ↗
#A12
Juya 早报精选
要闻
阿里千问发布 Qwen3.8-Max 正式版并计划下周开源模型权重 #1
阿里千问发布Qwen3.8-Max模型正式版。该模型基于 Qwen 3.5 的架构基础构建,总参数达2.4T,激活参数95B。目前已在官方API平台和Token Plan、Qwen Studio、Qoder系列等产品上线。官方称该模型在编程、办公、长周期任务及多模态智能体等方面实现了全面提升。根据官方测试,该模型能够独立完成长达约 16 天的长程自动编程。该模型权重将于下周公开,Qwen3.8-27B 模型也将开放权重。
阿里今日发布 Qwen3.8-Max 模型,已上线千问 AI 平台 API 服务及 Token Plan、Qoder 系列等产品。该模型基于 Qwen 3.5 架构构建,总参数 2.4 万亿,激活参数 95B,支持 100 万上下文。定价方面,国内每百万 Tokens 输入 12 元、输出 36 元;海外分别为 2 美元、6 美元。
官方称该模型在编程、办公、长周期任务及多模态智能体等方面实现全面提升。据官方测试,其能独立完成长达约 16 天的长程自动编程。据 Arena.ai 榜单数据,该模型视觉与编程能力分列第二和第四。
官方宣布该模型权重将于下周公开,这也是 Qwen 首个 Max 规模的开源权重模型,Qwen3.8-27B 模型也将开放权重。模型兼容 OpenAI 与 Anthropic 接口,支持集成至主流智能体框架。



相关链接:
- https://qwen.ai/blog?id=qwen3.8
- https://www.qianwenai.com/models/qwen3.8-max
- https://github.com/qwen-code-dev-bot/oh-my-cli
MiniMax-H3正式发布权重,ComfyUI原生支持 #2
MiniMax正式开源全模态生成系统 MiniMax-H3。此次发布的模型权重包括H3-Base的{FL2VA|FL to VA}和 {Ref2VA|Ref to VA}两个checkpoint。相关权重已获ComfyUI原生支持。其许可证禁止在美国和欧盟等国家和地区使用。
MiniMax正式开源全模态生成系统MiniMax-H3,在HuggingFace发布模型权重,支持文本、图像、音频与视频的统一理解,可生成最高2K分辨率、15秒时长、24FPS、32kHz立体声视频。本次开放的模型权重主要为 H3-Base-FL2VA 和 H3-Base-Ref2VA 两个任务专用 checkpoint。H3-Context-IR 与 H3-Regenerate-2K 的官方实现暂未开源,目前可通过官方 API 接入;其中 H3-Context-IR 还提供了自建替代处理流程的指导。ComfyUI在权重发布当日即原生支持。许可证禁止美国、欧盟、英国、韩国使用,MiniMax员工RyanLee称美国限制源于与好莱坞制片公司的生成式视频版权诉讼,美国用户可提交正式授权申请。


相关链接:
- https://huggingface.co/MiniMaxAI/MiniMax-H3
- https://platform.minimax.io/docs/api-reference/video-generation-v2-create
- https://x.com/RyanLeeMiniMax/status/2084115105042886973
开发生态
Qoder一周年:Qwen3.8-Max全端上线,新老用户可领免费调用 #3
Qoder 宣布 Qwen3.8-Max 正式上线Qoder全端。8月3日至9月3日期间,新用户和付费用戶可领取800次免费调用,下单可再叠加2000次。此外,每天错峰时段享5折计费,个人版与企业版同享,中国版还推出了邀请福利活动。
Qoder宣布,为庆祝一周年及Qwen3.8-Max正式上线Qoder国际版和中国版全端。8月3日至9月3日期间,新注册用户和老付费用户可领取800次Qwen3.8-Max免费调用,活动期间下单可再叠加2000次,调用次数有效期至9月30日。此外,每天22:00至次日08:00(UTC+8)错峰时段享5折计费,个人版与企业版同享。中国版同时推出邀请好友赚积分活动。

相关链接:
阿里云百炼 Token Plan 上线 Qwen3.8-Max 正式版, 重置周限 #4
阿里云百炼 Token Plan 宣布上线 Qwen3.8-Max 正式版,原 Qwen{3.8|三点八}-Max-Preview 版本将于8月5日下线,有生效订阅的用户可获一次7天额度重置权益。
阿里云百炼平台宣布 Qwen3.8-Max 正式版已上线,个人版 Token Plan 已同步支持该模型。官方将于北京时间8月5日开始为所有在此前订阅的用户发放一次7天额度重置权益,用户可在权益有效期内按需重置可用额度。原 Qwen3.8-Max-Preview 版本将于8月5日下线,官方建议用户尽快完成切换,以免影响线上服务。关于 Qwen3.8-Max 的 Credits 消耗标准,官方建议用户在控制台关注用量统计,合理规划使用节奏。

相关链接:
Ant Ling 延长 OpenRouter 平台 Ling-3.0-flash 免费期限 #5
Ant Ling 宣布,在 OpenRouter 平台免费使用 Ling-3.0-flash 模型的期限已延长至太平洋时间8月6日上午8点。用户目前可继续免费体验该模型。
Ant Ling 官方宣布,旗下 Ling-3.0-flash 模型在 OpenRouter 平台的免费访问期限已获得延长。用户目前可以在该平台上继续免费使用 Ling-3.0-flash,此次免费期限将一直持续至太平洋时间8月6日上午8点。

相关链接:
- https://openrouter.ai/inclusionai/ling-3.0-flash:free
- https://x.com/AntLingAGI/status/2084259301263286732
TRAE 为老用户加送积分并推进多项功能升级 #6
TRAE在积分体系上线后宣布为老付费用户额外加送通用积分,并将未升级用户的迁移加赠积分翻倍。官方同时表示正推进调整生图生视频限额和支持更大上下文窗口等功能以回应用户诉求。
TRAE 在积分体系上线后宣布为老用户增加两项福利。已升级到全新积分体系的付费用户于 8 月 3 日按会员档位额外获得一份通用积分,有效期为 31 天。尚未升级的速通用户一次性迁移加赠积分上调至原来的两倍,自切换到积分体系之日起 31 天内有效。两份福利均为通用积分,TRAE Work 与 TRAE IDE 全端通用,到账后无需任何操作即可使用。官方同时表示,调整生图生视频限额、支持更大上下文窗口、支持选择模型思考强度、增加 Deepseek-V4-Flash 正式版模型资源量以覆盖更多用户等功能正在推进中。

相关链接:
Kiro 推出统一 Kiro agent harness,已上线全部四个客户端 #7
Kiro 推出统一的 Kiro agent harness,取代各客户端独立架构。新套件已在 Kiro IDE、CLI、Web 和 iOS 全面上线,实现跨平台一致配置。
Kiro 官方宣布将此前的三个独立代理套件整合为单一的 Kiro agent harness,目前该套件已在 Kiro IDE、CLI、Web 和 iOS 四个客户端全面上线。新架构作为独立服务器进程运行,通过 Agent Client Protocol (ACP) 及其扩展与客户端通信,使规范化驱动开发、自定义代理和 Hooks 在所有客户端保持一致的行为和配置格式。此外,Kiro 引入了基于 Cedar 的单一能力级权限模型,取代了以往各客户端互不兼容的权限系统。

相关链接:
OpenRouter发布Ori Eval,支持对比模型并给出量化推荐 #8
OpenRouter 推出 Ori Eval 评估工具,帮助开发者为项目选择最合适的模型。Ori Eval 通过编程 Agent 自动扫描代码库并运行跨提供商的模型比较。
OpenRouter 推出 Ori Eval,这是一款 CLI 工具和评估框架,目前可用。Ori Eval 让开发者通过在真实提示词上测试 Agent 来寻找最适合项目的模型,自动扫描代码库、编写评估文件、运行跨提供商模型比较并给出带分数的推荐;每次运行固定 harness 和模型以确保结果可复现。开发者可通过编程 Agent 运行 curl 命令启动,或手动安装 CLI,需要 Bun 运行时和 OpenRouter 登录凭证;评估会调用真实模型并产生费用。

相关链接:
- https://openrouter.ai/docs/guides/ori/eval
- https://openrouter.ai/skills/spawn-ori-eval
- https://openrouter.ai/labs/ori/install.sh
Interconnects AI上线Artifacts Hub与Adoption Dashboard,分析开源模型趋势与采用 #9
Interconnects AI宣布推出两个免费工具帮助洞察开源模型生态,Artifacts Hub用于追踪开源模型趋势,Adoption Dashboard展示按地区和机构的{模型采用数据|"模型采用数据"}。
Interconnects AI 宣布推出两个免费资源:The Artifacts Hub和Adoption Dashboard。Artifacts Hub是一个精选视图,整合Open Router推理token数据、Artificial Analysis模型智能评分以及基于Hugging Face数据构建的自定义采用指标,目前覆盖近两年发布的792个模型。Adoption Dashboard是动态仪表板,按地理区域和组织展示下载量与衍生模型数量,突出中美差距及开源生态中的新兴参与者。


相关链接:
- https://www.interconnects.ai/p/introducing-our-artifacts-hub-and
- https://artifactshub.ai
- https://dashboard.interconnects.ai
Cloudflare 推出开源 Agent 运行时 @cloudflare/computer #10
Cloudflare推出开源Agent运行时@cloudflare/computer早期预览版。它为Agent提供独立计算环境,依托SQLite虚拟文件系统,动态编排isolates与Linux容器执行任务。
Cloudflare 推出开源的 agent runtime 早期预览版 @cloudflare/computer,旨在为每个 Agent 提供独立的“计算机”环境。其核心提供基于 SQLite 的虚拟文件系统,并能根据任务需求,动态编排快速的 isolates 和完整的 Linux 容器。官方表示,这种设计旨在优化性能和成本,目标是让 Agent 处理大部分工作时使用 isolates,仅在不到 10% 的任务中才需要容器。开发者目前可通过 npm 安装该库并进行试用。

相关链接:
Cloudflare 发布 Billable Usage API,自助服务账户可程序化查询成本与用量 #11
Cloudflare 推出全新 Billable Usage API,面向自助服务账户开放,单端点即可按产品查询全部用量与成本。
Cloudflare 发布 Billable Usage API,为自助服务账户提供单端点程序化成本与用量查询能力,覆盖 Workers、R2、D1、Workers AI、Vectorize、Images、Stream 等全部按量计费产品。API 字段对齐 FinOps 开放成本与用量规范 FOCUS,返回按产品和计费周期的明细行。目前用量与成本数据每日更新,企业级合同支持仍在开发中。

相关链接:
产品应用
NousResearch 发布 Hermes Agent v0.20.0 #12
NousResearch 发布 Hermes Agent {v0.20.0|新版本更新}。该版本新增{流式对话语音|"流式对话语音"}、{Agent-to-Agent协议|"Agent-to-Agent协议"}与{桌面应用插件 SDK|"桌面应用插件SDK"}等功能。
NousResearch 发布 Hermes Agent v0.20.0。相比上版,该版本包含约 3,650 次提交与约 1,400 个合并 PR。 本次更新核心新增支持流式合成与可中途打断的实时对话语音模式,覆盖 CLI、桌面应用及飞书等多平台。同时引入 Agent-to-Agent v1.0 协议、出站 webhooks、事实检查技能,以及桌面应用 plugin SDK 与 artifacts 沙盒预览。 工具调用默认迭代上限从 90 提升至 500,引入上下文微压缩机制,冷启动降至约 1.8 秒。
相关链接:
行业动态
据报道美国已完成AI监管框架,邀请主要科技公司审阅 #13
据报道,美国政府已邀请OpenAI、Google、Anthropic等AI公司,于周二审阅一份已完成的自愿AI监管框架。该框架将建立前沿模型发布前向政府提交的流程。
据The Information独家报道,美国政府已邀请OpenAI、Google和Anthropic等主要科技公司员工于周二前往白宫,审阅一份已完成的AI监管框架最终版本。该框架为自愿性质,将建立一套流程,要求各实验室在发布前沿模型前向政府提交。

相关链接:
技术与洞察
OpenAI 发文详解 GPT-Live 架构:全双工模型与异步委派 #14
OpenAI发文详解其第三代语音系统GPT-Live。它采用全双工模型,移除轮次检测器,支持同时听与说。需深度推理或用工具时,它能不中断语音流异步调用GPT-5.5。
OpenAI发文详解第三代语音系统GPT-Live的底层架构。该系统采用全双工模型支持同时听与说,移除传统轮次检测器以降低延迟。需深度推理或调用工具时,系统可异步调用GPT-5.5等前沿模型,且核心语音流不中断。
为实现该体验,OpenAI耗时六个月重构系统,将核心媒体流与业务逻辑分离。系统改用Go语言取代Python,使新系统p95帧流畅度媲美旧系统p50。团队开发WARP协议与Instant Connect技术,将网络启动往返次数从六次降至一次。系统支持无缝切换实例与动态上下文压缩,发布前曾路由部分真实流量进行静默测试。
目前,GPT-Live已为ChatGPT Voice提供支持,包含控制电脑及协调Agent等功能,其专属API即将推出。

相关链接:
- https://openai.com/index/continuous-voice-interaction-with-gpt-live/
- https://x.com/TheRealAdamG/status/2084422356349624404
Google Agent Skills 团队分享项目构建、测试与质量控制机制 #15
Google Agent Skills 团队发文分享了该项目 Skills 构建与质量机制,项目要求 Skill 通过自动化检查与持续评估,以保证规模化扩展时的质量。
Google Agent Skills 团队详细介绍了该项目在构建、测试和规模化过程中的质量控制机制。该项目旨在将 Google Cloud 领域知识编码为结构化的开源指令,以减少 AI Agent 幻觉并强制执行最佳实践。为保证规模化扩展时的质量,团队为每个 Skill 制定了标准化的仓库布局,在设计上优先引用远程 MCP 工具。所有 Skill 在公开发布前,必须通过包含链接检查在内的自动化 CI/CD 管道,并在提交时和每周接受基于准确性与效率的持续评估。

相关链接:
前瞻与传闻
智谱GitHub仓库及ZCode文档出现GLM-5.3相关内容 #16
据社区用户发现,智谱ZCode文档短暂出现 GLM-5.3 相关字样。同时智谱官方GitHub仓库也出现相关字符,但官方尚未透露有关GLM-5.3的更多信息。
社区用户发现智谱官方 GitHub 仓库 zai-org/z-ai-sdk-java 出现了 glm-5.3 分支,ZCode 文档页面也短暂出现了 GLM-5.3 相关字样,该模型疑似即将上线。上述信息均来自社区用户对官方仓库和文档的观察,智谱尚未正式宣布 GLM-5.3 的发布时间或可用范围。


相关链接:
提示:内容由AI辅助创作,可能存在幻觉和错误。
AI HOT 补充资讯
模型发布/更新
Qwen3.8-Max 发布:开源最强编码与协作模型,2.4T 参数 #A1
来源:AI HOT:Qwen:Blog Retrieval(API)
Qwen 正式发布 Qwen3.8-Max,这是 Qwen 家族迄今最强的模型,拥有 2.4T 参数(95B 激活),并首次开源 Qwen-Max 级权重,开放权重将于下周发布。
商汤发布 SenseNova U1.5-Lite-Preview 开源模型 #A2
来源:AI HOT:X:商汤 SenseTime (@SenseTime_AI)
商汤推出 SenseNova U1.5-Lite-Preview,一个基于 NEO-Unify 架构的轻量级原生统一多模态模型,仅 8B-MoT 参数即可达到商业闭源模型的生成与编辑质量。
产品发布/更新
Cloudflare 推出 Billable Usage API:为自助账户提供按产品与计费周期的程序化成本可见性 #A3
来源:AI HOT:Cloudflare Blog
Cloudflare 发布 Billable Usage API,为自助账户提供单一端点,一次调用即可返回按产品和计费周期拆分的用量与成本,覆盖 Workers、R2、D1、Workers AI、Vectorize、Images 和 Stream。
OpenRouter 推出 Ori Eval 简化评估流程 #A4
来源:AI HOT:X:OpenRouter (@OpenRouter)
推出 Ori Eval:编写首个评估的最简单方式。 没有绝对最好的模型,只有最适合每项任务的模型。Ori Eval 利用 OpenRouter 的 API 处理代码库中的每项任务,然后评估结果。 curl -fsSL https://openrouter.ai/skills/spawn-ori-eval
Cloudflare 推出 @cloudflare/computer 预览版:为智能体提供虚拟文件系统与多执行环境 #A5
来源:AI HOT:Cloudflare Blog
Cloudflare 发布 @cloudflare/computer 早期预览版,这是一个开源智能体运行时,为每个智能体提供虚拟文件系统,并支持在 isolate、容器沙箱或浏览器中执行代码。
GPT-Live实时音频新架构发布 #A6
来源:AI HOT:X:Greg Brockman (@gdb)
GPT-Live 是一种用于实时音频的新架构和栈: GPT-Live 可以在说话的同时聆听。 为了让这种体验在 ChatGPT 规模下显得自然,我们从客户端到模型重建了语音栈。 这一新架构让音频持续流动,因此更深入的推理和工具使用不会打断对话。
微软开源 Orchard 智能体训练框架 #A7
来源:AI HOT:X:Microsoft Research (@MSFTResearch)
Orchard 是一个面向研究社区的开源框架,用于跨任务类型训练和评估 AI 智能体。它降低了复杂性,同时通过让研究人员复用同一套基础设施,支持较小模型也能实现强劲性能。https://msft.it/6019a8fqP
行业动态
欧盟《人工智能法案》透明度规则生效,违规最高罚 1500 万欧元 #A8
来源:AI HOT:The Verge:AI(RSS)
欧盟《人工智能法案》下的新透明度义务于 8 月 2 日生效,要求公司披露用户何时与 AI 模型互动,并为合成音视频和文本添加机器可读标记。欧盟还推出了一套可选的 AI 披露标签供平台采用,但标注要求本身是强制性的。违规公司面临最高 1500 万欧元(约 1720 万美元)或全球年营业额 3% 的罚款,8 月 2 日前推出的模型有 4 个月宽限期。
Databricks 完成对 Panther 的收购,加速安全湖仓时代 #A9
来源:AI HOT:Databricks:Blog(RSS)
Databricks 宣布正式完成对安全数据平台 Panther 的收购,旨在加速安全湖仓(Security Lakehouse)时代。此次收购将 Panther 的安全分析能力整合进 Databricks 平台,帮助企业在统一的数据架构上运行安全运营与威胁检测工作负载。具体交易条款未披露。
论文研究
多模态大语言模型对齐的全面研究:Apple 团队独立拆解偏好对齐各环节 #A10
来源:AI HOT:Apple Machine Learning Research(RSS)
Apple 研究团队系统梳理了多模态大语言模型(MLLM)中的偏好对齐方法,将算法分为离线(如 DPO)与在线(如 online-DPO)两类,并发现两者结合可在特定场景下提升模型性能。团队还提出无需额外标注或外部模型的新型多模态偏好数据构建方法 Bias-Driven Hallucination Sampling(BDHS),在多项基准上取得与既有对齐工作相当的竞争力。
技巧与观点
AirLLM 实现单块 4GB GPU 运行 70B 模型推理 #A11
来源:AI HOT:Hacker News 热门(buzzing.cc 中文翻译)
AirLLM 项目支持在单块 4GB 显存 GPU 上运行 70B 参数大模型推理,无需多卡或大规模显存配置。该项目已开源,相关讨论在 Hacker News 上获得 103 点热度,引发社区关注。
Palantir 强劲季度后,CEO Alex Karp 称 AI 行业“马克思主义” #A12
来源:AI HOT:TechCrunch:AI(RSS)
Palantir CEO Alex Karp 在季度股东信中警告,前沿 AI 实验室对企业过于不可信,并称其意图“占有所谓合作伙伴的生产资料”,带有“马克思主义色彩”。该公司第二季度营收 19 亿美元,同比增长 93%,利润 11 亿美元。Karp 主张 Palantir 提供模型无关的 AI 与分析软件,让企业掌控自身数据与 AI“废气”(提示词、编排、上下文)。
Kimi Work 幻灯片制作教程发布 #A13
来源:AI HOT:X:Kimi.ai (@Kimi_Moonshot)
使用 Kimi Work 制作幻灯片 - 教程 #1。 Kimi Slides 处理整个幻灯片制作流程: - 清晰的结构与研究,由 Kimi K3 驱动 - 连贯的设计,包括精美的图表和 SmartArts - 可编辑并可直接下载 欢迎在评论区告诉我们你还想看什么内容!
Claude Code 连接器可复用至 Artifacts #A14
来源:AI HOT:X:Thariq (@trq212)
我想很多人没有意识到——如果你连接了一个 Claude 连接器(例如你的 Gmail、日历、Slack 等),Claude Code 也将能够使用它们,包括在 Artifacts 中。
EA 首席战略官谈生成式 AI 如何进入可游玩的实时游戏世界 #A15
来源:AI HOT:Runway:News(网页)
EA 首席战略官 Mihir Vaidya 认为,游戏是 AI 的试验场,但生成式 AI 进入游戏面临 60 帧/秒、数千玩家同步和低延迟等严苛约束,不能只追求“看起来真实”,而必须“行为正确”。他主张采用神经符号架构,在生成能力之外保留确定性与可控性,并称“控制是下一个前沿”。EA 将 AI 影响分为效率、扩展和转型三个层面,其中《模拟人生》已服务超 5 亿玩家,拥有近万亿种游玩排列组合。
提示:内容由 AI 辅助整理,可能存在错误,请以原始出处和官方信息为准。