AI 早报 2026-08-11

本页合并来源:Juya AI 早报 + AI HOT 日报。Juya 保留完整精选,AI HOT 作为补充来源;已按链接和标题做基础去重。

概览

Juya · 要闻

  • Meta 发布 Muse Glimmer 并预告 Muse Spark 1.2 开源权重 #1
  • Anthropic:未发布的研究版Claude模型将黎曼零点比例下界提高至67.2% #2
  • Anthropic为Claude输出添加机器可读标记,覆盖所有产品线 #3
  • Claude Sonnet 5 定价永久保持2美元/10美元每百万token #4

Juya · 模型发布

  • OpenAI 推出 GPT-5.6-Cyber 并扩展 Daybreak 网络安全倡议 #5
  • Microsoft AI 发布 MAI-Image-2.6,位列 Arena 榜单第二名 #6
  • 蚂蚁百灵开放Ling-3.0-tiny权重 7.9B总参数 #7
  • NVIDIA发布Magpie TTS Multilingual模型,支持12种语言 #8

Juya · 开发生态

  • 阿里上线千问开放平台 支持在对话内直接调用第三方服务 #9
  • Qwen 官方发布 Qwen-MM-Plugins 多模态插件 #10
  • Kilo Code 宣布受 Metabase 安全事件影响,部分用户数据或已暴露 #11
  • OpenRouter Auto Router 升级,按实际消费份额路由模型 #12
  • Spotify 发布 Xirp:支持多 Agent 集中管理与无缝切换模型 #13

Juya · 产品应用

  • ChatGPT 新增餐厅预订功能,首批面向美国和加拿大开放 #14
  • Grok 推出 Voice connector 支持生成个性化播客 #15
  • 千问App推出办公助理付费会员与视频生成收费方案 #16
  • OpenAI 即将为 ChatGPT Business 订阅推出五倍用量的高级席位 #17
  • Tibo 宣布所有付费 ChatGPT Work 和 Codex 用户使用限制已重置 #18

Juya · 行业动态

  • 桑德斯敦促科技巨头暂停 AI 开发,称失控风险已至灾难边缘 #19
  • 英伟达与Apollo及黑石等建立合作 推动AI工厂计算成为可投资资产 #20
  • 报道称微软计划大幅扩大自研 Maia AI 芯片产量以减少对英伟达依赖 #21
  • 晚点报道称智谱 API 用户近700万,已启用超5万块国产算力芯片 #22
  • 零一万物大模型开放平台将逐步停止API调用及充值服务 #23

Juya · 技术与洞察

  • Mark Zuckerberg 发文阐述 Meta 构建超级智能哲学与愿景 #24

AI HOT 补充

  • SGLang 为 Muse Glimmer 提供 Day-0 支持,针对本地智能体工作流优化推理 #A1
  • Meta 发布开源模型 Muse Glimmer #A2
  • OpenAI 推出 GPT-5.6-Cyber,面向授权漏洞研究的网络安全专用模型 #A3
  • OpenRouter 推出由市场智慧驱动的新版 Auto 路由器 #A4
  • 千问开放平台上线:租房、寄快递、查理财等十余领域服务可对话办理 #A5
  • Qwen-MM-Plugins 让智能体原生支持多模态 #A6
  • OpenChamber:一个基于代理的开发环境 #A7
  • Claude Code 自动模式默认开启原理 #A8
  • 英伟达联合六大机构融资5000亿美元建AI工厂 #A9
  • Zapier 如何用 ChatGPT Work 改造核心营销流程 #A10
  • Claude 未发布研究版将黎曼 zeta 函数零点下界从 41.6% 提升至 67.2% #A11
  • tl;dv 逾18.1万段AI会议录音被公开暴露,可实时闯入他人通话 #A12

Juya 早报精选

要闻

Meta 发布 Muse Glimmer 并预告 Muse Spark 1.2 开源权重 #1

Meta Superintelligence Labs 发布 Muse Glimmer 30B 开放权重模型,该模型为参数约 300 亿的Dense模型,支持文本与图像多模态输入,上下文长度128k。根据官方基准测试数据,Muse Glimmer 在多项任务上表现优于同级别的 Gemma4-31B 和 Qwen3.6-27B。同时,官方确认 Muse Spark {1.2|一点二} 的权重也即将发布。

Meta Superintelligence Labs 发布 Muse Glimmer 30B 开源 Agentic 语言模型,采用 Apache 2.0 许可协议,权重已在 Hugging Face 开放下载。该模型为Dense模型,总参数约 296 亿,包含约 18 亿参数的 ViT-G/14 感知编码器,支持文本与图像多模态输入,上下文长度128k tokens。根据官方基准测试数据,Muse Glimmer 在多项任务上表现优于同级别的 Gemma4-31B 和 Qwen3.6-27B。同时,Mark Zuckerberg 和 Alexandr Wang 均确认最新基础模型 Muse Spark 1.2 的开放权重即将发布。

相关链接:


Anthropic:未发布的研究版Claude模型将黎曼零点比例下界提高至67.2% #2

Anthropic宣布,其一个未发布的研究版Claude模型在尝试证明黎曼猜想时,虽未证明猜想本身,但把黎曼ζ函数零点落在临界线的比例下界从{41.6%|百分之四十一点六}提高到67.2%,相关论文和形式化证明已公布。

Anthropic近日宣布,其未发布的研究版Claude模型在尝试证明黎曼猜想时,虽未能证明猜想本身,但将黎曼ζ函数非平凡零点落在临界线上的已知比例下界从41.6%提高至67.2%。该结果由Anthropic两位数学家Levent Alpöge和Ralph Furman审查验证,外部专家Brian Conrey和Dan Goldston审阅了论文,Claude还使用Lean形式化证明语言产出了可机器验证的证明,相关论文、证明笔记、附录及Lean形式化证明均已公布。Anthropic表示,Claude所用技术不太可能直接导向黎曼猜想的最终证明,但展示了AI模型数学能力的进展。

相关链接:


Anthropic为Claude输出添加机器可读标记,覆盖所有产品线 #3

Anthropic宣布,8月2日起发布的新Claude模型将在输出中添加机器可读标记,以遵守欧盟AI法案第50条。标记包含隐形文本水印和基于{C2PA|C to PA}标准的文件签名元数据,覆盖全产品线。配套检测工具正开发中,未来向第三方开放。

Anthropic宣布为遵守欧盟AI法案第50条透明度准则,自2026年8月2日起发布的所有新Claude模型在生成内容时添加机器可读标记,包括嵌入文本的隐形水印和附加于文件的数字签名元数据。标记机制在全球范围内生效,覆盖Claude Platform(API)、Claude、Claude Code、Claude Cowork、Claude Tag等全部产品线,通过AWS、Google Cloud或Microsoft Foundry调用时文本水印同样适用。2026年8月2日之前发布的现有模型正在补充标记功能,具体时间表尚未公布。Anthropic正在开发配套检测工具,未来将向第三方开放检测能力。

相关链接:


Claude Sonnet 5 定价永久保持2美元/10美元每百万token #4

Claude官方宣布将Sonnet 5的优惠期定价永久化,每百万token 输入 2美元、输出10美元不变,该价格原定于8月31日截止。

Anthropic旗下Claude官方账号发布消息,称将Claude Sonnet 5的优惠期定价永久化。该模型于今年6月推出,当时定价为每百万输入token 2美元、每百万输出token 10美元,原计划优惠期持续到8月31日,如今官方确认该价格将保持不变。

相关链接:


模型发布

OpenAI 推出 GPT-5.6-Cyber 并扩展 Daybreak 网络安全倡议 #5

OpenAI 宣布扩展其网络安全倡议 Daybreak,并推出了新的 GPT-5.6-Cyber 模型。根据官方数据,该模型在内部高级网络安全完成率评估中达到 95.0%,目前仅向获批的防御者和组织提供访问权限。

OpenAI 宣布扩展其网络安全倡议 Daybreak,推出包含 Daybreak Blue 和 Daybreak Red 两个层级的访问权限,并发布了新的 GPT-5.6-Cyber 模型。根据官方数据,基于 GPT-5.6 Sol 训练的 GPT-5.6-Cyber 旨在提高漏洞利用开发等任务的完成率,其在内部评估中的高级网络安全完成率达到 95.0%。该模型在 ExploitGym 测试中优于前代,但在漏洞报告写作评估中因报告较短而表现不及 GPT-5.6 Sol。目前,这些模型仅向经过批准的防御者和组织开放,2026 年 9 月 1 日起 Daybreak 个人账户将被强制要求使用硬件安全密钥。

相关链接:


Microsoft AI 发布 MAI-Image-2.6,位列 Arena 榜单第二名 #6

Microsoft AI 宣布推出文生图模型 MAI-Image-{2.6|二点六}。官方称该模型在文本渲染、人像和 3D 图像等多个类别实现全面增长,并位居 Arena 文生图排行榜第二名。

Microsoft AI 发布了全新的文生图模型 MAI-Image-2.6。根据 Arena.ai 排行榜数据,该模型以 1336 分位列全球第二,仅次于 GPT Image 2 (Medium)。官方表示,相较于上一代 MAI-Image-2.5,新模型总体提升了 79 个 Elo 分数,并在文本渲染、人像和 3D 图像等多个类别实现全面增长。目前,用户可以在 Arena 上体验该模型,它将于本周晚些时候登陆 MAI Playground,并陆续向 Microsoft Foundry 等其他产品推出。

相关链接:


蚂蚁百灵开放Ling-3.0-tiny权重 7.9B总参数 #7

蚂蚁百灵正式发布{Ling-3.0-tiny|"Ling-3.0-tiny"}的模型权重,含BF16、FP8、INT4 三种。该模型总参数7.9B、每token激活1.3B。

蚂蚁集团百灵大模型团队正式发布Ling-3.0-tiny权重模型,提供BF16、FP8、INT4三套权重,并上传至Hugging Face和ModelScope。该轻量混合推理MoE拥有7.9B总参数,每token仅激活1.3B参数。官方称其采用3:1 KDA-MLA混合架构和128路由专家,支持可按请求配置的思考模式。

相关链接:


NVIDIA发布Magpie TTS Multilingual模型,支持12种语言 #8

NVIDIA发布Magpie TTS Multilingual 357M模型,支持汉语在内的12种语言,提供开放权重。

NVIDIA发布了Magpie TTS Multilingual 357M文本转语音模型,支持英语、汉语、阿拉伯语、韩语、巴西葡萄牙语等12种语言。该模型参数量为364M,采用编码器-解码器Transformer架构,并开放权重允许商用。最新版本在NVIDIA B200 GPU上将单流首音延迟降至32毫秒。模型目前可支持标准模式下单次生成最多20秒的语音,出于安全考虑移除了零样本语音克隆功能,且仅支持这12种指定语言。

相关链接:


开发生态

阿里上线千问开放平台 支持在对话内直接调用第三方服务 #9

阿里上线千问开放平台,面向开发者开放手机、PC和AI眼镜三类终端的服务接入。目前手机和PC端已开放AI智能体接入,用户可通过千问App在对话中直接调用{顺丰速运|"顺丰速运"}、自如等十余个第三方服务完成交易下单。

阿里正式上线千问开放平台,帮助品牌和开发者将服务接入千问对话。目前,平台已在手机和PC端开放AI智能体接入能力,提供账号授权、AI支付和订单接入等基础设施,支持用户在单一对话内完成咨询、推荐、交易履约等全链路任务。用户可在千问App中通过“@”或点击角标直接调用顺丰速运、自如租房、哈啰租车等十余个领域的首批服务。

相关链接:


Qwen 官方发布 Qwen-MM-Plugins 多模态插件 #10

Qwen 官方发布 Qwen-MM-Plugins 多模态插件,让各类 Agent Harness 获得多模态能力。该插件提供图片、视频、{文档读取|"文档读取"},以及视频编辑、3D 建模和 CAD 等六项能力,支持 Claude Code、Codex等多种开发框架。

Qwen 官方发布了 Qwen-MM-Plugins 多模态插件,面向 Qwen 模型,使任意 Agent Harness 具备原生多模态能力。插件包含 core、video-memory、video-edit、blender、freecad、edu-agent 共六项能力,每项能力由一个 skill 和一个可选的 MCP server 组成。用户可通过引导式安装脚本在 Claude Code、Codex等 harness 中快速部署,原生视觉读取无需 API key,但 OCR、grounding、生成类等工具需配置 DASHSCOPE_API_KEY 或 SERPER_API_KEY。

相关链接:


Kilo Code 宣布受 Metabase 安全事件影响,部分用户数据或已暴露 #11

Anaconda 表示,Kilo Code 因 Metabase 安全事件,部分用户提示词及个人数据可能被暴露。官方正向受影响用户发送通知邮件,并确认支付信息未受影响。

Anaconda 官方就 Metabase 安全事件对 Kilo Code 的影响发布了最新调查更新。该事件导致部分 Kilo 用户的提示词或姓名、邮箱等用户数据可能已被暴露。官方确认未暴露支付卡信息,目前正陆续向受影响用户发送通知邮件,调查仍在进行中。此前官方曾确认 Kilo Slackbot 访问令牌暴露并已将其废止。此次事件仅影响 Kilo Code 用户,非 Kilo 的 Anaconda 客户不受影响。

相关链接:


OpenRouter Auto Router 升级,按实际消费份额路由模型 #12

OpenRouter发布Auto Router升级,路由现依据市场实际使用的模型和任务类型动态选择。默认成本档下MMLU Pro得分仅差1.4分而成本约降至三分之一。

OpenRouter发布Auto Router重大升级,新路由根据社区实际使用的模型和任务类型动态选择模型,当市场将工作负载迁移到新模型时会在几天内跟随。官方称在基准测试中,默认成本档大多匹配或超过旧路由器且花费更少,最大成本档全面超过旧路由器。路由通过轻量分类器将提示分为约30种任务类型,按过去7天匿名支出份额排序并应用用户的成本层级。使用时在模型字符串处发送“model”: “openrouter/auto”,可选cost_tier和允许模型列表,无额外费用。

相关链接:


Spotify 发布 Xirp:支持多 Agent 集中管理与无缝切换模型 #13

Spotify 官方宣布推出 Agentic 开发环境 Xirp,帮助开发者集中管理多个 Agent 会话。该工具目前已开放试用,支持在不同 Agent、模型与工具之间无缝切换并保留工作上下文。

Spotify 官方宣布推出名为 Xirp 的厂商中立 Agentic 开发环境,旨在解决多 Agent 并行操作带来的上下文碎片化问题。Xirp 提供一个集中界面,支持管理 Claude Code、Gemini CLI 和 OpenAI Codex 等多个工具框架下的并发会话。开发者可以在任务中途切换模型或工具,且整个工作状态和上下文会完整保留。官方表示,Xirp 目前已通过 xirp.spotify.com 向公众开放免费试用。

相关链接:


产品应用

ChatGPT 新增餐厅预订功能,首批面向美国和加拿大开放 #14

ChatGPT 正式上线餐厅预订搜索功能,用户可直接在对话中查找并预订餐厅座位。目前面向美国和加拿大用户开放。

ChatGPT 宣布新增餐厅预订搜索功能,用户只需在对话中描述需求,ChatGPT 即可在聊天界面中直接展示可用预订结果,无需逐一搜索各个平台。该功能目前已与 OpenTable、Resy 和 Yelp 三个预订平台完成整合,首批面向美国和加拿大地区开放,官方表示后续将引入更多国际合作伙伴。

相关链接:


Grok 推出 Voice connector 支持生成个性化播客 #15

Grok 正式推出 Voice connector。用户可借此生成语音备忘录与个性化播客,官方称该功能现已面向全平台用户开放。

Grok 上线了全新的 Voice connector 语音连接器功能。该功能允许用户生成语音备忘录、将每日事件转化为个性化播客,以及创建每日简报自动化任务。目前,该功能已面向 iOS、Android 和 Web 端的所有用户开放,且无需进行额外设置即可直接使用。

相关链接:


千问App推出办公助理付费会员与视频生成收费方案 #16

据报道,阿里千问App推出办公助理专业会员及视频生成收费方案,将办公与视频分开收费,成为国内第二款探索付费的头部AI应用。

据智东西报道,阿里旗下千问App推出办公助理专业会员及视频生成的对应收费方案,目前用户可在App内订阅购买。千问App的办公助理会员分为高级、精英、旗舰三档,均支持最新Qwen旗舰模型,可操作本地电脑和浏览器,并交付PPT、Excel等多种文件。与豆包专业版不同,千问App将办公与视频生成分开收费,视频生成每天提供10个免费额度,超出部分需单独购买。

相关链接:


OpenAI 即将为 ChatGPT Business 订阅推出五倍用量的高级席位 #17

OpenAI 宣布即将为 ChatGPT Business 订阅增加高级席位,提供五倍于标准席位的使用量并取消五小时使用限制。高级席位每月收费 125 美元。

OpenAI 宣布即将为 ChatGPT Business 订阅增加高级席位。高级席位提供比标准席位多 5 倍的使用量,取消五小时使用限制,并引入可预测的每周用量重置。高级席位定价为每用户每月 125 美元,按年付费为每月 100 美元,而标准席位的定价保持为每用户每月 25 美元或年付每月 20 美元。工作区所有者和管理员可以在同一工作区内混合分配这两种席位类型,并根据团队需求进行升级或重新分配。

相关链接:


Tibo 宣布所有付费 ChatGPT Work 和 Codex 用户使用限制已重置 #18

Codex 负责人 Tibo 宣布,所有付费 ChatGPT Work 和 Codex 用户的使用限制均已重置。目前,该额度重置操作已经完成。

Codex 负责人 Tibo 宣布,针对所有付费 ChatGPT Work 和 Codex 用户的额度限制已经重置完毕。此次重置适用范围为全部相关的付费用户。Tibo 在发布该消息后,明确回复了相关用户的询问,确认重置状态为真实生效。

相关链接:


行业动态

桑德斯敦促科技巨头暂停 AI 开发,称失控风险已至灾难边缘 #19

美国参议员桑德斯致信OpenAI、Anthropic和Meta的CEO,指出AI能力已达关键风险阈值,要求三家公司履行安全承诺立即暂停AI开发,并警告若企业不行动,他将推动立法介入。

参议员桑德斯向 OpenAI 的 Sam Altman、Anthropic 的 Dario Amodei 和 Meta 的 Mark Zuckerberg 发出公开信,引用三家公司此前的承诺——即在技术风险超出安全可控范围时暂停开发——要求他们履行这一承诺。桑德斯指出,AI 能力已经达到关键风险阈值,近期出现的 AI 用于开发新型病毒以及模型脱离人类控制入侵其他公司系统等事件即为明证。桑德斯表示,如果企业不主动采取行动,他将与参议院同事推动立法介入。

相关链接:


英伟达与Apollo及黑石等建立合作 推动AI工厂计算成为可投资资产 #20

英伟达宣布与 {Apollo|"Apollo"}、{BlackRock |"BlackRock "}等多家金融机构建立合作伙伴关系,共同创建独立的 AI 基础设施融资平台。这些平台旨在长期内动员超过 5000 亿美元的第三方资本,以支持 AI 工厂的扩建。

英伟达宣布与 Apollo、BlackRock、Blackstone、Brookfield、Goldman Sachs 和 KKR 建立合作伙伴关系,旨在创建可重复的融资平台,帮助符合条件的 AI 实验室、企业和 AI 云端大规模获取基础设施。据英伟达 CEO 黄仁勋透露,超过 5000 亿美元的资金代表这些平台计划长期动员的累计第三方资本,这笔资金并非英伟达的收入或单一基金。合作的金融机构将独立评估每个项目的客户需求、利用率和现金流,而英伟达主要提供 AI 工厂平台。在特定情况下,英伟达可能会提供最高不超过 25% 的残值支持机制。

相关链接:


报道称微软计划大幅扩大自研 Maia AI 芯片产量以减少对英伟达依赖 #21

报道称微软将大幅扩产自研 Maia 芯片以降低对英伟达的依赖。下一代 Maia 300 最快下月面世,正与台积电商讨数十万颗产能。

据 The Information 报道,微软正计划大幅扩大其自研 Maia AI 芯片的生产,此前其当前一代芯片仅生产了数万颗。在首席执行官萨蒂亚·纳德拉推动减少对英伟达依赖的背景下,微软的下一代 Maia 300 芯片最快将于下个月面世。微软目前正与台积电讨论,为 2027 年确保超过 30 万颗 Maia 300 芯片的产能,并目标在明年实现同等规模的产量。该公司的最终目标是获得超过 100 万颗芯片的产能,以期在未来赢得 Anthropic 等大客户的青睐。

相关链接:


晚点报道称智谱 API 用户近700万,已启用超5万块国产算力芯片 #22

据《晚点 LatePost》报道,智谱 API 注册用户近 700 万,较七月初增长约 200 万,已启用超 5 万块国产算力芯片,今年以来智谱 ARR 增长 15 倍。

据《晚点 LatePost》报道,智谱 MaaS 开放平台 API 注册用户近 700 万,较七月初增长约 200 万,其中包括 2.3 万家企业客户;对标 Codex 的开发者产品 ZCode 上线一个月用户突破百万。今年以来智谱 ARR 增长 15 倍,有投资人透露年底 ARR 预期达 20 亿美元,但智谱官方已予以否认,接近公司的人士则表示实际数字应该更高。据《晚点 LatePost》了解,智谱已启用超过 5 万块国产算力芯片以缓解日益增长的推理需求。

相关链接:


零一万物大模型开放平台将逐步停止API调用及充值服务 #23

近期,零一万物大模型开放平台宣布将逐步停止在线体验、API调用及充值等服务,平台已开放余额退还通道并预留过渡期供用户完成迁移。

近期,零一万物通过大模型开放平台发布服务调整通知称,因公司产品与服务体系升级并进一步聚焦企业级人工智能解决方案,零一万物大模型开放平台将逐步停止面向用户提供在线体验、API调用及充值等相关服务。平台将预留必要的服务过渡期,并开放余额退还及账号处理通道。

相关链接:


技术与洞察

Mark Zuckerberg 发文阐述 Meta 构建超级智能哲学与愿景 #24

Mark Zuckerberg 发文阐述 Meta 构建超级智能的哲学与价值观。Meta 计划向数十亿人提供免费的个人超级智能 Agent,并恢复发布开源模型。

Meta 首席执行官 Mark Zuckerberg 撰文阐述了 Meta 构建超级智能的哲学与价值观,主张通过个人赋权和广泛的权力制衡来确保安全。官方称,Meta 计划向数十亿人提供能够协助生活、工作和学习的个人超级智能 Agent,并承诺提供免费或可负担的版本。目前 Meta Superintelligence Labs 已经启动并运行,将恢复发布部分开源模型。此外,Meta 正在实施由独立董事会批准模型发布安全标准的治理结构。

相关链接:


提示:内容由AI辅助创作,可能存在幻觉错误

AI HOT 补充资讯

模型发布/更新

SGLang 为 Muse Glimmer 提供 Day-0 支持,针对本地智能体工作流优化推理 #A1

来源:AI HOT:LMSYS:Blog(Chatbot Arena 团队)

SGLang 与 Meta Superintelligence Labs 合作,为 30B 参数多模态模型 Muse Glimmer 提供 Day-0 支持,该模型拥有 128k+ token 上下文窗口。

Meta 发布开源模型 Muse Glimmer #A2

来源:AI HOT:X:AI at Meta (@AIatMeta)

推出 Muse Glimmer,一款开放权重、300 亿参数的模型,专为本地、常驻运行的智能体工作流优化。 与同尺寸领先模型相比,Muse Glimmer 在关键智能体用例和基准测试中表现出色,并设计为完全在消费级硬件(如 Mac 或配备高性能 GPU 的 PC)上运行。 秉承我们长期分享基础 AI 研究的传统,我们以宽松的 Apache 2.0 许可证发布模型权重。

OpenAI 推出 GPT-5.6-Cyber,面向授权漏洞研究的网络安全专用模型 #A3

来源:AI HOT:OpenAI:官网动态(RSS · 排除企业/客户案例)

OpenAI 发布网络安全专用模型 GPT-5.6-Cyber,可通过 Daybreak Red 获取,用于授权的漏洞研究、漏洞验证和安全测试。该模型旨在应对网络防御窗口不断收窄的挑战,为安全研究人员提供专门工具。

产品发布/更新

OpenRouter 推出由市场智慧驱动的新版 Auto 路由器 #A4

来源:AI HOT:OpenRouter:Announcements(RSS)

OpenRouter 基于每周超 55T token 的社区消费数据,推出新版 Auto 路由器(openrouter/auto),其模型选择在多数任务和成本档位上优于旧版。新路由器按约 30 种任务类型匹配近 7 天社区实际消费的模型,支持 cost_tier 参数(low 至 max)并遵循账户隐私设置。在 MMLU Pro 等基准上,新默认档位在多数领域以更低成本达到旧版同等性能。

千问开放平台上线:租房、寄快递、查理财等十余领域服务可对话办理 #A5

来源:AI HOT:公众号:千问APP(阿里)

千问开放平台今日上线,面向生态伙伴和开发者开放手机、PC和AI眼镜三类终端的服务接入,首批覆盖物流运输、房产居住、本地生活、理财、汽车等十多个领域。用户可在对话中@相关服务或点击“圆点角标”进入智能体,完成从咨询、推荐到下单的完整流程。平台支持标准化协议接入、一键授权与端到端调测,并提供账号、AI支付、订单接入等基础设施。

Qwen-MM-Plugins 让智能体原生支持多模态 #A6

来源:AI HOT:X:通义千问 / Qwen (@Alibaba_Qwen)

👀 看见只是开始。 借助 Qwen-MM-Plugins,让你的智能体原生支持多模态——读取图片、视频和文档,编辑视频,处理 3D/CAD,以及更多。 从多模态模型 → 多模态智能体。🚀 观看实际效果:https://github.com/QwenLM/Qwen-MM-Plugins

OpenChamber:一个基于代理的开发环境 #A7

来源:AI HOT:Hacker News 热门(buzzing.cc 中文翻译)

OpenChamber 是一个基于代理的开发环境,可跨桌面、浏览器、手机和 VS Code 使用,支持会话目标、多模型并行运行与融合、变更走查、从 issue 到 PR 的完整流程及定时任务。该工具基于 OpenCode SDK,完全开源且免费,代码和会话内容均保存在本地,远程访问可通过 UI 密码和端到端加密的 Private Relay 保护。

Claude Code 自动模式默认开启原理 #A8

来源:AI HOT:X:Claude Devs (@ClaudeDevs)

我们最近将自动模式设为 Claude Code 的默认选项,这意味着你不再需要批准每一个操作。 但什么决定某个操作是否可以安全运行?看看它是如何工作的:

行业动态

英伟达联合六大机构融资5000亿美元建AI工厂 #A9

来源:AI HOT:X:Jensen Huang (@JensenHuang)

英伟达宣布与Apollo、BlackRock、Blackstone、Brookfield、Goldman Sachs和KKR合作,建立独立融资平台,动员超5000亿美元第三方资本支持AI基础设施建设。

Zapier 如何用 ChatGPT Work 改造核心营销流程 #A10

来源:AI HOT:OpenAI:官网动态(RSS · 排除企业/客户案例)

Zapier 企业营销团队用 ChatGPT Work 自动化线索漏斗优化、营销素材搭建和报告生成,每月可对数千条线索执行 QA/QC,单人查看一条流失线索原本需 35 至 45 分钟。该系统每月为销售团队带来七位数管道价值,并生成高管仪表盘展示线索管道中的重复问题与每周趋势。团队得以将更多时间投入策略与创意工作,并计划未来设置常驻自动化循环。

论文研究

Claude 未发布研究版将黎曼 zeta 函数零点下界从 41.6% 提升至 67.2% #A11

来源:AI HOT:Anthropic:Research(发表成果 · 网页)

Anthropic 员工让 Claude 尝试攻克黎曼猜想,虽未成功,但一个未发布的研究版 Claude 在相关问题上取得突破:将满足黎曼猜想的 zeta 函数零点比例下界从 41.6% 提升至 67.2%。

技巧与观点

tl;dv 逾18.1万段AI会议录音被公开暴露,可实时闯入他人通话 #A12

来源:AI HOT:Hacker News 热门(buzzing.cc 中文翻译)

AI会议记录平台tl;dv的Firestore数据库因缺乏租户隔离,任何已认证用户可查询全部18.1万段会议记录,涉及84,312名用户、35,003个域名,含23国政府及多所高校会议。处于录制状态的约1,000场会议会暴露可加入的会议ID,研究者借此闯入马来西亚教育部及美国某大学创业团队的实时通话。该漏洞自2026年1月报告后6个月仍未修复,另有超1,000段会议内容为公开状态。

智能体真的会用电脑吗?a16z 用数据给出答案 #A13

来源:AI HOT:a16z:News(RSS)

a16z 数据显示,计算机操作智能体在 OSWorld-Verified 基准上的最佳成绩已从一年前的 42% 升至 85%,超过人类测试者约 72% 的水平,Claude Fable 5 以 85% 领先。

扎克伯格:超级智能应人人可用 #A14

来源:AI HOT:X:Mark Zuckerberg (@finkd)

我相信每个人都应能使用超级智能,我撰写了一篇长文,阐述 Meta 为所有人构建积极未来的理念与价值观。http://meta.com/thefutureisforeveryone

Linear 如何构建 Linear Agent:在系统提示词、工具设计与系统技能中划定边界 #A15

来源:AI HOT:Linear:Now(RSS)

Linear Agent 的价值在于完成未预设的工作,因此团队未为其编写固定路径,而是通过系统提示词、工具设计、产品模型、运行范围及底层自定义 harness 划定边界。系统提示词聚焦沟通风格、硬性边界与产品概念解释;工具设计将约束编码进参数,使无效操作难以执行。团队还引入系统技能作为组合单元,按需渐进加载,避免一次性暴露过多上下文。

Forking-Sequences:一种统计与计算上更高效的多步预测训练范式 #A16

来源:AI HOT:CMU:Machine Learning Blog

CMU 研究团队正式定义并系统评测了 forking-sequences 训练范式:它无需新增参数,在一次前向传播中跨所有预测创建日期编码解码整条序列。


提示:内容由 AI 辅助整理,可能存在错误,请以原始出处和官方信息为准。