AI 早报 2026-08-26

本页合并来源:Juya AI 早报 + AI HOT 日报。Juya 保留完整精选,AI HOT 作为补充来源;已按链接和标题做基础去重。

概览

Juya · 要闻

  • 阿里千问预告今日将开源Qwen3.8-Flash-Next #1
  • OpenAI公布Jalapeño推理芯片实测数据 #2
  • Codex 重置付费用户用量,并恢复 Plus 和 Business 订阅5小时限额 #3

Juya · 开发生态

  • OpenAI 正式推出每席 100 美元的 ChatGPT Business Premium 席位 #4
  • ChatGPT Work 新增代用户登录网站能力 #5
  • ChatGPT 浏览器扩展新增支持 Edge、Brave、Opera 与 Vivaldi #6
  • ChatGPT 定时任务更新:支持 Github 等应用变化触发 #7
  • OpenAI 推出 WebMCP 支持及黑客松 #8
  • Cursor 调整计费方式和套餐额度 #9
  • Command Code 宣布支持支付宝支付 #10
  • 商汤 SenseNova U1.5 Lite 生图模型接入 Token Plan #11
  • Grok 4.6 现已登陆 OpenCode Go #12
  • 官方称 OpenCode 因遭滥用下架5美元入门优惠 #13

Juya · 产品应用

  • Anthropic 统一 Claude 对话与 Cowork 记忆 #14
  • 豆包工作正式发布,下载电脑版可领 30 天订阅权益 #15
  • 千问APP与PC端「工作助理」支持绑定阿里云Token Plan额度 #16
  • ChatGPT推出Stickers贴纸生成功能 #17
  • Google Labs 推出实时协作 vibe coding 工具 Play with Putty #18
  • Perplexity 发布本地 Agent 应用 Portable Computer #19

Juya · 模型发布

  • Apodex 发布 Apodex 1.1 模型家族,开源 35B 的 mini 版本 #20
  • IBM 发布开源 Granite 4.2:面向企业 Agentic AI #21
  • 腾讯开源 WeMM-Embedding 多模态嵌入模型 #22
  • MiniMax发布H3生态集成索引仓库 #23

Juya · 行业动态

  • 苹果发布新款Mac mini与Mac Studio #24
  • Anthropic 推出 500 万美元资助计划 #25

Juya · 其他

  • Claude Code 坚持 CLAUDE.md 引发争议 #27

AI HOT 补充

  • WeatherNext 预测气旋:提前五天预警五级飓风 #A1
  • OpenWorker 新版发布,内置网络安全智能体 #A2
  • Claude 记忆功能全面打通聊天与 Cowork,用户可逐条查看和编辑 #A3
  • Apple 推出搭载 M5 Max 与 M5 Ultra 的全新 Mac Studio #A4
  • LangChain 与 Airbyte 集成:让数据摄取达到生产级就绪 #A5
  • Apple 发布搭载全新 M6 与 M5 Pro 芯片的 Mac mini #A6
  • Anthropic 推出 500 万美元资助计划,支持 AI 对用户幸福感影响的独立评估 #A7
  • OpenAI 封禁俄罗斯虚假影响力行动账号 #A8
  • AgentHands:为XR空间对话智能体生成交互式手部手势 #A9
  • STARFlow2:用归一化流桥接语言模型,实现统一多模态生成 #A10
  • 如何在编辑器里实时挑选最佳 AI 模型 #A11
  • OpenRouter 视频生成 API:一份代码优先的接入指南 #A12

Juya 早报精选

要闻

阿里千问预告今日将开源Qwen3.8-Flash-Next #1

阿里千问预告将于今日 23:00 开源 Qwen3.8-Flash-Next ,这是基于下一代Qwen4架构构建的多模态MoE模型。

阿里千问在魔搭社区和Hugging Face预告开源Qwen3.8-Flash-Next,预计发布时间为北京时间8月26日23:00,目前处于倒计时阶段、尚未放出权重。官方介绍,该模型是基于下一代Qwen4架构构建的多模态MoE模型。官方表示提前发布这些架构改进,是为了让社区为即将推出的完整Qwen4模型家族做好准备,更多细节暂未公布。

相关链接:


OpenAI公布Jalapeño推理芯片实测数据 #2

OpenAI发布了首款自研推理芯片Jalapeño的首批实测结果。该芯片专为语言模型与交互式Agent设计,在多项基准测试中,峰值每瓦性能达对比系统的1.5至1.9倍,端到端延迟降低1.7至3.6倍。OpenAI计划于今年底在内部基础设施中部署该芯片。

OpenAI发布首款自研定制推理芯片Jalapeño的首次实测性能结果,官方称该芯片在单一架构下实现了更高吞吐量和更低延迟,每瓦特可提供更多AI算力。根据InferenceX基准测试,在GPT-OSS 120B、DeepSeek R1 670B和Kimi K2.5 1T模型上,Jalapeño的峰值每瓦性能为对比系统的1.5至1.9倍,端到端延迟降低1.7至3.6倍。OpenAI计划于今年底在其计算基础设施中部署该芯片,同时其第二代芯片已进入深入开发阶段,第三代初步成型,并将继续部署NVIDIA及其他合作伙伴的加速器。

相关链接:


Codex 重置付费用户用量,并恢复 Plus 和 Business 订阅5小时限额 #3

Codex 恢复了 Plus 订阅和 Business 订阅原有的 5 小时限额机制,Pro 用户目前不受影响。同时,Codex 重置了付费用户的用量。此外,据用户观察,Codex桌面版开始原生支持显示第三方模型,并在桌面端取消了按 provider 隔离会话的机制。

Codex 近期调整了使用额度与桌面端能力。OpenAI 宣布恢复 Plus 用户的 5 小时使用限额,以平滑算力负载并避免用户过快耗尽周额度;社区随后反馈 Team 也受到同样限制。与此同时,官方重置了Plus、Team 和 Pro 用户的额度。此外,Codex 桌面版开始原生显示配置的第三方模型,且有用户实测桌面端会话已不再按 provider 隔离,不过 CLI 仍然隔离。

相关链接:


开发生态

OpenAI 正式推出每席 100 美元的 ChatGPT Business Premium 席位 #4

OpenAI 宣布正式推出 ChatGPT Business Premium 席位,每席定价 100 美元,面向小企业和初创团队,提供更多用量且不设置 5 小时用量限制。

OpenAI 宣布正式推出 ChatGPT Business Premium 席位,每席定价 100 美元,Greg Brockman 表示应大量用户需求,该席位现已可在 ChatGPT 中使用。Premium 席位取消 5 小时用量限制并提供标准席位的 5 倍用量。Tibo 表示该方案与 100 美元的 Pro 方案类似,但为团队和小公司设计。

相关链接:


ChatGPT Work 新增代用户登录网站能力 #5

ChatGPT 官方宣布,ChatGPT Work 现已可在网页端和移动端登录网站,且 ChatGPT 全程看不到用户的用户名或密码。该功能今日起向 Plus、Pro 和 Business 用户逐步推出。

ChatGPT 官方账号宣布,ChatGPT Work 现在可以在网页端和移动端使用其 computer 和 browser 登录网站。官方称,登录过程由 ChatGPT Work 代为完成,ChatGPT 全程不会看到用户的用户名或密码。网站登录功能今日起在网页端和移动端向 Plus、Pro 和 Business 用户逐步推出。官方还表示,凡是平时需要用户自己打开浏览器逐项点击完成的任务,都可以尝试交给 ChatGPT Work。

相关链接:


ChatGPT 浏览器扩展新增支持 Edge、Brave、Opera 与 Vivaldi #6

ChatGPT 浏览器扩展新增支持 Edge、Brave、Opera、Vivaldi 四款浏览器,标签页上下文可直接带入任务供 Codex 使用。

OpenAI 的 ChatGPT 浏览器扩展已新增对 Microsoft Edge、Brave、Opera 和 Vivaldi 四款浏览器的支持。扩展现在可以把标签页的上下文带入 ChatGPT 桌面版的任务中,让 Codex 基于用户面前的内容工作,也能驱动浏览器完成取消订阅、向 CRM 录入数据等网页任务。用户还可以在任意标签页内通过 side chat 使用 ChatGPT 的完整能力,但 side chat 尚未在 Opera 上推出,官方表示很快会上线。

相关链接:


ChatGPT 定时任务更新:支持 Github 等应用变化触发 #7

ChatGPT 更新定时任务,Plus 和 Pro 用户可设置任务在 Slack、Gmail、Github 出现变化时自动响应。定时任务功能正陆续向免费用户开放,最多可创建三个任务,现在还支持分享任务。

ChatGPT 官方宣布对网页端和移动端 ChatGPT Work 的定时任务进行多项更新。Plus 和 Pro 用户现在可以设置任务在 Slack、Gmail 和 Github 出现变化时自动响应,而不是只能按固定时间表运行。定时任务功能正陆续向 ChatGPT 免费用户推出,免费用户最多可创建三个任务。用户现在还可以分享自己常用的任务,供其他人定制和使用。

相关链接:


OpenAI 推出 WebMCP 支持及黑客松 #8

OpenAI 为 ChatGPT 桌面应用内置浏览器和 ChatGPT Sites 添加 WebMCP 支持。官方同步启动为期 10 天的 WebMCP Challenge 黑客松。

OpenAI Developers 宣布,ChatGPT 桌面应用的内置浏览器和 ChatGPT Sites 正在加入对 WebMCP 的支持,用户访问兼容网站时,ChatGPT 或 Codex 可自动使用该网站暴露的工具完成任务。WebMCP 是一项实验性开放标准,允许网站直接向 Agent 暴露结构化工具。同一时间,OpenAI 联合 Google Chrome、Cloudflare、Shopify、Vercel、Render 和 Netlify 推出为期 10 天的 WebMCP Challenge 黑客松。

相关链接:


Cursor 调整计费方式和套餐额度 #9

Cursor 宣布将 Auto模式改为按路由模型计费,同步上调 Cursor Models 额度,此外,为回应需求,Cursor 再次提高 Grok 模型的包含额度。

Cursor 调整 Auto 的计费方式,由统一价格改为按实际路由到的模型计费,多数请求价格将高于此前;与此同时,Cursor 也提高了包括 Auto 在内的自有模型套餐额度。此外,随着 Grok 4.6 使用需求上升,Cursor 在上月已经翻倍的基础上,再次永久提高 Grok 模型的包含额度。

相关链接:


Command Code 宣布支持支付宝支付 #10

Command Code 官方宣布其产品现已支持支付宝支付。

Command Code 官方宣布其产品新增支持 Alipay(支付宝) 支付方式。多名社区用户还提出增加中文界面和文档的诉求。

相关链接:


商汤 SenseNova U1.5 Lite 生图模型接入 Token Plan #11

商汤 SenseNova U1.5 Lite 生图模型接入日日新 Token Plan,公测期间每 5 小时免费 1500 次请求,支持生成编辑一体与 4K 无水印输出。

商汤宣布,新一代图片创作模型 SenseNova U1.5 Lite 已正式接入日日新 SenseNova Token Plan。公测期间提供免费配额,每 5 小时 1,500 次请求,设置 watermark=false 可免费生成无水印高清原图,官方提示该能力后续将转为付费。

相关链接:


Grok 4.6 现已登陆 OpenCode Go #12

OpenCode 宣布 Grok 4.6 模型现已上线 OpenCode Go 订阅方案,订阅用户每 5 小时可获得 169 次请求额度,目前即可使用。

OpenCode 通过官方账号宣布,Grok 4.6 模型现已在 OpenCode Go 上线,当前处于可用状态。该模型面向 OpenCode Go 订阅用户开放,使用配额为每 5 小时 169 次请求。

相关链接:


官方称 OpenCode 因遭滥用下架5美元入门优惠 #13

OpenCode 官方确认因遭遇大量滥用而移除首月5美元入门定价,该服务当前起步价已调整为10美元/月。

据社区用户发现,OpenCode 已移除首月5美元的入门优惠定价,目前起始价格调整为10美元/月。OpenCode 官方人员 dax 确认了该变动,并称移除原因是该优惠方案吸引了大量滥用。官方表示仍认可入门优惠的想法,但后续需寻找不易受滥用影响的新方案。

相关链接:


产品应用

Anthropic 统一 Claude 对话与 Cowork 记忆 #14

Anthropic 宣布 Claude 对话现在与 Claude Cowork 共用同一份记忆,交给 Cowork 的任务可直接沿用对话中积累的背景。

Anthropic 宣布,Claude 的记忆功能完成统一,聊天与 Claude Cowork 现在使用同一份记忆,Cowork 在云端执行任务时可直接调用聊天中积累的内容,反之亦然。Claude 现在会在对话进行中自动把新话题加入记忆,用户也可随时暂停或重置记忆,并在记忆设置的 Topics 列表中逐条查看、编辑或删除记忆内容。记忆功能在 Free、Pro 和 Max 订阅方案的网页端、桌面端和移动端默认开启。

相关链接:


豆包工作正式发布,下载电脑版可领 30 天订阅权益 #15

豆包工作正式发布,这款面向生产力场景的 Agent 产品可自主拆解任务、调用工具完成复杂办公工作,即日起下载电脑版可领 30 天订阅权益。

豆包工作正式发布,这是一款面向生产力场景的全新 Agent 产品,官方称其能围绕用户目标自主拆解任务、调用工具、持续推进复杂工作流程,覆盖写文档、做表格、画 PPT等常见办公能力。产品可操作电脑与浏览器,过程全程可见、用户可随时接管,并与飞书深度打通,让 Agent 基于企业上下文更准确地完成工作。即日起,下载豆包工作电脑版或将豆包电脑版更新至最新版本,即可领取 30 天订阅权益;豆包订阅用户领取后,订阅有效期顺延 30 天。

相关链接:


千问APP与PC端「工作助理」支持绑定阿里云Token Plan额度 #16

千问APP与PC端上线阿里云Token Plan接入功能,用户绑定API Key后,「工作助理」执行任务将直接消耗 Token Plan 额度。

千问APP与PC端上线阿里云Token Plan接入功能,支持用户绑定API Key后使用Token Plan额度处理复杂任务。在千问「工作助理」中执行操作电脑和浏览器、调用skill交付office文档等复杂任务时,消耗的Token将直接从用户Token Plan订阅额度中扣除,该功能已在千问APP与PC端可用。

相关链接:


ChatGPT推出Stickers贴纸生成功能 #17

ChatGPT官方推出Stickers贴纸生成功能,支持将照片或想法生成带透明背景的自定义表情包,并可在iMessage及WhatsApp分享。

ChatGPT官方宣布推出Stickers功能。用户可通过ChatGPT Images将照片或创意转化为自定义表情包,且支持生成透明背景。该贴纸可在iMessage或WhatsApp中分享,操作需在侧边栏选择“Images”后点击“Stickers”。此外,用户也可为其他图片生成透明背景。

相关链接:


Google Labs 推出实时协作 vibe coding 工具 Play with Putty #18

Google Labs 推出实验性协作 vibe coding 工具 Play with Putty,现已开放候补名单。这款工具支持多人实时共同搭建网站和工具,目前仅限美国地区用户加入。

Google Labs 宣布推出全新实验项目 Play with Putty,这是一款协作式 vibe coding 工具,目前已开放候补名单。官方介绍称,这款工具支持多人实时共同搭建工具和网站,并邀请用户加入候补名单后向团队分享反馈。该实验目前仅面向美国地区年满 18 岁的用户。

相关链接:


Perplexity 发布本地 Agent 应用 Portable Computer #19

Perplexity 推出本地 AI Agent「Portable Computer」,可在 NVIDIA DGX Spark 上运行完整 Agent 栈,主打本地处理和隐私,并公布了自研 27B 模型及相关性能测试。

Perplexity 推出本地 AI Agent「Portable Computer」,首发支持 NVIDIA DGX Spark,遇到需要更强推理的任务时,也可在用户授权后调用云端前沿模型,同时敏感文档继续保留在设备上。产品内置 PPLX 27B,并支持 Qwen 3.8 27B,Perplexity 还公布了一系列知识工作、网页研究和文档解析测试结果,强调其在隐私、成本和本地执行效率上的优势。该产品已面向拥有 DGX Spark 的 Pro 和 Max 用户开放,后续还将扩展更多 NVIDIA 硬件和模型支持。


模型发布

Apodex 发布 Apodex 1.1 模型家族,开源 35B 的 mini 版本 #20

Apodex 发布 Apodex 1.1 模型家族,主打复杂专业工作的 Agentic 能力;35B 的 Apodex 1.1 mini 开放权重,配套开源工作台 FrontierAgent 同步推出。

Apodex 正式发布 Apodex 1.1 模型家族,完整模型已驱动官方在线工作台上线,官方称可在专业工作、科研、金融分析与深度搜索等复杂任务上提供前沿 Agentic 表现。35B 的 Apodex 1.1 mini 已开放权重、支持本地部署。配套开源的 FrontierAgent 是本地可部署研究工作台,提供 ReAct 与 Agent Team 两种模式,在 macOS 和 Linux 上可一条命令运行、无需预装 Docker。裸模型 API 访问将陆续通过主要 API 平台推出,官方称模型权重、技术报告与开发者文档仍在推进中。

相关链接:


IBM 发布开源 Granite 4.2:面向企业 Agentic AI #21

IBM 发布面向企业 Agentic AI 的开源模型系列 Granite 4.2,提供 3B、8B、30B 三种参数规模。

IBM 官方发布开源模型家族 Granite 4.2,包含 3B、8B、30B 三个参数规模,面向企业 Agentic AI 工作流。官方模型卡显示其支持完整思考、不思考与低努力三种模式,上下文窗口为 512K。语言模型采用 Apache 2.0 许可,可部署于云端、本地与边缘环境,已上线 Hugging Face、Ollama 等平台。此次同步推出 Granite Speech 5.0 Turbo CTC 及其非商用版本,参数量仅 470M。

相关链接:


腾讯开源 WeMM-Embedding 多模态嵌入模型 #22

腾讯开源多模态嵌入模型 WeMM-Embedding,提供 2B、4B、9B 三个版本。模型基于 Qwen3.5,支持文本、图像、视频等输入。

腾讯在 Hugging Face 公开 WeMM-Embedding 系列通用多模态嵌入模型,含 WeMM-Embedding-2B、4B、9B 三个版本,同步提供 GitHub 仓库和技术报告。三款模型均基于 Qwen3.5 构建,支持文本、图像、视频、视觉文档及交错多模态输入,分别输出 2048、2560、4096 维 L2 归一化嵌入,不支持音频输入。模型以 Apache License 2.0 开源。

相关链接:


MiniMax发布H3生态集成索引仓库 #23

MiniMax官方发布H3生态集成索引仓库,涵盖从24GB显存本地ComfyUI部署到企业级推理及开发者工具,现已面向开源社区开放。

MiniMax官方称其H3生态系统正在快速发展,并发布了名为“Awesome MiniMax H3 Integrations”的GitHub索引仓库。该仓库追踪围绕H3构建的项目,涵盖支持INT8、NVFP4、GGUF直至8GB显存限制的量化指南,加速LoRA、Sol-Attn等推理加速工具,以及原生Agent技能等开发者工具和对Apple Silicon的h3.c支持。

相关链接:


行业动态

苹果发布新款Mac mini与Mac Studio #24

苹果发布新款Mac mini与Mac Studio,搭载M6、M5 Pro、M5 Max及M5 Ultra芯片,强化了设备端AI与集群推理能力。

苹果发布新款Mac mini与Mac Studio,分别首发2nm制程的M6芯片及采用四晶粒架构的M5 Ultra芯片,两款产品均强调设备端AI推理及雷雳5集群能力。Mac mini提供M6与M5 Pro两种版本;Mac Studio提供M5 Max与M5 Ultra两种版本。

相关链接:


Anthropic 推出 500 万美元资助计划 #25

Anthropic 推出 500 万美元资助计划,资助评估 AI 对用户福祉影响的独立研究。

Anthropic 宣布推出总额 500 万美元的资助计划,支持针对 AI 影响用户福祉的独立评估研究。获资助者将获得直接资金、Anthropic 模型的访问权限和技术支持,用于构建帮助 AI 行业衡量模型对使用者影响的开源评估。

相关链接:


其他

Claude Code 坚持 CLAUDE.md 引发争议 #27

Shopify CEO Tobi Lütke 称考虑禁用 Claude Code,因其只认 CLAUDE.md、易造成团队配置分裂;Anthropic 工作人员回应称正增强自定义能力,并将支持 AGENTS.md 等配置。

Shopify CEO Tobi Lütke 表示,正考虑在公司内部禁用 Claude Code,直到 Anthropic 支持其读取 AGENTS.md、.agents/skills 等通用配置文件,而不是只认 CLAUDE.md。他认为,团队成员使用不同 AI 编程工具时,这种做法会导致配置和行为出现“split brain”。 Anthropic 员工 Thariq 随后回应称,团队正在增强 Claude Code 的可定制性,包括更方便地支持 AGENTS.md 和修改系统提示词,相关功能准备好后会公布。他解释,Anthropic 认为不同模型并不能简单互换,而系统提示词又会显著影响性能,因此 Claude Code 会针对不同模型维护不同提示词;不过他也承认,这种维护成本并不适合所有团队。

相关链接:


提示:内容由AI辅助创作,可能存在幻觉错误

AI HOT 补充资讯

模型发布/更新

WeatherNext 预测气旋:提前五天预警五级飓风 #A1

来源:AI HOT:X:Google AI (@GoogleAI)

Google AI 发布 WeatherNext 气旋预测模型,可同时预测风暴路径、强度和规模,比现有系统多提供一整天的预警时间。该模型在 2025 飓风季实战测试中,提前五天预测飓风 Melissa 在牙买加的五级登陆,系美国国家飓风中心首次实时使用 AI 模型。模型单场风暴可生成多达 1000 次模拟,代码与权重已开源。

产品发布/更新

OpenWorker 新版发布,内置网络安全智能体 #A2

来源:AI HOT:X:Andrew Ng(DeepLearning.AI 创始人) (@AndrewYNg)

Andrew Ng 旗下开源智能体 OpenWorker 发布新版,强化安全工作流。其 harness 完全开源,安全团队可审计无后门。新版内置代码漏洞扫描、依赖供应链注入检测和云安全配置检查三类网络安全智能体,并支持本地运行开源权重模型以保护敏感代码。

Claude 记忆功能全面打通聊天与 Cowork,用户可逐条查看和编辑 #A3

来源:AI HOT:Claude:Blog(网页)

Claude 即日起将聊天与 Claude Cowork 的记忆统一,用户在任一场景对话时都能调用此前积累的上下文,减少重复解释。记忆会在聊天过程中实时更新,用户可在 Memory 设置中按主题查看、编辑或删除每条记忆。健康、信仰等敏感话题默认不存储,但可在设置中开启,且敏感识别号、犯罪记录等始终不会被保存。

Apple 推出搭载 M5 Max 与 M5 Ultra 的全新 Mac Studio #A4

来源:AI HOT:Apple:Newsroom(RSS)

Apple 发布搭载 M5 Max 与全新 M5 Ultra 的 Mac Studio,AI 性能最高提升 4.3 倍,图形性能提升 1.8 倍,存储速度提升 2 倍。M5 Ultra 版本支持最高 512GB 统一内存与 1.2TB/s 内存带宽,可完全在设备端运行大型 LLM;四台集群可带来最高 3 倍分布式 AI 推理速度提升。新品今日起接受预购,9 月 22 日开售。

LangChain 与 Airbyte 集成:让数据摄取达到生产级就绪 #A5

来源:AI HOT:LangChain:Blog(RSS)

LangChain 与 Airbyte 的集成方案旨在将检索应用扩展至生产环境。该方案通过调度、文本拆分和 50 多种嵌入模型实现数据摄取自动化,帮助开发者构建可规模化的生产级数据管道。

Apple 发布搭载全新 M6 与 M5 Pro 芯片的 Mac mini #A6

来源:AI HOT:Apple:Newsroom(RSS)

Apple 推出搭载全新 M6 与 M5 Pro 芯片的新款 Mac mini,M6 版本 AI 性能最高提升 4 倍、CPU 性能提升 40%,支持 Wi-Fi 7 与蓝牙 6。

行业动态

Anthropic 推出 500 万美元资助计划,支持 AI 对用户幸福感影响的独立评估 #A7

来源:AI HOT:Anthropic:Newsroom(网页)

Anthropic 启动一项 500 万美元的资助计划,为研究 AI 如何影响用户幸福感的独立研究提供直接资金、模型访问权限和技术支持。受资助者将完全独立工作,并以开源项目形式发布成果,供任何开发者使用。申请截止日期为 9 月 21 日,入选者将于 10 月 5 日前收到通知。

OpenAI 封禁俄罗斯虚假影响力行动账号 #A8

来源:AI HOT:OpenAI:官网动态(RSS · 排除企业/客户案例)

OpenAI 封禁了一批源自俄罗斯的账号,这些账号利用 AI 推广一个虚构的以色列智库及“主权”指数,内容赞扬俄罗斯并批评西方。

论文研究

AgentHands:为XR空间对话智能体生成交互式手部手势 #A9

来源:AI HOT:Google Research:Blog(网页)

Google在CHI 2026发布研究原型AgentHands,利用LLM为XR对话智能体生成与语音同步的富有表现力的手部手势,提供空间锚定的物理指引。该系统通过眼动追踪和场景重建注册物体,由LLM生成内联GestureEvents,并在头显上按词级时间戳协调TTS与动画引擎,实现手势与语音的精准同步。应用场景包括兰花养护交互式教学、3D打印机操作技术讲解和生活方式陪伴。

STARFlow2:用归一化流桥接语言模型,实现统一多模态生成 #A10

来源:AI HOT:Apple Machine Learning Research(RSS)

STARFlow2 提出将自回归归一化流与语言模型统一,用于多模态生成。该方法观察到自回归归一化流与 LLM 共享因果掩码、KV-cache 机制和从左到右结构,从而弥合文本与图像生成的架构差异,避免离散 token 化带来的视觉保真度损失。

技巧与观点

如何在编辑器里实时挑选最佳 AI 模型 #A11

来源:AI HOT:OpenRouter:Announcements(RSS)

OpenRouter 提出一套模型选型框架:先定义任务,从实时用量和第三方基准中筛选候选,再对比各提供商的定价与延迟,最后用自有提示词测试。判断标准是“每完成任务的成本”而非“每 token 成本”。其 MCP 服务器可直接在 Claude Code、Cursor 等编辑器中查询实时排名、价格和基准,并用 openrouter/auto-beta 按请求路由。

OpenRouter 视频生成 API:一份代码优先的接入指南 #A12

来源:AI HOT:OpenRouter:Announcements(RSS)

OpenRouter 推出统一的异步视频生成 API,通过 POST /api/v1/videos 提交任务、轮询状态并下载 MP4,支持 Seedance、Veo、Wan 等模型,切换模型只需更改 model 标识符。

Dylan Patel:Anthropic 与 OpenAI 到 2028 年将控制全球大部分算力 #A13

来源:AI HOT:Dwarkesh Patel:Podcast & Blog(RSS)

在最新一期播客中,SemiAnalysis 创始人 Dylan Patel 与 Dwarkesh Patel 讨论实验室经济学,预计 Anthropic 和 OpenAI 到 2028 年将控制全球大部分可用 FLOPs,因其能更好变现算力并出价高于其他方。

LangChain 评测 CSV 数据问答系统:智能体、检索与 LLM 评估 #A14

来源:AI HOT:LangChain:Blog(RSS)

LangChain 发布针对 CSV 数据问答系统的基准评测,涵盖智能体、检索与 LLM 评估方法。文章提供基准测试结果、调试洞察及开源代码,帮助开发者构建更优的 CSV 数据问答系统。评测聚焦于实际应用中的性能表现与常见问题。

LLMs 与 SQL:用 LangChain 构建可靠的 text-to-SQL 方案 #A15

来源:AI HOT:LangChain:Blog(RSS)

本文探讨如何用大语言模型以自然语言查询 SQL 数据库,并重点介绍减少模型幻觉、构建可靠 text-to-SQL 解决方案的技术方法。内容基于 LangChain 框架展开,涵盖从自然语言到 SQL 查询转换的关键实现路径。


提示:内容由 AI 辅助整理,可能存在错误,请以原始出处和官方信息为准。