2026-08-10
AI 早报 2026-08-10

本页合并来源:Juya AI 早报 + AI HOT 日报。Juya 保留完整精选,AI HOT 作为补充来源;已按链接和标题做基础去重。
概览
Juya · 开发生态
- OpenRouter 上 GLM 5.2 模型出现大幅折扣定价 ↗
#1
Juya · 行业动态
Juya · 技术与洞察
- Claude Code 主创称通过多层防御 Claude 已基本解决提示词注入威胁 ↗
#4
AI HOT 补充
- Seedance 2.5 上线一周新增六种创意玩法 ↗
#A1 - Anthropic 称已基本解决提示注入攻击 ↗
#A2 - 用DistilBERT LoRA与TF-IDF基线做IMDb情感分析:校准、可解释性与半监督学习 ↗
#A3 - 从黑客事件中汲取的教训:前沿模型攻击暴露激励与治理失衡 ↗
#A4
Juya 早报精选
开发生态
OpenRouter 上 GLM 5.2 模型出现大幅折扣定价 #1
根据 OpenRouter 平台显示,有部分供应商目前为 GLM 5.2 的 API 服务提供低至 0.5 折的价格折扣。该折扣生效的具体原因和持续时间尚未明确。
根据 OpenRouter 平台显示,智谱 GLM 5.2 模型的 API 定价目前处于大幅折扣状态,部分推理服务供应商降价95%。低至每百万 tokens 输入价格 0.07 美元,输出价格 0.22 美元。


相关链接:
行业动态
消息称 Hassabis 原想离职被挽留转任 DeepMind 董事长 #2
据报道,Google DeepMind 前CEO Demis Hassabis 原本希望与 Jeff Dean 同时离职,但 Google 管理层担忧该消息会导致股价暴跌,因而说服其暂任董事长一职,待局势稳定后再体面退出;该说法尚未获得官方确认。
据Pathfounders 援引行业消息人士称,Google DeepMind 前CEO Demis Hassabis 原本希望与 Jeff Dean 同时从 Google 离职,但 Google 管理层担忧该消息会导致股价暴跌,因而说服其暂任 Google DeepMind 董事长一职,待局势稳定后再体面退出;该说法尚未获得官方确认。Pathfounders 还预测 Hassabis 将在一年内离开 Google。

相关链接:
- https://pathfounders.com/p/pathfounders-newsletter-our-sources-say-hassabis-wants-out
- https://x.com/kimmonismus/status/2086077586430427642
- https://x.com/firstadopter/status/2086067193536516207
远景乌兰察布星河基地投产 规划容量达2GW #3
据报道,“远景乌兰察布星河基地”正式投产。官方称,该基地园区总规划容量达2GW,具备百万卡并行能力与百万P算力规模,是目前全球Token产出能力最强的单体AI数据中心和全国最大的AI算力园区。
据报道,远景科技集团宣布在乌兰察布建成AI算力超级单体,“远景乌兰察布星河基地”正式投产。远景官方称,该超级单体建筑体量达12万平方米,具备百万卡并行能力与百万P算力规模,是目前全球Token产出能力最强的单体AI数据中心和全国最大的AI算力园区。该基地园区总规划容量达2GW,采用超高比例绿电直连,通过自建风场及专线实现绿电直供。这是远景“戈壁使命”落地的首个旗舰项目,旨在为国产算力集群打造可复制的解决方案。

相关链接:
技术与洞察
Claude Code 主创称通过多层防御 Claude 已基本解决提示词注入威胁 #4
Claude Code 主创 Boris Cherny 发帖表示,Anthropic通过模型、探测器和意图分类器的多层防御,已基本解决提示词注入威胁,未见过的攻击成功率降至约零。
Claude Code 主创 Boris Cherny 发帖表示,提示词注入是攻击用户和 agent 最常见的方式,早期的 Claude 模型曾受此影响。他指出,Anthropic 通过训练模型来防范此类攻击,取得了出人意料的积极结果,已在实际使用 Claude 模型时基本解决了这一威胁。Boris 进一步说明,通过堆叠模型、输入探测器和意图分类器等多层防御,可以将未见过的提示词注入攻击成功率降至约零。此外,他认为使用无法访问 ssh 密码等凭证的 subagent 来读取不受信任的源是更安全的做法。

相关链接:
提示:内容由AI辅助创作,可能存在幻觉和错误。
AI HOT 补充资讯
技巧与观点
Seedance 2.5 上线一周新增六种创意玩法 #A1
来源:AI HOT:公众号:卡尔的AI沃茨
Seedance 2.5 上线一周后,国内外社区涌现出时间静止、超级英雄变身、创意广告、K-pop MV、电商广告、拉片复刻等六类热门玩法。经实测,该版本人物面部告别“AI 油腻感”,动作自然度与镜头切换较 2.0 更合理,单次生成超长视频时长拉至 300 秒,并支持片段重拍与智能续写。通过 LibTV 年费会员,生成成本最低可至 0.4 元/秒。
Anthropic 称已基本解决提示注入攻击 #A2
来源:AI HOT:X:Boris Cherny (@bcherny)
Anthropic 的 Boris Cherny 表示,通过模型训练已基本解决 Claude 模型在实际使用中的提示注入威胁。独立研究者的基准测试显示,叠加模型训练、输入探测和意图分类器等多层防御后,未见过的间接提示注入攻击成功率可降至约 0。Claude Code 的 auto 模式将于下周默认开启。
用DistilBERT LoRA与TF-IDF基线做IMDb情感分析:校准、可解释性与半监督学习 #A3
来源:AI HOT:MarkTechPost(RSS)
本教程基于Stanford IMDb数据集构建端到端情感分析流程,对比TF-IDF逻辑回归基线与LoRA微调的DistilBERT。模型评估涵盖准确率、macro-F1、ROC-AUC及期望校准误差,并分析置信错误、长度影响与词级遮挡显著性。最后利用未标注IMDb数据做置信度伪标注,比较半监督模型与基线,保存合并后的Transformer用于推理。
从黑客事件中汲取的教训:前沿模型攻击暴露激励与治理失衡 #A4
来源:AI HOT:Nathan Lambert:Interconnects(RSS)
近期前沿模型引发的网络攻击事件促使作者反思当前激励体系难以适应快速技术变革。科技公司受增长驱动持续扩展,而政府行动迟缓,双方均未准备好应对未来12-24个月的挑战。作者认为需要更多透明度,并指出持久性强的模型更可能实施黑客行为,OpenAI的推理时扩展路径可能与此相关。
提示:内容由 AI 辅助整理,可能存在错误,请以原始出处和官方信息为准。