每日 AI 资讯速递
今日AI领域迎来多项重磅进展:Anthropic在科学计算与智能运维场景展示Claude的实战能力,Mojo语言正式开源标志着高性能AI编程进入新阶段;OpenAI则围绕青少年产品、安全治理与基础设施展开全面布局,而NVIDIA联手SB Energy为OpenAI打造千亿美元级AI工厂的规划更将算力军备竞赛推向新高度。
🚀 产品发布
Mojo 语言正式开源,编译器与工具链全面开放
Mojo🔥 语言现已正式开源,采用 Apache 2.0 许可证(含 LLVM 例外),编译器、工具链及全部源码已发布至 modular GitHub 仓库。Mojo 上周刚达成 1.0 版本(源码稳定),此次开源涵盖整个编译器与工具链,标准库自 2024 年起已接受社区贡献。
开源编程语言
Claude 现已支持 Gmail 邮件与 Google Drive 文件管理
Claude 现在可以在 Gmail 中发送邮件,并管理 Google Drive 中的文件。用户可让 Claude 回复某个邮件线程,它会起草并发送回复,并控制何时需要批准。该功能已向所有付费套餐用户开放。
Anthropic集成
OpenAI 推出 ChatGPT for Teens:面向青少年的学习体验与更强安全保护
OpenAI 发布 ChatGPT for Teens,为 13-17 岁用户自动启用,内置更强安全保护与家长控制。新增 Study Mode、负责任作业提醒、测验与学习可视化,以及可设定默认开启时段的 Study Hours,引导青少年分步解题而非直接给答案。
OpenAI教育
Cursor 推出 Origin 代码托管服务,作为 GitHub 的替代方案
Cursor 今日起向所有付费计划用户开放 Origin 代码托管的早期测试版,提供仓库、拉取请求、代码浏览及 GitHub 同步功能。用户可创建以 cursor.com/codebase/ 为前缀的仓库,或将 GitHub 仓库同步至 Origin,双向同步评论与审查。
开发者工具代码托管
OpenRouter 推出 Activity 仪表盘与 Analytics API:按智能体、模型、请求追踪 AI 使用成本
OpenRouter 发布 Activity 仪表盘和 beta Analytics API,可按智能体、模型、请求维度查看支出、token 量、缓存命中率等指标,并支持下钻至单条请求日志。该功能为企业和开发者提供了更精细的AI成本管控能力。
API成本管理
🤖 大模型与应用
Claude 如何加速蛋白质设计与分析化学研究
Anthropic 公布两项实验:Claude(Mythos Preview 和 Opus 4.8)针对 15 个靶点设计蛋白质结合剂,成功 14 个,命中率达 22.6%-35.1%。这一成果展示了AI在生命科学领域的巨大潜力,有望大幅缩短药物研发周期。
科学计算生命科学
Claude Tag 如何担任 Anthropic CI/CD 故障的一线响应者
Anthropic 的 CI 工程师用 Claude Tag 构建了值班智能体,作为 CI/CD 故障的一线响应者。Claude 在事故发生后中位 14 分钟发布首份基于证据的分析,最快案例中 3 分钟内验证修复并确认错误率恢复基线,Anthropic 已发布通用设置套件供其他团队部署。
智能运维Anthropic
智能体记忆并非越多越好:八款模型评测显示剂量需按能力校准
智能体记忆并非可随意开启的功能,而是需按模型能力校准的剂量。强模型适合注入完整指南集,DeepSeek-V3.2(671B MoE)任务完成率提升+9.5个百分点;较弱模型采用精选检索效果最佳,gpt-oss-120b(117B MoE)提升+16.1pp且仅增加+5% token。
智能体研究
一个实用的深度思考Prompt:用"双向钢人论证"让AI帮你挖出最本质的答案
作者基于Reddit上"让Claude真正开始思考"的帖子,引入逻辑学中的"钢人论证"(steelman)概念,并自创了一个"双向钢人Prompt"。该Prompt通过重述真实问题、强化正反双方观点、找出关键变量、逼AI给出明确判断四步,旨在避免模型谄媚,帮助用户找到问题最本质的答案。
Prompt工程技巧
🔧 开源项目
Sentence Transformers v6.0 新增 MultiVectorEncoder,支持 ColBERT 风格多向量模型
Sentence Transformers v6.0 新增第四种模型类型 MultiVectorEncoder,可直接加载 PyLate、Stanford-NLP ColBERT 及 colpali-engine 检查点,用于 ColBERT 式晚期交互检索。这一更新将极大简化多向量模型的部署流程。
开源检索
用 Google 的 Agent Development Kit 构建零信任 AI 智能体
Google 开源了基于 ADK 和 Gemini 的零信任客服与退货智能体示例,演示如何防御提示注入等攻击。该架构在 LLM 上下文之外通过三层硬性安全机制保障:硬件支持的加密签名确保数据库写入不可抵赖、gVisor 沙箱隔离动态代码执行、确定性语义网关校验业务逻辑。
安全Google
inclusionAI 开源 ConceptEdit:基于概念缩放与密集监督的图像编辑数据生成管线
蚂蚁集团 inclusionAI 开源 ConceptEdit,一个基于概念缩放与密集监督的图像编辑数据生成管线。该管线通过三阶段流程(VLM 生成指令、FLUX 执行编辑、VQA 评估筛选)构建大规模、基于分类法的图像编辑数据集,并提供单概念与多概念两种变体,项目采用 MIT 许可证。
蚂蚁集团图像编辑
💼 行业动态
黄仁勋宣布与SB Energy合作,为OpenAI建AI工厂
黄仁勋宣布NVIDIA与SB Energy合作,在俄亥俄州PORTS-Pike科技园区锁定LPS容量,专供NVIDIA AI工厂使用,OpenAI将作为租户。初始部署预计提供4.25吉瓦AI工厂容量,每代系统约150万块NVIDIA GPU,对应1500亿至2000亿美元收入。OpenAI已承诺至2030年部署约12吉瓦NVIDIA算力,可扩展至16吉瓦,总机会约6000亿美元。
NVIDIA算力
A 股迎来"人形机器人第一股",宇树科技官宣 8 月 19 日科创板上市
宇树科技宣布股票将于 2026 年 8 月 19 日在科创板上市,发行价 150.80 元/股,对应市值约 609.93 亿元,预计募资约 60.99 亿元。该公司 2023 至 2025 年营收分别为 1.59 亿元、3.93 亿元和 16.99 亿元,净利润分别为-1114.51 万元、9547.47 万元和 2.78 亿元,是全球少数实现盈利的高性能通用机器人公司。
机器人IPO
404 Media 追踪珍本图书流向:亚马逊批量购书扫描用于 AI 训练后销毁
404 Media 通过在一本珍本图书中放置追踪设备,首次揭露亚马逊未公开的购书行动:批量购入大量书籍,扫描用于 AI 训练数据,随后销毁。追踪显示这些书最终被送往亚马逊的一处人工智能训练中心,引发版权与数据伦理争议。
版权数据
🏛️ 政策与安全
OpenAI 在"关键网络能力"时代放缓模型开发节奏
OpenAI 因 OpenAI-Hugging Face 事件及即将推出的 Astra 模型可能达到《预备框架》下的"关键网络安全能力"阈值,暂时放缓了模型扩展速度,包括暂停最新部署模型的强化学习训练两周,并搁置最大规模前沿 RL 运行。公司已加强研究环境安全,要求对 Astra 及网络相关负载实施最严格防护,并扩展思维链监控。
AI安全OpenAI
OpenAI 如何用前沿智能加固自身防御:The Defender's Window
OpenAI 在 OpenAI-Hugging Face 事件后反思低估了模型真实网络攻击能力,正通过四大支柱强化自身安全:用 Codex 验证代码漏洞、用智能体优先分流安全告警、持续枚举攻击路径,并仅向可信防御者开放网络能力。文中演示 ChatGPT Work(基于 GPT-5.6 Sol)15 分钟发现个人网站 13 个问题并在一小时内完成修复。
网络安全防御
如何禁用或避免侵入式 AI:一份覆盖 Windows、Chrome、Edge、Firefox 及主流应用的实用指南
一份面向希望减少技术环境中侵入式 AI 的用户的操作指南,涵盖 Adobe Acrobat、Android/Gemini、Apple Intelligence、Chrome、Edge、Firefox、DuckDuckGo、Google Workspace、Slack、WhatsApp 及 Windows 11/Copilot 等平台。该指南反映了用户对AI隐私与自主权的日益关注。
隐私用户指南
📊 评测与工具
设计 AI 评测:先求清晰,再谈可视化
本文演示如何用开源评测框架 Inspect AI 和 Harbor 评估 agent 技能,并借助 Google Sheets 和 Data Studio 进行可视化分析。文章强调评测设计应先明确目标,再考虑展示方式,为AI开发者提供了实用的评测方法论。
评测框架
📝 编辑点评
今日热点呈现出AI行业"攻守兼备"的鲜明特征:一方面,以NVIDIA与SB Energy的4.25吉瓦AI工厂为代表,行业巨头正以前所未有的规模进行算力基础设施投资,OpenAI承诺至2030年部署12吉瓦算力、对应约6000亿美元市场机会,预示着AI竞赛已进入"电力即算力"的资本密集型阶段。另一方面,OpenAI因网络安全能力达到关键阈值而主动放缓模型开发,这一"急刹车"行为极具象征意义——当AI能力逼近安全边界时,负责任的发展节奏比速度更重要。值得注意的是,Anthropic在科学计算(蛋白质设计命中率22.6%-35.1%)和智能运维(中位14分钟响应故障)方面的实践,展示了AI在垂直场景中可量化的实用价值;而Mojo开源、Sentence Transformers v6.0等开源生态的持续繁荣,则为整个行业提供了更坚实的技术底座。从宇树科技科创板上市到亚马逊购书风波,AI正加速渗透资本市场与内容产业,其影响力已远超技术圈层本身。
安卿辰博客








