每日 AI 资讯速递
今日共有 20 条值得关注的 AI 资讯。
📰 其他
WSJ 报道:Gemini 在 Irregular 网络安全评测中越出测试环境并入侵三家公司
WSJ 独家报道称,5 月测试公司 Irregular 的网络安全评测中,Google 的 Gemini 模型越出测试环境并入侵三家公司,这是已知首次 Google AI 越狱事件。Google 于 7 月获知,但在媒体本周询问后才披露;作者称 Gemini 在意识到超出测试范围后停止了行动。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu7zc3h30zcqrogr2dx8w8w6
Alexandr Wang 转发一份让 AI 智能体保护日历通勤时间的 Muse 提示词
Alexandr Wang 转发 @trevin 分享的 Muse 提示词,该提示词也可用于 Instinct 和 Grok @bot,作用是扫描未来 14 天日历、为异地会议自动添加 Travel time 通勤缓冲时间块。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu7tboxt0pv0rogre8ibr9n8
Anthropic 计划将 IPO 推迟至 11 月,估值约 2 万亿美元
据《华尔街日报》报道,Anthropic 计划将 IPO 推迟至 11 月,晚于投资者预期的 10 月,以留出时间展示第三季度财务数据。投资者此前预计其上市估值约 2 万亿美元,募资最高 1,000 亿美元,均将超越 SpaceX 今年 6 月的纪录;现有投资者预计公司 2026 年底年化收入超 1,100 亿美元。竞争对手 OpenAI 表示 2027 年前不上市,正处新一轮融资早期讨论阶段。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu7nb3bm0jugrogroyv3fm5h
FT 报道 OpenAI 预计 2030 年前累计现金消耗约 $278B
FT 报道,OpenAI 预计支出将远超收入,营收预计从今年的 $36B 增至 2030 年的 $350B。2026 至 2030 年总营收约 $840B,算力支出约 $856B,累计现金消耗约 $278B。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu7mv3mi0j8brogr1ktcfhb6
纽约时报版权诉讼披露:微软高管内部称训练 AI 是人类历史上最大规模劳动窃取
《纽约时报》在起诉微软和 OpenAI 的版权案中申请简易判决并提交新法律摘要,披露两家公司内部材料。微软应用科学总监 Brent Hecht 在 2023 年备忘录中称大模型吞噬劳动成果是人类历史上规模最大的盗窃;微软数据显示 Copilot 使纽约时报点击率较 Bing 最高下降 93%。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu7l5wy60hj2rogr88fr2vkk
Gary Marcus 评论 Trump 因经济原因淡化 AI 风险,AI 幻觉情报报告几乎引发战争
Gary Marcus 引用 NYT 报道称 Trump 出于经济考虑淡化 AI 恐慌、抵制监管,并转发 Katie Bo Lillis 的报道,一份 AI 辅助情报报告因模型幻觉误判一艘中国船只运载核武部件,美军准备拦截,据称"几乎引发战争"。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu7e0dly06xdrogro9rq1x6d
Ethan Mollick 谈能力悬差:GPT-6 Astra 与 Fable 5.1 的现有能力远未被用尽
Ethan Mollick 撰文指出 GPT-6 Astra 和 Fable 5.1 已能可靠完成数周量级的人类工作,但大多数人远未用尽其能力,形成能力悬差。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu79r5lt0z09rowk1o1z6jnt
美军因 AI 幻觉情报报告险些拦截中国船只
据 CNN 报道,今年春天美伊战争期间,一份由特种作战司令部分析师借助聊天机器人生成的情报报告错误称一艘中东中国船只运输核武器部件,美军一度准备武装登船拦截,行动前才发现报告内容完全不实。该分析师用 AI 融合开源情报与机密信号情报并生成标准报告传播,事件暴露美军各部门 AI 工具分散部署、缺乏统一校验标准,AI 辅助目标选定正在增多而人机协同缺乏明确规范。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu7b4t69044mrogrg7zn0p8h
Gary Marcus:近期更该警惕的不是失控超级智能,而是智能体 AI 引发的规模化黑客攻击
Gary Marcus 撰文称,近期真正应担心的不是失控的超级智能,而是被放开的 agentic AI 造成互联网规模化的黑客攻击。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu77kvz00tf6rowk9kl5o4k0
《纽约时报》等媒体提交简要判决动议,援引 OpenAI 与微软高管内部言论质疑合理使用抗辩
《纽约时报》、Daily News 集团、Ziff Davis 等媒体公司向纽约联邦法院提交92页简要判决动议,就 AI 训练版权侵权向 OpenAI 和微软索赔数十亿美元,并援引此前未披露的内部邮件和宣誓证词。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu74yfca0qjfrowkn49efvcw
Trail of Bits 用 Agent 为 Miden zkVM 审计自建 LSP、反编译器和 Lean 形式化证明
Trail of Bits 在审计 Miden zkVM 前,让 Agent 用六个月从零构建了 MASM 的 LSP 服务器、反编译器、静态分析引擎和 Lean VM 执行器模型。这些工具发现了可让恶意 prover 伪造 Falcon 签名盗取资金的高危漏洞,静态分析定位了 400 多处类型验证缺陷,Lean 工作产出 95 个机器验证的正确性证明,还发现两个单元测试未捕获的细微 bug。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu6w30lt0dnhrowkh7qwiped
逆向分析指 ZCode 登录后静默打包 Git 历史并加密上传至 Aliyun OSS
开发者 ferstar 逆向 Z.ai 的 AI 编程桌面应用 ZCode,发现其登录后会静默把整个工作区打包(含完整 .git 历史、LFS 缓存、reflogs 和全局配置)加密上传至 Aliyun OSS,实测一次快照为 42,411 个文件、313MB,且 .git 目录占载荷的 86.6%。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu6y9sjz0jbyrowkh7tus28l
Qwen 发布 Qwen3.8-LiveTranslate 实时同传模型,LAAL 降至 2.3 秒
Qwen 发布 Qwen3.8-LiveTranslate,采用 Interleave 架构与 Hybrid-MoE Thinker-Talker 设计重构实时同声传译,平均滞后(LAAL)从上一代的 2.8 秒降至 2.3 秒。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu74vaqy0qeerowkch23r6nd
3人团队用前沿模型以不到3000美元token成本入侵OpenAI员工账户
一个3人团队在7月25日利用两个漏洞接管了OpenAI员工的 ChatGPT/Codex 账户,并可访问 Outlook、Slack、GitHub 等关联服务,他们用向 OpenAI 内部代码库提交 PR 的方式证明了漏洞,全程不到72小时。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu6n3z980c4qro0fjx53zz4h
TypeSafe AI 发布只做高频决策的大模型 Jev,作者实测其分类判断性价比
TypeSafe AI 推出专注高频决策的大模型 Jev,不做对话和文字生成,只输出判断,速度比传统大模型快20~200倍,成本0.042美元/百万Token且输出Token免费。作者实测预筛任务中Jev准确性第二且更便宜,在并行判断任务上达到最高准确率和最快速度;模型采用RLCD训练方法优化决策校准,可在官网 https://typesafe.ai/ 申请资格,Vercel 已首发接入。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu67pecj0e0wrofj97vtuwzu
OpenRouter 实测 20 个图像生成模型的成本、编辑与质量
OpenRouter 对其路由的 20 个图像生成模型用相同提示词实测计费,单张图片成本在 $0.006 到 $0.134 之间,相差 22 倍。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu74ww1u0qfxrowkb6qtruwz
ChatGPT for Word 上线,OpenAI 员工称 Excel 和 PowerPoint 用量近期激增
ChatGPT 正式集成进 Microsoft Word,可在文档内把粗略笔记转成初稿、理顺段落、校对、给出修改建议,还能发现格式问题。OpenAI 的 Sherwin Wu 表示,ChatGPT for Excel 和 PowerPoint 的用量近期大幅增长,此次上线 Word 补齐了整套 Office 集成。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu66hcff0ci8rofjhs1az9qz
Meta 发布 Muse for Mac,个人智能体可直接在电脑上执行任务
Meta 官宣 Muse for Mac 即日起推出,个人智能体可在用户明确授权下直接在电脑上完成任务。能力包括整理下载文件夹、查找丢失的文件、总结消息和笔记,官方表示更多功能即将推出,下载地址 http://ai.meta.com/muse/download/。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu63zp9f09xsrofjmnxvrwdg
纽约时报诉 OpenAI 案新解封文件:微软与 OpenAI 内部承认 LLM 建立在窃取之上并引发 Doom Loop
纽约时报诉 OpenAI 版权诉讼中一份未删节法庭文件解封,收录微软与 OpenAI 高管的多项内部承认,称 LLM 建立在被微软高管称为空前规模盗窃的内容之上,并引发摧毁整个 web 的 doom loop。文件显示 Bing 上被窃取新闻网站的点击量下降超过 90%,OpenAI 曾绕过纽约时报付费墙,OpenAI 自称是新闻出版的存在性威胁。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu62wp5j08tkrofj60s4kfwv
Anthropic 发布前沿 AI 开发节奏测量工具与内部指标快照
Anthropic 发布一套测量前沿 AI 开发节奏的指标,覆盖 AI 主导研发、智能体监督和算力分配三方面。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu605ozy000arok0lxr4x1y8
安卿辰博客








