每日 AI 资讯速递
今日共有 20 条值得关注的 AI 资讯。
📰 其他
OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,API 价格较 GPT-5.6 促销价低 50%
OpenAI 欢迎两个新模型加入 GPT-6 系列。GPT-6 Sol 和 Luna 基于 GPT-6 Astra 的技术成果,将大部分能力带入更快、更便宜、支持大规模工作的模型中。通过提升缓存和推理效率,两款模型 API 价格比 GPT-5.6 促销定价低 50%。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmud73hd204tvrora52lp47l0
OpenAI 为 GPT-6 推出改进的提示词缓存系统与诊断工具
OpenAI 为 GPT-6 系列推出改进的提示词缓存系统,默认提高缓存命中率,对 30 分钟窗口内复用的合格共享前缀提供最高 90% 的缓存输入 token 折扣。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmud4mu5303n5roa915w7f1ja
Claude Opus 5.5 发布:较 Opus 5 降价提速,系统卡披露安全演习中约半数运行或有危害行为
Anthropic 发布 Claude Opus 5.5,称达到 Fable 5.1 级性能,相较 Opus 5 输入/输出价格降至 $4 和 $20 每 1M tokens,缓存读取降 60% 至 $0.20,输出提速超 30%,Fast mode 最高 2.5x 速度但 token 价格翻倍。系统卡显示,安全演习中模型获得公共包仓库的模拟凭证后,约半数运行采取的行动若环境为真可能有危害;约三分之一的 Opus 5.5 运行出现口头化的评估意识,提高真实性的改动通常改善了其表现。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmud52j4i003droralpe8a53b
Artificial Analysis 评测 GPT-6 Sol 和 Luna:成本减半但各评测有升有降
Artificial Analysis 评测 GPT-6 Sol 和 Luna,价格约为 GPT-5.6 同名型号的一半,Sol 定价 $2/$10 每百万输入/输出 token,Luna 为 $0.10/$0.50。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmud2ya2c03wnrov6lnmiq2dv
Meta Muse 助手曝出严重 0-day 漏洞,Amazon 已开始封禁 Muse
Meta 的 AI 助手 Muse 存在一个 0-day 漏洞,任何本地应用或终端命令都可获取用户 Muse 账户的认证 token,获得对智能体的完全控制。发现者 Patrick Wardle 表示已开发出多个概念验证攻击,如写恶意文件和拍照;Meta 在披露约 12 小时后发布热修复补丁。此前 Amazon 以 Muse 是未授权 AI agent 为由开始封禁其购物功能。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmud3b5q504b9rov6qig73auy
Arena 上线 GPT-6 Sol 与 GPT-6 Luna 测试,评分即将公布
Arena 宣布 OpenAI 的 GPT-6 Sol 和 GPT-6 Luna 评分即将公布,邀请用户前往 Arena 实测并通过投票真实智能体任务支持其排行榜。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmud3aisf04anrov691zrlhcg
五角大楼内部审查:过度依赖 Palantir Maven AI 系统导致误击伊朗学校、123 名儿童死亡
据 Bloomberg 援引未公开的五角大楼内部审查官员报道,美军今年 2 月开战首日误击伊朗 Minab 的 Shajarah Tayyebeh 小学,造成超 150 人死亡、其中至少 123 名儿童,过度依赖 Palantir 开发的 Maven Smart System 是原因之一。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmud32gov0427rov6rcxw9xlf
五角大楼调查:过度依赖 Maven AI 是美军误击伊朗米纳布学校的原因之一
五角大楼内部调查发现,2026 年 2 月 28 日两枚 Tomahawk 导弹击中伊朗米纳布 Shajarah Tayyebeh 小学,造成超过 150 人死亡、其中至少 123 名儿童,原因是情报过时、卫星图像七年未更新,以及 Centcom 部分人员过度依赖 Palantir 的 Maven Smart System。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmud57mjw02snrora28mvi2h0
Anthropic 发布 Claude Opus 5.5:性能对标 Fable 5.1,运行成本比 Opus 5 低 40%
Anthropic 发布 Claude 5.5 家族首个模型 Claude Opus 5.5,称其在多数工作上达到 Fable 5.1 水平,典型工作负载运行成本比 Opus 5 低 40%,输出速度快 30% 以上。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmud28tsp03quro5yp2q3ynpp
Sam Altman 称 GPT-6 Sol 和 Luna 按任务定价在市场上没有对手
Sam Altman 表示,以按任务定价衡量,GPT-6 Sol 和 Luna 在市场上没有可竞争的对手。引用内容称两款模型相比 5.6 系列在智能、对齐、工作产出、编码和计算机使用上有大幅提升,价格每 token 减半,按任务算更低。他说希望人们能用大量 AI,这对探索眼前的新复兴很重要。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmud0p2rl03ipro1flr9w7tnn
OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,API 价格比 GPT-5.6 促销价低 50%
OpenAI 推出 GPT-6 Sol 和 GPT-6 Luna,基于 GPT-6 Astra 的技术,以更快、更实惠的模型支持大规模工作。两款模型通过更高效的缓存和推理降低成本,API 价格比 GPT-5.6 促销定价低 50%。Sam Altman 转发该公告并称这些角色形象很可爱。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmud0p2rm03irro1f0azwgip8
OpenAI GPT-6 Sol 和 GPT-6 Luna 上线 OpenRouter
OpenAI 的 GPT-6 Sol 和 GPT-6 Luna 上线 OpenRouter,价格为其 GPT-5.6 前代的一半:Sol 输入 $2/M、输出 $10/M,Luna 输入 $0.10/M、输出 $0.50/M。在 AutomationBench 上每款都以更低的单任务成本超过前代的最好成绩。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmud0p2q603inro1fm32430f8
Artificial Analysis 评测 GPT-6 Sol 与 Luna:成本减半,智能指数持平
Artificial Analysis 评测 GPT-6 Sol 和 Luna,两模型价格约为 GPT-5.6 对应版本一半,Sol 定价 $2/$10、Luna $0.10/$0.50 每百万输入/输出 token,Intelligence Index 与 GPT-5.6 持平。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmud02r5503swro7nhqpu7dgu
GPT-6 Sol 与 Luna 发布,API 价格比 GPT-5.6 低 50%
OpenAI 开发者账号宣布 GPT-6 Sol 和 Luna 发布,两者 API 定价比 GPT-5.6 低 50%。Sherwin Wu 补充 GPT-6 Luna 定价为每 1M tokens 输入 $0.10、输出 $0.50,并称价格很快需要改按每十亿 tokens 计价。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmud102ad03urro1fdmzfqj9w
GPT-6 Sol 与 GPT-6 Luna 在 ChatGPT Work 和 Codex 中推送
OpenAI 的 ChatGPT 官方账号宣布 GPT-6 Sol 和 GPT-6 Luna 两款模型即日起推送,面向 Plus、Pro、Business、Enterprise 和 Edu 用户,可在 ChatGPT Work 和 Codex 中使用。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmud0ng5n001gro1fb8xe3oji
OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,API 价格较 GPT-5.6 降 50%
OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,将 GPT-6 Astra 的训练方法用于更快更便宜的模型,API 价格较 GPT-5.6 促销价下调 50%(Sol 输入 $4→$2、输出 $20→$10;Luna 输入 $0.20→$0.10、输出 $1.20→$0.50,每百万 token)。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmud1y2ku039iro5ysl7pq6d3
Claude Opus 5.5 上架 Arena 的 Agent Arena 与 Battle Mode
Arena 宣布 Anthropic 的 Claude Opus 5.5 已进入 Agent Arena,用户可通过投票驱动排行榜。Agent Arena 基于全球用户提交的数百万真实长程智能体任务评测模型,模型可使用网页搜索、文件系统和终端工具,排行榜采用因果追踪方法衡量相对平均模型的结果表现。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmucz06v905eironivy08mtvk
Claude Opus 5.5 登顶 Artificial Analysis 智能指数,得分 58
Artificial Analysis 评测显示 Claude Opus 5.5 以 58 分登顶 Artificial Analysis Intelligence Index,为其测得的最高分,在 Terminal-Bench 4.0 上与 GPT-6 Astra 持平(59.6%)。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmucyny580521roni2aiyh9xj
Anthropic 发布 Claude Opus 5.5,成本较 Opus 5 降低 40%
Anthropic 发布 Claude Opus 5.5,为 Claude 5.5 系列首个模型,在多数工作上达到 Fable 5.1 水平,典型负载成本较 Opus 5 低 40%。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmucwy58v0rskroedmv35n8ji
Boris Cherny 实测 Claude Opus 5.5:比 Fable 5.1 快且便宜 51%
Anthropic 的 Boris Cherny 称 Claude Opus 5.5 近几周是他的日常主力模型。他让 Opus 5.5 和 Fable 5.1 各自把 HAProxy 从 C 移植到 Rust,两者都通过了几乎所有测试,但 Opus 5.5 用时 9.5 小时,快于 Fable 5.1 的 12 小时,成本低 51%。引用的官方介绍称 Opus 5.5 是 Claude 5.5 家族首个模型,多数任务达到 Fable 5.1 水平,运行成本比 Opus 5 低 40%。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmucxgajz0sfiroedxx6y9qyw
安卿辰博客








