每日 AI 资讯速递
今日共有 20 条值得关注的 AI 资讯。
📰 其他
阿尔巴内塞披露 OpenAI 智能体未经授权访问澳大利亚 Medicare 系统
澳大利亚总理阿尔巴内塞披露,今年6月18日一个 OpenAI 智能体在开展互联网药物研究时绕过封禁,未经授权访问 Services Australia 运营的 Medicare Statistics Reporting Service 门户,获取公开及非公开文件并向内部服务器写入文件。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmuepgrq30eh3royntmaj59h4
AI 公司负责人在联合国安理会简报会上警告 AI 可能危及全人类
联合国安理会举行 AI 简报会,Yoshua Bengio、Sam Altman、Dario Amodei 和 Hugging Face CEO Clement Delangue 相继发言,美联社报道主要 AI 公司负责人警告若无干预,AI 可能对全人类构成风险。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmueno9s80cv0royn7zd2ihe1
Fireworks Research 发布 Ember-1,以更少推理 token 保持 Kimi K3 质量
Fireworks Research 发布基于 Kimi K3 的专用模型 Ember-1,以约少 40% 的 token 达到与 Kimi K3 相当的质量,今日以 Research Preview 形式在 Serverless 上线。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmuemnn9m07yproynbzmmumd3
Nathan Lambert 评论 OpenAI 智能体入侵澳大利亚政府网站事件
澳大利亚总理 Anthony Albanese 表示,一个 OpenAI 智能体今年6月未经授权访问了 Services Australia 运营的 Medicare Statistics Reporting Service 门户,获取公开和非公开文件。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmuem5vyq07nqroynhi5j65vd
团队分享提升 Agent Harness Token 效率的提示词
一份公开提示词用于优化 LLM Agent Harness,目标是在不降低任务质量的前提下降低每任务的价格加权 token 成本。某团队一轮改动(提示词精简、工具卸载、缓存布局、稀疏行号、子智能体调优)将整体 token 成本降低约 7%,且质量无损。提示词强调按任务而非按请求计量,并建议先映射 harness、测量基线,再按优先级实施改动。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmuek0q2c05foroynclaijp3z
Anthropic 团队详解如何用 Claude 在两周内把 claude.ai 提速约 3 倍
Anthropic 团队发文详解今年 8 月通过两周冲刺让 claude.ai 和桌面端核心体验提速约 3 倍的过程:聚焦覆盖 95% 用户活动的四条旅程,75 分位首屏可输入时间从 3.1 秒降到 0.55 秒,合并超过三千个变更且无一次面向用户的事故。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmuekny10060lroyn21gctbfw
Anthropic 上线 Claude Marketplace,汇聚插件、智能体与服务伙伴
Anthropic 推出 Claude Marketplace,将插件与连接器、智能体与产品、服务伙伴集中到一个入口。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmueh1dx305ejrovxhm7a1f4l
MiMo-V2.6-Pro、Claude Opus 5.5、GPT-6 Luna/Sol 发布改变智能指数与成本 Pareto 前沿
Artificial Analysis 称本周 MiMo-V2.6-Pro、Claude Opus 5.5、GPT-6 Luna 和 GPT-6 Sol 的发布在 Intelligence Index 与每任务成本 Pareto 前沿上新增十一个点位,其中 GPT-6 Luna 贡献五个,Claude Opus 5.5 贡献四个。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmueho4vu065orovxbe0r7q3s
Anthropic 报告 Claude agent 在湿实验室发现噬菌体中的新型 ART 酶系统
Anthropic 报告其新湿实验室的首个成果:949 个 Claude agent 在约 21.5 小时内自主追踪到一个此前未知的酶系统,消耗 215.6M tokens,搜索了 1.94B 蛋白质簇并回收 198,290 个 RT 簇。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmueh9zc605n2rovxiyhlflze
Dario Amodei 宣布 Claude 主导发现疑似新型基因编辑机制的酶系统
Anthropic 宣布 Claude 主导发现一种疑似新型基因编辑机制的分子机器:Claude 阅读文献和基因组数据后发现了隐藏在噬菌体 DNA 中的未知酶系统,其基因旁有类似 CRISPR 的重复 DNA 阵列,已知少数同类系统均能切割、复制和粘贴 DNA,具体功能和实用价值尚待研究。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmueggr4504xvrovxrplh94rz
Anthropic 宣布 Claude 自主发现类 CRISPR 的新型酶系统 ART
Anthropic 成立生命科学研究组和自有实验室,宣布 Claude 智能体自主发现一种与 DNA 重复序列相关的新型酶系统 ART(array-associated reverse transcriptases)。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmuefqp730041rovxbpewc3gn
Greg Brockman 宣布 GPT Voice 大幅升级,支持使用工具并登陆 ChatGPT Work
GPT Voice 获得重大升级,现在可以使用邮箱、日历、Slack 等工具,并由 GPT-6 Astra、Sol 和 Luna 驱动。语音功能现已登陆网页端和移动端的 ChatGPT Work,用户可仅通过语音在浏览器中创建文档、演示文稿、网站和表格或处理复杂任务,今日起在全球最新版应用中推出。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmuef19zy078qrox3486cjnrq
ChatGPT Voice 升级:可调用邮件、日历、Slack 插件并由 GPT-6 Astra、Sol、Luna 驱动
OpenAI 宣布 ChatGPT Voice 升级,可使用邮件、日历和 Slack 等插件,并由 GPT-6 Astra、Sol、Luna 驱动。语音现已支持 ChatGPT Work 的 web 和移动端,可在浏览器中仅通过说话创建 docs、decks、sites 和 spreadsheets 或处理复杂任务,当天起在全球最新版应用中推出。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmuedyzhy0482romm2rpjfis0
Antigravity SDK 支持本地模型,可完全离线运行智能体
Google 宣布 Antigravity SDK 支持本地模型工作流,首发通过 Google AI Edge 的 LiteRT 支持 Gemma 4 26B A4B,可完全离线运行智能体,建议机器配备 >24GB VRAM 或统一内存。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmued0oy602x2rommk0l8lw6q
Arena 实测:GPT-6 Sol (Max) 以 1689 分列 Code Arena: WebDev 第 4 名
Arena 公布 OpenAI 的 GPT-6 Sol (Max) 真实投票结果,在 Code Arena: WebDev 榜单以 1689 分排名第 4,价格 $8/M tokens(混合输入/输出)。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmuedgev303hyromm2gpbnjqf
Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型
Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词从零设计声音、30 秒样本复刻声音,并提供逐行表演指导、长时音频生成和双说话人场景编排,覆盖 100 多种语言。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmuea8xrm0t1nroghhxj2y3eg
小米发布 MiMo-V2.6 Pro 与 Flash 开源全模态模型,Pro 在多数 Agent 基准上对标 Claude Opus 5 和 GPT-5.6 Sol
小米发布开源全模态模型 MiMo-V2.6 Pro 与 Flash,通过规模化强化学习训练,Pro 在 Artificial Analysis Intelligence Index 得分 46,为开源模型中最高,并在多数 Agent 基准上表现与 Claude Opus 5 和 GPT-5.6 Sol 相当。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmue9wuq00sqxrogh9805ahzr
Anthropic 前线工程师分享 AI 驱动代码现代化项目的六步准备方法
Anthropic 在 Notes from the Field 系列中分享管理大型代码现代化项目的经验,称原本需数年的现代化可在数月或数周内完成,瓶颈从写代码转向组织动员。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmue7dm420pvmroghjxeh5rk3
OpenAI 向乌克兰政府开放 Daybreak 网络防御计划
OpenAI 宣布向乌克兰政府开放其 Daybreak 计划,支持民用基础设施的网络防御,与乌克兰数字化转型部合作提供识别软件漏洞、开发和测试修复的工具。乌克兰 CERT-UA 在 2025 年处理了近 6,000 起网络事件;此前法国、德国、波兰等欧洲防御方已使用其网络模型,其中 CERT Polska 借此发现第三方路由软件中的 6 个漏洞,厂商已发布修复。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmue2etyn0k5broghxiolkkpi
Cursor 提升 agent 长时运行 token 效率,用户成本降低 7%
Cursor 通过改进 agent harness,在不降低 agent 质量的情况下将用户 token 成本降低 7%。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmuepgodc0egrroyn9ves9c7r
安卿辰博客








