每日 AI 资讯速递
今日 AI 领域迎来多重重磅进展:OpenAI 因安全考量延缓关键级模型 Astra 的发布,同时披露 ChatGPT 全球用户画像;视频生成赛道竞争白热化,Seedance 2.5 全面登陆 Runway、Krea 及火山引擎 API;开源生态持续繁荣,腾讯混元、蚂蚁百灵相继释放高性能算子与模型。此外,AI 在病毒设计、气象预测等科学领域的突破,正不断拓展技术应用的边界。
🤖 大模型
OpenAI 优化 ChatGPT 中的 GPT-5.6 Sol,并扩大免费用户对 GPT-5.6 Luna 的访问权限
OpenAI 更新 ChatGPT:Plus 和 Pro 用户的 GPT-5.6 Sol 在事实准确性和回答聚焦度上有所提升,新增滑块可控制模型思考投入。免费用户默认模型升级为 GPT-5.6 Luna,并开放无限文本聊天,新增 Think 按钮以处理更复杂问题。
模型更新产品迭代
千问功能上新:推出思考研究、定时任务、办公助理、语音通话等多项新功能,并支持 Qwen3.8-MAX
千问今日上线多项新功能,并支持最新旗舰模型 Qwen3.8-MAX。其中"思考研究"强化复杂推理与工具调用;"定时任务"可预设执行时间自动完成行业简报梳理等周期工作;"办公助理"能连接备忘录、日历等应用并操作电脑浏览器,直接输出可用的 Office 文档。语音通话支持 7x24 小时多场景,智能体广场首批覆盖物流、房产等十多个领域。
智能体办公助手
🚀 产品发布
OpenAI:因网络安全风险,延缓 Astra 模型发布
OpenAI 因内部与专家评估显示 Astra 在智能体编程和网络安全领域取得重大突破,依据《准备框架》将其列为旗下首个网络安全风险达"关键"级别的模型,决定延缓发布。OpenAI 已采取隔离测试环境、限制网络与工具访问、强化权重保护与加密等管控措施,并与政府机构和 AI 安全组织合作测试。CEO 萨姆·奥尔特曼表示 Astra 性能强劲,正全力推进公开发布。
安全模型发布
Kitesurf:一款在 V8 隔离环境中运行的"代理优先"浏览器
Cloudflare 推出 Kitesurf,一款专为 AI 智能体设计的浏览器,完全运行在 Workers 上,基于 V8 隔离环境,现已在 Browser Run 中免费开放测试。
智能体基础设施
Suno 移动端上线 Voices 功能
Voices 功能已在 Suno 移动应用 iOS 和 Android 版正式上线。现在你可以直接在手机上录制人声,并将其用于你的歌曲中。只需在创作界面点击"+ Voice"按钮,录制至少一分钟,然后让音乐流淌起来。Pro 和 Premier 套餐可无限使用,免费套餐可体验有限版本。
AI音乐移动端
Runway 上线 Seedance 2.5,支持 50 个角色参考
Seedance 2.5 现已登陆 Runway。每次生成最多可引用 50 个角色参考,构建充满角色的完整世界;可创作最长 30 秒、带完整音效与对白的片段,再按你的故事需求随意剪辑与延展。
视频生成多角色
Krea 推出 Seedance 2.5 视频模型
Krea 宣布推出 Seedance 2.5 视频模型,支持 30 秒连续视频、完整多镜头序列,以及最多 50 个参考。
视频生成模型发布
Seedance 2.5 API 上线,视频生成开启「电影级长叙事」
火山引擎正式上线 Seedance 2.5 API,将单次视频生成时长从 15 秒提升至 30 秒,并支持最高 50 个全模态素材参考。模型在指令遵循、长叙事、真人感及声画质感上大幅提升,能稳定保持多角色外形与场景关系,兼容十余种语言。
API视频生成
💼 行业动态
OpenAI 披露 ChatGPT 全球 10 亿用户画像:35 岁及以上用户用量上升
OpenAI 报告称全球超 10 亿用户使用 ChatGPT,使用方式从"问答工具"转向"任务工具",工作场景中完成任务或创建内容的可能性是非工作场景的 2 倍以上。自 2026 年 4 月发布 ChatGPT Images 2.0 以来,多媒体相关消息占比升至 7.8%。35 岁及以上用户发送消息份额较 12 个月前增加 5 个百分点,法国和捷克增幅超 10 个百分点。
用户数据市场洞察
独立开发者用 VoxCPM 克隆网红声音,让 AI 终于"会聊天"了
独立开发者叶小叔用面壁智能开源的 VoxCPM 克隆千万粉丝网红声音,搭建 STT → LLM → VoxCPM(TTS)三段式实时对话管道,TTS 首包延迟不到 1 秒,端到端体感 2 到 3 秒。
语音克隆开源应用
🔧 开源项目
HPC-Ops × SGLang:腾讯混元开源高性能 Attention、Router GEMM 与 MoE 算子
腾讯混元开源算子库 HPC-Ops 已集成至 SGLang 主分支,其 Dynamic Attention 与 Fused MoE 在 Hy3 模型上最高降低 TPOT 48.8%。
开源性能优化
蚂蚁百灵开源 Ling-3.0-flash:124B 总参数 MoE 模型,支持 API、单机与高性能三种部署
蚂蚁百灵正式开源新一代原生混合推理模型 Ling-3.0-flash,采用 124B 总参数、5.1B 激活参数的 MoE 架构,并提供 FP8、FP4、INT4 等多个版本。
开源模型MoE
LangChain 推出 Managed Deep Agents 公开测试版
LangChain 的 Managed Deep Agents 进入公开测试版,可将 Deep Agents 部署到托管的 LangSmith 运行时。该服务提供持久化执行、记忆、沙箱、通道、评估(evals)及生产级基础设施。
智能体托管服务
🎓 学术研究
斯坦福与 Arc Institute 用 AI 设计全新病毒基因组,16 种在实验室成功杀死细菌
斯坦福大学与 Arc Institute 团队用 AI 模型 Evo 从零设计完整病毒基因组,并在实验室构建出 16 种自然界不存在的功能性病毒。Evo 提出 70 万个候选基因组,团队仅筛选最有希望的 285 个序列合成并植入细菌,其中 16 个成功复制并杀死宿主。该研究已通过同行评审发表于《Science》,但 Evo 未接受人类病原体数据训练,且能否推广至其他病毒类群仍是未知数。
AI+生物Science
谷歌推出 WeatherNext 气旋模型,AI 高精度预报飓风平均提前 24 小时
谷歌 DeepMind 联合多家机构推出 WeatherNext Cyclones 气旋预测模型,在路径、强度和风场结构预测精度上达到业界领先。该模型将有效预报时长从 2 天延长至 3 天,平均提前 24 小时,预测量级约相当于 10 年气象进展。
AI+气象DeepMind
小红书联合浙大、复旦提出 CULTURE-MT:首个面向社媒翻译的「文化有效性」评测基准,入选 ICML 2026
小红书联合浙江大学、复旦大学提出 CULTURE-MT,这是首个面向中英社媒笔记翻译、兼顾文化符号传递与情感共鸣的评测基准,并首次提出「文化有效性」评估标准与自动评估模型 JUDGER(准确率 86.03%)。
机器翻译ICML
扩展分类流映射(Categorical Flow Maps)规模
连续扩散与流匹配模型有望成为语言建模中自回归方法的有力替代,可解锁加速采样与倾斜等连续模态优势。近期研究通过高斯分布与 one-hot 编码数据分布间的简单流匹配过程,实现离散数据的连续生成,并借助分类流映射(CFMs)验证了加速采样的可行性,样本质量具有竞争力。
流匹配扩散模型
⚡ 政策与安全
OpenAI 将 Astra 列为首个"关键"网络安全模型
OpenAI 在评估其即将推出的模型 Astra 后,依据"准备框架"将其列为首个"关键"网络安全模型。OpenAI 表示已为此情景做好规划,并将实施额外控制措施以确保 Astra 后续开发的安全。该公司正努力让 Astra 广泛可用,并将其先进网络能力交到防御者手中。
AI安全风险管理
Anthropic 更新 Claude Fable 5 生物安全防护,误报率大幅降低
Anthropic 更新了 Claude Fable 5 的生物安全防护机制,将生物相关查询的"回退"次数减少约 85%,用户在日常健康与教育问题上将更少遇到系统切换至较弱模型的情况。此次更新扩大了模型可协助的生物任务范围,但涉及双重用途的病毒学、毒理学和分子设计请求仍会回退至 Opus 5。
生物安全模型更新
Claude Code 会话间可互发消息
Claude Code 新功能:你的会话现在可以互相发送消息了。无需在另一个会话中重新解释自己,你现在可以让 Claude 代为传达。它会发送一份摘要(而非你的历史记录或文件),另一个会话会在任务进行中接收该摘要。
开发者工具Agent通信
📝 编辑点评
今日头条无疑属于 OpenAI 对 Astra 的"关键"定级与延缓发布——这是业界首次有前沿模型因安全评估被公开列为最高风险等级,标志着 AI 安全治理从"理论框架"走向"实际落地",为后续模型发布设立了新的审查标杆。与此同时,视频生成赛道呈现"三国杀"局面:Seedance 2.5 同时登陆 Runway、Krea 与火山引擎 API,30 秒长叙事与 50 个角色参考成为新标配,AI 视频正从"单镜头炫技"迈向"完整叙事"阶段。开源生态方面,腾讯混元与蚂蚁百灵同日释放高性能算子与 MoE 模型,国产大模型在推理效率与部署灵活性上持续发力。科学应用层面,AI 设计功能性病毒与飓风提前预报的突破,证明了生成模型在探索未知空间上的巨大价值。整体来看,行业正从"模型能力竞赛"转向"安全治理、工程效率与多模态叙事"的全面角力。
安卿辰博客








