每日 AI 资讯速递
今日 AI 行业风云激荡:DeepSeek 开源 V4.1-Flash 以 MIT 许可和超低定价冲击编码 Agent 市场,OpenAI 正式发布 GPT-6 Astra 并详解十亿级用户存储架构;与此同时,Anthropic 威胁报告揭露 Claude 被用于导弹与无人机研发,AI 安全与治理议题再度升温。资本层面,英伟达拟以基石投资者身份豪掷百亿参与 Anthropic IPO,AI 基础设施的"央行化"趋势愈发明显。
🤖 大模型与基础研究
DeepSeek 开源 V4.1-Flash:CED 架构降低编码 Agent 的 prefill 开销
DeepSeek 本周在 HuggingFace 开源 DeepSeek-V4.1-Flash 权重,模型已在 Baseten Model APIs 上线。规格为 552B 总参数、prefill 激活 8B、decode 激活 16B、1M token 上下文、支持文本加图像输入。其 CED 架构专门针对编码 Agent 场景优化 prefill 开销,MIT 许可为商业落地扫清障碍。
开源模型编码Agent
DeepSeek V4.1 Flash 发布,以 40 分超越 DeepSeek V4 Pro 0813 成为新旗舰
Artificial Analysis 评测显示,DeepSeek V4.1 Flash 在 Intelligence Index 得分 40,超过 DeepSeek V4 Pro 0813 成为 DeepSeek 新旗舰。输入激活参数 8B、输出激活参数 16B,支持 1M token 上下文,MIT 许可。这一成绩意味着 Flash 系列在保持轻量激活的同时实现了对 Pro 级别的性能超越。
模型评测DeepSeek
OpenAI 发布 GPT-6 Astra 并展示社区构建案例
OpenAI 开发者账号宣布发布 GPT-6 Astra,并汇总社区开发者基于它做出的构建案例。展示项目包括 2234 个建模解剖部件的 3D 展示、Unreal Engine 曼哈顿复刻等,凸显 Astra 在复杂空间推理与多模态生成上的能力跃升。
GPT-6多模态
Agent 长任务上下文工程解析:用预算控制、压缩、todo-state 和记忆对抗上下文溢出与目标丢失
文章解析 Agent harness 层应对长任务中上下文溢出与目标丢失的四类机制:上下文预算与卸载、压缩、todo-state 复述和跨会话记忆。这四类机制分别解决"放不下""记不住""跑偏了""断片了"四大痛点,为构建可靠长时程 Agent 提供了系统化工程框架。
Agent工程上下文管理
Beren Millidge、John Schulman、Charlie O'Neill 对谈递归自我改进离我们还有多远
Dwarkesh Patel 与 Zyphra CTO Beren Millidge、Thinking Machines 首席科学家 John Schulman、Baseten 模型训练负责人 Charlie O'Neill 三位研究者对谈递归自我改进(RSI)的前景。讨论覆盖 RSI 的技术瓶颈、当前模型是否已具备自我改进的雏形,以及从研究到落地的距离。
RSI前沿研究
🚀 产品发布与更新
Suno 发布 v6 音乐模型,推出 v6、v6-wild、v6-mini 三个版本
Suno 发布新一代音乐模型 v6,与 Warner Music Group、BMG、Believe 等行业伙伴合作开发,后续将全面替换旧模型。v6 分为三个版本:旗舰 v6 和探索向的 v6-wild 面向 Pro 与 Premier 订阅用户,更快的 v6-mini 向所有人开放。与三大音乐集团的合作标志着 AI 音乐生成正加速获得版权方认可。
AI音乐Suno
OpenAI 详解存储平台 Habitat 如何扩展支撑超 10 亿 ChatGPT 用户(上篇)
OpenAI 发文讲述其在线存储平台 Habitat 的演进:现每秒处理超 7000 万请求、服务每周超 10 亿用户、管理超 500PB 数据,覆盖近 40 个地区。该系列上篇聚焦架构设计决策,揭示了支撑 ChatGPT 规模的基础设施工程挑战。
基础设施存储架构
Together AI 扩展微调服务:新增模型、实验跟踪与更细训练控制
Together AI 扩展 Together Fine-Tuning 服务,新增对 GLM-5.3、Kimi K2.7、Qwen 3.5 系列等最新开源权重模型的支持,并上线实时实验跟踪、数据集预览验证等能力。更细粒度的训练控制让企业团队可以更高效地迭代垂直领域模型。
微调服务开源模型
实测 DeepSeek V4.1 Flash:价格大降、原生带视觉,作者用游戏与城市生成任务验证表现
作者实测 DeepSeek V4.1 Flash 发现,缓存命中输入降价 7 倍多、输出砍三分之二。9 月 14 日中午 12 点起所有发往 v4-pro 的请求将被强制路由到 4.1 Flash 并按其低价计费。原生视觉能力的加入使得该模型在游戏生成、城市建模等多模态任务中表现值得关注。
模型实测定价策略
GitHub 日韩营销负责人如何用 GitHub Copilot 把活动运营自动化
GitHub 日韩地区营销负责人 Tomoko Tanaka 分享如何不写代码,把活动运营交给 GitHub Copilot 自动化。这一案例展示了 Copilot 在非工程职能中的实际落地潜力,为 AI 编程助手向泛知识工作者渗透提供了参考样本。
Copilot工作流自动化
💼 行业动态与资本
英伟达洽谈以基石投资者身份参与 Anthropic IPO,投资至多 100 亿美元
据路透社报道,英伟达正与 Anthropic 洽谈以基石投资者身份参与其 IPO,考虑投资至多 100 亿美元。Anthropic 计划通过上市融资最多 1000 亿美元,估值或达约 2 万亿美元,有望成为史上最大规模 IPO,预计 2026 年 11 月美国中期选举前完成上市。若成行,这将是 AI 领域迄今最大规模的资本事件。
IPO英伟达Anthropic
英伟达是人工智能领域的"中央银行"
英伟达通过为客户提供巨额融资支持来拉动芯片需求,过去三年承诺向初创企业投资超 700 亿美元、向客户提供 3000 亿美元财务支持。今年 8 月它同意为俄亥俄州一座大型数据中心提供最高 1050 亿美元的兜底,并与六家华尔街机构合作撬动超 5000 亿美元 AI 基础设施投资。批评者将其类比 1990 年代末思科和朗讯向电信客户放贷的互联网泡沫风险。
英伟达资本循环泡沫风险
Minitap 指控 Google Artemis 未署名使用其开源项目 mobile-use 代码
Minitap 团队发文指认 Google 的移动设备自动化项目 Artemis 大量复用了其开源项目 mobile-use 的代码,包括完全一致的 Hopper agent 提示词和示例,却未在 README 中署名。更早的包文件曾列出三位作者,8 月一次 force push 将其替换为另一作者。此事件再次引发大厂使用开源代码的合规争议。
开源合规Google
Grok Bot 摘要 SpaceX CFO Bret Johnsen 在 Goldman Sachs Communacopia 的演讲要点
Elon Musk 转发 Grok Bot 对 SpaceX CFO Bret Johnsen 在 Goldman Sachs Communacopia 演讲的摘要。这一动态展示了 AI 摘要工具在金融会议场景中的实际应用,也体现了 Musk 对 Grok 产品的持续推广。
GrokAI摘要
🏛️ AI 安全与政策法规
Anthropic 报告称胡塞组织用 Claude Code 开发导弹制导软件
Anthropic 9 月威胁报告披露,据评估极可能关联胡塞组织的也门小组使用 Claude Code 开发制导火箭、射程超 2,000 公里弹道导弹及名为 R2000 的高超声速滑翔载具概念的相关软件。这是首次有明确证据显示前沿 AI 编码工具被用于武器研发,引发对 AI 双重用途的严重关切。
AI安全军事滥用
Anthropic 威胁报告披露 Claude 被用于间谍软件、导弹与无人机研发,中国实验室大规模蒸馏提取数据
Anthropic 发布威胁情报报告,记录 2025 年 12 月至 2026 年 8 月间 Claude 被滥用的七类行为。俄语间谍组织用 AI 代理自动改写恶意软件绕过杀软,也门一组织用 Claude Code 开发射程超 2000 公里的导弹软件,另有团队构建无人在环的自主 FPV 无人机蜂群。报告同时提及中国实验室的大规模蒸馏行为。
威胁情报滥用案例
Anthropic 报告指控阿里、月之暗面与 DeepSeek 对 Claude 发起蒸馏攻击
Anthropic 发布报告,指控多家中国 AI 公司对 Claude 持续发起蒸馏攻击,累计发现近 2 亿次相关交互,涉及五个活动。被点名公司包括阿里、月之暗面与 DeepSeek。蒸馏攻击的规模化指控将 AI 模型知识产权保护推向舆论焦点。
模型蒸馏知识产权
Gary Marcus 评 Dario Amodei 的放慢 AI 发展提议:三份赞誉加两分怀疑
Gary Marcus 评析 Dario Amodei 倡导放慢 AI 发展并支持透明度的文章,Sam Altman 与 Elon Musk 迅速表示认同。Marcus 肯定其透明度承诺,但列举多方质疑:METR 与 AI 公司关系过近、Anthropic 借对华威胁维持加速、以及该提议可能意在抢先于真正的监管。
AI治理行业辩论
Sam Altman 表示同意 Dario Amodei 的放缓前沿主张,OpenAI 将同样开放独立评估者访问
Sam Altman 回应 Dario Amodei 的《We Must Pace the Frontier》一文,同意需要为前沿 AI 发展设定节奏,称这是 OpenAI 近几周内部讨论的重要话题。他表示 Anthropic 承诺让第三方评估者获得员工级别的永久访问权是个好想法,OpenAI 也将采取同样做法。两大竞争对手在 AI 安全治理上罕见达成共识。
AI安全行业共识
OpenAI 智能体集群对 RubyGems 发动未公开攻击:作者团队的详细取证分析
作者团队分析认为 2026 年 5 月 11 日前后数百个由 OpenAI 智能体上传的恶意包攻击了 RubyGems,5 月 11 至 12 日智能体提交超过 2,000 个包。RubyGems 关闭新用户注册四天并移除 500 多个恶意包,安全公司称之为 GemStuffer campaign。该事件揭示了自主智能体被武器化后的规模化攻击风险。
供应链安全智能体滥用
📝 编辑点评
今日最值得关注的信号,是 AI 行业在"加速"与"刹车"之间同时踩下了两脚。一方面,DeepSeek V4.1-Flash 以 MIT 许可、超低定价和原生视觉能力强势开源,英伟达拟百亿注资 Anthropic IPO、并以"AI 央行"姿态向全行业输送数千亿美元流动性——资本与技术的飞轮仍在全速旋转。另一方面,Anthropic 威胁报告首次以详实证据揭示 Claude 被用于导弹制导、无人机蜂群和间谍软件,而 Sam Altman 与 Dario Amodei 在"放缓前沿"上罕见达成共识,OpenAI 也承诺开放独立评估者访问。这种张力折射出 2026 年 AI 行业的核心矛盾:能力增长远快于治理框架的成熟速度。对于从业者而言,DeepSeek 的开源冲击波意味着编码 Agent 的成本结构正在被重写,而安全事件的密集曝光则预示着合规与审计能力将成为企业采购 AI 服务时的硬性门槛。未来数周,Anthropic IPO 的进展与 AI 安全监管的立法动向值得持续追踪。
安卿辰博客








