每日 AI 资讯速递
今日 AI 行业迎来重磅变局:Cursor 正式被 SpaceX 收购,开启 AI 与航天算力的深度融合;与此同时,开源生态呈现井喷态势,通义千问 Qwen3.8 系列、GLM-5.3、DeepSeek-V4-Pro 等国产模型密集发布,在编程与智能体能力上全面赶超。价格战与生态分化同步加剧,AI 行业正进入新一轮洗牌期。
🚀 大模型
通义千问开源 Qwen3.8 系列模型
Qwen3.8-27B 作为原生多模态稠密模型,仅 27B 参数即全面超越 Qwen3.7-Plus,原生支持 262K 上下文并可扩展至 1M tokens,采用 Apache 2.0 许可。Max 级 Qwen3.8-2.4T-A95B 开放权重同步发布,为开发者提供从轻量到旗舰的完整选择。
开源多模态
GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力
智谱 GLM-5.3 基于与 5.2 相同基座,通过极致后训练 Scaling 提升智能上界,编程能力较前代提升 50%,在 Terminal Bench 3.0 等基准中取得开源第一并接近 Claude Fable 5。模型在 CyberGym 安全测试中得分 84.5%,权重将在两周后开源。
编程安全
DeepSeek V4 Pro 登陆硅基流动,1M 上下文
DeepSeek-V4-Pro-0813 正式上线 SiliconFlow,提供 Day-0 支持,具备 1M 上下文窗口及三档推理强度,侧重编码、工具调用与智能体工作流,仍保持 MIT 协议。定价为输入 $1.32/M、输出 $3.96/M,性价比优势显著。
智能体API
Qwen3.8-2.4T-A95B 开源,硅基流动即日上线
阿里开源 Qwen3.8-2.4T-A95B,拥有 2.4T 参数、95B 激活参数,主打自主编码、深度研究与端到端智能体执行。API 定价为输入 $2.00/百万 token,输出 $6.00/百万 token,缓存输入仅 $0.25/百万 token。
开源MoE
DeepSeek-V4-Pro 正式版上线,Agent 能力大幅增强
DeepSeek-V4-Pro 正式版已在 APP、网页端和 API 同步上线,模型名设为 deepseek-v4-pro 即可使用。其 Agent 能力显著提升,HLE(wo/w tools)达 42.7/60.0,Terminal Bench 2.1 得分 87.9,多项基准表现亮眼。
Agent正式版
📱 产品发布
Gemini 3.7 Flash 全面上线 Pro 与 Ultra 用户
Gemini 3.7 Flash 现已向聊天中的 Pro 和 Ultra 用户开放,更新提升多步骤任务的推理与准确性,如智能整合数十个文件和邮件为一份主文档。Gemini Spark 也已运行于 3.7 Flash,通过改进对 Workspace 应用的工具调用,让个人 AI 智能体更精准。
Google智能体
Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型
Google DeepMind 发布 Gemini 3.7 Flash,距 3.6 Flash 仅三周,主打编程与智能体任务,输入/输出价格分别为每百万 token $0.75 和 $3.75,为原 3.6 Flash 的一半。新模型在保持高性能的同时大幅降低使用成本。
编程降价
Google Sheets 推出 Sheets canvas:用 Gemini 将表格数据变为交互式迷你应用
Google Sheets 发布新功能 Sheets canvas,基于 Gemini 构建,用户只需用自然语言提示词即可将表格数据转化为交互式仪表盘、学习追踪器、座位表等"迷你应用"。这一功能大幅降低了非技术用户的数据可视化门槛。
Google办公
Cursor 推出 builds:云智能体启动速度提升至 3 倍
Cursor 推出 builds 功能,在后台持续准备就绪的开发环境副本,让云智能体启动时无需从零搭建,响应速度最高提升 3 倍。内部环境启动快 10 倍,首个 token 生成快 3 倍,8 月 17 日起所有环境默认启用,无需额外费用。
Cursor开发工具
💼 行业动态
Cursor 正式被 SpaceX 收购
Cursor 已被 SpaceX 正式收购,完成自 4 月启动的收购流程。借助 SpaceX 全球最大规模的 GPU 集群,Cursor 将构建更强且运行成本更低的模型,并以更低价格向客户提供更强大的模型。本周三发布的 Grok 4.6 是双方合作成果的早期体现。
收购算力
AI生成书籍正淹没亚马逊,并拉低人类作者的单书收入
一项对 14,419 本自出版电子书的分析显示,AI 生成书籍正以数量而非质量挤占人类作者市场。2023 年 Q1 至 2026 年 Q1,书目总量增长 38.3 倍,而季度收入仅增长 8.9 倍;八个类型中七个类型的无 AI 文本书籍单书收入下降。
内容生态市场冲击
OpenAI and Anthropic in price war as Chinese AI rivals gain ground
随着中国 AI 竞争对手的崛起,OpenAI 与 Anthropic 正陷入价格战。国产模型的性价比优势迫使美国头部厂商调整定价策略,全球 AI 市场竞争格局正在重塑。
价格战竞争
Claude 接管应用日常维护:388 个 PR 的实践
Boris Cherny 尝试让 Claude 接管其应用的日常维护,通过 Slack 频道运行崩溃模糊测试、重复代码统一、死代码移除等任务。数周内自动开出 388 个 PR,其中 180 个经 Claude Code Review 和人工审核后合并,展示 AI 在软件维护中的实际生产力。
AI编程实践案例
📊 生态观察
2026年夏季开源模型生态观察:中国前沿模型规模领先,AMD与NVIDIA主导发布量
2026 年 1 至 8 月,Hugging Face 公开模型仓库从 243 万增至 296 万,但 85.6% 的模型下载量不足 200 次,1.5% 的仓库占据 99.2% 下载量。中国实验室月度最大开源模型参数规模在 754B 至 2.78 万亿之间,美国实验室七个月中五个月低于 130B。
开源生态趋势
dots3-note Preview 开源:280B 参数轻量模型,主打长程智能体与多模态推理
小红书技术开源 dots3-note Preview,这是 dots3 系列最轻量模型,总参数 280B、激活参数 16B,支持 512K 上下文及文本、视觉、语音多模态理解,并针对复杂推理和长程 Agent 任务优化。
开源多模态
蚂蚁百灵与 ASystem 团队打通单机 Agentic RL 后训练闭环
蚂蚁百灵与 ASystem 团队合作,用 Ling-3.0-tiny 和 AReno 在 DGX Spark 上跑通单机 Agentic RL 后训练闭环。以井字棋为最小验证任务,用 GSPO 算法训练 400 步后,rollout/rewards_mean 从约 -0.5 升至 0.4,response_len 降至约 850 tokens,验证了单机 RL 训练的可行性。
强化学习技术突破
🔧 开源项目
DeepSeek Harness v0.1 开发者预览版发布
DeepSeek Harness v0.1 现已推出开发者预览版,并以 MIT 许可证开源。该智能体框架基于 Cordis 元框架构建,核心设计为"一切皆插件",模型、工具、技能、会话、沙箱、文件系统、循环、编排及 UI 均可自由组合、替换和扩展。
框架MIT
从 0 到 1 带你速通 DeepSeek Harness
DeepSeek Harness 作为新开源的智能体框架,其"一切皆插件"的设计理念为开发者提供了极高的灵活性。该教程帮助开发者快速上手,理解其核心架构与扩展方式。
教程智能体
📋 政策法规
Claude 文本水印机制如何运作
未来 Claude 模型生成的文本将包含水印,用于判断文本由 Claude 撰写的可能性,这是 Anthropic 为遵守欧盟《AI 法案》而实施的变更。该方法基于 Google DeepMind 的 SynthID-Text 技术,对输出质量、创造力和可读性无实际影响,且不增加额外 token 或成本。
合规欧盟
📝 编辑点评
今日行业动态呈现三大核心趋势:其一,算力军备竞赛进入新阶段,SpaceX 对 Cursor 的收购标志着 AI 与航天级算力基础设施的深度融合,这将大幅降低模型训练与推理成本,重塑竞争格局;其二,中国开源模型在规模与能力上全面领先,Qwen3.8、GLM-5.3、DeepSeek-V4-Pro 等密集发布,在编程、智能体等关键领域逼近甚至超越闭源标杆,叠加价格战压力,全球 AI 市场正经历结构性洗牌;其三,AI 应用从"生成内容"向"自主执行"进化,Claude 自动维护代码库、Gemini 驱动办公自动化等案例表明,智能体已具备承担实际生产任务的能力。值得注意的是,AI 内容泛滥对创作者经济的冲击已显现量化数据,如何在效率与生态健康之间取得平衡,将是行业下一阶段的重要课题。
安卿辰博客








