欢迎光临
我们一直在努力

AI日报 | 2026年07月20日

AI Daily Digest
AI 日报

每日 AI 资讯速递

2026年07月20日 星期一

今日 AI 行业迎来多重重磅消息:NVIDIA 联手日本打造物理 AI 工厂,月之暗面与面壁智能分别披露前沿技术路线与开源模型,而苹果与 OpenAI 的法律战则持续升级。与此同时,多款大模型密集发布,端侧与具身智能赛道热度不减,行业正从“参数竞赛”转向“实用价值”的深度探索。

🤖 大模型与前沿技术

Qwen3.8 开源发布,2.4T 参数模型上线

阿里巴巴发布 Qwen3.8 系列,拥有 2.4T 海量参数,并很快开源权重。其预览版 Qwen3.8-Max-Preview 已在阿里云的 Token Plan、Qoder 等平台首发,官方称其可与领先前沿 AI 模型媲美,仅次于 Fable 5。

📰 阿里云 Qwen
大模型开源

月之暗面在 GTC 2026 披露 Kimi K2.5 技术路线:重构三大基础组件

月之暗面 CEO 杨植麟在 GTC 2026 上提出用 MuonClip 优化器替代 Adam,数据利用效率提升近一倍。同时推出 Kimi Linear 线性注意力,在百万 Token 上下文下全面超越全注意力;Agent Swarm 已支持 300 个 Agent 并行工作。

📰 社交媒体
技术突破Agent

八天四款前沿模型发布,Kimi K3 跻身第三

过去八天内,Grok 4.5、GPT-5.6、Muse Spark 1.1 与 Kimi K3 四款模型相继发布,使 Artificial Analysis Intelligence Index 得分超 50 的实验室从 6 月初的 2 家增至 6 家,AI 前沿竞争格局加速重塑。

📰 Artificial Analysis
行业动态模型竞赛

MiniCPM5-2B 发布:4B 以下全球性能第一,适配 9 款芯片

面壁智能联合 OpenBMB 发布端侧模型 MiniCPM5-2B,以 2B 参数量在 AA-Index 榜单取得 4B 以下模型最高分 17 分,超越 Qwen3.5-2B 等竞品。模型原生支持混合思考与 512K 上下文,已完成华为昇腾、英伟达等 9 款芯片的 Day0 适配,即将开源。

📰 面壁智能
端侧模型开源

🚀 产品发布与行业动态

黄仁勋访日:Nvidia 联手日本打造物理 AI 时代

Nvidia CEO 黄仁勋在 7 月 15-16 日访日期间,宣布为日本建设“Vera Rubin AI 工厂”,配备 13,750 颗 Vera CPU 和 27,500 颗 Rubin GPU,预计 2028 年投运。同时推动 Noetra 主权 AI 工厂与 Cosmos 机器人联盟落地,标志日本在物理 AI 领域迈出关键一步。

📰 TechCrunch
基础设施机器人

ChatGPT Work 功能:建站、邮件、文档处理

OpenAI 推出 ChatGPT Work,支持创建和托管网站、管理电子邮件、总结海量文档以及制作文档、表格和幻灯片。该功能已集成至 Plus、Pro、Business 和 Enterprise 套餐,标志着 ChatGPT 从对话助手向生产力平台的跨越。

📰 OpenAI
产品发布办公效率

昆仑万维宣布 2026 为“世界模型元年”,发布 Matrix-Game 3.5 等模型

昆仑万维董事长方汉在 WAIC 上宣布 2026 年为“世界模型元年”,并发布 Matrix-Game 3.5 世界模型、Mureka v9.5 与 O3 音乐模型。Matrix-Game 3.5 实现 Patch 级记忆注入,5B 模型在 720p 分辨率下单卡可达 20FPS 实时生成,核心架构已开源。

📰 昆仑万维
世界模型开源

通义实验室发布 Wan-Streamer v0.2,端到端响应延迟仅 550ms

通义实验室发布 Wan-Streamer v0.2,将“听、看、说、演”统一进单个 Transformer 的端到端全模态模型。其端到端响应延迟仅 550ms,输出分辨率从 v0.1 的 192×336 提升至 640×368 @ 25FPS,采用 Thinker-Performer 双通路架构在提升画质的同时维持了极低延迟。

📰 通义实验室
多模态低延迟

🔧 开源项目与工具

面壁智能开源 MiniCPM-Robot 具身智能模型系列

面壁智能开源首个具身 AI 模型系列 MiniCPM-Robot,包含 1.5B 参数的通用视觉-语言-动作(VLA)模型 MiniCPM-RobotManip 和用于目标跟踪的 MiniCPM-RobotTrack。同时发布高性能推理框架 PhyAI,旨在让机器人实现理解、记忆与行动。

📰 面壁智能
具身智能开源

transcribe.cpp 发布:基于 ggml 的跨平台语音转录库

transcribe.cpp v0.1.0 发布,一个基于 ggml 的语音转录库,支持 16 个 ASR 模型族(60+ 模型),并通过 Vulkan、Metal、CUDA 和 TinyBLAS 实现 GPU 加速,为开发者提供高性能的本地语音转录方案。

📰 cjpais
开源工具语音识别

美团 LongCat 发布 LoHoSearch:更难搜索智能体基准

美团 LongCat 推出 LoHoSearch,一个基于 762 万实体维基百科知识图谱自动生成问题的搜索智能体基准。在 11 个前沿模型测试中,最佳得分仅 34.74%,远低于当前模型在 BrowseComp 上约 90% 的成绩;上下文策略仅带来 +6.8 个百分点的提升。该基准包含 544 道问题、11 个领域,已开源。

📰 美团 LongCat
基准测试搜索智能体

Schema Harness 在 ARC-AGI-3 公开集上取得约 99% 成绩

Schema 框架在 ARC-AGI-3 公开集上,使用 Claude Opus 4.8 和 Fable 5 达到 99% RHAE 分数,使用 GPT-5.6 Sol 达到 95.35%。该框架不修改模型权重,而是将原始观测转化为可编辑程序,联合解决状态归因和机制发现问题,此前最强模型 GPT-5.6 Sol 在半私有集上仅得 7.78%。

📰 Schema Harness
AGI开源框架

NVIDIA 发布 Nemotron 3 Embed 系列,8B 版本在 RTEB 基准上排名第一

NVIDIA 发布 Nemotron 3 Embed 系列,包含三个开源 checkpoint,其中 8B-BF16 版本在 RTEB 基准上以 78.46 的平均 NDCG@10 排名第一。1B-NVFP4 版本在 Blackwell 上吞吐量比 BF16 高 2 倍,精度保留 99.5%,所有模型最大序列长度 32,768 tokens。

📰 MarkTechPost
嵌入模型开源

LLM cliché highlighter:一款识别 AI 写作套话的检测工具

Simon Willison 用 Fable 5 开发了一款 LLM cliché highlighter 应用,用于高亮 LLM 生成文本中常见的十种套话模式,例如“no fluff, no filler, no jargon”这类陈词滥调。该工具旨在帮助读者快速识别并过滤 AI 写作风格化表达。

📰 Simon Willison
检测工具AI 写作

⚡ 行业动态与法律纠纷

苹果与 OpenAI 法律战升级:约 40 名前员工收到苹果律师函

苹果已向约 40 名就职于 OpenAI 的前员工发出律师函,要求保存相关文件。此前苹果起诉 OpenAI 及两名前员工,指控其通过挖角获取商业机密以加速 AI 硬件研发。苹果称已有超 400 名前员工在 OpenAI 工作,正寻求法院禁令阻止 OpenAI 使用苹果信息并要求归还机密。

📰 IT之家
法律纠纷商业秘密

Apple 起诉 OpenAI:诉讼背后是竞争焦虑还是时机博弈?

Apple 对 OpenAI 提起诉讼,指控其存在多项不当行为,尽管许多专家认为部分指控属于行业惯例。此举正值 Apple 发布新版软件公测版(以新 Siri AI 为核心)之际,外界猜测 Apple 究竟是担忧 OpenAI 成为潜在竞争对手,还是想利用 OpenAI 的弱势期获利。

📰 The Verge
法律纠纷竞争

AI 热潮正在瓦解全球决策机制

一位拥有 300 多次行业交流经验的从业者观察到,全球公私机构正陷入集体性 AI 狂热,决策层要么没有计划,要么只能低头回避。过去一年半中,其团队所见的所有 AI 项目均以失败告终(成功率 0%),失败原因常与 LLM 能力无关,而是企业本就难以有效运行软件项目,且 AI 项目叠加了额外风险。

📰 ludic.mataroa.blog
行业反思失败案例

Index Ventures 联合创始人 Neil Rimer 认为 AI 财富将面临“再分配”

Index Ventures 联合创始人 Neil Rimer 表示,围绕 AI 积累的巨额财富将面临“某种形式的再分配”,无论是自愿还是强制。他呼吁科技领袖在推动自愿再分配中发挥主导作用。与此同时,美国慈善捐赠总额虽创新高,但捐赠人数持续下降,而加州正考虑对亿万富翁征收 5% 的一次性财富税。

📰 TechCrunch
财富分配社会影响

📊 行业标准与学术研究

OpenAI 提出 AI 时代记分卡:“有用智能每美元”衡量实际工作价值

OpenAI 提出“Useful Intelligence per Dollar”(有用智能每美元)作为衡量 AI 投资回报的核心指标,从完成的有用工作量、成功任务的实际成本、结果可靠性三个维度评估,标志着行业从单纯参数竞赛转向实用价值衡量。

📰 OpenAI
评估标准投资回报

首届“小有可为”大赛乡村教育一等奖作品“智绘科普”技术拆解

首届“小有可为”大赛乡村教育赛道一等奖作品“智绘科普”采用 Qwen3.5-397B-A17B 大语言模型与 Manim 动画引擎,通过多 Agent 分阶段协作与自动修复机制,将知识主题转化为可控、可编辑的教学动画。系统包含规划、草稿、实现、审查、合成五个阶段,渲染失败时可自动提取日志并修复。

📰 微信
教育应用多Agent

📝 编辑点评

今日热点勾勒出 AI 行业的两大主线:一是基础设施与前沿模型的持续跃进,NVIDIA 的日本 AI 工厂、Qwen3.8 的 2.4T 参数以及月之暗面在优化器与注意力机制上的突破,都表明行业仍在加速冲刺;二是泡沫与反思的并存,AI 项目高达 0% 的成功率报道、苹果与 OpenAI 的法律战以及财富再分配的讨论,提醒我们技术落地与社会治理的挑战同样不容忽视。端侧模型 MiniCPM5-2B 的出色表现与 Wan-Streamer v0.2 的极低延迟,预示着 AI 正从云端向边缘与实时场景渗透。整体来看,行业正处于“技术自信”与“商业理性”的博弈期,谁能率先将参数优势转化为用户可感知的实用价值,谁就能在下半场的竞争中占据主动。

📊 数据来源:
⚠️ 免责声明:内容整理自公开来源,仅供参考。
 收藏 (0) 打赏

您可以选择一种方式赞助本站

支付宝扫一扫赞助

微信钱包扫描赞助

未经允许不得转载:安卿辰博客 » AI日报 | 2026年07月20日

热门推荐

评论 抢沙发

安卿辰博客 专业 快捷

QUX主题是一款功能强大的收费 WordPress 主题,适配个人博客、资源分享站、资讯网站等多种场景

联系我们联系我们
切换注册

登录

忘记密码 ?

切换登录

注册