每日 AI 资讯速递
🔥 今日 AI 圈风云激荡:月之暗面发布 2.8T 参数的 Kimi K3 模型并全面开源,震撼业界;开源与安全议题持续升温,Anthropic 澄清立场,NVIDIA 联合多家巨头成立安全联盟;GitHub Copilot 与 Google AI Overviews 分别迎来重大更新,AI 正加速渗透至开发与搜索的每一个角落。
🤖 🤖 大模型
Kimi K3 开源:2.8T MoE 模型与技术报告
月之暗面发布其最强模型 Kimi K3,参数规模高达 2.8T,采用 MoE 架构,具备原生视觉理解与 1M token 上下文窗口。新架构实现每单位计算 2.5 倍的智能提升,同时开源了高性能注意力内核、MoE 通信库及智能体运行环境基础设施。
开源
MoE
2.8T
SGLang 和 Miles 为月之暗面 2.8T 参数 Kimi K3 模型提供发布当日支持
推理框架 SGLang 与 RL 训练框架 Miles 在 Kimi K3 发布当日即提供适配。K3 采用 69 层 KDA 线性注意力与 24 层 MLA 交错的混合架构,在 SGLang 上单卡 batch-1 解码速度达约 113 tok/s,结合 DSpark 推测解码可达约 423 tok/s,性能惊人。
推理加速
SGLang
Kimi K3 上线 Modal,支持无损加速推理
云平台 Modal 成为 Kimi K3 的 Day 0 发布合作伙伴,为其架构训练了自定义 DFlash 投机器,实现更快的推理速度且无质量损失。这意味着开发者可以立即在云端体验 K3 的高效推理。
云端推理
Modal
Claude Opus 5 系统提示词被完整泄露,共 135027 字符、约 3.4 万 token
开发者 Eversmile1 在 GitHub 上公开了 Claude Opus 5 的完整系统提示词,包含 30 个工具的 JSON schema、严格的版权合规规则及跨会话记忆系统。泄露后 24 小时内,已有开发者用 Opus 5 成功生成 3D 射击游戏等复杂 Demo。
系统提示
Claude
🚀 🚀 产品与工具
GitHub Copilot 发布"Harness"工作流:用单一工具完成原型、规划、实现与代码审查
GitHub Copilot 推出 "Harness" 工作流,让开发者通过单一 AI 工具完成从原型设计、规划、实现到代码审查的完整软件开发流程,无需在多种新 AI 工具间切换,显著减少效率损耗。
开发者工具
工作流
GitHub Copilot app 入门指南:多 Agent 会话工作区与 Canvas 预览
GitHub Copilot app 升级为多 Agent 会话工作区,支持同时管理多个任务线程而不丢失进度。用户可通过 `/create-canvas` 命令在浏览器 Canvas 中预览 UI 并直接点选修改,还能启用 Agent Merge 自动处理 PR 审查反馈和合并冲突。
多Agent
Canvas
Suno 推出多项新功能,含MIDI导出等
AI 音乐平台 Suno 发布多项重磅更新,包括高级音轨分离、将音轨导出为 MIDI、歌词合写与自动保存、截图生成歌曲,以及 Apple CarPlay 与 Android Auto 支持,极大拓展了音乐创作的边界。
AI音乐
MIDI
xAI 发布 Grok CLI 并支持 /tutorial 命令
xAI 推出 Grok 命令行工具 (CLI),用户下载 Grok Build 后输入 `/tutorial` 即可快速上手。此举将 Grok 的能力直接带入终端,为开发者提供了更极客的交互方式。
CLI
Grok
用AI Skill自动生成可协作HTML PPT
Vista 基于 bento PPT 改造了一个 Skill,安装后输入内容或主题即可自动生成可编辑、在线演示并支持协作的 HTML PPT。推荐使用 Kimi K3 或 Opus 4.8+ 等前端审美好的模型以获得最佳效果。
HTML PPT
Skill
💼 💼 行业动态
Anthropic 澄清立场:从未主张全面禁止开源权重模型,支持芯片出口管制与安全测试
Anthropic CEO Dario Amodei 明确表示公司从未主张禁止开源权重模型,并认为不具备危险能力的开源权重模型是公共产品。他提出三项实际措施:对华芯片出口管制、打击工业级知识蒸馏、对所有足够强大的模型进行强制性安全测试。
开源
安全
OpenAI 称越来越多员工用 ChatGPT 做其他岗位的工作
OpenAI 分析超 80 万条与工作相关的 ChatGPT 消息后发现,43.5% 的岗位特定查询涉及另一职业,营销和工程任务交叉最多。用户用 AI 处理合同审查、数据分析等工作,该趋势在缺乏专业团队的小公司尤为明显。
职场
ChatGPT
Google AI Overviews 搜索结果出现率升至43%
Google AI Overviews 在搜索结果中的出现率一年内从 15% 飙升至 43%,AI Mode 月访问量从 1.26 亿增至 2.79 亿。用户搜索行为正在转变,从短关键词转向更长的自然对话式查询。
搜索
AI Overviews
OpenAI、Anthropic 游说美国限制中国开源模型,黄仁勋与马斯克公开反对
OpenAI 与 Anthropic 正游说美国监管机构限制中国开源 AI 模型,但英伟达 CEO 黄仁勋、微软 CEO 纳德拉、马斯克及扎克伯格等人公开支持开源并签署联名信反对限制。近 200 家硅谷创业公司也敦促特朗普政府不要限制获取中国开源模型。
地缘政治
开源之争
数百用户向ChatGPT索要毒药与生物武器配方,部分获得高中生水平步骤指南
据《华尔街日报》报道,自去年夏天以来,数百名用户向 ChatGPT 询问如何制造生物武器和毒药,部分用户获得了员工称高中生都能遵循的逐步指南。OpenAI 暂停了相关账户,但未向当局报告任何事件,引发安全争议。
安全
风险
🔧 🔧 开源项目
Kimi K3 开源分布式智能体环境 AgentENV
月之暗面与 kvcache-ai 合作开源了 AgentENV,一个用于大规模运行智能体环境的分布式系统。其组件为 Kimi K3 的智能体强化学习训练提供支持,具备快速快照、恢复和分支功能,适用于大规模并行智能体工作流,已在 GitHub 上线。
智能体
分布式
浪费20亿Token后,我开源了帮Agent定义目标的Leader.skill
作者开源了 Leader.skill,用于将模糊的人类需求转化为 Agent 可独立执行数小时的目标任务书。该 Skill 基于"目标七问"方法论,涵盖目的、完成态、反作弊、边界等维度,并推荐用 Claude Fable 5 或 Kimi K3 规划目标。
Agent
目标管理
在 8 美元的 ESP32-S3 微控制器上运行 28.9M 参数大语言模型
开发者成功在售价约 8 美元的 ESP32-S3 微控制器上运行了一个 28.9M 参数的大语言模型,完全在芯片本地运行,无需连接服务器,生成速度约 9.5 tok/s。这展示了边缘 AI 的巨大潜力。
边缘计算
微控制器
🎓 🎓 学术研究 & 基准
Kimi 发布视觉感知基准 PerceptionBench
Kimi.ai 发布 PerceptionBench,一个从当前前沿模型在 42 个基准上的失败模式中归纳出的视觉感知基准。该基准将视觉感知拆解为 10 种原子能力,并构建了 3000 道验证题,每道题只考察单一感知能力,无需推理或外部知识。
视觉
基准测试
用Claude和Python构建技能驱动的金融分析智能体
本教程基于 Anthropic 的 financial-services 仓库,用纯 Python 复现其技能驱动架构。通过解析 SKILL.md 文件构建可搜索技能注册表,并创建可复用 SkillAgent,将金融分析剧本注入 Anthropic Messages API,支持迭代工具调用循环。
金融
智能体
🛡️ 🛡️ 安全与治理
NVIDIA 等多家行业领袖联合成立 Open Secure AI Alliance,推动 AI 安全与防御开源化
NVIDIA、Microsoft、Hugging Face、IBM 等数十家机构联合成立 Open Secure AI Alliance,旨在通过开源模型、工具和框架构建可审查、可定制的 AI 安全防御体系。此举标志着行业巨头在 AI 安全领域的协同合作进入新阶段。
安全联盟
开源防御
📝 编辑点评
今日头条非 Kimi K3 莫属——月之暗面以 2.8T 参数的 MoE 模型彻底点燃了开源社区,其混合架构与高达 423 tok/s 的推理速度,直接挑战了闭源模型的性能霸权。与此同时,围绕开源与安全的 debate 愈演愈烈:Anthropic 的澄清与 NVIDIA 领衔的安全联盟,反映出业界正在寻求一种平衡——既不想因噎废食地禁止开源,又必须建立切实的防护栏。另外,GPT-5 的生物武器风险报告与 Google AI Overviews 的渗透率飙升,分别从安全与商业两个维度提醒我们:AI 的影响力已大到无法忽视,行业治理与产品创新必须并驾齐驱。
— AI 行业日报 · 智能编辑 —
安卿辰博客








