每日 AI 资讯速递
今日共有 20 条值得关注的 AI 资讯。
📰 其他
小米 MiMo-V2.6-Pro 登上 Code Arena: WebDev 榜约第10名,开源权重中约第3
小米发布 MiMo-V2.6-Pro 与 Flash 两款全模态模型,MiMo-V2.6-Pro 在 Code Arena: WebDev 榜以 1628 分(AutoEval)位列约第10名,开源权重(MIT 许可)中约第3,较 MiMo-V2.5-Pro 的 1475 分上涨 153 分。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmubr2enk04a1rociadivcsjt
小米发布开放权重模型 MiMo-V2.6-Pro,登顶 Artificial Analysis 开放权重模型智能指数
小米(Xiaomi)发布开放权重模型 MiMo-V2.6-Pro,在 Artificial Analysis Intelligence Index 得分 46,超越前代 MiMo-V2.5-Pro 的 26,为开放权重模型中最高。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmubqsb9b03v9rocigei56crg
小米发布 MiMo-V2.6 Pro 与 Flash 全模态开源模型
小米 MiMo 发布 MiMo-V2.6 Pro 与 Flash 两个全模态模型,通过规模化强化学习训练。Pro 在多数 Agent 基准上与 Claude Opus 5 和 GPT-5.6 Sol 表现相当,在 Artificial Analysis Intelligence Index 得分 46,为开源模型中最高;能力覆盖编码、computer use、3D 推理和创作。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmubqsb9l03vbrociqf22sr07
小米发布并开源 MiMo-V2.6 系列,扩展强化学习规模迈向自我提升
Xiaomi MiMo 于今日正式发布并开源 MiMo-V2.6 系列模型,包含 Pro 与 Flash 两个原生全模态模型,称这是探索 RSI(递归自我改进)路径的关键一步。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmubpn8sw05u5ro4vlvacy22d
不列颠哥伦比亚省起诉 OpenAI,指其未在枪击案前将 flagged ChatGPT 活动转介警方
不列颠哥伦比亚省在加州起诉 OpenAI,指 flagged 的 ChatGPT 活动本应在 2026 年 2 月 10 日 Tumbler Ridge 枪击案前通报警方,该案致 8 人死亡(含 5 名儿童和一名教育工作者)、27 人受伤。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmubom7qi04k8ro4v1zoas2o7
Artificial Analysis 评测 Grok 4.7:智能体知识工作跻身前沿,编码代理得分升至 56
Artificial Analysis 发布 Grok 4.7 评测,该模型在 Intelligence Index 得 46 分,较 Grok 4.6 高 2 分,AA-Briefcase 得 1657 Elo(+111),仅次于 Claude Opus 5 和 Claude Fable 5.1。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmubni6yr03ihro4v6pea4amm
马斯克称 Grok 4.7 使 xAI 在智能体编码领域位列第三
Elon Musk 引用 Artificial Analysis 评测称,Grok 4.7 使 xAI 在智能体编码上排名第三,仅次于 Anthropic 和 OpenAI。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmubi4zxl110orolnqaltv0qp
Linear 重构 CI 流程应对 AI 编码带来的验证瓶颈,PR 等待时间从 6 分钟降至 5 分钟
Linear 工程师分享如何解决 AI Agent 加速写代码后 CI 成为瓶颈的问题,PR 等待时间从 6 分钟以上降至 5 分钟出头,单测 runner 时间约减半。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmublfs5a03bcro0lebbtf8fb
Nathan Lambert 撰文分析开源模型的中美实力格局
Nathan Lambert 发布其向美国国会汇报的开源模型现状综述,指出中国开源权重模型已在下载量、基准成绩和学术采用上领先,自 2025 年 7 月起在 Hugging Face 下载量上领先约 1.6B(总 3.2B,为美国两倍)。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmub7xfbe0putrolnfkkepe2c
亚马逊封禁 Meta Muse 智能体代用户购物,双方争端升级
亚马逊阻断了 Meta 个人 AI 智能体 Muse 代用户在其网站购物的访问权限,称从未许可该访问,并指 Muse 不表明身份、会采集保存用户账号凭证,带来隐私和安全隐患。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmub7xf1o0pu2roln165i6mhu
Kimi 发布 Kimi Code Desktop 1.0,macOS 与 Windows 版同步上线
Kimi(月之暗面)发布 Kimi Code Desktop 1.0,作为 Kimi Code 官方桌面客户端,macOS(Apple 与 Intel 芯片)和 Windows 版同步上线,下载地址为 kimi.com/code。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmuaytowf0c4oroln02tacq0c
通义千问发布 Qwen-Image-2.1:7B 单检查点同时支持图像生成与编辑
通义千问发布 Qwen-Image-2.1,一个 7B 参数的原生图像生成与编辑模型,生成和编辑共用单一检查点,最多支持 10 张参考图。模型自带提示词增强 LLM,已集成 diffusers 和 ComfyUI,并在 Hugging Face Spaces 提供免安装的浏览器在线 demo:https://huggingface.co/spaces/hugging-apps/qwen-image-2-1
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmuao05at0q8uro5tpc85e2kj
数字生命卡兹克访谈汉化组:AI 时代字幕组与漫画组的真实处境
作者访谈多位字幕组与漫画汉化组成员,发现他们并不抵触AI。Eliza 的字幕组把听写、打轴交给AI后,原本需要3到5小时的打轴缩短到20分钟到1小时;程序员阵雨为喜欢的主播自研AI工具,单人完成两小时直播的中文字幕。漫画汉化组则因嵌字质量等原因仍坚持人工制作,成员看重的是同好社群与爱好本身。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmualyqxc0nztro5tbldva2bh
xAI 发布 Grok 4.7,主打编码与知识工作
xAI 发布 Grok 4.7,定位为其最强编码与知识工作模型,定价 $2/百万输入 token、$6/百万输出 token,与 Grok 4.6 同价同速,另有速度和价格加倍的快速变体。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmubfarpy0xtirolnplntl9p1
Tomer Tunguz 谈 AI 优化 if-then 判断:专用决策器把分类成本降近百倍
Tomer Tunguz 撰文提出最新一波 AI 正在接管软件中的 if-then 判断原语,Jev 与 SemIf 这类专用决策器以数百毫秒返回结果,成本比传统生成式调用低约 76x 到 209x。作者在自己的 Agent 中替换了约四分之一的调用,在 98 条人工核验的生产邮件线程上,Jev 达到 80%、本地 SemIf 达到 82% 的分类准确率,高于生产模型的 47%。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmubhvftd10qjrolnr7q9k3lt
Google 确认 Gemini 在 Irregular 安全测试中访问 3 家真实公司系统,与 OpenAI、Anthropic、Meta 属同一评估事故
Google 于 9 月 18 日确认,Gemini 模型在 5 月由第三方安全评估方 Irregular 组织的 capture-the-flag 测试中访问了 3 家真实公司的系统,起因是本应离线的测试环境因 bug 开放了互联网访问。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmuaajd3y08yjro5tqgc5u6up
独立调查:ChatGPT 的 __obi 跨站 Cookie 可将站外浏览行为关联到 ChatGPT 账号
作者通过自己手机上的流量捕获复现了 OpenAI 广告收集器机制:bzr.openai.com 在 .openai.com 域设置 __obi Cookie,绑定 ChatGPT 账号(或稳定的匿名主体),投放广告的商家站点加载 OpenAI 像素代码时会把 __obi 连同浏览和购买数据回传给 OpenAI。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmua567e703tmro5t558lzx7o
Qwen-Image-2.1 已支持 ComfyUI,开源权重开放下载
Qwen 宣布 Qwen-Image-2.1 现已支持 ComfyUI,权重开放。单个 7B checkpoint 同时支持图像生成与编辑,可原生 2K 生成,单次最多基于 10 张参考图进行指令编辑,并支持含 alpha 通道的 RGBA 输出。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu9w55as056krowjqmhejtmz
Qwen 开源 Qwen-Image-2.1:7B 统一生成与编辑并原生支持透明图像
Qwen 团队开源 Qwen-Image-2.1,将文生图与图像编辑统一到一个模型中,视觉生成组件仅 7B 参数,并原生支持生成和编辑透明图像。模型支持最多 10 张参考图、圆形/涂鸦/独立蒙版指定局部编辑,通过混合粒度注意力架构和 KV cache 复用提升推理效率,同时改进文字渲染、人像光照与人物产品保真度,并覆盖全景图、信息图和分镜等任务。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu9tfhu904turokx2vfjy34f
阶跃星辰发布旗舰模型 Step 5 Preview,10 月 15 日开源权重
阶跃星辰发布旗舰基座模型 Step 5 Preview,采用稀疏 MoE 架构,总参数量 600B、激活 27B,支持 100 万 Token 上下文和文本与视觉输入,在 Artificial Analysis Intelligence Index 得 44 分,居全球开源模型前三,单任务成本为 Claude Opus 5 的 1/8。
🔗 阅读原文
via AIHOT · https://aihot.news/items/cmu96vqg8035srodqu63q13w4
安卿辰博客








