欢迎光临
我们一直在努力

AI日报 | 2026年08月13日

AI Daily Digest
AI 日报

每日 AI 资讯速递

2026年08月13日 星期四

今日共有 20 条值得关注的 AI 资讯。

📰 其他

DeepSeek V4 Pro与Grok 4.6同日发布,双双逼近Claude Fable 5体验

DeepSeek V4 Pro正式版与Grok 4.6在2小时内先后发布,均为1.6T/1.5T参数模型,逼近Claude Fable 5体验。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmsqq3bc001snro7vo8picfbp

📰

Claude in Chrome 侧边栏升级为 Claude Cowork 会话

Claude in Chrome 浏览器扩展的侧边栏现已升级为 Claude Cowork 会话,对话会保存至历史记录,技能和连接器可在浏览器中工作,且任务可在桌面、网页和移动端应用间无缝切换。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmsqj4ly004izroxvzl349s3r

📰

AutoGPT 如何用 AGENTS.md 和技能门控管理 AI 生成的拉取请求

AutoGPT 维护者发现,AI 智能体不会主动阅读文档,因此将指令放在 AGENTS.md 和技能文件中,并置于代码目录旁。他们通过强制 PR 模板、测试计划、CI 覆盖率门槛和 CLA 签名等门控机制,将智能体提交的 PR 从"不可用"转变为"可用但不符合路线图"。其中 CLA 签名因需浏览器和 OAuth 流程,被用作区分人类与智能体的"人类探测器"。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmsqgeo2e02cvroxvpnycl2zi

📰

空货架还是丢钥匙?Google 研究:Recall 是参数化事实性的瓶颈

Google Research 提出知识画像框架,发现前沿 LLM(如 Gemini3、GPT-5)的事实编码接近饱和,但回忆(recall)能力不足,多数事实错误源于"丢钥匙"而非"空货架"。该框架将事实分为编码失败、回忆失败等五类画像,并配套推出 WikiProfile 基准,含 2,150 条维基百科事实,每条配 10 个问题,用于分别探测编码、回忆与识别能力。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmsqe6mat01bsroli3hw71nz7

📰

阿里开放 Qwen3.8-2.4T-A95B 模型权重:2.4T MoE、激活 95B、原生 256K 上下文

阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重,这是 Qwen-Max 级别模型首次开源。模型总参数 2.4T,每个 Token 激活 95B,原生支持 262,144 Token 上下文并可扩展至 1,010,000 Token。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmsqagyyz00yuroucf55e5fue

📰

微软首发自研推理模型MAI-Thinking-1

我们的首个推理模型 MAI-Thinking-1 从零开始构建,现已在 Microsoft Foundry 上线。为团队点赞!更多详情如下。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmsqbnb8j01nrroosmwa5r6mj

📰

我写了一本 AI 教科书--AI 还要多久才能写得更好?

作者在完成一本 RLHF 教科书后反思,LLM 在长文非虚构写作上进展停滞,GPT 4.5 和 Kimi K2 等写作强模型已显老旧,而编码、数学等任务已接近超人水平。模型能改错字、做编辑,但组织整章内容时仍混乱且易出错,作者认为这阻碍了模型自主解决开放科学问题。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmsq5saxh051mro2e90h10exo

📰

Meta 开源 Muse Glimmer 登陆 OpenRouter

Meta AI 超级智能实验室的首个开放权重模型 Muse Glimmer 已在 OpenRouter 上线!
这是一款 30B 密集文本+图像模型,采用 Apache 2.0 许可证,旨在成为可靠的本地智能体,MCP Atlas 得分 75.5,SWE-Bench Pro 得分 51.2。
https://openrouter.ai/meta/muse-glimmer-30b
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmsq1hwsb02norobuzbw8cdcc

📰

LTX-2.5 模型登场:AI 生成 10 秒 720P 视频仅需 6.8 秒,原生集成 ComfyUI

LTX 推出 LTX-2.5 模型,原生集成 ComfyUI,在 2 张英伟达 GB200 配置下生成 10 秒 720P 视频仅需 6.8 秒。LTX-2.5 Fast 以每秒 0.09 美元生成带音频 720p 视频,10 秒片段成本 0.90 美元;年度经常性收入低于 1,000 万美元的组织可免费使用。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmspr6h6s01hero4hjcdf95mw

📰

Research Gold 号称"100%人类撰写、绝不使用AI",实则全程由AI驱动

面向医学研究者的网站 Research Gold 宣称其服务"100%由人类撰写、绝不使用AI",并列出多名博士审稿人。但调查发现,这些审稿人系AI生成、并不存在;部分真实方法学家的身份和照片未经许可被挪用。致电该公司时,自称"Sarah"的AI助手坚称自己是真人,邮件与聊天回复也均为AI生成。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmspo193n05q2rojeue8j2k5a

📰

零基础用户半天上手AI的12步实操流程

文章给出一套零基础用户半天上手AI的12步实操流程:准备内存不低于16G的电脑,订阅ChatGPT并安装Codex或使用WorkBuddy,用语音输入法以【背景、痛点、需求】框架向AI交代任务,经苏格拉底提问澄清需求后投喂文件让AI直接完成,最后沉淀为可复用Skill。文中建议Codex选GPT-5.6 Sol最高模型,WorkBuddy选Kimi K3。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmspc30un0e4xrorts1kax9zg

📰

Cursor 与 SpaceXAI 联合发布 Grok 4.6

Cursor 与 SpaceXAI 今日发布 Grok 4.6,重点强化长时运行智能体与交互式视觉任务,在多项智能体编程与知识工作基准上达到前沿水平,并在 Artificial Analysis Intelligence Index 上追平 GPT-5.6 Sol。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmsqf39o0015groxvnc7oiwop

📰

OpenRouter 推出实时网页搜索基准测试:如何为智能体选择引擎、深度与模型

OpenRouter 发布实时排行榜,系统评测模型、搜索引擎、搜索方法与预算四类配置组合。数据显示,将搜索预算从 1 轮增至 25 轮可使 BrowseComp 得分近乎翻倍,成本仅增 2.5-7 倍;模型选择比引擎更重要,平均分差 15 分 vs 10 分。失败率高的任务应降低搜索深度以控制成本。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmsq9h6gs01x5ronde8fdla7e

📰

xAI 发布 Grok 4.6,强化长时运行智能体能力

xAI 今日发布 Grok 4.6,在 Grok 4.5 基础上重点强化长时运行智能体及更复杂的交互式与视觉工作能力。该模型在多项智能体编码与知识工作基准上达到前沿水平,在 Artificial Analysis Intelligence Index(九项基准综合分)上追平 GPT-5.6 Sol。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmsqabu0f001krouc6sfhic2d

📰

Mojo 1.0 正式发布:为生态系统增长提供稳定基础

Mojo 语言正式发布 1.0 版本,提供稳定、可用于生产环境的语言基础,自 2023 年首次发布以来已发展成通用语言。自开源标准库以来,近 200 名贡献者合入超 1,100 个拉取请求,改动超 200,000 行代码。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmsp3o23e04vnrortt7twvx4v

📰

ChatGPT 与 Gemini 双双突破 10 亿用户

OpenAI 与 Google 的聊天机器人均跨过 10 亿用户门槛。OpenAI 在 8 月 6 日的博文中披露 ChatGPT 月活用户超 10 亿,Google CEO 皮查伊则宣布 Gemini 月活达 10 亿,成为其史上增长最快的产品。OpenAI 称 ChatGPT 在 7 月周活用户已达 10 亿,而 Gemini 在 2 月月活为 7.5 亿,增长势头更猛。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmsp2lgxo03xjrortthctedzu

📰

Runway Seedance 2.5 上线,支持50角色参考

完整阵容,完整曲目,一次生成一个。
Seedance 2.5 已在 Runway 上线,支持 50 个独特角色参考,以及最长 30 秒、与音乐同步的片段。点击下方链接即可开始使用。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmsp1lufu03a9rortoc0ci36q

📰

将 GitHub Copilot 置于中间人(MitM)代理之后后,我学到了什么

作者通过 mitmproxy 对 VS Code 中的 GitHub Copilot 进行中间人代理拦截,逆向分析其网络流量与内部架构。文章指出这些 AI 应用普遍基于 Electron 构建,共享相似的网络栈,因此探测结果可迁移至其他同类应用。作者借此揭示了 Copilot 的运行时行为,并分享了配置代理的具体步骤。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmsp0g9v20242rort4zh7mzx0

📰

ChatGPT 桌面端支持导入其他智能体工作数据

你现在可以将其他智能体的工作内容与 ChatGPT Work 和 Codex 保持同步。
可导入项目、聊天记录、技能和插件,查看导入历史,并可在设置中选择开启自动更新。
现已在 ChatGPT 桌面应用中提供。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmsp0j1ph027prortm21absbh

📰

研究人员发现可读取ChatGPT等模型加密推理过程的API漏洞

Alexander Panfilov团队发现OpenAI、Anthropic、Google等主要AI提供商API存在漏洞,可读取推理模型的加密思考过程。扫描约7000条公开会话发现62个API密钥、33个邮箱和33个密码。通过越狱,Anthropic的Haiku 4.5可逐字转写Opus 4.8的原始推理;解码10000条推理轨迹的API成本约720美元。
🔗 阅读原文
via AIHOT · https://aihot.virxact.com/items/cmsoydypn029yro3yvsi036au

📰
📊 数据来源:
⚠️ 免责声明:内容整理自公开来源,仅供参考。
 收藏 (0) 打赏

您可以选择一种方式赞助本站

支付宝扫一扫赞助

微信钱包扫描赞助

未经允许不得转载:安卿辰博客 » AI日报 | 2026年08月13日

热门推荐

评论 抢沙发

安卿辰博客 专业 快捷

QUX主题是一款功能强大的收费 WordPress 主题,适配个人博客、资源分享站、资讯网站等多种场景

联系我们联系我们
切换注册

登录

忘记密码 ?

切换登录

注册