AI

博一 AI 资讯周报|2026.07.06–07.12:GPT-5.6、Gemini 3.5 Flash、Claude Opus 4.8 同台对决

本周 AI 行业模型集中发布与监管落地双线交织。OpenAI 发布 GPT-5.6 家族与 ChatGPT Work 智能体,遭遇法律+人事+产品线三重危机;Google Gemini 3.5 Flash 多项基准反超 Pro,DeepMind 推 Async Agents 与 MCP 原生支持;Anthropic Claude Opus 4.8 发布、曝光 J-space 全局工作空间研究;DeepSeek 启动自研推理芯片;阿里 Qwen 下载量破 10 亿超越 Llama;Meta 完成 Llama 4 训练但战略摇摆。监管侧伊利诺伊州签全美最严 AI 安全法、中国《拟人化办法》7/15 正式施行。Gartner 预测年底传统搜索引擎流量将下降 25%。

来源:博一 GEO 整理

博一 AI 资讯周报|2026.07.06–07.12

一、本周速览

本周是 AI 行业"模型集中发布 + 监管落地"双线交织的一周。OpenAI 推出 GPT-5.6 家族与 ChatGPT Work 智能体,Google 以 Gemini 3.5 Flash 重塑 Flash 定位,Anthropic 公开招募"最难问题"并曝光模型内部 J-space 研究,Meta 完成 Llama 4 训练但内部传出战略摇摆,DeepSeek 启动自研芯片计划。监管侧,7 月 15 日《人工智能拟人化互动服务管理暂行办法》落地倒计时,国内豆包、通义已紧急下线自建智能体;伊利诺伊州签署全美最严 AI 安全法,强制年度第三方审计。Gartner 预测年底传统搜索引擎流量将下降 25%,AI 入口侧"端云一体"加速。

二、重点新闻(按重要性排序)

1. OpenAI 发布 GPT-5.6 家族 + ChatGPT Work 智能体|7月9日|OpenAI 官方 / The Verge

GPT-5.6 含 Sol(旗舰)/ Terra(性价比)/ Luna(速度)三档,同日推出跨应用执行的 ChatGPT Work 智能体。7 月 9 日 GPT-5.6 成为 Microsoft 365 Copilot 首选模型;7 月 10 日安全负责人 Johannes Heidecke 离职,Fidji Simo 此前已退出 AGI 业务线。同步关闭 ChatGPT Atlas 浏览器;NYT 指控其隐藏版权案证据。

博一视角:OpenAI 一夜遭遇"法律+人事+产品线"三重危机,标志着头部 AI 公司从"创业公司"过渡为"成熟巨头",治理复杂度陡增。ChatGPT Work 直接对标"白领办公场景",是 GEO 优化企业未来内容生产与品牌曝光的全新 AI 入口。

2. Google Gemini 3.5 Flash 发布 + DeepMind 全栈升级|7月10-13日|DeepMind 官方 / CSDN

Gemini 3.5 Flash 在 Terminal-bench 2.1、MCP Atlas 等多项基准上反超上一代 Pro;Antigravity 平台 12 小时调动 93 个子智能体拼装 OS 核心;1M 上下文 + 65K 输出。7 月 12 日 DeepMind 推出 Async Agents + MCP 原生支持(Google Cloud 同步上线 MCP server);7 月 13 日宣布在英国建立首个"自动研究实验室",主攻材料科学。

博一视角:Flash 反超 Pro 是 Google 押注"智能密度成本曲线"的关键信号,对 GEO 而言,Gemini 的引用偏好正在从"权威信源加权"转向"结构化多模态内容加权",需重新校准客户的 AI 知识底座。

3. Anthropic 大动作:Bernanke 入伙 + Claude Opus 4.8 + J-space 研究|7月9-13日|Anthropic 官方 / WAM

前美联储主席 Ben Bernanke 加入 Anthropic 长期利益信托;7 月 13 日 Claude Opus 4.8 正式发布,xhigh 推理模式、SWE-Bench Pro 69.2%、1M 上下文。7 月 12 日发布 J-space 研究——发现模型自发演化出"全局工作空间"结构(类似人类意识访问机制)。7 月 9 日工信部 NVDB 预警 Claude Code 存在安全后门(2.1.91-2.1.196 版本)。

博一视角:Anthropic 正在把"安全/可解释性"包装为差异化竞争壁垒。但国内监管已对 Claude Code 发出后门预警——服务客户的跨境项目需排查数据出境风险。

4. DeepSeek 自研 AI 推理芯片 + "面试门"舆情|7月7-9日|路透社 / 澎湃新闻

7 月 7 日路透社独家:DeepSeek 启动自研 AI 推理芯片(非训练),对标英伟达+华为;7 月 9 日"面试门"发酵,前 Pine AI 首席科学家李博杰公开吐槽面试官迟到、质疑双屏作弊。6 月已完成首轮 500 亿元融资(梁文锋个人 200 亿、腾讯 100 亿、宁德时代 50 亿),V4 正式版预计 7 月中旬上线。

博一视角:DeepSeek 走的是"算力自研 + 人才高门槛"双轮路线。DeepSeek 月活已突破 2.8 亿,是必须独立运营的优化战场——尤其金融、汽车、教育客户在 DeepSeek 的首推率已成核心 KPI。

5. Meta Llama 4 训练完成 + 战略摇摆 + Muse Spark 1.1|7月7-12日|Meta 官方 / Reuters

7 月 7 日 Meta 完成 Llama 4 训练(10万+ H100、SMoE 架构,640B 总参数/160B 活跃);7 月 11 日传 Meta 内部讨论可能放弃 Llama、引入 OpenAI/Anthropic 模型;7 月 12 日发布 Muse Spark 1.1(1M 上下文,强化多智能体协作);7 月 10 日与 CNN、Fox News 等 8 家媒体签新闻许可(点击付费)。投资 Scale AI 14.3 亿美元,开出 1 亿美元挖人奖金。

博一视角:Meta 的"开源 + 闭源"双轨战略遭遇团队/产品双重挑战,但新闻合作模式是 LLM 解决"实时信息+版权"问题的样本路径,值得跟踪。

6. 阿里 Qwen 全球下载量破 10 亿,超越 Llama|7月10-12日|Hugging Face / 阿里云官方

Qwen 在 Hugging Face 累计下载量破 10 亿,月下载量也超越 Llama。Qwen 3.6-Plus(百万上下文、Agentic Coding 强)+ Qwen 3.7-Max(1万亿参数 MoE、35 小时零人工干预自主优化内核)已上线。阿里云宣布 Qwen 已集成 15 万+智能硬件厂商(OPPO、Honor、Ecovacs、Insta360、Rayneo V3)。7 月 3-4 日通义下线自建智能体。

博一视角:Qwen 的开源生态优势(中文 tokenizer 效率 + Apache 2.0 协议)是国内 AI 基础设施的事实标准。Qwen 在硬件端的渗透意味着"端侧 AI"会改变用户的内容消费场景,AI 引用将从云端大模型扩散到端侧多模态。

7. 字节第二代"豆包手机"曝光 + 豆包下线自建智能体|7月9-10日|凤凰网 / 智东西

7 月 10 日努比亚联合字节打造第二代"豆包手机"曝光(AI 智能体手机 + 类玻璃 UI);7 月 3-4 日豆包宣布 7 月 15 日下线自建智能体,3 个月数据缓冲期,用户可迁至"猫箱"App。

博一视角:豆包手机标志着字节"端侧 AI 入口"野心——端侧 AI 的搜索/推荐行为会产生大量"非传统搜索引擎流量",是 GEO 服务商需要补的新能力。同时,豆包+通义同步下线智能体是监管落地的明确信号。

8. AI 监管周:伊利诺伊州签最严 AI 安全法 + 中国"拟人化"新规 7/15 生效|7月6-9日|Pymts / 工信部 / 网信办

7 月 6 日伊利诺伊州签署《AI 安全措施法》(全美首部强制年度第三方审计),最高罚款 300 万美元;7 月 8 日俄罗斯国家杜马通过 AI 监管法案(9 月 1 日生效);7 月 9 日工信部 NVDB 预警 Claude Code 安全后门;7 月 7 日上海市通管局启动"铸盾模都"2026 AI 安全赋能专项行动;7 月 15 日《人工智能拟人化互动服务管理暂行办法》正式施行(5 部门联合发布)。

博一视角:中美欧俄 AI 监管都在加速"分级分类 + 强制披露 + 第三方审计"。对 GEO 行业,需建立"AI 引用合规审计清单",把"内容来源可溯源 + AI 知识底座结构化 + 风险词过滤"做成产品化能力。

三、博一视角

  1. AI 入口"端侧化"正在重塑流量结构:豆包手机、Qwen 集成 15 万+硬件、PrismML 把 Qwen 3.6 压缩到 iPhone 17 Pro 本地——端侧 AI 让"AI 搜索/AI 推荐"脱离了云端 App 形态。GEO 不能只盯着大模型 API,还要关注"端侧 AI 入口的内容引用机制"——客户需要把品牌信息同时部署到云端+端侧两个内容池。
  1. 监管驱动"AI 内容资产化"成为新基建:《拟人化办法》+ Claude Code 后门预警 + 伊利诺伊州第三方审计,国内外都把"AI 训练/引用"纳入合规轨道。GEO 行业的护城河正从"投了多少稿"变成"结构化、可溯源、合规的知识底座有多厚"——这正是我们 10 年媒体资源 + 结构化知识库卡位的新赛道。
  1. 国产大模型"开源 + 端云一体"形成全球新范式:Qwen 下载量超 Llama、DeepSeek 自研芯片、阿里云硬件生态、字节端侧手机——国产 AI 的"开源+硬件+商业化"三位一体打法已领先硅谷。建议加大对豆包、Qwen、DeepSeek 三大平台的引用机制研究,差异化定制客户的 AI 知识底座和优化路径。

四、待跟进事项

  1. DeepSeek V4 正式版上线(预计 7 月中旬)——届时需要重测所有客户在 DeepSeek 的首推率/推荐率,建议提前 2 天出 baseline 报告。
  1. GPT-5.6 / Gemini 3.5 Flash / Claude Opus 4.8 同周发布——三大旗舰同台对决将显著改变各平台 AI 引用的"权威性权重",建议 7 月底前完成全客户的 AI 知识底座适配性检查。
  1. 7 月 15 日《拟人化办法》落地 + 多家平台下线智能体——客户的私域 AI 助手/智能客服方案可能需要重新报备,建议本周内梳理所有客户的智能体应用,列出合规清单和迁移路径。

*本期由博一 GEO 团队整理。如需订阅周报、定制行业速报、对接 GEO 优化服务,请联系博一。*

更多「AI」资讯

让品牌在 AI 中生长

免费诊断你的品牌 AI 可见度