英伟达 Spectrum-X 硅光 CPO 交换机于 8 月 14 日官宣全面量产,把 AI 互连的商用时间表整整提前约两年,腾讯新闻、网易、头条等多家媒体在 8 月 24 至 28 日集中深度解读。对国内光通信产业链,这是一次卡位红利与替代考题并存的拐点:中际旭创、新易盛供应对外互联的 1.6T 硅光可插拔模块,天孚通信进入英伟达 CPO 光引擎无源组件供应链(FA 光纤阵列、耦合透镜、隔离器),工业富联承接整机 ODM 与出厂光学测试;但高端硅光芯片国产化率仍仅约 4%。CPO 市场预计从 2024 年 0.46 亿美元增至 2030 年 81 亿美元,年复合增速 137%。谁先拿到订单、跑通量产,谁就吃到光电融合时代最大的增量。
行业动态
8 月 27 日,AI 基础设施公司基元律动(TokenRhythm)宣布完成由弘晖基金领投、聚合资本与尚势资本跟投的数千万美元新一轮融资,同时 TokenRhythm API 平台启动公测。该平台对标 OpenRouter,定位面向中国开发者的一站式多模型 API 服务;公司披露已积累 5.4 万用户、单日 Token 调用量超过 5000 亿(500B),并与多家头部企业推进 PoC。真正的赌注在模型与 Agent 应用之间的 Routing Harness 基础设施——按任务类型、阶段、成本与实时状态动态选模型、切换、协作与聚合结果。
营销机构 CRM 白标平台 GoHighLevel(GHL)在 2026 年把「AI 员工」做成主叙事:AI Employee 套件包含 Voice AI、Conversation AI、Reviews AI、Content AI、Workflow AI、Funnel AI、Ask AI 七个原生工具,跑在 CRM 内部、覆盖电话/SMS/社媒/WhatsApp 全渠道,按 subaccount $50–97/月叠加收费;同期推出的 AI Agent Studio 则走「vibe coding」路线——用自然语言描述就能生成工具/工作流(定价计算器、登入仪表盘、自主销售助理),2026 年 5 月又加了 Knowledge Base Search / Web Crawler / Gap Finder 与 MCP Server Node,让 agent 能接外部工具服务器。GHL 正从「漏斗建站器」演进为机构级「all-in-one AI operating system」,也折射出 SaaS 平台把 Agent 运行时内置化的普遍趋势。
Open WebUI 8/25 21:17 UTC 打 tag v0.11.1(北京时间 8/26),头号特性是 human-in-the-loop 工具审批:管理员开启后,已保存会话里每次工具调用都会停下来等 allow/deny。配套新增 ask_user 工具(模型可先问再动)与流式重写(官方称长回复 append 最高省 1000x)。这不是新模型,而是把“可中断、可治理”做进自托管界面的控制层。
LangChain 在 8 月通讯(官方博客 8/27)把两项代理基础设施能力推上公开测试:Managed Deep Agents(一条命令部署到 LangSmith 托管运行时)与 LLM Gateway(坐在 Agent 与模型之间的控制平面,管成本、限流、回退、敏感数据)。开源侧 Deep Agents v0.7 在性能相当下把基础输入 token 砍掉 65%。这是一套“让 Agent 从实验品变生产件”的拼图,而非一个新模型。
靠「读 diff + LLM 猜问题」的静态 AI 评审正被一类新工具逼到墙角——它们直接在一次性容器里把 PR 对应的应用跑起来,用 computer-use 智能体点完受影响流程,再把视频、日志、复现步骤贴回 PR。代表性产品 Ito 8 月 13 日登 Product Hunt 当日第 2,DoltHub 用它在一个后端库揪出 diff 完全看不出的 SQL 命名窗口 bug;同在赛道的还有会直接写修复的 Gitar(已被 Sonar 于 2026 年 5 月收购),以及 CodeRabbit、Greptile、Cursor BugBot 等静态派。当 AI 写码速度远超人审,评审从「看代码」转向「验行为」正从噱头变成刚需。
Kilo Code 于 8/24 推送 Kilo App 重大更新(iOS build 149 / Android build 150),把原本只在 Web 端的三项能力——Code Reviewer、Security Agent、Organizations——整搬进移动 App,并首次在手机上实现完整 GitHub PR 审查:diff、行内评论、approve、会话线程与 merge 控制,还修掉了此前「无评论直接批准」做不了的问题。
8/24 多家媒体报道,NousResearch 开源的 Hermes Agent 出现在 GitHub Trending,Star 约 23.4 万、Fork 约 4.7 万;同期发布的 v0.20.5(v2026.8.19)新增 keyless web tier,内置 Exa / Parallel / Tavily / Firecrawl / Keenable 五家厂商免费模型环形轮转,网页搜索开箱即用、新手无需配置任何 API KEY。
OpenClaw 8/24 推出 beta.3 预览版,把 GPT-5.6 四档推理、可校验 SQLite 备份/恢复、外部 Gateway 生命周期监督与 Puppeteer 兼容 CDP 中继一并打包,并宣称 89 个官方 npm 插件全部随版回填完整性元数据。
Cursor 8/22 发布的 1.4 把 Agent 可控性往前推了一大步:运行中的 Agent 可在下一合适时机接收消息(⌥+Enter 排队、⌘+Enter 立即打断);读取文件取消 2MB 上限、代码库搜索重排更相关;可为不同 tab 的 Agent 指定不同模型;用量与价格可在聊天界面查看;GitHub PR 里 @Cursor 即可让后台 Agent 读提示、修代码、提交,并通过评论与 todo 回报进度。
8/21 凌晨,美团旗下 LongCat-2.0 在 NousResearch Portal 正式上线,并同步开放 Hermes Agent 一周免费试用;数小时后官方宣布延长两周,累计免费窗口达三周。这是国产大模型通过 Nous 渠道面向开发者开放体验的新动作。
OpenClaw 8/15 发布的 2026.8.1-beta.2(8/22 多家媒体集中解读)把安全边界从「能不能拿凭据」推进到「凭据只能去哪」:共享 Secret Store 的每个密钥现在绑定精确 HTTPS 目标主机,未绑定目标直接 fail-closed 拦截明文外发;新增 openclaw backup sqlite create|list|verify|restore 可校验备份;Sol/Terra/Luna 在 OpenClaw 与 Codex 双引擎原子化切换。
8 月 20 日 Anthropic 宣布 Computer Use、新 Browser Use 工具、Skills API、Files API 在 Claude Platform 全面可用(GA),把“读文件—按团队规范操作软件—写回结果”的生产级 Agent 闭环补齐。这是 Claude 生态从“聊天/补全”走向“自己干活”的关键一步,也已通过 Microsoft Foundry 提供,Vertex AI 支持在路上。
Nous Research 旗下开源 Agent Hermes 于 8/18 发布 v0.20.4 稳定版(标签 v2026.8.18),将两周内约 146 次提交、74 个 PR 收束为稳定发布;最大看点是技能安全扫描与 Krea 2 图像生成接入。
8 月 18 日,刚被 SpaceX 收购的 Cursor 向付费用户推送自有代码托管平台 Origin(Beta),定位为「AI Agent 时代的 Git」;同日 GitHub 发生 6 小时 42 分钟全球故障(PR/Issues/API 错误率约 20%、归档与原始文件下载达 50%、Copilot 与 SSO 瘫痪),微软股价当日跌超 3%。Origin 不要求用户离开 GitHub,而是把 GitHub 当「事实来源」叠加 AI 协作层。
DigitalOcean(NYSE:DOCN)旗下 Cloudways 于 8/17 正式 GA「托管式 AI 智能体」,首批托管 OpenClaw 与 Hermes 两个开源 agent。用户在既有托管平台上「一键部署」,无需自建 VPS、配安全网关;每个 agent 跑在隔离环境,运行时更新经 Cloudways 验证后推送,并支持一键 MCP 集成。这是开源 agent 从 GitHub 项目走向标准云产品的信号,当天 DigitalOcean 股价涨约 5%。
LangChain 与 AWS 于 8/17 发布开源中间件 AgentCore Payments,让 LangChain agent 在遇到付费 API 返回的 HTTP 402 时,按会话预算校验金额、用 x402 协议签名付款并重试,全程由 LangSmith 追踪。这把 agent 从「只能蹭免费接口」推进到「能自主花钱买数据」,且把花费闸门放在基础设施层而非提示词里。
支付巨头 Stripe 据彭博社报道已就收购 AI 模型路由平台 OpenRouter 达成协议,交易价超 70 亿美元(约 5 个月前 B 轮估值仅 13 亿美元);双方尚未官宣,Stripe 拒绝对传闻置评。OpenRouter 不训练模型,而是把 400+ 模型接到同一 API,按能力、价格、可用性为开发者自动选路,周处理 token 已从半年前 5 万亿增至 25 万亿,服务 800 万+ 开发者。
DeepSeek旗下开发者工具DeepSeek Harness推出v0.1开发者预览版,以MIT协议开放源代码。该工具采用“一切皆插件”的设计思路,通过Cordis元框架构建插件化开放架构,支持开发者灵活扩展与组合Agent能力。
8 月 10 日 vLLM 发布 v0.27.0,来自 242 位贡献者的 561 次提交。这一版把 Moonshot Kimi K3 的模型文件、算子、Python 与 Rust 双前端、量化与专家分片一次性补齐;同时升级到 PyTorch 2.13(属破坏性环境变更)、深化 FlashAttention 4 在 SM100 上的支持,并给尚未大规模商用的英伟达 Rubin 加了 sm_107 编译目标。
8 月 10 日,Meta 超级智能实验室(MSL)把 Muse Glimmer 的权重挂上 Hugging Face,Apache 2.0 许可、30B 稠密参数、128K 上下文,从旗舰 Muse Spark 用 logit 蒸馏压下来,配 DFlash 草稿模型做投机解码,4-bit 量化后显存占用从 55GB 压到 20GB 以内。扎克伯格同日发了约 6500 字长文为开源权重辩护,并预告 Muse Spark 1.2 的开权重版本。
Anthropic 8 月 7 日博客宣布,自 8 月 14 日起,Claude Code 在 Pro、Max、Team 套餐的新会话将默认以 Auto 模式运行——由模型自主判断何时需要用户批准,而非每条命令都弹窗。官方引用内部测试:Auto 模式拦下了 89% 的危险命令,人工审查仅拦下 13.6%;开启 Auto 的 Teams/Enterprise 用户 PR 产出约高 25%。Enterprise、API 等场景仍保持 opt-in。
The Information 独家披露,SpaceX 以全股票形式收购 Cursor 的交易最快 8 月底完成;管理层称现有 Cursor 品牌将在新产品线上逐步淘汰、团队拆散并入 SpaceXAI。这是 AI 编码工具领域迄今最大一笔收购,也意味着 Cursor 长期坚持的「模型中立」定位走向终结。
发生了什么:8 月 7 日晚,OpenAI 在官方博客宣布,对下一代模型 Astra 的最新内部评估显示其在智能体编码与网络安全上出现显著跃升,公司「无法排除」它已达到《准备框架》中的关键(Critical)网络能力档,并据此暂停了所有尚未满足强化安全管控要求的 Astra 内部活动。为什么重要:这是《准备框架》2023 年 12 月发布以来,OpenAI 首次公开承认自家模型可能触到网络安全领域最高风险档——此前包括 GPT-5.6-Sol 在内的模型均只被评为高(High)级;也是前沿实验室第一次在模型尚未发布阶段,就主动对外披露因能力过强而放缓研发。
发生了什么:Anthropic 开放 Claude Code 自托管环境(self-hosted environments)公测,Team 与 Enterprise 组织可用 claude self-hosted-runner 把自己的机器或容器变成云会话的执行层;随后落地的 v2.1.224 同时把 SendMessage 打通成跨机器能力,配套 ListAgents 发现可通信会话。为什么重要:仓库检出、构建产物、密钥与会话生成的文件都留在企业自己的机器上,把「代码必须出网」这个企业采纳 AI 编码工具的最大阻力拆掉了一半;跨会话消息则给多智能体协作提供了官方原语。
8 月 5 日,代码编辑器 Zed 宣布 Agent 面板的终端与网页抓取工具自 1.14 版起默认沙箱化,限制由操作系统强制执行,不依赖智能体是否听话。默认规则禁止在项目目录外写入、禁止写 .git、禁止发起网络请求,智能体需要时可申请临时提权并说明理由。Zed 明确指出细粒度命令规则在稍有手段的攻击者面前会瞬间失效,并披露了其沙箱对 symlink swap 攻击采取失败即拒绝的处理方式。
8 月 5 日,Meta 超级智能实验室发布终端编码智能体 Muse Code 测试版及为其协同训练的 Muse Spark 1.2 模型。模型在 Terminal-Bench 2.1、DeepSWE v1.1 与 Meta 内部编码基准上均排名第二,三项全部落后于 Claude Opus 5。Muse Code 的差异化不在跑分,而在运行时设计:常驻异步后台子智能体、本地追加式事件日志带来可精确重放与崩溃续跑。定价上 Contributor 档比标准档便宜一个数量级,代价是数据可被用于产品改进。
AWS 于 8 月 4 日发布公告,OpenAI 的编码智能体 ChatGPT Codex 现已在 Amazon Bedrock 上提供,支持 openai.gpt-5.6、gpt-5.5、gpt-5.4 系列模型。企业可用 IAM 与 Bedrock API Key 鉴权、按 token 计费、数据驻留在所选 Region,并借助 Bedrock 的零操作员访问设计把推理提示与结果隔离在 AWS 与 OpenAI 运维人员之外。需要 Codex CLI 0.128.0 或 VS Code 扩展 26.429.30905 及以上版本。
具身智能产业正从技术研发向产业化落地加速推进,头部企业的组织能力建设成为核心竞争力指标。智元机器人近期披露的核心团队阵容,折射出行业对商业化落地能力的迫切需求。
AI办公赛道正从功能迭代转向场景卡位,头部玩家通过入口级工具积累工作上下文。传统办公软件市场存在格式兼容、付费门槛等痛点,AI技术为新玩家提供了低成本切入的机会。
杭州初创团队打造的AI宠物翻译硬件PettiChat,依托阿里云通义千问大模型实现1秒内宠物情绪意图识别,上线一个半月斩获全球2万台订单,覆盖30余个国家。该产品打破20余年宠物翻译硬件的技术瓶颈,为养宠群体搭建跨物种沟通桥梁,同时具备宠物健康数据采集的延伸潜力。
AI 互动叙事平台 ISEKAI ZERO 提供“创作者发布内容 → 按用户消耗 Mana 的 25% 分成”模式,App 下载超 5 万、评分 4.5,以异世界题材视觉小说式角色扮演切入 AI 叙事赛道。
Descript 预告 Season X 将于 8 月 5 日直播发布新版 Underlord,称其为“首个且唯一懂好视频的 AI 协同剪辑师”,新版本已进入 beta,用户可在产品内直接体验。
Descript 八月更新上线:AI 协同剪辑助手 Underlord 新增视频生成与 Avatar 定制能力,配合 Uplighting、跳切平滑等增强功能,把“文本方式剪辑视频”推进到“一句话生成视频”。
AI 角色扮演社区 Janitor AI 已有超 30 万用户创建角色、月访问约 8800 万,2026 年先后上线 Creator Analytics 与 Project Multiverse,并集成 DeepSeek V4 作为平价角色扮演模型选项。
由 Resend 创始人 Zeno Rocha 等参与打造的终端编程 Agent Command Code,凭借 taste-1 持续学习机制(从每次采纳/拒绝/修改学习编码偏好并生成项目级技能)获得 500 万美元种子轮,主打开箱即用的品味自适应。
开源编程 Agent Cline 在 VS Code 市场累计安装已超 500 万、GitHub 星标约 6 万,坚持“每步编辑与命令都需人工确认”的人机回环模式,并推出 CLI 2.0 与团队版扩展使用场景。
libGDX 作者与 Flask 作者联合打造的终端编程 Agent pi 已超 8 万星、周 npm 下载约 130 万次,在 Terminal-Bench 上以 Claude Opus 排名第二——证明“四个工具 + 极简提示词”的路线正在被市场验证。
8 月 1 日,Peter Steinberger 的“Loop 还是 Graph”推文引爆 AI 开发圈 Graph Engineering 讨论;同天有媒体发文称 OpenClaw“已凉透”,而观测数据显示其星标仍在 38.5 万高位,争议折射本地部署 Agent 的商业化困境。
8 月 2 日 OpenClaw 发布 v202656,修复 OAuth 回调路由回归——该缺陷曾导致授权 token 以明文形式进入 stdout 日志,暴露窗口约 11 天;48 小时内完成补丁与复盘。
Anthropic 与 Cognizant 扩大合作,后者成为 Claude Partner Network 全球顶级合作伙伴(Global Premier Partner),超 3 万名员工完成 Claude 训练,Claude 将嵌入 Flowsource、Neuro 等平台。
7 月 24 日 Anthropic 工程师透露 Claude Code 团队删除了超过 80% 的系统提示词、内部编码评测零性能损失,8 月 1 日该话题在中文开发者社区刷屏:“旧规则不是护栏,是绊脚石”。
Kilo Code 于 8 月 1 日发布 v7.4.18;近两周 v7.4.8–v7.4.11 密集上线项目记忆可见性、任务时间线高亮、聊天搜索等能力,GitHub 仓库累计提交超 2.68 万次。
Kilo Code 宣布 8 月 4 日在 Product Hunt 上线 JetBrains 版本,覆盖 IntelliJ IDEA、PyCharm、WebStorm 等;此前该开源编程 Agent 在 VS Code/Cursor 累计下载已超 100 万,8 月 1 日 GitHub 发布 v7.4.18。
8 月初第三方观测显示,Hermes Agent GitHub 星标已超 22.35 万,与 OpenClaw(约 38.5 万)共同构成开源自主 Agent 的第一梯队,开源 Agent 社区从“单极”走向“双雄”格局。
Nous Research 官方账号转发实测:DeepSeek V4 Flash 0731 在 Hermes Agent 框架内完成 32 分钟自主任务仅花约 0.07 美元,接近 40 万次观看,低成本 Agent 长时运行成为可能。
OpenAI编程工具Codex周活跃用户超800万,带动围绕其皮肤的商业生态快速形成。从闲鱼倒卖差价到开发者搭建主题商城,不同玩家依托情绪价值与商业设计,挖掘AI工具的衍生变现空间。
2026年大模型行业头部项目融资热度攀升,一级市场对具备核心技术与商业化潜力的标的争抢加剧。头部大模型企业估值逻辑从线性利润转向IPO参照系,资本循环逐步形成。
2026年7月,深圳一家不足40人的硬件厂商Plaud推出的AI录音卡片Plaud Note,拿下全球AI录音笔品类销量第一。该产品以信用卡大小的便携形态、AI驱动的内容转化能力,在亚马逊多区域榜单长期霸榜,成为中国AI硬件出海的标杆案例。
2026年7月,DeepSeek低调上线DeepSeek-V4-Flash正式版API公测,未发布官方公告,相关信息通过API更新日志被开发者发现。本次升级未调整模型架构与尺寸,仅通过后训练强化Agent执行、工具调用与长任务处理能力,9项Agent基准测试数据全线大涨,性价比优势进一步凸显。
AI模型竞争逻辑正从参数规模比拼转向架构、推理效率等维度的技术竞争。DeepSeek-V4-Flash正式版API上线公测,284B参数规模的模型在多项Agent编程任务中超越GLM-5.2,同时支持本地部署,推动AI从云端向个人电脑迁移。
['7月28日,全国首个统筹具身智能全产业链的政府职能局——佛山市顺德区具身智能发展局正式揭牌,标志着当地在AI与实体经济融合领域迈出体制创新关键一步。', '作为全国最大工业机器人生产基地,顺德依托雄厚制造底盘,将通过专属职能机构打通具身智能产业政策、技术、场景、人才壁垒,打造新质生产力发展样板。']
资管行业AI叙事火热,但落地呈现高度集中特征。头部机构已在研究层大规模应用AI,决策层却因可验证性等核心障碍停滞。Morningstar最新报告揭示了这一分界及背后的四大阻碍,同时指出决策层突破的技术路径已在探索中。
AI原生技术落地背景下,人才评价逻辑正发生重构。国内AI模型厂商Kimi披露的五条AI原生人才观,打破传统经验、专精优先的人才筛选框架,转向好奇心、学习效率等更适配AI协作的能力维度。这一观点为AI产业人才招募与培养提供了新的参考方向。
AI学习工具赛道再添新玩家,NotebookLM前核心成员创办的Wearing将大模型学习逻辑转化为全科课程路径。该产品主打个性化学习规划,试图解决AI工具仅提供答案、缺乏系统学习引导的行业痛点。
传统ERP普遍沦为企业录单工具,仅用于生成报表供管理层参考,未发挥决策支撑价值。AI技术正逐步重构ERP的应用逻辑,WorkBuddy作为落地载体,已验证通过对话交互简化操作的可行性。
['开源AI工具仓颉Skill近期热度攀升,累计Star数突破5.3K,项目核心功能为将书籍、长视频等内容蒸馏为可调用的Agent技能', '该项目已入驻腾讯WorkBuddy平台,用户可通过WorkBuddy直接免费使用其内容蒸馏功能', '当前仓颉Skill相关需求旺盛,近30天指数呈上涨趋势,工具落地场景逐步拓展']
本周国内AI、智能硬件、自动驾驶等领域密集发布多项动态:寒武纪推出高额限制性股票激励计划,vivo调整XR业务架构,多家企业在融资、技术落地、合规测试等方面取得进展;国际领域则有OpenAI核心人员变动、谷歌调整科研团队等事件。
国内企业级AI Coding赛道迎来新玩家,字节系团队打造的词元无限完成数亿元天使轮融资,明确聚焦B端市场。该项目依托技术积累,主打可落地的智能体生产力服务,已服务近50家金融等领域大型客户,商业化进展超预期。
AI技术领域概念迭代速度较快,新名词常快速涌现。近期Agent Loop热度尚未消退,Graph Engineering概念已引发行业关注。二者分别对应AI原生组织实践与工程架构层面的探索,并非替代关系,核心均围绕提升AI系统运行效率展开。
AI技术正持续渗透传统服务领域,婚恋赛道成为AI应用创业的新方向。曾有大厂AI搜索负责人跨界切入该赛道,凭借自身技术积累与行业资源,快速获得顶级投资机构认可。其打造的AI交友产品,通过创新机制试图解决传统婚恋平台的核心痛点。
开源AI Agent工具领域迎来新落地项目,ego-lite基于Chromium框架打造,专为AI Agent优化浏览器操作场景。该项目解决了Agent操作浏览器时的登录状态复用与用户操作冲突问题,目前已登上GitHub Trending榜单。
['具身智能领域正从软硬一体向专注模型侧分化,智在无界选择不做机器人本体,聚焦跨本体通用具身基础模型研发。', '该团队以50万小时人类视频为核心数据,推出Being-H、Being-M两条模型线,将触觉模态融入预训练,解决具身模型交互核心瓶颈。', '行业对非本体型具身模型公司的认可度已显著提升,通用具身模型落地仍需场景适配与技术迭代。']
本地AI硬件市场中,AMD锐龙AI Max+ 395迷你主机凭借128GB统一内存的特殊架构,实现了消费级设备对120B级MoE大模型的加载能力。但实测显示,该设备在稠密模型运行、长提示词处理等场景存在明显短板,性价比不及二手RTX 3090。
大模型赛道正进入资本与技术的双重竞赛阶段,头部厂商加速登陆资本市场以储备长期弹药。国内头部模型厂商月之暗面旗下Kimi近期启动赴港IPO筹备,同时推出K3模型强化技术壁垒,其商业化进展也成为市场关注焦点。
近期AI领域多项工具级产品落地,大模型开源适配、Agent搜索、编程智能体等细分赛道均有新动作。头部厂商围绕大模型的多厂商兼容、AI Agent的信息供给、编程场景的语音交互等方向,推出针对性产品优化。
一支以数据结构命名的清华摇滚乐队,成员如今成为中国AI产业不同阶段的核心参与者。其成员的职业轨迹,折射出中国AI行业从早期布局到大模型时代的发展脉络。
当前AI Agent正从简单问答向长程任务执行演进,传统单次检索模式难以满足深度信息需求。豆包搜索针对Agent的信息获取痛点完成多维度升级,已落地多个行业场景并面向开发者开放服务。
大模型API定价已成为平台战略布局的重要信号。DeepSeek近期的API价格调整,并非单纯的成本应对,而是其从拉新转向商业化的关键动作。该调整大概率是为推出更完善的Code Plan开发者套餐做铺垫,标志着平台正从低价模型API向可付费的开发者平台转型。
AI推理场景中,高性价比硬件的应用价值正受关注。二手数据中心显卡凭借大容量显存,成为低成本部署大模型的可行方案。NVIDIA Tesla P40作为退役数据中心计算卡,在本地AI部署中展现出适配性。
移动AI智能体赛道持续迭代,Minis作为手机端原生独立智能体,凭借完整本地运行能力与高自由度配置,成为移动端AI工具领域的代表性产品。其功能覆盖多模型兼容、本地环境部署、多模态交互等核心场景,为移动端AI应用提供了新的实现路径。
月之暗面在Kimi K3开放日同步发布大模型权重、技术报告及三项关键基础设施技术,覆盖模型训练全链路。此举旨在降低前沿智能获取门槛,推动AGI领域创新与生态建设。
微信开发者工具推出Skills套件,解决AI编程工具与开发环境割裂的痛点,实现开发流程一体化。该套件覆盖编译、调试、部署等全环节,提升小程序开发效率。
美团万亿参数大模型LongCat预训练核心负责人裴鹏近日离职,距LongCat-2.0开源仅三周。裴鹏曾主导LongCat从零到一研发,推动其在Agentic Coding等场景落地。目前美团官方未回应,其去向及LongCat后续迭代受关注。
吴恩达团队推出开源桌面端AI协作工具OpenWorker,填补AI工具与实际办公流程的衔接空白。该项目基于此前开源的aisuite构建,主打本地优先、权限可控的AI任务执行能力,上线5天便收获7.6k GitHub星标。
AI Agent赛道近期经历剧烈波动,OpenClaw凭借套利模式短期爆红后迅速遇冷,带动跟风产品同步跳水。行业洗牌信号显现,头部厂商调整相关业务,非营利组织接手OpenClaw后续运营。
面向产品、设计、工程团队的协作型项目管理工具Linear,近期新增AI相关功能,引发开发者与团队管理领域关注。该工具主打高效协作,与代码仓库深度联动,同时存在明确的适用边界。
阿里整合多款Agent产品推出千问办公Beta版,主打智能办公场景,对标腾讯WorkBuddy。该产品依托阿里千问大模型,覆盖多类办公需求,强化生态整合与拓展能力,正式开启AI办公领域竞争。
腾讯混元大模型业务启动架构整合,将大语言与多模态研发团队合并为基础模型部,由首席AI科学家姚顺雨统筹。此次调整旨在提升研发协同效率,探索全模态模型技术上限。
AI Agent工具Hermes推出开源桌面端,解决原命令行版操作分散、配置繁琐的痛点。该桌面端上线6周获5200+星,核心功能围绕体验优化展开。
腾讯旗下智能办公产品WorkBuddy正式登陆鸿蒙电脑应用市场,成为鸿蒙平台首个桌面办公智能体。该产品已实现鸿蒙全终端覆盖,依托鸿蒙底层能力打造独家跨端办公功能。
阿里开源自研代码审查工具Open Code Review,该工具已在内部运行两年,服务数万开发者,累计排查数百万代码缺陷。其采用确定性流水线与Agent混合架构,解决通用Agent常见的覆盖不全、位置漂移等问题,兼容主流大模型且token消耗仅为通用方案的1/9。
大模型行业竞争加剧,头部厂商技术路线与商业策略受关注。月之暗面针对Kimi K3的外界质疑作出官方回应,披露核心技术创新。中国大模型企业的技术价值与定价逻辑成为行业讨论焦点。
文档智能领域迎来技术路线突破,阿里推出的0.8B参数小模型OvisOCR2登顶权威基准OmniDocBench v1.6,实现端到端解析超越传统流水线方案。该模型基于Qwen3.5基座优化,采用真实与合成混合训练数据,兼容主流推理框架并开源。
AI生成PPT领域新增第四种解决方案Bento,该项目凭借独特的文件结构与编辑逻辑,打破了此前三类工具的使用局限。不同类型的AI生成PPT工具各有优劣,Bento的出现为用户提供了兼顾美观性与可编辑性的新选择。
AI交互正从纯文字向多模态场景演进,声音、记忆、形象的融合正在重构人与AI的关系认知。一款名为Luna的AI产品通过整合实时语音、有限记忆与可定制形象,让使用者从“与模型对话”转向“与特定对象互动”,相关体验变化成为行业关注的新方向。
7月17日WAIC开幕,华为首次公开展出昇腾950超节点(Atlas 950 SuperPoD)真机,支持1024张NPU卡高速互联,总算力达英伟达NVL144方案的6.7倍。中科曙光、中兴通讯等同期展出十万卡集群和超节点新品。算力竞争正从单一芯片性能比拼转向系统级集群能力竞争,"超节点"成为AI基础设施的主流形态。
工信部透露,今年上半年中国人形机器人产量已超过4万台,预计全年将超过10万台,相比去年全年约2万台大幅跃升。宇树G1完成全球首例活体腹腔镜手术并登上《Nature》,智元机器人第1500台工业人形下线,整机租赁模式降低中小企业引入门槛。产业开始从单机样机走向批量交付。
DeepSeek、OpenAI、Anthropic、智谱等头部大模型厂商几乎同时推进自研AI推理芯片。当推理成本占营收30%-50%,自研芯片从"可选项"变成"必选项"。与手机厂商造芯聚焦端侧SoC不同,大模型厂商造芯聚焦云端推理ASIC,本质是"算法定义硬件"的垂直整合。
4月10日发布的《人工智能拟人化互动服务管理暂行办法》于7月15日正式施行,这是全球首部针对AI拟人化互动服务的专项管理法规。法规要求AI服务提供方在用户连续使用超过2小时时弹窗提醒,严禁向未成年人提供虚拟亲属/伴侣服务,14岁以下需监护人同意。同期豆包、千问等平台已主动下线拟人智能体功能。
7月9日,OpenAI正式发布GPT-5.6系列模型(Sol/Terra/Luna三版本),同步推出企业级智能体ChatGPT Work和全双工语音模型GPT-Live。但发布日面临三重压力:Anthropic企业API份额首次反超OpenAI,微软加速用自研MAI模型替换第三方方案,版权诉讼与监管审查悬而未决。大模型市场"四巨头"格局正式成型。
阿里内部已全面禁用Claude等海外AI工具,切换至自研编程工具Qoder(原通义灵码)。截至2026年5月,Qoder全球用户超500万,已覆盖从需求分析到代码部署的全流程。与此同时,工信部对Claude Code发布风险提示,国产AI编程工具迎来替代窗口期。
微软在Build 2026大会一口气发布七款全自研MAI模型,并在Excel、Outlook等核心办公产品中逐步替换OpenAI与Anthropic第三方模型。与此同时,微软与OpenAI的排他性合作已于4月正式终止。微软正从"借船出海"转向"造船远航"。
路透社报道DeepSeek正在开发自有AI推理芯片,项目约一年前启动,目前处于早期阶段。从依赖英伟达H800训练R1,到转向华为昇腾部署V4,再到亲自下场设计芯片,DeepSeek的算力路线变迁,几乎就是中国AI产业算力自主化进程的微缩样本。
工信部正式发布《人工智能 智能体互联》系列国家标准(GB/Z 185—2026),这是我国智能体互联领域首套国家级标准体系。标准围绕"身份可信、能力可见、发现匹配、交互协作"到"工具调用、任务完成"全流程建立统一技术框架,旨在解决各厂商智能体"连不上、信不过、管不住"的"智能孤岛"难题。
快手旗下视频生成大模型可灵AI完成近30亿美元首轮融资,创下全球视频大模型领域最大单笔融资纪录。腾讯、阿里、百度三大巨头罕见集体入场,国资、中东资本悉数到位。这是中国互联网"战国时代"落幕后,BAT首次在同一张投资桌上握手。
7月2日,证监会同意宇树科技科创板IPO注册申请,从受理到注册仅用时104天,创下科创板审核最快纪录。宇树科技2025年人形机器人出货量超5500台,全球第一。公司拟募资42.02亿元,投向智能机器人模型研发与机器人本体研发,将成为A股"人形机器人第一股"。
6月12日,美国商务部以国家安全为由对Anthropic的Fable 5和Mythos 5模型发布出口管制指令,禁止任何外国公民使用。Anthropic被迫全面关停两款模型。这是美国出口管制历史上首次直接叫停商业化大模型的全球流转,标志着前沿AI监管从硬件断供延伸到模型本身。
感应塔《2026年AI行业报告》显示,ChatGPT在全球AI助手市场的份额首次跌破50%。中国市场集体发力,国产大模型调用量连续九周超过美国模型。华为昇腾950超节点即将亮相,华尔街机构喊话"撤出AI(中国除外)"。中美AI产业格局正实质性进入"双轨并行"的竞争新阶段。
