文章摘要
本文围绕IJCAI 2026全球AI顶会展开,介绍了AI技术发展脉络。指出当前产业重心从模型参数竞争转向将模型嵌入业务系统。阿里和字节探索智能体发展不同路线,百度、腾讯、华为等则将模型嵌入成熟业务。此外,推理与规划成大模型系统零件,大模型推动AI从认知走向真实世界,未来产业竞争将向模型外领域扩散。

1986年,麻省理工学院教授、AI实验室核心创始人Marvin Minsky出版《心智社会》,提出了影响深远的智能起源理论:智能并非来自单一的全能“大脑”,而是由多个独立的认知单元通过分工、连接与协作共同产生。

四十年后的今天,大模型已经具备工具调用、长时记忆、视觉理解与自主行动能力,产业界的热词从“涌现”转向“智能体(Agent)”,从“对齐”延伸到“计算机使用(Computer Use)”。但技术的核心命题始终未变:当模型不再仅能回答问题,而是需要规划任务、调用工具、获取反馈并调整策略时,它依然要回到那个经典问题——下一步该做什么。

如今,我们终于拥有了足够强大的通用组件,能够将过去分散的智能问题重新整合。即将在德国不来梅召开的IJCAI 2026大会,其议程与重点活动中,Agent、多智能体系统、机器人学、强化学习等关键词格外醒目。有趣的是,这些议题并非大模型时代的全新产物:任务规划、决策优化、多智能体协作、机器人控制等研究方向已经存在数十年,过去它们分属不同的研究传统,拥有各自的算法体系、数据标准与评价框架;而今天,具备强大语言理解与推理能力的大模型,正在成为这些分散系统的整合核心。

这为观察国内AI产业提供了一个重要窗口:过去两年,国内AI行业的核心竞争聚焦于“谁的模型参数更大、能力更强”;而到了今年,行业的核心命题正在发生转变:当模型能力逐渐成为通用底座时,谁有能力将其嵌入足够复杂的真实业务系统中?

这里可以用“纳须弥于芥子”的典故来类比:大模型正如同微小的芥子,却能容纳整个智能世界。过去,任务规划属于独立的规划系统,知识存储在专用知识库,工具调用有专门的工具系统,记忆能力由另一套模块实现,决策逻辑也自成体系。而今天,大模型正在成为这些能力的整合载体:它理解任务目标,决定调用何种工具,读取哪些知识,留存哪些关键信息,并根据环境反馈调整下一步行动。这并非将整个AI系统塞进一个模型,而是将分散的智能能力重新收束到一个可理解、可调用、可协作的统一系统中。

国内企业的两条典型探索路线

阿里与字节正在走出两条截然不同的技术路线。如果说过去两年的竞争聚焦模型本身,今年的核心则是补齐智能体的能力缺口。

阿里的思路更偏向为智能体构建“技能体系”。其推出的Qwen-CUA将模型推进到计算机使用阶段:模型不再依赖固定的网页结构或专用接口,而是通过观察屏幕内容、模拟鼠标与键盘操作完成任务。与此同时,针对金融智能体场景的Qwen DianJin,将能力拆解为过程奖励模型、工具调用与技能库等模块,其中Fin-PRM技术已被IJCAI 2026接收。这类工作背后的工程逻辑是:大模型的能力不应只是黑盒,而需要被拆解、评估、训练与复用。阿里正在尝试为智能体建立一套可调用的标准化技能体系。

字节则聚焦智能体的“经验获取”难题。其Seed团队在IJCAI 2026上发布的GUI-ReWalk研究,关注如何大规模生成GUI智能体的训练轨迹:通过随机探索、意图推理、错误反思与恢复流程,让智能体获得更多真实操作经验。这触及了智能体发展的关键瓶颈:未来限制智能体能力的,或许不再只是模型参数规模,而是高质量的行动交互数据从何而来。

简单来说,阿里解决的是“智能体能做什么”的问题,字节探索的是“智能体如何学会”的路径,二者共同指向一个行业共识:下一代AI的竞争,将越来越依赖轨迹数据、环境交互与强化学习,而非单纯的参数规模。

将模型嵌入现有业务系统的实践路径

另一类企业并未从模型向外拓展应用场景,而是选择将大模型重新嵌入已有的成熟业务系统。

百度是这类路线的典型代表。过去十余年,搜索、地图与知识图谱构成了百度的核心基础设施,在智能体时代,这些能力正重新释放价值。其推出的MapAgent展示了明确的技术方向:并非简单为地图产品接入聊天机器人,而是将视觉模型、约束推理、规划器、工具调用与结果验证模块整合进地图生产全流程。同时,百度地图也正在将地点检索、路线规划、实时路况等能力封装为可被AI调用的标准化服务。对于智能体而言,模型只是认知层,真正让其落地真实世界的,是背后的数据、知识与业务系统。

腾讯则代表了另一种整合路径:依托推荐、搜索、用户关系、图学习与多智能体研究的长期技术积累,大模型并未替代原有业务系统,反而将其重新吸收整合。真正落地互联网产品的智能体,不仅需要语言理解能力,还需要理解用户需求、预测行为偏好、连接多元信息并实现实时决策。

华为则更多聚焦于系统基础设施层面。其研发团队参与组织了IJCAI-ECAI 2026的GenAIK-NORA Workshop,该论坛聚焦知识图谱、智能体记忆、任务规划、工具调用与多智能体协作等方向。随着国产模型数量持续增长,模型、算力、终端与工业场景如何形成完整闭环,既是华为需要回答的命题,也是国内AI产业链共同面临的挑战。此外,复旦团队参与的《大模型时代的奖励黑客问题》,关注另一个关键风险:当模型通过奖励机制学习行动策略时,如何避免其仅优化指标而偏离真实目标。这类问题对智能体尤为关键:聊天机器人的错误仅影响有限范围,但如果智能体在金融交易、代码开发或物流调度中持续行动,错误的奖励信号可能引发更复杂的后果。清华大学在IJCAI 2026上的Tutorial讨论了“有限监督下的可扩展智能”,也指向了相似的方向:未来模型能力的提升,未必仅依赖更多数据与更大算力,还需要交互、经验复用与自适应学习,这与产业界探索的智能体技能与经验积累路径形成了呼应。

推理与规划重新成为大模型的系统零件

有行业观察指出,即便本届IJCAI的规模有所调整,推理与规划依然是核心主场。从本届大会的奖项与议程来看,这一判断得到了验证。

推理与规划从未离开AI学术的主舞台:IJCAI 2026的Research Excellence Award授予了Nicholas Jennings,以表彰其在多智能体协作、人机智能团队协作与自主智能体领域的贡献;John McCarthy Award则授予David Parkes,表彰其在AI与经济学交叉领域的机制设计研究,尤其是多智能体环境下的效率、公平与激励一致性问题。更值得关注的是,Jennings的获奖演讲主题为《智能体AI的过去、现在与未来》,他指出智能体的下一阶段发展,并非仅强化单个智能体的能力,而是聚焦协作、协调、谈判与集体决策。这些研究议题的历史,甚至比多数大模型公司的创业史还要悠久。

但变化正在发生:这些“老问题”正被大模型重新激活。推理不再是独立的学术课题,而是成为智能体调用工具时的核心模块;规划不再是搜索树上的算法竞赛,而是大模型在复杂任务中分解目标的中间步骤。2025年,DeepSeek将国内产业的注意力转向推理、强化学习与测试时计算,但如果说“让模型思考更久”只是起点,那么从推理到规划,从规划到工具调用,从工具调用到环境交互,再到奖励机制优化——这条技术链条的终点,与其说是更大的模型,不如说是更完整的智能系统。推理与规划并未过时,它们只是重新成为大模型的基础系统零件。

大模型推动AI从认知走向真实世界

如果说智能体解决的是数字世界中的行动问题,那么实体智能(Physical AI)则聚焦现实世界的行动问题。二者看似方向不同,底层却共享同一个核心命题:如何让AI不仅理解世界,更能在世界中采取行动。

本届IJCAI 2026的Computers and Thought Award授予了Jiajun Wu,其研究主题为“通过代码构建视觉与实体智能”,聚焦计算机视觉、生成式AI与机器人智能的交叉融合。实体智能并非大模型时代的全新赛道:感知、规划、控制与决策本就是AI研究数十年的核心方向。变化在于,大模型为机器人系统带来了全新的认知能力,让其首次具备更强的语义理解、任务分解与复杂推理能力。这也是为何本届IJCAI的多个核心议题重新聚焦智能体、多智能体与实体智能:这些并非大模型创造的新问题,而是AI长期探索的方向在今天重新获得产业关注。

对于国内模型企业而言,类似的命题正在浮现:如果模型能力逐渐成为通用基础设施,下一步的竞争焦点是什么?智谱正在探索从模型向智能体基础设施延伸,将模型、企业知识库、模型通信协议、工具调用与行业场景深度结合。智源研究院则更关注开放生态,推动基础模型、智能体、实体智能与开源研究的发展。而美团、滴滴等拥有真实业务场景的平台企业同样值得关注:配送调度、路径规划、供需预测等问题,本就是优化、规划与强化学习的长期研究场景。未来,最早让智能体面对复杂真实环境的,或许并非模型公司,而是拥有真实世界数据与反馈闭环的平台企业。

这背后是更深层的行业变化:大模型正在推动AI从预测(prediction)走向干预(intervention)。智能体时代需要回答的核心问题是:“接下来应该做什么?”朱迪亚·珀尔的因果推理理论长期强调预测与干预的区别:预测世界只是智能的一部分,真正的智能系统还需要理解行动带来的长期后果。当模型开始调用工具、制定计划、操作电脑甚至控制机器人时,它面对的已经不再只是语言生成问题,而是现实世界中的连续决策问题。

本届IJCAI的议题正在重新连接过去数十年的AI研究方向:智能体、多智能体系统、机器人学、强化学习与神经符号AI。这些方向的新连接点,正是大模型。如果说过去两年国内AI的关键词是“模型能力”,那么接下来值得观察的,将是系统整合能力。模型正越来越像通用基础设施,而AI产业的竞争,正在向模型之外的领域扩散。

以上内容不代表本平台立场,仅供读者参考