大语言模型(LLM)知识百科
大语言模型(Large Language Model,LLM)是一种基于深度学习的人工智能程序,能够识别、生成和处理自然语言文本[^c1]。关于LLM的定义、工作原理和核心能力,请参阅 [[概述/llm-定义.md|LLM 定义与基本概念]]。
2022年末ChatGPT的发布引爆了全球生成式AI浪潮,此后LLM经历了飞速发展。截至2026年7月,领先的LLM由OpenAI、Google、Meta、Anthropic、DeepSeek、智谱AI、阿里巴巴等公司开发[^c2]。该领域正处于"全能对决"的深水区——海外巨头迭代提速、国产模型强势突围、开源力量持续破局[^c3]。当前不存在绝对的全能王者,Claude在编程和智能体领域领先,GPT在均衡推理方面胜出,Gemini领跑科学计算,国产模型在中文场景中占据统治地位[^c4]。
2026年7月重大进展
2026年7月初,大语言模型领域发生了一系列标志性事件,深刻改变了市场竞争格局。
美国政府以前所未有的力度干预前沿AI模型发布。Anthropic的Fable 5在经历19天出口管制后恢复访问,OpenAI的GPT-5.6被要求延后公开时间表并逐个审批客户。CIA局长John Ratcliffe将前沿AI模型能力比作"数字核武器"[^c14]。
AI资本开支周期宣告进入2.0时代。Meta计划推出云基础设施业务对外出租AI算力,Anthropic被爆正与三星接触探讨定制AI芯片合作,OpenAI联合博通发布Jalapeño推理芯片。不计成本砸钱抢算力的"野蛮增长阶段"落幕,精细化运营、重视资本回报的成熟周期开启[^c15]。
国产模型取得关键突破。智谱GLM-5.2被硅谷称为"mini DeepSeek时刻",前白宫AI负责人David Sacks评价其与OpenAI和Anthropic的当前模型一样好[^c12]。美团LongCat-2.0成为业界首个在国产算力上完成全流程训练的万亿参数模型[^c11]。Meta的Watermelon(西瓜)模型在基准测试中追平GPT-5.5,其Muse Spark即将迎来编程和智能体能力的大幅提升[^c16]。
核心能力与趋势
LLM的核心能力包括语言理解与生成、多步推理、代码生成和多模态处理。GPT-4o作为首个端到端多模态统一模型,可接受文本、音频、图像和视频输入并生成相应输出[^c5]。推理能力提升、智能体化、多模态原生融合和小型化边缘部署被视为主要发展方向。42%的组织报告在生产力、效率和成本方面取得了显著提升[^c6]。然而,LLM发展也面临幻觉问题、安全威胁(提示注入被列为最大安全缺陷)、环境影响(预计AI数据中心年耗电量可达100-150 TWh[^c7])以及伦理与社会挑战。