大语言模型

大语言模型(LLM)是基于 Transformer 架构、通过海量文本预训练得到的神经网络模型,具备文本生成、理解、推理与代码生成等通用能力。代表模型包括 GPT 系列、Claude、Gemini、DeepSeek 等,是当代 AI 应用的基础设施。

关联