标签: GPT-4

〖每日知识点〗大语言模型 Large Language Model (LLM) 大语言模型是参数规模达百亿、千亿乃至万亿级的神经网络模型,它以「预测下一个词」为基本方式,在海量文本上预先训练,从而掌握语言规律和世界知识,具备理解、生成、推理等通用能力;当规模大到一定程度,还会「涌现」出小模型不具备的本领。

〖每日知识点〗大语言模型 Large Language Model (LLM) 大语言模型是参数规模达百亿、千亿乃至万亿级的神经网络模型,它以「预测下一个词」为基本方式,在海量文本上预先训练,从而掌握语言规律和世界知识,具备理解、生成、推理等通用能力;当规模大到一定程度,还会「涌现」出小模型不具备的本领。

2026 年 9 月 10 日,X 用户 @caofengguang 在「每天学点儿 AI」系列第 32 期给出大语言模型(LLM)的通俗定义:参数规模达百亿到万亿级、以「预测下一个词」为训练目标,并在规模足够大时「涌现」出小模型不具备的能力。这套说法是理解当下所有大模型产品的基础框架。