LLMの歴史
Transformerの登場から、ChatGPTによる一般普及、オープンウェイトモデルの拡大、推論特化モデルの登場まで、大規模言語モデル(LLM)全体の主要な流れをベンダー横断でたどる。
年表
2017
自己注意機構のみで構成されるTransformerアーキテクチャが発表され、以降のLLMの標準的な基盤アーキテクチャとなる。
Google
2018
双方向の文脈理解に強みを持つBERTが発表され、事前学習・ファインチューニングという枠組みがNLP全体に広まる契機となった。
Google
2022