エントリーの編集
エントリーの編集は全ユーザーに共通の機能です。
必ずガイドラインを一読の上ご利用ください。
nvidia/GPT-2B-001 · Hugging Face
記事へのコメント0件
- 注目コメント
- 新着コメント
このエントリーにコメントしてみましょう。
注目コメント算出アルゴリズムの一部にLINEヤフー株式会社の「建設的コメント順位付けモデルAPI」を使用しています
- バナー広告なし
- ミュート機能あり
- ダークモード搭載
関連記事
nvidia/GPT-2B-001 · Hugging Face
GPT-2B-001 ||| Model Description GPT-2B-001 is a transformer-based language model. GPT refers to ... GPT-2B-001 ||| Model Description GPT-2B-001 is a transformer-based language model. GPT refers to a class of transformer decoder-only models similar to GPT-2 and 3 while 2B refers to the total trainable parameter count (2 Billion) [1, 2]. This model was trained on 1.1T tokens with NeMo. Model Architecture improvements The model uses the SwiGLU activation function [4] Rotary positional embeddings (R