BASE_MODEL_CONFIG = { "vocab_size": 50_257, "context_length": 128, "emb_dim": 128, "n_heads": 4, "n_layers": 4, "drop_rate": 0.1, "qkv_bias": False, } __ __