Instructions to use google/gemma-4-E4B-it-qat-q4_0-unquantized-assistant with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use google/gemma-4-E4B-it-qat-q4_0-unquantized-assistant with Transformers:
# Load model directly from transformers import AutoTokenizer, AutoModelForCausalLM tokenizer = AutoTokenizer.from_pretrained("google/gemma-4-E4B-it-qat-q4_0-unquantized-assistant") model = AutoModelForCausalLM.from_pretrained("google/gemma-4-E4B-it-qat-q4_0-unquantized-assistant", device_map="auto") - Notebooks
- Google Colab
- Kaggle
Recommended GGUF quant for assistant model
1
#4 opened about 1 month ago
by
tavern-guardian