feat: init_commit 41384a2
ngdxzy commited on
How to use FastFlowLM/Gemma4-E2B-IT-NPU2 with Transformers:
# Load model directly
from transformers import AutoTokenizer, AutoModelForMultimodalLM
tokenizer = AutoTokenizer.from_pretrained("FastFlowLM/Gemma4-E2B-IT-NPU2")
model = AutoModelForMultimodalLM.from_pretrained("FastFlowLM/Gemma4-E2B-IT-NPU2", device_map="auto")