feat: init 7d967cc
ngdxzy commited on
How to use FastFlowLM/Gemma4-E4B-IT-NPU2 with Transformers:
# Load model directly
from transformers import AutoTokenizer, AutoModelForMultimodalLM
tokenizer = AutoTokenizer.from_pretrained("FastFlowLM/Gemma4-E4B-IT-NPU2")
model = AutoModelForMultimodalLM.from_pretrained("FastFlowLM/Gemma4-E4B-IT-NPU2", device_map="auto")