Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
justinchuby
/
gemma-4-e2b-it-onnx
Like
0
Image-Text-to-Text
ONNX
OpenVINO
onnxruntime-genai
mobius
int4
multimodal
License:
gemma
Model card
Files
Files and versions
xet
Community
Copy to bucket
new
19a16f0
gemma-4-e2b-it-onnx
126 GB
Ctrl+K
Ctrl+K
1 contributor
History:
57 commits
justinchuby
Add OpenVINO EPContext models (ORT-loadable compiled OV graph) for gemma-4-E2B-it
19a16f0
verified
2 months ago
NF4
Rebuild NF4/cuda (quantized decoder) with per_layer_inputs contract
3 months ago
Q4_K_M
Rebuild Q4_K_M/cuda (quantized decoder) with per_layer_inputs contract
3 months ago
bf16
Rebuild bf16/onnx-standard with per_layer_inputs contract
3 months ago
f16
Rebuild f16/onnx-standard with per_layer_inputs contract
3 months ago
openvino-epcontext
Add OpenVINO EPContext models (ORT-loadable compiled OV graph) for gemma-4-E2B-it
2 months ago
openvino-ir
Add OpenVINO IR (compiled artifact) for gemma-4-E2B-it, built with OpenVINO 2026.3 (incl. RMSNorm/RoPE opset-24 translators)
2 months ago
.gitattributes
Safe
6.16 kB
Add OpenVINO NPU INT4 model (mobius + K-Quant) for google/gemma-4-E2B-it
2 months ago
README.md
Safe
2.4 kB
Update README: add OpenVINO IR variant (OV 2026.3), path now works
2 months ago