Spaces:
Paused
Paused
File size: 1,038 Bytes
9e5e4dc 7f0878d 9e5e4dc daaf8b9 9e5e4dc addce48 9e5e4dc 057ef60 9e5e4dc addce48 9e5e4dc 057ef60 daaf8b9 815c156 a4a25c5 9a354eb 9e5e4dc a4a25c5 9e5e4dc | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 | FROM nvidia/cuda:12.1.0-runtime-ubuntu22.04
# Wave tank surgery on DeepSeek-V4-Pro model
RUN apt-get update && apt-get install -y \
python3.10 python3-pip git \
&& rm -rf /var/lib/apt/lists/*
WORKDIR /app
RUN mkdir -p /app/.cache/huggingface && chown -R 1000:1000 /app/.cache
COPY requirements.txt .
RUN pip install --no-cache-dir -r requirements.txt
COPY wave_tank_surgeon.py .
COPY space_runner.py .
ENV HF_TOKEN=${HF_TOKEN}
ENV HOME=/app
ENV HF_HOME=/app/.cache/huggingface
ENV HUGGINGFACE_HUB_CACHE=/app/.cache/huggingface/hub
ENV TRANSFORMERS_CACHE=/app/.cache/huggingface/transformers
ENV TORCH_CUDA_ARCH_LIST="80;89;90"
EXPOSE 7860
ENTRYPOINT ["python3.10", "space_runner.py"]
CMD ["python3.10", "wave_tank_surgeon.py", \
"--model", "huihui-ai/Llama-3.3-70B-Instruct-abliterated-finetuned", \
"--ffn-grid", "64", \
"--attn-grid", "64", \
"--steps", "750", \
"--lr", "0.001", \
"--device", "cuda:0", \
"--dtype", "bf16", \
"--push-to-hub", "Jibbalit/DeepSeek-V4-Pro-WaveTank"]
|