Instructions to use UNIVA-Bllossom/DeepSeek-llama3.3-Bllossom-70B with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use UNIVA-Bllossom/DeepSeek-llama3.3-Bllossom-70B with Transformers:
# Use a pipeline as a high-level helper from transformers import pipeline pipe = pipeline("text-generation", model="UNIVA-Bllossom/DeepSeek-llama3.3-Bllossom-70B")# Load model directly from transformers import AutoModel model = AutoModel.from_pretrained("UNIVA-Bllossom/DeepSeek-llama3.3-Bllossom-70B", device_map="auto") - Notebooks
- Google Colab
- Kaggle
- Local Apps Settings
- vLLM
How to use UNIVA-Bllossom/DeepSeek-llama3.3-Bllossom-70B with vLLM:
Install from pip and serve model
# Install vLLM from pip: pip install vllm # Start the vLLM server: vllm serve "UNIVA-Bllossom/DeepSeek-llama3.3-Bllossom-70B" # Call the server using curl (OpenAI-compatible API): curl -X POST "http://localhost:8000/v1/completions" \ -H "Content-Type: application/json" \ --data '{ "model": "UNIVA-Bllossom/DeepSeek-llama3.3-Bllossom-70B", "prompt": "Once upon a time,", "max_tokens": 512, "temperature": 0.5 }'Use Docker
docker model run hf.co/UNIVA-Bllossom/DeepSeek-llama3.3-Bllossom-70B
- SGLang
How to use UNIVA-Bllossom/DeepSeek-llama3.3-Bllossom-70B with SGLang:
Install from pip and serve model
# Install SGLang from pip: pip install sglang # Start the SGLang server: python3 -m sglang.launch_server \ --model-path "UNIVA-Bllossom/DeepSeek-llama3.3-Bllossom-70B" \ --host 0.0.0.0 \ --port 30000 # Call the server using curl (OpenAI-compatible API): curl -X POST "http://localhost:30000/v1/completions" \ -H "Content-Type: application/json" \ --data '{ "model": "UNIVA-Bllossom/DeepSeek-llama3.3-Bllossom-70B", "prompt": "Once upon a time,", "max_tokens": 512, "temperature": 0.5 }'Use Docker images
docker run --gpus all \ --shm-size 32g \ -p 30000:30000 \ -v ~/.cache/huggingface:/root/.cache/huggingface \ --env "HF_TOKEN=<secret>" \ --ipc=host \ lmsysorg/sglang:latest \ python3 -m sglang.launch_server \ --model-path "UNIVA-Bllossom/DeepSeek-llama3.3-Bllossom-70B" \ --host 0.0.0.0 \ --port 30000 # Call the server using curl (OpenAI-compatible API): curl -X POST "http://localhost:30000/v1/completions" \ -H "Content-Type: application/json" \ --data '{ "model": "UNIVA-Bllossom/DeepSeek-llama3.3-Bllossom-70B", "prompt": "Once upon a time,", "max_tokens": 512, "temperature": 0.5 }' - Docker Model Runner
How to use UNIVA-Bllossom/DeepSeek-llama3.3-Bllossom-70B with Docker Model Runner:
docker model run hf.co/UNIVA-Bllossom/DeepSeek-llama3.3-Bllossom-70B
Update README.md
Browse files
README.md
CHANGED
|
@@ -33,7 +33,7 @@ DeepSeek-llama3.3-Bllossom-70B๋ DeepSeek-R1-distill-Llama-70B ๋ชจ๋ธ์ ๋ฒ ์ด
|
|
| 33 |
|
| 34 |
## 1. Introduction
|
| 35 |
|
| 36 |
-
DeepSeek-llama3.3-Bllossom
|
| 37 |
|
| 38 |
ํ์ต์๋ ํ๊ตญ์ด, ์์ด reasoning ๋ฐ์ดํฐ๋ฅผ ์ฌ์ฉํ์์ผ๋ฉฐ, ๊ธฐ์กด DeepSeek-R1 ๋ชจ๋ธ ํ์ต์ ์ฃผ๋ก ์ฌ์ฉ๋ STEM ๋ถ์ผ ๋ฐ์ดํฐ ์ธ์๋ ๋ค์ํ ๋ถ์ผ์ ๋ฐ์ดํฐ๊ฐ ํฌํจ๋์์ต๋๋ค. ๋ฐ์ดํฐ์
์ค๊ณ์ ๋ชจ๋ธ ํ์ต ๊ณผ์ ์์ DeepSeek-llama3.3-Bllossom์ ํ๊ตญ์ด ์ฌ์ฉ ํ๊ฒฝ์์ ๋ ์ ํํ๊ณ ์ ๋ขฐํ ์ ์๋ ์ถ๋ก ๊ฒฐ๊ณผ๋ฅผ ์ ๊ณตํ๋ ๊ฒ์ ์ฃผ๋ ๋ชฉํ๋ก ๊ฐ๋ฐ๋์์ต๋๋ค.
|
| 39 |
|
|
|
|
| 33 |
|
| 34 |
## 1. Introduction
|
| 35 |
|
| 36 |
+
DeepSeek-llama3.3-Bllossom-70B๋ DeepSeek-R1-distill-Llama-70B ๋ชจ๋ธ์ ๋ฒ ์ด์ค๋ก ๊ตฌ์ถ๋ ๋ชจ๋ธ๋ก, ๊ธฐ์กด ๋ฒ ์ด์ค ๋ชจ๋ธ์ด ์์ด์ ์ค๊ตญ์ด ์์ฃผ์ ๋ฐ์ดํฐ๋ก ํ์ต๋ ํ๊ณ๋ฅผ ๊ทน๋ณตํ๊ณ ์ ๊ฐ๋ฐ๋์์ต๋๋ค. ํนํ, ๊ธฐ์กด DeepSeek-R1-distill-Llama-70B์ ๊ฒฝ์ฐ ํ๊ตญ์ด๋ก ์ถ๋ก ์ ๋ชจ๋ธ ์ฑ๋ฅ์ด ํฌ๊ฒ ํ๋ฝํ๋ ๋ฌธ์ ๊ฐ ์์๋๋ฐ, DeepSeek-Bllossom์ ์ด ๋ฌธ์ ๋ฅผ ํด๊ฒฐํ๊ธฐ ์ํด ๋ด๋ถ ์ฌ๊ณ ๊ณผ์ ์ ์์ด๋ก ์ํํ๊ณ ์ต์ข
์ฌ์ฉ์์๊ฒ ์ ๊ณต๋๋ ์๋ต์ ์
๋ ฅ ์ธ์ด์ ๋ฐ๋ผ ์ถ๋ ฅ๋๋๋ก ์ถ๊ฐ๋ก ํ์ต๋์์ต๋๋ค. ์ด๋ฅผ ํตํด ํ๊ตญ์ด ํ๊ฒฝ์์์ ์ถ๋ก ์ฑ๋ฅ์ด ํฌ๊ฒ ๊ฐ์ ๋์์ต๋๋ค.
|
| 37 |
|
| 38 |
ํ์ต์๋ ํ๊ตญ์ด, ์์ด reasoning ๋ฐ์ดํฐ๋ฅผ ์ฌ์ฉํ์์ผ๋ฉฐ, ๊ธฐ์กด DeepSeek-R1 ๋ชจ๋ธ ํ์ต์ ์ฃผ๋ก ์ฌ์ฉ๋ STEM ๋ถ์ผ ๋ฐ์ดํฐ ์ธ์๋ ๋ค์ํ ๋ถ์ผ์ ๋ฐ์ดํฐ๊ฐ ํฌํจ๋์์ต๋๋ค. ๋ฐ์ดํฐ์
์ค๊ณ์ ๋ชจ๋ธ ํ์ต ๊ณผ์ ์์ DeepSeek-llama3.3-Bllossom์ ํ๊ตญ์ด ์ฌ์ฉ ํ๊ฒฝ์์ ๋ ์ ํํ๊ณ ์ ๋ขฐํ ์ ์๋ ์ถ๋ก ๊ฒฐ๊ณผ๋ฅผ ์ ๊ณตํ๋ ๊ฒ์ ์ฃผ๋ ๋ชฉํ๋ก ๊ฐ๋ฐ๋์์ต๋๋ค.
|
| 39 |
|