zzoceanpie commited on
Commit
a4e25bf
·
verified ·
1 Parent(s): f3453bf

Update README.md

Browse files
Files changed (1) hide show
  1. README.md +12 -0
README.md CHANGED
@@ -62,6 +62,18 @@ inputs = tokenizer(text, return_tensors="pt").to(model.device)
62
  outputs = model.generate(**inputs, max_new_tokens=128, temperature=0.8)
63
  print(tokenizer.decode(outputs[0], skip_special_tokens=True))
64
  ```
 
 
 
 
 
 
 
 
 
 
 
 
65
 
66
  ## 许可 / License
67
 
 
62
  outputs = model.generate(**inputs, max_new_tokens=128, temperature=0.8)
63
  print(tokenizer.decode(outputs[0], skip_special_tokens=True))
64
  ```
65
+ ### GGUF
66
+
67
+ ```python
68
+ from llama_cpp import Llama
69
+
70
+ model = Llama(model_path="Qwen3-1.7B-Yukari-SFT-f16.gguf", n_ctx=2048, n_gpu_layers=-1)
71
+ response = model.create_chat_completion(
72
+ messages=[{"role": "user", "content": prompt}],
73
+ max_tokens=200, temperature=0.8
74
+ )
75
+ print(response["choices"][0]["message"]["content"])
76
+ ```
77
 
78
  ## 许可 / License
79