GGUF
conversational

Qwen3-1.7B-Yukari-GGUF (archived)

⚠️ 本仓库已归档,仅保留下载记录。请使用以下新仓库,三个版本均已内置 GGUF。

新仓库

模型 LoRA 方法 仓库
SFT (初版) r=8, a=8 SFT Yukari-SFT
SFT (改进) r=32, a=64 SFT Yukari-SFT-v2
DPO (对齐) r=32, a=64 SFT+DPO Yukari-DPO

系列: Yukari-Yakumo-Roleplay

用法

from llama_cpp import Llama

model = Llama(model_path="qwen3-1.7b-yukari-f16.gguf", n_ctx=2048, n_gpu_layers=-1)

# 情绪标签控制语气,8 维 Plutchik 离散化标签
tags = "[<|中度喜悦|><|轻微愤怒|><|轻微悲伤|><|无恐惧|><|无厌恶|><|无惊讶|><|轻微信任|><|中度期待|>]"
prompt = f"{tags}\n你觉得人类最有趣的地方是什么?"

response = model.create_chat_completion(
    messages=[{"role": "user", "content": prompt}],
    max_tokens=200, temperature=0.8
)
print(response["choices"][0]["message"]["content"])

许可

  • 模型权重: Apache 2.0
  • 角色版权: (C) 上海爱丽丝幻乐团 (Team Shanghai Alice) / ZUN
  • 东方Project二次创作,遵循 官方指南
Downloads last month
4
GGUF
Model size
2B params
Architecture
qwen3
Hardware compatibility
Log In to add your hardware

16-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Collection including zzoceanpie/Qwen3-1.7B-Yukari-GGUF