File size: 760 Bytes
99f3f86
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
# pip install -U gradio huggingface_hub

import os
import gradio as gr
from huggingface_hub import InferenceClient

MODEL_ID = "Qwen/Qwen3-Coder-Next"
client = InferenceClient(model=MODEL_ID, token=os.environ.get("HF_TOKEN"))

def chat(user_msg, history):
    messages = []
    for u, a in history:
        messages += [{"role": "user", "content": u}, {"role": "assistant", "content": a}]
    messages.append({"role": "user", "content": user_msg})

    # Server-side Chat Completions (je nach Backend/Provider)
    resp = client.chat.completions.create(
        messages=messages,
        max_tokens=512,
        temperature=0.2,
    )
    return resp.choices[0].message["content"]

gr.ChatInterface(chat, title="Qwen3-Coder-Next (HF Inference API)").launch()