π In a Training Loop
Charles
qikp
AI & ML interests
Training smaller models and fighting tooth and nail against underfitting.
Recent Activity
updated a Space 5 days ago
qikp/tokenizers new activity 6 days ago
AxiomicLabs/Open_SLM_Leaderboard:Add Kite 7Organizations
None yet
Add Kite 7
1
#116 opened 6 days ago
by
qikp
lie, it is suitable for production workload
5
#1 opened 12 days ago
by
wesdoffical
Request: DOI
1
#17 opened 11 months ago
by
vkpriya
This dataset is a poison
ππ₯ 3
4
#25 opened 24 days ago
by
BornSaint
Why Qwen3.8-27B overthinks? Here the reason and partial fix confirmed by benchmarks.
β€οΈπ 25
29
#76 opened 19 days ago
by
LuffyTheFox
New Qwen 4B when?
ππ 10
1
#94 opened 19 days ago
by
Enderchef
question
ππ₯ 3
7
#3 opened 21 days ago
by
nkthebass
Training Loss?
2
#1 opened 20 days ago
by
qikp
Question
π₯ 1
27
#1 opened about 1 month ago
by
Banaxi-Tech
Tokenizer training data
2
#1 opened about 2 months ago
by
qikp
Update README.md
1
#16 opened about 2 months ago
by
oberonism
https://huggingface.co/openbmb/MiniCPM5-1B
1
#2667 opened about 2 months ago
by
qikp
Open-OSS/privacy-filter
π€―π 3
4
#9744 opened 4 months ago
by
Procyong
No weights?
#1 opened 5 months ago
by
qikp
Dark mode is broken
2
#1 opened 5 months ago
by
qikp
add finephrase
1
#3 opened 5 months ago
by
qikp
https://huggingface.co/Qwen/Qwen3.5-0.8B-Base
1
#2220 opened 5 months ago
by
qikp
Qwen3.6-27B?
πβ€οΈ 32
19
#2 opened 5 months ago
by
lingyezhixing
Thanks
π€ 1
1
#3 opened 5 months ago
by
qikp