Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
Wang
YYYYYYibo
Follow
AI & ML interests
None yet
Recent Activity
updated
a dataset
4 days ago
YYYYYYibo/qwen3-8b-base-deepscaler-rollouts
published
a dataset
4 days ago
YYYYYYibo/qwen3-8b-base-deepscaler-rollouts
updated
a dataset
12 days ago
YYYYYYibo/alfworld-experimenter-gpt5mini-sft-1k
View all activity
Organizations
None yet
YYYYYYibo
's activity
All
Models
Datasets
Spaces
Buckets
Papers
Collections
Community
Posts
Upvotes
Likes
Articles
updated
a dataset
4 days ago
YYYYYYibo/qwen3-8b-base-deepscaler-rollouts
Viewer
•
Updated
4 days ago
•
80k
•
29
published
a dataset
4 days ago
YYYYYYibo/qwen3-8b-base-deepscaler-rollouts
Viewer
•
Updated
4 days ago
•
80k
•
29
updated
a dataset
12 days ago
YYYYYYibo/alfworld-experimenter-gpt5mini-sft-1k
Viewer
•
Updated
12 days ago
•
1k
•
81
published
a dataset
12 days ago
YYYYYYibo/alfworld-experimenter-gpt5mini-sft-1k
Viewer
•
Updated
12 days ago
•
1k
•
81
updated
a dataset
14 days ago
YYYYYYibo/alfworld-expert-prefix-rollouts
Viewer
•
Updated
14 days ago
•
194k
•
85
published
a dataset
14 days ago
YYYYYYibo/alfworld-expert-prefix-rollouts
Viewer
•
Updated
14 days ago
•
194k
•
85
updated
a model
24 days ago
YYYYYYibo/olmo3-7b-openthoughts-estep-pos5-neg5
7B
•
Updated
24 days ago
•
15
published
a model
24 days ago
YYYYYYibo/olmo3-7b-openthoughts-estep-pos5-neg5
7B
•
Updated
24 days ago
•
15
updated
a model
about 1 month ago
YYYYYYibo/Qwen3-4B-Teacher-Penalty-PPO-Step50
4B
•
Updated
Aug 11
•
4
published
a model
about 1 month ago
YYYYYYibo/Qwen3-4B-Teacher-Penalty-PPO-Step50
4B
•
Updated
Aug 11
•
4
updated
a model
about 1 month ago
YYYYYYibo/Qwen3-4B-Teacher-Penalty-PPO-Step25
4B
•
Updated
Aug 11
•
138
published
a model
about 1 month ago
YYYYYYibo/Qwen3-4B-Teacher-Penalty-PPO-Step25
4B
•
Updated
Aug 11
•
138
updated
a dataset
about 2 months ago
YYYYYYibo/VSR-MATH500-Qwen2.5-7B-Rollouts
Updated
Jul 30
•
89
published
a dataset
about 2 months ago
YYYYYYibo/VSR-MATH500-Qwen2.5-7B-Rollouts
Updated
Jul 30
•
89
updated
a dataset
about 2 months ago
YYYYYYibo/qwen3-4b-nonthinking-skywork-rollouts-verified
Viewer
•
Updated
Jul 22
•
215k
•
21
published
a dataset
about 2 months ago
YYYYYYibo/qwen3-4b-nonthinking-skywork-rollouts-verified
Viewer
•
Updated
Jul 22
•
215k
•
21
updated
a dataset
5 months ago
YYYYYYibo/alfworld-success-trajs
Viewer
•
Updated
Apr 6
•
3.46k
•
6
published
a dataset
5 months ago
YYYYYYibo/alfworld-success-trajs
Viewer
•
Updated
Apr 6
•
3.46k
•
6
updated
a model
6 months ago
YYYYYYibo/qwen2_5_7b_sft_baseline
8B
•
Updated
Mar 26
•
4
published
a model
6 months ago
YYYYYYibo/qwen2_5_7b_sft_baseline
8B
•
Updated
Mar 26
•
4
Load more