Hugging Face's logo Hugging Face
  • Models
  • Datasets
  • Spaces
  • Buckets new
  • Docs
  • Enterprise
  • Pricing
    • Website
      • Tasks
      • HuggingChat
      • Collections
      • Languages
      • Organizations
    • Community
      • Blog
      • Posts
      • Daily Papers
      • Hardware
      • Learn
      • Discord
      • Forum
      • GitHub
    • Solutions
      • Team & Enterprise
      • Hugging Face PRO
      • Enterprise Support
      • Inference Providers
      • Inference Endpoints
      • Storage Buckets

  • Log In
  • Sign Up

MakiAi
/
gpt-oss-2048-rl-v8.4-s3-r32-b2-lora

Text Generation
Safetensors
English
reinforcement-learning
grpo
2048-game
unsloth
lora
Model card Files Files and versions
xet
Community

Instructions to use MakiAi/gpt-oss-2048-rl-v8.4-s3-r32-b2-lora with libraries, inference providers, notebooks, and local apps. Follow these links to get started.

  • Local Apps Settings
  • Unsloth Desktop
gpt-oss-2048-rl-v8.4-s3-r32-b2-lora
92.1 MB
Ctrl+K
Ctrl+K
  • 1 contributor
History: 2 commits
MakiAi's picture
MakiAi
Upload model and visualization
f92987c verified 9 months ago
  • lora_adapter
    Upload model and visualization 9 months ago
  • .gitattributes
    1.73 kB
    Upload model and visualization 9 months ago
  • README.md
    1.82 kB
    Upload model and visualization 9 months ago
  • reward_distribution_20251226_203442.png
    82.5 kB
    Upload model and visualization 9 months ago
  • reward_functions_20251226_203443.png
    142 kB
    xet
    Upload model and visualization 9 months ago
  • training_log_20251226_203441.csv
    1.65 kB
    Upload model and visualization 9 months ago
  • training_metrics_20251226_203441.png
    229 kB
    xet
    Upload model and visualization 9 months ago