Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
๐
In a Training Loop
42.5
TFLOPS
Milton Montiel
miltmont
76
4
Follow
0 followers
ยท
2 following
https://discretized.dev
MiltMont
AI & ML interests
Reinforcement learning
Recent Activity
upvoted
a
paper
about 7 hours ago
Understanding Evolution Strategies for LLM Reasoning: Broader Reasoning Coverage than GRPO
upvoted
a
paper
2 days ago
On-Policy Self-Distillation in Diffusion Models
upvoted
a
paper
6 days ago
Co-RL: Unsupervised Reasoning Emerges from Diverse Cohort in Multi-agent RL
View all activity
Organizations
buckets
1
miltmont/traces
407 kB
models
0
None public yet
datasets
0
None public yet