arxiv:2608.08722
Victor Gallego
vicgalle
AI & ML interests
Preference fine-tuning, alignment & synthetic data.
Building LLMs in general!
Recent Activity
liked a model 2 days ago
Cloudflare/clef authored a paper about 1 month ago
Opponent Aware Reinforcement Learning upvoted a paper about 1 month ago
Opponent Aware Reinforcement Learning