Datasets with reasoning traces for math and code (Train + Eval)
Maojia Song
OrangeEye
·
AI & ML interests
None yet
Recent Activity
upvoted a paper about 11 hours ago
StartupBench: Benchmarking General-Purpose Agents on Market-Validated End-to-End Workflows upvoted a paper about 12 hours ago
AgentMercury: Your Agent Can Synthesize Verifiable Environments for Business Scenarios at scale upvoted a paper about 12 hours ago
Meta^n: Recursive Self-Improvement through Emergent Depth