AI Evaluation Benchmark Researcher
-step benchmarks that assess model reasoning, coding, and data-analysis skills. You will create tasks, write Python... below;this role expects careful, research-grade task design and evaluation. MSc or PhD in a STEM field, or a computationally...
Lugar: USA | 30/07/2026 17:07:23 PM | Salario: S/. No Especificado | Empresa: OpenTrain AI