Member of Technical Staff - RL Environments
Cohere · Londonmid
In short
- ▸Construyes entornos de aprendizaje por refuerzo (RL) realistas para evaluar y entrenar agentes de IA empresarial.
- ▸Tu trabajo diario incluye diseñar tareas, generar datos sintéticos, verificar resultados y mejorar el rendimiento de agentes mediante iteraciones continuas.
- ▸Destacan los proyectos reales con impacto directo en productos de IA para empresas, con retroalimentación constante de clientes.
Proficiency in English is required for collaboration across global teams.
In ~1 minute you get: who interviews you, the likely questions answered from your CV, and your CV tailored to this job. Free, no card.
What they ask for
- ✓Experiencia en desarrollo e optimización de agentes de IA para casos de uso específicos
- ✓Capacidad para analizar trayectorias de agentes y identificar puntos de fallo
- ✓Habilidad para crear procesos repetibles de medición de capacidades agenticas
- ✓Experiencia en diseño de verificadores y diseño de recompensas para RL
- ✓Construcción de flujos de anotación para mejorar la calidad de datos y evaluar rendimiento
- ✓Desarrollo de pipelines de datos sintéticos para escalar evaluaciones y entrenamiento
Don't tick every box? That's normal — your free dossier shows your gaps and how to cover them in the interview.
Reinforcement LearningAgent evaluationSynthetic data pipelinesAnnotation workflowsVerifier implementationsReward designModel trainingHassle engineeringEvaluation systemsTask design
Who should you write to at Cohere?
Your free dossier identifies the people who'd interview you — their background, what they value, and how to reach out so you stand out before applying.
Don't apply unprepared
We research who's interviewing you, tailor your CV and rehearse you live — first one free.