Research Engineer - Inference
Elevenlabs · United Kingdommid
In short
- ▸Ingeniero de investigación enfocado en desplegar y optimizar modelos de IA de vanguardia en producción.
- ▸Trabajas con rendimiento de inferencia: latencia, throughput, costos, usando técnicas como cuantización y optimización de caché KV.
- ▸Destaca el enfoque en llevar descubrimientos de investigación a productos en tiempo real con millones de usuarios.
Proficiency in English is required for communication and collaboration.
In ~1 minute you get: who interviews you, the likely questions answered from your CV, and your CV tailored to this job. Free, no card.
What they ask for
- ✓Experiencia en despliegue de modelos ML en producción, especialmente para aplicaciones con baja latencia.
- ✓Habilidades sólidas en optimización de inferencia: cuantización, distilación, estrategias de agrupamiento, kernels personalizados.
- ✓Capacidad para construir sistemas de servidores de alto rendimiento para cargas de trabajo en streaming en tiempo real.
- ✓Habilidades técnicas avanzadas en Python y C++ para optimizar el rendimiento del sistema.
- ✓Experiencia con herramientas de ML y frameworks como PyTorch, TensorFlow, Triton.
- ✓Capacidad para crear infraestructura y herramientas que permitan a investigadores desplegar modelos de forma segura y rápida.
Don't tick every box? That's normal — your free dossier shows your gaps and how to cover them in the interview.
Who should you write to at Elevenlabs?
Your free dossier identifies the people who'd interview you — their background, what they value, and how to reach out so you stand out before applying.
Don't apply unprepared
We research who's interviewing you, tailor your CV and rehearse you live — first one free.