Research Engineer - Inference
Elevenlabs · United Kingdommid
En corto
- ▸Ingeniero de investigación enfocado en desplegar y optimizar modelos de IA de vanguardia en producción.
- ▸Trabajas con rendimiento de inferencia: latencia, throughput, costos, usando técnicas como cuantización y optimización de caché KV.
- ▸Destaca el enfoque en llevar descubrimientos de investigación a productos en tiempo real con millones de usuarios.
Proficiency in English is required for communication and collaboration.
En ~1 minuto te damos: quién te entrevista, las preguntas probables con respuestas desde tu CV, y tu CV adaptado a esta vacante. Gratis, sin tarjeta.
¿Qué piden?
- ✓Experiencia en despliegue de modelos ML en producción, especialmente para aplicaciones con baja latencia.
- ✓Habilidades sólidas en optimización de inferencia: cuantización, distilación, estrategias de agrupamiento, kernels personalizados.
- ✓Capacidad para construir sistemas de servidores de alto rendimiento para cargas de trabajo en streaming en tiempo real.
- ✓Habilidades técnicas avanzadas en Python y C++ para optimizar el rendimiento del sistema.
- ✓Experiencia con herramientas de ML y frameworks como PyTorch, TensorFlow, Triton.
- ✓Capacidad para crear infraestructura y herramientas que permitan a investigadores desplegar modelos de forma segura y rápida.
¿No cumplís todo? Es lo normal — tu dossier gratis te dice qué gaps tenés y cómo cubrirlos en la entrevista.
¿A quién escribirle en Elevenlabs?
Tu dossier gratis identifica a las personas que te entrevistarían — con su background, qué valoran y cómo escribirles para destacar antes de aplicar.
No apliques sin prepararte
Investigamos quién te entrevista, adaptamos tu CV y te ensayamos en vivo — gratis la primera.