ML Systems Engineer — Inference Acceleration
Arago · Paris Officessenior
En corto
- ▸Ingeniero de sistemas de ML que optimiza inferencia en un acelerador óptico-CMOS único.
- ▸Trabaja en kernels, ejecución distribuida, servidor de inferencia y optimización de memoria en un stack de software en desarrollo.
- ▸Destaca por ser el único equipo que trabaja con un procesador híbrido óptico-CMOS con rendimiento de orden de magnitud superior.
Proficient level of English
En ~1 minuto te damos: quién te entrevista, las preguntas probables con respuestas desde tu CV, y tu CV adaptado a esta vacante. Gratis, sin tarjeta.
🎧¿Llegás a la entrevista? Llevá el copiloto. Nuestra extensión escucha la entrevista en vivo y te muestra anclas de 3-4 palabras desde tu CV y tu preparación — mirás, conectás, hablás. Gratis. Ver la extensión →¿Qué piden?
- ✓Experiencia sólida en inferencia de alto rendimiento de ML.
- ✓Conocimiento profundo de arquitectura de computadoras y modelos de ejecución en aceleradores.
- ✓Experiencia con CUDA, Triton, ROCm/HIP o entornos equivalentes para programación de kernels.
- ✓Habilidades sólidas en C++ y Python para desarrollo en stack personalizado.
- ✓Experiencia con sistemas de inferencia modernos como vLLM, SGLang o TensorRT-LLM.
- ✓Nivel de inglés proficient, con trabajo en entornos técnicos en inglés.
¿No cumplís todo? Es lo normal — tu dossier gratis te dice qué gaps tenés y cómo cubrirlos en la entrevista.
¿A quién escribirle en Arago?
Tu dossier gratis identifica a las personas que te entrevistarían — con su background, qué valoran y cómo escribirles para destacar antes de aplicar.
No apliques sin prepararte
Investigamos quién te entrevista, adaptamos tu CV y te ensayamos en vivo — gratis la primera.