Senior ML Engineer (Token Factory)
Nebius · Berlinsenior
En corto
- ▸Ingeniero de ML sénior enfocado en optimizar inferencia y fine-tuning de modelos grandes a escala en GPU.
- ▸Días a día: perfilar trabajo en GPU, diseñar pipelines de baja precisión y mejorar motores de inferencia como vLLM o TensorRT-LLM.
- ▸Destacado: trabajar en una de las mayores nubes de GPU del mundo, con miles de GPUs y un impacto directo en el rendimiento de modelos como GPT-OSS o GLM-5.
Excellent command of the English language, alongside superior writing, articulation, and c
En ~1 minuto te damos: quién te entrevista, las preguntas probables con respuestas desde tu CV, y tu CV adaptado a esta vacante. Gratis, sin tarjeta.
🎧¿Llegás a la entrevista? Llevá el copiloto. Nuestra extensión escucha la entrevista en vivo y te muestra anclas de 3-4 palabras desde tu CV y tu preparación — mirás, conectás, hablás. Gratis. Ver la extensión →¿Qué piden?
- ✓Conocimiento profundo de arquitecturas de transformadores y ML teórico.
- ✓Experiencia con herramientas de perfilado de GPU (Nsight, PyTorch profiler).
- ✓Entendimiento de jerarquía de memoria y tradeoffs de compute/memory en GPU.
- ✓Familiaridad con conceptos clave de LLM (MHA, RoPE, KV-cache, Flash Attention, cuantización).
- ✓Experiencia con frameworks modernos de deep learning y alta habilidad en ingeniería de software (Python, CI/CD, testing).
- ✓Habilidades comunicativas y de liderazgo sólidas.
¿No cumplís todo? Es lo normal — tu dossier gratis te dice qué gaps tenés y cómo cubrirlos en la entrevista.
¿A quién escribirle en Nebius?
Tu dossier gratis identifica a las personas que te entrevistarían — con su background, qué valoran y cómo escribirles para destacar antes de aplicar.
No apliques sin prepararte
Investigamos quién te entrevista, adaptamos tu CV y te ensayamos en vivo — gratis la primera.