Performance Engineer, Inference Engine
Anthropic · San Francisco, CA | New York City, NYmid
En corto
- ▸Ingeniero de rendimiento enfocado en optimizar el motor de inferencia de LLM a escala de millones de usuarios.
- ▸Trabajas en hardware, memoria, comunicación entre dispositivos y coordinación distribuida para maximizar eficiencia y mantener calidad del modelo.
- ▸Destaca que el sistema es interno, crítico para la seguridad y escalabilidad de Claude.
Fluency in English is required for the role.
En ~1 minuto te damos: quién te entrevista, las preguntas probables con respuestas desde tu CV, y tu CV adaptado a esta vacante. Gratis, sin tarjeta.
🎧¿Llegás a la entrevista? Llevá el copiloto. Nuestra extensión escucha la entrevista en vivo y te muestra anclas de 3-4 palabras desde tu CV y tu preparación — mirás, conectás, hablás. Gratis. Ver la extensión →¿Qué piden?
- ✓Modelo mental sólido de la inferencia de LLM (prefill, decode, aceleradores, memoria, interconexión)
- ✓Capacidad probada de aprender rápido y entregar cambios significativos en sistemas complejos
- ✓Programación de sistemas sólida en Rust, C++ o similar con enfoque en calidad y pruebas
- ✓Enfoque analítico: observar, modelar, probar y cambiar iterativamente
- ✓Bajo ego, disposición a preguntar, aceptar feedback y colaborar
- ✓Gusto por programar en pareja y compromiso con el impacto social del trabajo
¿No cumplís todo? Es lo normal — tu dossier gratis te dice qué gaps tenés y cómo cubrirlos en la entrevista.
¿A quién escribirle en Anthropic?
Tu dossier gratis identifica a las personas que te entrevistarían — con su background, qué valoran y cómo escribirles para destacar antes de aplicar.
No apliques sin prepararte
Investigamos quién te entrevista, adaptamos tu CV y te ensayamos en vivo — gratis la primera.