Desarrollador/a de IA Generativa (RAG & Agentes) – SOLO México
ITOESTE
Abrimos una búsqueda exclusiva para personas residentes en México, en modalidad remota, para incorporar a alguien que quiera llevar soluciones de inteligencia artificial generativa a producción: no experimentos aislados, sino sistemas que se usan a diario dentro de la operación de nuestros clientes.
El Reto: ¿Cuál será tu misión?
- Búsqueda sobre datos propios: Armar y afinar canalizaciones de RAG que respondan con información precisa a partir de documentación interna, cuidando la calidad del troceado, el embebido y el reordenamiento de resultados.
- Agentes y automatizaciones: Desarrollar flujos donde el modelo decide qué herramienta usar, encadena pasos y resuelve tareas completas con supervisión mínima.
- Control de costos: Medir consumo de tokens, aplicar caché de contexto y elegir el modelo adecuado para cada tarea, de manera que la solución sea sostenible a escala.
- Conexión con el resto del sistema: Exponer la capa de IA como servicios consumibles por aplicaciones web y móviles, integrando bases vectoriales y fuentes de datos existentes.
- Evaluación y resguardos: Montar pruebas automáticas que detecten respuestas inventadas o desviadas, y sumar defensas frente a inyección de instrucciones.
- Criterio técnico: Documentar decisiones, comparar alternativas del ecosistema y ayudar a que el equipo adopte lo que realmente aporta valor.
¿Qué buscamos? (Requisitos técnicos)
- Experiencia real con LLMs: Haber llevado a producción soluciones con modelos comerciales o abiertos (OpenAI, Anthropic, Gemini, Llama u otros).
- Herramientas del ecosistema: Manejo de al menos uno de LangChain, LangGraph, LlamaIndex o CrewAI.
- Bases vectoriales: Trabajo previo con pgvector, Pinecone, Qdrant, Weaviate o similares, incluyendo estrategias de indexado.
- Programación: Buen nivel de Python (o TypeScript/Node.js) y capacidad para escribir servicios limpios, modulares y testeables.
- APIs y backend: Comodidad construyendo endpoints, manejando autenticación y trabajando con bases de datos relacionales.
- Residencia y disponibilidad: Vivir en México y poder coordinar en horario laboral local.
Valoraremos positivamente (Extras)
- Despliegue y MLOps: Docker, pipelines de CI/CD y publicación de servicios en AWS o DigitalOcean.
- Medición de calidad: Uso de RAGAS, TruLens o marcos propios de evaluación de respuestas.
- Tratamiento de información sensible: Anonimización de datos y buenas prácticas de gobierno de la información.
- Modelos locales: Experiencia sirviendo modelos abiertos con Ollama, vLLM o infraestructura propia.
- Metodologías ágiles: Haber trabajado con SCRUM o Kanban y herramientas como Jira o Notion.
Qué ofrecemos
- Modalidad 100% remota desde cualquier estado de México.
- Contratación freelance con pago mensual en dólares.
- Proyectos con impacto directo y libertad para proponer la arquitectura.
- Presupuesto de trabajo con modelos y herramientas actuales del ecosistema.
Características del empleo
| Ubicación | México (100% remoto) |