Data Science
Summary
Data Scientist on an international document-intelligence project, designing and evaluating LLM/VLM/ML solutions for extraction and classification of complex documents, writing production-grade Python in a hybrid Barcelona role.
¿Te gustaría trabajar en un proyecto internacional de inteligencia artificial y ciencia de datos, participando en el desarrollo y mejora de soluciones avanzadas de procesamiento de documentos mediante LLMs, VLMs, OCR y Machine Learning?
En Capitole buscamos un/a Data Scientist con experiencia en modelos de lenguaje, procesamiento de lenguaje natural y extracción de información no estructurada, para incorporarse a un proyecto estratégico en un entorno global e innovador.
🧩 Responsabilidades del puesto
Diseñar, prototipar y evaluar soluciones de IA, LLMs y Machine Learning para la extracción, clasificación y transformación de documentos complejos.
Desarrollar y optimizar prompts, lógica de validación, métricas de evaluación automatizada y datasets de ground-truth.
Escribir código en Python limpio, testeable y mantenible, colaborando estrechamente con el equipo de AI Engineers para llevar modelos a producción.
Analizar la viabilidad técnica de nuevos casos de uso y comunicar hallazgos, métricas y limitaciones tanto a equipos técnicos como de negocio.
Must Have
+3 años de experiencia profesional en Data Science, Machine Learning o IA aplicada, con dominio de LLMs, Generative AI y Prompt Engineering.
Sólida base en NLP y ML tradicional, con capacidad para evaluar cuándo un enfoque clásico o determinista es superior a un LLM.
Excelentes competencias de programación en Python (testing, control de versiones, reproducibilidad) y conocimientos estadísticos para validar hipótesis y métricas.
Experiencia práctica trabajando con datos no estructurados/semiestructurados, diseño de schemas y creación de datasets de evaluación.
Fluidez en inglés y habilidades de comunicación para explicar decisiones y trade-offs técnicos a perfiles no técnicos.
Titulación universitaria en Informática, IA, Data Science, Matemáticas, Ingeniería o campo afín.
Requisitos deseables
Experiencia en Document Intelligence y OCR (especialmente Azure Document Intelligence).
Manejo de plataformas gestionadas de IA como Azure OpenAI o Amazon Bedrock.
Conocimientos en clasificación de documentos, extracción de información, NER o modelos multimodales (VLM).
Modalidad híbrida en Barcelona (2 días de presencialidad en Viladecans)
¿Por qué unirte a nosotros?
1.200€ anuales para formación y certificaciones.
Seguro médico privado.
️ Retribución flexible (restaurante, transporte y guardería).
️ Acceso a Wellhub con miles de gimnasios y actividades deportivas.
Eventos, team buildings y actividades de equipo.
Comunidades tecnológicas internas para compartir conocimiento y seguir creciendo.
Proyecto internacional con tecnologías de vanguardia y gran impacto en negocio.
✨ ¿Quieres saber más? Haz clic here ️ y descubre todos los detalles.
Descubre lo que dicen sobre nosotros en Glassdoor Reviews ️ ♀️
¿Te gustaría conocer más sobre nuestra cultura? Mira este video YouTube
¿Te animas a este gran reto y equipo? 🚀
Empowering People, Unlocking Innovation
El empleado se adherirá a las políticas de seguridad de la información:
· Tendrá acceso a información confidencial relacionada con Capitole y el proyecto en el que está trabajando.
· Deberá cumplir con las políticas de seguridad y las pautas internas de la empresa y del cliente.
· Se le requerirá firmar un NDA.