Data Science

Summary

Data Scientist on an international document-intelligence project, designing and evaluating LLM/VLM/ML solutions for extraction and classification of complex documents, writing production-grade Python in a hybrid Barcelona role.

¿Te gustaría trabajar en un proyecto internacional de inteligencia artificial y ciencia de datos, participando en el desarrollo y mejora de soluciones avanzadas de procesamiento de documentos mediante LLMs, VLMs, OCR y Machine Learning?


En Capitole buscamos un/a Data Scientist con experiencia en modelos de lenguaje, procesamiento de lenguaje natural y extracción de información no estructurada, para incorporarse a un proyecto estratégico en un entorno global e innovador.


🧩 Responsabilidades del puesto

Diseñar, prototipar y evaluar soluciones de IA, LLMs y Machine Learning para la extracción, clasificación y transformación de documentos complejos.

Desarrollar y optimizar prompts, lógica de validación, métricas de evaluación automatizada y datasets de ground-truth.

Escribir código en Python limpio, testeable y mantenible, colaborando estrechamente con el equipo de AI Engineers para llevar modelos a producción.

Analizar la viabilidad técnica de nuevos casos de uso y comunicar hallazgos, métricas y limitaciones tanto a equipos técnicos como de negocio.


Must Have

+3 años de experiencia profesional en Data Science, Machine Learning o IA aplicada, con dominio de LLMs, Generative AI y Prompt Engineering.

Sólida base en NLP y ML tradicional, con capacidad para evaluar cuándo un enfoque clásico o determinista es superior a un LLM.

Excelentes competencias de programación en Python (testing, control de versiones, reproducibilidad) y conocimientos estadísticos para validar hipótesis y métricas.

Experiencia práctica trabajando con datos no estructurados/semiestructurados, diseño de schemas y creación de datasets de evaluación.

Fluidez en inglés y habilidades de comunicación para explicar decisiones y trade-offs técnicos a perfiles no técnicos.

Titulación universitaria en Informática, IA, Data Science, Matemáticas, Ingeniería o campo afín.


Requisitos deseables

Experiencia en Document Intelligence y OCR (especialmente Azure Document Intelligence).

Manejo de plataformas gestionadas de IA como Azure OpenAI o Amazon Bedrock.

Conocimientos en clasificación de documentos, extracción de información, NER o modelos multimodales (VLM).


Modalidad híbrida en Barcelona (2 días de presencialidad en Viladecans)


¿Por qué unirte a nosotros?

1.200€ anuales para formación y certificaciones.

Seguro médico privado.

️ Retribución flexible (restaurante, transporte y guardería).

️ Acceso a Wellhub con miles de gimnasios y actividades deportivas.

Eventos, team buildings y actividades de equipo.

Comunidades tecnológicas internas para compartir conocimiento y seguir creciendo.

Proyecto internacional con tecnologías de vanguardia y gran impacto en negocio.


✨ ¿Quieres saber más? Haz clic here ️ y descubre todos los detalles.

Descubre lo que dicen sobre nosotros en Glassdoor Reviews ️ ♀️

¿Te gustaría conocer más sobre nuestra cultura? Mira este video YouTube

¿Te animas a este gran reto y equipo? 🚀


Empowering People, Unlocking Innovation

El empleado se adherirá a las políticas de seguridad de la información:

· Tendrá acceso a información confidencial relacionada con Capitole y el proyecto en el que está trabajando.

· Deberá cumplir con las políticas de seguridad y las pautas internas de la empresa y del cliente.

· Se le requerirá firmar un NDA.

See also

Data Science jobs by country — openings, pay and top skills →

Tailor your CV for this role?

We couldn't check your fit for this role — add a CV to your profile to see it next time.

A new version of freehire is available