Ampliamos equipo – Data & Platform Engineer

— SOBRE TELÓMERA

¿Te apasiona trabajar con datos que tienen un impacto directo en la salud de las personas? En Telómera creemos que con los datos correctos y los profesionales adecuados se puede transformar la sanidad. Somos una compañía española de consultoría, investigación e innovación en salud, fundada en 2022 y en plena expansión. Combinamos análisis de datos del mundo real (RWD), analítica avanzada e inteligencia artificial con un equipo experto para generar evidencia que mejore la toma de decisiones en salud.

Si quieres construir y mantener infraestructura de datos con propósito real, y crecer en un entorno ágil donde tu criterio técnico cuenta desde el primer día, este es tu sitio.

— EL PUESTO

Buscamos incorporar de forma inmediata a un/a Data & Platform Engineer. Junto a un equipo de ingenieros, serás responsable de construir y mantener las plataformas de datos que permiten optimizar los procesos de extracción, curado y análisis de datos clínicos del mundo real.

Trabajarás en estrecha colaboración con data analysts, data scientists, bioestadísticos y el equipo científico para garantizar que los datos estén disponibles, validados, trazables y listos para los proyectos. Buscamos un/a ingeniero/a experto/a en plataformas de datos, con dominio sanitario real y mentalidad de producto.

— STACK ACTUAL

•    PostgreSQL on-premise (Telotron, modelo propio de datos clínicos).

•    Python para ETL y automatización.

•    Despliegue on-prem + cloud híbrido.

— FUNCIONES PRINCIPALES

Pipelines e ingesta de datos

•    Construir pipelines de extracción desde HCE/EHR, incluyendo datos estructurados y no estructurados, así como registros clínicos y datos administrativos.

•    Implementar y mantener procesos ETL para la integración, transformación y carga de datos procedentes de múltiples fuentes.

•    Curado y normalización a CDM (Common Data Model). Mapeo a terminologías clínicas: SNOMED-CT, CIE-10, ATC, LOINC etc.

Bases de datos e infraestructura

•    Modelado relacional sobre PostgreSQL: particionado, índices, RLS por estudio/usuario, tuning y replicación.

•    Diseñar, administrar y optimizar bases de datos orientadas a datos clínicos y de vida real, garantizando calidad, integridad, trazabilidad y seguridad a lo largo de todo el flujo.

•    Integración de IA: desarrollo y mantenimiento del MCP server Telotron Bridge (autenticación, scoping por proyecto y auditoría de queries) y de los pipelines de LLM para procesamiento y estructuración de la información.

Reproducibilidad y calidad

•    Versionado reproducible de cohortes (dbt o equivalente): snapshots fechados de criterios y resultados.

•    Tests automatizados de calidad de datos y observabilidad de pipelines.

•    Garantizar la calidad, integridad, trazabilidad y seguridad de los datos a lo largo de todo el flujo.

•    Participar en la implementación y mantenimiento de Modelos Comunes de Datos (CDM) como OMOP u otros estándares europeos aplicables.

DevOps y coordinación técnica

•    Aplicar DevOps básico: Docker, CI/CD y gestión de despliegues on-prem y cloud híbrido.

•    Liderar o participar en discusiones técnicas con equipos de IT internos y externos para proponer mejoras en la plataforma de datos.

•    Elaborar y mantener documentación técnica de procesos, bases de datos y flujos de trabajo.

•    Aplicar buenas prácticas de ingeniería de software (Git, contenerización, metodologías ágiles) y contribuir a la mejora continua de la infraestructura de datos.

— PERFIL REQUERIDO

Formación

•    Grado en Ingeniería Informática, Ingeniería de Telecomunicaciones, Matemáticas o titulación afín. Se valorará Máster en Big Data, Bases de Datos o similar.

Experiencia

•    Mínimo 3 años trabajando con datos clínicos reales (HCE, registros, datos hospitalarios).

•    Experiencia en diseño e implementación de procesos ETL e integración de datos de múltiples fuentes.

•    Capacidad para trabajar de forma autónoma, gestionar varias tareas simultáneamente y adaptarse a un entorno dinámico y en crecimiento. Persona colaboradora, con iniciativa y ganas de aprender y contribuir.

Conocimientos técnicos

•    PostgreSQL nivel avanzado (imprescindible): tuning, EXPLAIN, particionado, RLS y replicación.

•    Python avanzado para procesamiento y automatización de datos.

•    Orquestación de pipelines: Airflow, Prefect o Dagster.

•    Transformación versionada: dbt o herramienta equivalente.

•    Conocimiento de terminologías clínicas.

•    Control de versiones (Git), contenerización (Docker) y soltura en línea de comandos.

— SE VALORARÁ

•    OMOP CDM en producción u otros estándares.

•    FHIR y estándares europeos en salud (CONCEPTION, TriNetX, EMA/DARWIN EU).

•    RGPD aplicado a datos de salud: pseudonimización, anonimización y k-anonimato (RGPD, LOPDGDD, EHDS).

•    Experiencia previa en el sector salud en España (atención primaria, especializada u hospitalaria).

•    Plataformas de big data (Spark, Hadoop, Databricks) y servicios cloud (AWS, Azure, GCP).

•    LLMs en pipelines reales: API de Claude/OpenAI, MCP, RAG sobre datos estructurados, function calling.

•    NLP sobre texto clínico en español (cTAKES, MedSpaCy, modelos propios).

•    Inglés B1 o superior.

— CONDICIONES

Contrato Indefinido

Jornada Completa — 40 horas semanales

Modalidad Híbrida: 3 días de oficina (Barajas, Madrid) + teletrabajo

Incorporación Inmediata

Departamento Datos e Infraestructura

Reporta a Equipo de dirección

Con trabajo transversal entre departamentos y proyectos propios.

— CÓMO APLICAR

Envía tu CV a contact@telomera.com  junto con una breve descripción técnica (máx. 1 página) de un problema real de datos clínicos que hayas resuelto: contexto, decisión técnica y resultado.

Asunto: “Data & Platform Engineer en Salud”

Scroll al inicio