#data-engineering
Fabric Capacity Events en Real-Time Hub: Monitorización en tiempo real de tu capacidad
Cómo monitorizar en tiempo real la utilización de tu capacidad en Microsoft Fabric.
Inventario de shortcuts en OneLake: cómo detectar huérfanos, ciclos y fugas de governance con un notebook de Fabric
Cómo usar Fabric Notebooks desde local con VS Code
Cómo ejecutar y depurar notebooks de Microsoft Fabric desde tu entorno local usando Visual Studio Code, con agentes de IA y Microsoft Fabric Skills.
Fabric Apache Spark Diagnostic Emitter: captura logs y métricas en tiempo real
Cómo configurar un Fabric Environment para emitir telemetría de Spark directamente hacia un Eventhouse.
Change Data Feed en Delta Lake: Captura incremental de cambios para pipelines modernos en Microsoft Fabric
Descubre cómo Change Data Feed, el CDC nativo de Delta Lake, registra inserciones, actualizaciones y eliminaciones a nivel de fila sin herramientas externas. Aprende a activarlo y aprovecharlo en pipelines incrementales modernos dentro de Microsoft Fabric
Cómo usar Workspace Identity para la autenticación en Microsoft Fabric
Aprende a utilizar Workspace Identity para la autenticación en Microsoft Fabric y mejorar la seguridad de tus aplicaciones
Comparativa de Consumo de CUs: Por qué elegir el artefacto incorrecto puede costarte miles de euros al año
Comparativa exhaustiva del consumo de Capacity Units en Microsoft Fabric: Notebooks PySpark/Python, Pipelines, Copy Jobs y Dataflows Gen2 en tres escenarios reales —CSV pequeño, CSV de 83 GB y Azure SQL— con coste económico calculado.
Cómo recuperar objetos eliminados de tu Lakehouse en Microsoft Fabric
Cómo recuperar tablas Delta, archivos y carpetas eliminados de tu Lakehouse en Microsoft Fabric usando la librería Semantic Link Labs, antes de que expiren los 7 días de retención de OneLake.
Cómo recuperar Workspaces eliminados en Microsoft Fabric
Cómo usar la API REST de administración de Microsoft Fabric para listar y restaurar workspaces eliminados, incluyendo todos sus artefactos (lakehouses, notebooks, pipelines), con un notebook de PySpark.
¿Qué es la deduplicación de datos y por qué es tan importante?
Qué es la deduplicación de datos, por qué es crítica para la calidad de datos, y cómo implementarla en PySpark con dropDuplicates(), Window functions y ROW_NUMBER() para obtener siempre el registro más reciente.
Deletion Vectors en Delta Lake: Funcionamiento interno, impacto en el rendimiento y recomendaciones prácticas
Guía técnica sobre Deletion Vectors en Delta Lake: cómo funcionan internamente, benchmarks reales de DELETE/UPDATE/MERGE y SELECT en tablas de 100 millones de filas, y cuándo habilitarlos en Microsoft Fabric.
Ejecutando notebooks en paralelo usando runMultiple
Aprende a usar la API runMultiple de NotebookUtils en Microsoft Fabric para lanzar varios notebooks en paralelo, definir dependencias con DAG y coordinar flujos de trabajo complejos.