Estás leyendo
Cloudflare lleva su modelo serverless al análisis de datos con Basin

Cloudflare lleva su modelo serverless al análisis de datos con Basin

  • La nueva plataforma combina Apache Iceberg y Cloudflare R2 para gestionar datos analíticos sin servidores dedicados y facilitar su uso desde herramientas de distintas nubes.
Cloud almacenamiento

Cloudflare amplía su actividad hacia la infraestructura de análisis de datos con Cloudflare Basin, una plataforma que permite recopilar, organizar, almacenar y consultar información sin aprovisionar servidores dedicados. La propuesta extiende el modelo serverless de la compañía a una capa tecnológica habitualmente formada por servicios de almacenamiento, motores de consulta y herramientas procedentes de distintos proveedores.

Basin está desarrollada sobre Apache Iceberg y Cloudflare R2. Los datos se guardan en el formato abierto Apache Iceberg, de modo que pueden ser leídos directamente por herramientas compatibles. Cloudflare pretende así reducir las copias y conversiones de información, además de limitar la dependencia técnica que puede surgir cuando los datos quedan sujetos a formatos exclusivos de una plataforma.

El segundo elemento de la propuesta es la ejecución bajo demanda sobre la red global de Cloudflare. La empresa sostiene que los clientes pueden poner en marcha los procesos de recopilación y consulta sin configurar clústeres ni reservar capacidad por adelantado. También asegura que las consultas realizadas mediante herramientas ubicadas en diferentes nubes, plataformas o regiones no generan tarifas de transferencia de datos.

Unificar una arquitectura de datos fragmentada

Las arquitecturas analíticas empresariales suelen distribuir distintas tareas entre varios componentes. El almacenamiento conserva la información, mientras otros sistemas se ocupan de incorporarla, clasificarla o consultarla. Esa combinación puede exigir servidores sobredimensionados para absorber picos de demanda, integraciones entre servicios y pagos asociados al movimiento de datos entre entornos.

Basin concentra esas operaciones en una infraestructura gestionada por Cloudflare, pero mantiene los datos en un formato que pueden interpretar otras herramientas compatibles. Para los equipos de desarrollo, el planteamiento puede reducir las tareas operativas vinculadas a los servidores y facilitar que sus aplicaciones trabajen con información almacenada fuera del motor concreto utilizado para analizarla.

La interoperabilidad depende, en cualquier caso, de que las herramientas elegidas sean compatibles con Apache Iceberg. Dentro de ese perímetro, el formato abierto permite conservar una vía de acceso independiente del servicio que ejecuta las consultas. Esta separación entre el almacenamiento y las herramientas de análisis es uno de los argumentos con los que Cloudflare intenta diferenciar Basin frente a configuraciones más cerradas.

Dane Knecht, director técnico de Cloudflare, vincula el lanzamiento con la experiencia previa de la empresa en servicios ejecutados bajo demanda: «Con Cloudflare Basin, llevamos al ámbito del análisis el mismo modelo sin servidores que los desarrolladores esperan de Cloudflare. Sin clústeres que gestionar, sin transferencias innecesarias de datos y con estándares abiertos que permiten a los clientes mantener el control sobre sus datos».

El coste de mover datos entre nubes

La ausencia de tarifas de transferencia es especialmente relevante en arquitecturas que reparten almacenamiento y procesamiento entre varios proveedores o regiones. Según Cloudflare, Basin permite consultar los datos desde herramientas externas sin aplicar cargos por trasladarlos. La eliminación de ese coste puede facilitar la combinación de servicios y evitar que la ubicación de la información condicione qué plataforma se utiliza para analizarla.

Te puede interesar
Consultoría tecnológica

La compañía presenta además tres componentes operativos, denominados Basin Pipelines, Basin Catalog y Basin SQL. El caso descrito por Anomaly, empresa creadora del agente de programación de inteligencia artificial de código abierto OpenCode, muestra cómo esas piezas pueden reemplazar una configuración formada por servicios separados.

Dax Raad, cofundador de Anomaly, explica el cambio realizado por la empresa: «Hemos sustituido una compleja configuración de AWS S3 y Athena por una arquitectura más limpia y sin servidores que gestiona de forma fiable todos nuestros datos de eventos». El despliegue aporta un ejemplo de migración desde AWS S3 y Athena, aunque no se han detallado métricas comparables sobre costes, rendimiento o duración del proceso.

Una nueva capa en la oferta de Cloudflare

Otro usuario citado es Bobsled, una plataforma dedicada a crear y distribuir productos de datos. La empresa utiliza Basin para ofrecer información accesible desde distintas regiones de las principales plataformas de datos e inteligencia artificial. Su caso refleja el tipo de escenario multicloud al que Cloudflare dirige la combinación de formatos abiertos y transferencias sin cargos de salida.

Para Cloudflare, Basin extiende su posición desde la conectividad y el almacenamiento de objetos hacia las cargas analíticas. Para las empresas, la consecuencia práctica será poder valorar una arquitectura en la que la ingestión, el catálogo y las consultas se ejecutan como servicios gestionados, mientras los datos permanecen en un formato reutilizable. Esa combinación reduce infraestructura que administrar y permite elegir herramientas compatibles sin que cada consulta entre nubes implique necesariamente una nueva copia o un coste de transferencia.

Ver Comentarios (0)

Leave a Reply

Utilizamos cookies para facilitar la relación de los visitantes con nuestro contenido y para permitir elaborar estadísticas sobre las visitantes que recibimos. No se utilizan cookies con fines publicitarios ni se almacena información de tipo personal. Puede gestionar las cookies desde aquí.   
Privacidad