Consumo Serverless de Dados

Painel — NYC-Taxi Databricks

Este painel roda inteiramente no seu navegador: o DuckDB-Wasm lê os arquivos Parquet direto do S3 via HTTP range requests, sem nenhum servidor no meio. As duas perguntas de negócio do case são respondidas a partir da tabela agregada gold.trip_metrics.

Inicializando DuckDB-Wasm...

Média de total_amount por mês

Yellow Cab, jan–mai/2023

Média de passageiros por hora

Toda a frota, maio/2023

Consulta livre — escreva seu próprio SQL

SELECT é permitido. Tabelas disponíveis: trip_metrics (agregada, leve) e trips (grão de corrida, ~200 MB — a primeira consulta nela demora mais).

Consulta ad-hoc — grão de corrida individual

Consulta direta em gold.trips (~200 MB em 4 arquivos Parquet), filtrada para Yellow Cab — mesma população do gráfico acima. Carregada sob demanda porque é bem maior que a tabela agregada.

Isso faz o navegador ler diretamente do S3 — pode levar alguns segundos na primeira consulta.