PulseFlat Logo
Carregando cotações...
Atualização automática · Seg–Sex · 06h às 23h BRT

Pulse Flat

Pipeline de Dados Financeiros Brasileiros & Globais

Dados financeiros brasileiros e benchmarks macroeconômicos globais confiáveis, atualizados diariamente e 100% gratuitos. O PulseFlat coleta automaticamente indicadores da ANBIMA, B3, BCB, CVM, FRED (St. Louis Fed), IBGE, IPEA e Yahoo Finance — padroniza, versiona e disponibiliza em CSV e Apache Parquet para você importar direto no seu Excel, Google Sheets, Python, DuckDB ou ferramenta de BI favorita.

Explorar datasets Ver no GitHub Sugerir dataset
94+ Datasets
10+ Fontes de dados
Execuções por dia útil

Por que PulseFlat?

A PulseDataLabs nasceu da missão de democratizar o acesso a dados financeiros brasileiros de qualidade. Acreditamos que informações financeiras confiáveis não deveriam ser um privilégio de grandes instituições.

Por isso, construímos o PulseFlat: um pipeline open-source que coleta, padroniza e disponibiliza gratuitamente dezenas de indicadores do mercado financeiro brasileiro e internacional — de ANBIMA (Data & APIs), B3, BCB, CVM, FRED (St. Louis Fed), IBGE, IPEA e Yahoo Finance — atualizados automaticamente todos os dias úteis.

100% Open-source
Zero Custo de infra
Atualizações/dia
10+ Fontes oficiais

Como funciona

O pipeline automatizado roda em 9 janelas estratégicas ao longo de cada dia útil, além de monitoramento contínuo a cada 15 minutos, coletando, tratando, exportando para Parquet e versionando diretamente no repositório GitHub e no Oracle Database Cloud.

GitHub Actions orquestra o pipeline
9 execuções programadas ao longo dos dias úteis (06h00 às 23h00 BRT) sincronizadas com os órgãos reguladores, além de verificação de debêntures a cada 15 min.
🔗
Scrapers acessam as fontes oficiais
Arquitetura modular em Python (BaseScraper) com coleta resiliente em APIs REST, feeds JSON, arquivos FWF e planilhas (B3, ANBIMA, BCB, CVM, IBGE, IPEA, Yahoo Finance).
🧹
Normalização, auditoria e integridade
Encoding UTF-8 padronizado, conversão numérica defensiva, deduplicação por hash de registro e auditoria de continuidade temporal via bizdays.
📄
Exportação Multiformato (CSV, GZ e Parquet)
Geração de arquivos planos CSV, compactados (.csv.gz) e colunares de alta performance Apache Parquet para análise quantitativa direta (DuckDB, Polars, Pandas).
Versionamento no Git e Carga em Nuvem
Persistência incremental no Oracle Autonomous Database (mTLS Wallet) e commit automático no repositório GitHub, alimentando catálogos e o dashboard em tempo real.
🕐  Agenda de execução diária (Horário de Brasília)
06h00 Abertura & Séries Históricas ANBIMA BCB CVM
08h00 Carga Matinal & Cadastros ANBIMA BCB IBGE B3
09h00 Abertura de Mercado & Pré-Pregão B3 BCB
09h30 Boletins Matinais & Cotações ANBIMA B3 BCB
10h30 Pregão B3 em Andamento & PTAX B3 BCB
11h30 Consolidação Meio-Dia & Moedas BCB CVM B3
18h00 Fechamento do Pregão B3 B3 BCB ANBIMA
21h00 Consolidação Noturna & Fundos ANBIMA CVM B3
23h00 Fechamento Definitivo & Parquet ANBIMA BCB IBGE CVM B3
⚡ 15 min Monitor & Alerta de Debêntures (05h–20h) ANBIMA

Monitor de Capturas & SLA

Status em tempo real da última data capturada para cada base do pipeline. Identifique visualmente a defasagem e a conformidade dos dados.

Total Monitoradas 📊
--
Bases ativas no pipeline
Em Dia (D-0 / D-1) 🟢
--
Último fechamento de mercado
Atenção (D-2 / D-3) 🟡
--
Janela de tolerância / feriado
Fora do SLA / Atrasados 🔴
--
Requer verificação da fonte
Schema Drifts
--
Variações na fonte & Auto-Healing
⚡ Índice Geral de Saúde dos Dados (SLA)
0% em conformidade
🔍

Datasets disponíveis

CSVs atualizados diariamente. Clique em Download para baixar o arquivo mais recente.

Estrutura dos dados

Todos os CSVs seguem o padrão: UTF-8, separador vírgula, decimal ponto, datas YYYY-MM-DD.

Comece em minutos

Clone, configure as secrets e os dados chegam sozinhos todo dia útil.

1

Clone o repositório

Faça o fork ou clone direto do PulseFlat para sua conta GitHub.

2

Configure os Secrets (opcional)

Para projeções via API oficial: Settings → Secrets → Actions e adicione ANBIMA_CLIENT_ID e ANBIMA_CLIENT_SECRET. Sem isso, o scraper usa scraping como fallback.

3

Habilite o GitHub Actions

Na aba Actions do repositório, clique em "Enable Actions". O pipeline já está configurado para rodar automaticamente.

4

Rode manualmente para testar

Actions → Captura Diária → Run workflow para verificar se tudo funciona antes de aguardar o agendamento.

5

Consuma os CSVs

Aponte sua ferramenta de BI ou ETL para as URLs raw do GitHub. Os dados são atualizados automaticamente todo dia útil.

terminal
# 1. Clone o repositório git clone https://github.com/PulseDataLabs/PulseFlat.git cd PulseFlat # 2. Instale as dependências (Recomendado via uv) uv venv source .venv/bin/activate uv pip install -r requirements.txt # 3. Configure credenciais e banco de dados (opcional) cp .env.example .env # Edite .env com seu client_id e client_secret # 4. Teste localmente — todos os scrapers python run_all.py # Ou rode um scraper específico python run_all.py anbima python run_all.py b3_carteiras_teoricas # 5. URL raw para importar direto no seu BI: https://raw.githubusercontent.com/PulseDataLabs/ PulseFlat/main/data/ anbima_indicadores.csv