INSCRIÇÕES ENCERRADAS EM 3 DE JULHO. OS CANDIDATOS SELECIONADOS JÁ FORAM CONTATADOS.
Os participantes foram selecionados com base na instituição, disponibilidade e perfil do candidato, buscando garantir diversidade, inclusão e melhor aproveitamento do curso.
SOBRE ESTE CURSO: Este curso aborda o workflow completo para modernização de dados científicos n-dimensionais utilizados em oceanografia, clima e meteorologia. Os participantes aprenderão como migrar dados de formatos tradicionais, como NetCDF, para formatos cloud-native como Zarr e VirtualiZarr, permitindo acesso eficiente e escalável a dados em escala de múltiplos terabytes. O curso cobre todo o pipeline de dados, incluindo estratégias de armazenamento em object storage, conversão de dados, processamento paralelo utilizando ferramentas como Dask, e acesso e visualização eficiente dos dados na nuvem. Ao final do curso, os participantes terão uma compreensão prática de como construir workflows modernos, escaláveis e reproduzíveis para análise de grandes volumes de dados ambientais.
NOTAS DO CURSO: O material do curso, incluindo exemplos e notebooks, estará disponível em pagina especialmente dedicada a este curso no repositório do projeto no GitHub. Os participantes receberão um link para acessar o material antes do início do curso.
QUEM PODE PARTICIPAR?: Este curso é destinado a pesquisadores, cientistas de dados e engenheiros que trabalham com dados de oceanografia, clima, meteorologia ou outras áreas relacionadas. É especialmente relevante para quem precisa lidar com grandes volumes de dados (gigabytes a terabytes) e deseja modernizar seus fluxos de trabalho utilizando tecnologias cloud-native. O curso é aberto a participantes de diferentes instituições, sujeito à disponibilidade de vagas.
ONDE:
Presencial: R. Aloísio Teixeira, 278 - Cidade Universitária, Rio de Janeiro. Siga as instruções a seguir para chegar ao local do curso: OpenStreetMap or Google Maps.
Participantes Online: Para os participantes online, será fornecido um link para a reunião virtual antes do início do curso.
QUANDO: 01 a 03 de Setembro de 2026; 9:00 - 17:30 UTC-3 Add to your Google Calendar.
PRÉ-REQUISITOS: Não é necessário conhecimento prévio em computação em nuvem ou formatos cloud-native. No entanto, o curso será ministrado em Python, sendo recomendado que os participantes tenham boa familiaridade com a linguagem (loops, funções, uso de bibliotecas NumPy e xarray). Os participantes também devem estar confortáveis com o uso de um terminal de linha de comando e ter experiência prévia com análise de dados científicos e formatos tradicionais como NetCDF ou GRIB.
REQUISITOS:
Presencial: Os participantes devem trazer um laptop com acesso à internet. Toda a configuração necessária para o curso será feita em um ambiente de nuvem, portanto, não é necessário instalar software específico localmente.
Participantes Online: Diferentemente da modalidade presencial, os participantes online utilizarão seus próprios computadores durante o curso. Será necessário instalar previamente algumas ferramentas de desenvolvimento, como Python, Jupyter e VS Code (ou equivalente), além de garantir uma conexão estável com a internet. Instruções detalhadas serão enviadas por e-mail antes do início do curso. De modo a garantir que todos os participantes estejam preparados, realizaremos duas sessões de configuração antes do início do curso (datas serão divulgadas em breve). Nessas sessões, estaremos disponíveis para orientar a instalação e resolver eventuais problemas. Requisitos mínimos de hardware para os participantes online incluem: CPU Intel Core i5 ou superior, com pelo menos 4 núcleos; RAM de 16 GB como mínimo confortável para ciência de dados (32 GB é ótimo se você já trabalha com volumes grandes); e armazenamento com 512 GB ou mais, garantindo espaço para ambientes conda/venv, pacotes, cache e alguns datasets locais.
INSCRIÇÃO: INSCRIÇÕES ENCERRADAS. Os participantes foram selecionados com base na instituição, disponibilidade e perfil do candidato, buscando garantir diversidade, inclusão e melhor aproveitamento do curso. Os selecionados receberam um email de confirmação no dia 17 de julho.
CONTATO: Por favor, envie um email para tobias.ferreira@noc.ac.uk para mais informações.
PAPEIS NOS CURSOS: Para aprender mais sobre os papéis nos cursos (quem fará o quê), consulte nossa FAQ de Cursos (em inglês).
THE CARPENTRIES: O projeto The Carpentries compreende uma comunidade de Instrutores, ajudantes, mantenedores e outros. Cada um desses papéis tem responsabilidades específicas para garantir que o curso seja uma experiência positiva para todos os participantes.
ACESSIBILIDADE: Nos comprometemos a tornar este curso acessível para todos.
Nos dedicamos a fornecer um ambiente de aprendizado positivo e acessível para todos. Não exigimos que os participantes forneçam documentação de deficiências ou divulguem quaisquer informações pessoais desnecessárias. No entanto, queremos ajudar a criar uma experiência inclusiva e acessível para todos os participantes. Incentivamos você a compartilhar qualquer informação que possa ser útil para tornar sua experiência na Carpentries acessível.
| Antes | Pesquisa pré-curso |
| 09:00 | Abertura: INPO |
| 09:15 | Apresentação do curso, objetivos e setup |
| 09:45 | Introdução a formatos de dados, metadados e vocabulários |
| 10:20 | Desafios de dados n-dimensionais |
| 10:40 | INTERVALO |
| 11:00 | O que são formatos cloud-native? |
| 11:40 | Zarr: modelo de dados, metadados e armazenamento em chunks |
| 12:40 | Ferramentas em Python para trabalhar com Zarr |
| 13:00 | ALMOÇO |
| 14:00 | Ferramentas em Python para trabalhar com Zarr |
| 15:00 | Como escolher chunks para análise e processamento em escala |
| 15:30 | INTERVALO |
| 15:50 | Processamento paralelo para Zarr |
| 16:50 | Resumo do dia e discussões |
| 17:00 | Encerramento |
| 09:00 | Abertura do dia e recapitulação |
| 09:10 | Hands-on: datasets Zarr |
| 10:40 | INTERVALO |
| 11:10 | Hands-on: datasets Zarr |
| 11:30 | Object storage: conceitos, acesso remoto e organização de dados na nuvem |
| 12:20 | Fluxo de conversão de formatos tradicionais para Zarr |
| 13:00 | ALMOÇO |
| 14:00 | Fluxo de conversão de formatos tradicionais para Zarr |
| 15:30 | INTERVALO |
| 15:50 | Versionamento de dados com Icechunk |
| 16:50 | Resumo do dia e discussões |
| 17:00 | Encerramento |
| 09:00 | Abertura do dia e recapitulação |
| 09:10 | Criando Zarr Stores virtuais com VirtualiZarr |
| 10:30 | INTERVALO |
| 10:50 | Sessão de palestras: como outras instituições estão utilizando Zarr? |
| 11:50 | Organização de dados Zarr na nuvem com STAC |
| 13:00 | ALMOÇO |
| 14:00 | Visualização: Multiscale Zarr e GeoZarr |
| 15:30 | INTERVALO |
| 15:50 | Discussão: arquiteturas e boas práticas |
| 16:40 | Encerramento e Pesquisa pós-curso |
| 17:00 | Fim |
O material a ser ensinado neste curso está sendo pilotado e um cronograma preciso ainda não foi estabelecido. O curso incluirá intervalos regulares. Por favor, entre em contato com os organizadores do curso se você quiser mais informações sobre o cronograma planejado.
Para participantes presenciais, não é necessário instalar nenhum software específico localmente, pois toda a configuração necessária para o curso será feita em um ambiente de nuvem. No entanto, é recomendável que os participantes tragam um laptop com acesso à internet para acompanhar as atividades do curso.
Para participantes online, será necessário instalar previamente algumas ferramentas de desenvolvimento, como Python, Jupyter e VS Code (ou equivalente), além de garantir uma conexão estável com a internet. Instruções detalhadas serão enviadas por e-mail antes do início do curso. De modo a garantir que todos os participantes estejam preparados, realizaremos duas sessões de configuração antes do início do curso (datas serão divulgadas em breve). Nessas sessões, estaremos disponíveis para orientar a instalação e resolver eventuais problemas.
Gostaríamos de ser transparentes quanto ao formato do curso.
Como as atividades presenciais envolverão bastante interação, exercícios e acompanhamento individual, infelizmente não conseguiremos oferecer o mesmo nível de suporte em tempo real para quem estiver participando remotamente.
Mesmo assim, faremos o possível para incluir os participantes online durante todas as atividades. Eu estarei realizando bastante live coding durante o curso, explicando cada etapa do desenvolvimento, e farei o máximo possível para responder perguntas ao vivo. Mas acredito que talvez não consiga responder a perguntas online durante o curso, especialmente se houver muitas dúvidas simultaneamente.
Cabe ressaltar que também estaremos disponíveis antes do curso, durante as sessões de configuração, e após o curso para ajudar os participantes online sempre que possível.
Nosso objetivo é que todos consigam acompanhar o conteúdo e aproveitar ao máximo a experiência.
Todos os participantes das atividades da Carpentries devem seguir o Código de Conduta. Este documento também descreve como relatar um incidente, se necessário.