SREday

Site Reliability, DevOps and Cloud

December 4, 2025 Kyndryl, Campinas / Hortolandia, Brazil

1
Day
25+
Speakers
2
Tracks
200+
Attendees

SREday is a worldwide series of community events for engineers who build, ship and run modern software systems. Across cities around the world, we bring together people working in reliability, cloud, DevOps, observability and production engineering to share real-world experience, connect with their local community and explore how these disciplines are evolving in the age of AI.

Companies presenting:

4Linux, Accenture, Advolve.ai, AWS, Banco Bradesco, Bosch, C6 Bank, ClickHouse, Cloud Programming Shell (CPS1), Dynatrace, FIAP, GFT Technologies, Grafana Labs, Kyndryl, Matera, Microsoft, Netskope, Opsteam, Orca Security, Vivo

Topics so far:

This is a past event, what's next?

Schedule

December 4, 2025 • 2 parallel tracks • 9:30AM - 6PM • Campinas, in-person
view as table
english • Track track 1

09:30

Andre Murbach Maidl

KeynoteHow We Built ClickStack - an open source, open telemetry native Observability stack

ClickHouse
Observability was broken. How we built ClickStack - an open source, open telemetry native Observability stack.... Read more

10:00

Coffee break

Main lobby

10:30

Rod Anami

Agentic AI for SREs: How I casually developed my first MCP server

Kyndryl
Agentic AI has become well-known in the world of hybrid cloud operations. Cloud, DevOps, Platform, and Site Reliability engineers are either currently utilizing it or plan to do so in the near future. A common question is the steepness of the learning curve for incorporating it into your utility belt. In this session, I will introduce Agentic AI and the widely adopted integration framework, the Model Context Protocol (MCP). I will also share my experience building my first MCP server, which integrates Generative AI (referred to as the brain for modern operations) with MCP tools for HashiCorp Vault Server. A secrets management platform plays a crucial role in securing modern workloads.... Read more

11:00

Danne Aguiar

Business Observability with Dynatrace

Kyndryl
Observabilty is well known for IT departments around the world. SRE relies over Observability data to ensure the systems are performing as it should be. Automations depends on Observability insights to accurately remediate events. What about bring the Observability to Business side of history? Application Performance Monitoring (APM) tools capture more than the only 4 Golden Signals, let's leverage this and provide insights to the Business. In this presentation, I will explain how the Business Events can be captured from monitored sytems, and how to handle them in order to be presented and monitored, providing a real time source of insights at Business level.... Read more

11:30

Tiago Dias Generoso

Observability Strategy: From Metrics to Meaningful Reliability

Kyndryl
Observability isn’t about tools—it’s about strategy, people, and culture. Too often, organizations invest in “magic tools” expecting instant results, only to end up with dashboards no one uses, alerts no one trusts, and teams that feel more burdened than empowered. True observability must start with strategy: aligning telemetry with business outcomes, defining maturity models, and using benchmarks to guide the journey. This talk advocates for a shift in mindset: observability as the compass, not the destination. We’ll explore how maturity models and benchmarking frameworks can help organizations measure progress, identify gaps, and link engineering practices (like SLOs, automation, and postmortems) with business impact (resilience, reliability, customer trust). We’ll also cover challenges often amplified in enterprise contexts—such as tool-centric procurement, talent gaps, silos between Dev/Ops/Business, and uneven maturity across teams—and discuss how SREs can drive cultural alignment to overcome them.... Read more

12:00

Joao Fernando Helena Filho & Gabriel Leite

Enhancing SRE with AI Agents on AWS: Intelligent Automation for Incident Response and Operations

AWS
Transform your SRE with AWS GenAI solutions. From automated troubleshooting with Amazon Q to intelligent agents via Bedrock, we help teams automate tasks, detect anomalies, and streamline operations. Enhance efficiency with AI-powered assistance.... Read more

12:30

Lunch & networking

Main lobby

13:30

Douglas Bussoli Mugnos

Designing for Failure: Proven Techniques for Reliable Applications

Netskope
Failures are not a possibility — they are a certainty. What separates good systems from great ones is how they respond when things go wrong. In this talk, we’ll explore resilience at the heart of SRE: proven techniques such as load shedding, sharding, and deployment strategies that transform outages into controlled, predictable events. Attendees will walk away with understanding of patterns to minimize failure impact, protect user experience, and strengthen the reliability of their applications. If you care about building systems that survive chaos, this is the session you can’t miss!... Read more

14:00

Miguel Di Ciurcio Filho

Staging Is Dead: How Ephemeral Environments Redefine Platform Engineering

Cloud Programming Shell (CPS1)
Static staging slows everything down. Ephemeral environments flip the model by creating production-like sandboxes for every branch. Learn how they accelerate feedback, cut friction, and boost reliability across your platform and teams.... Read more

14:30

Igor Eulalio Morgado Lopes

eBPF: Why is everyone talking about it and what does that mean to you?

Orca Security
In the rapidly evolving landscape of technology, a groundbreaking innovation has captured the attention of enthusiasts, developers, and industry pioneers. This presentation aims to demystify the buzz around eBPF, illustrating its potential in the realms of networking, security, and monitoring.... Read more

15:00

Bruno Paiuca

The Anatomy of a Secure Request: Ten Layers of Defense from DNS to Database

Opsteam
Every HTTPS request tells a security story. Dissect the anatomy of an HTTPS request across ten layers of defense — from DNSSEC, TLS, WAF, to Cedar-based authorization and beyond. Learn how Devs, DevOps, and SREs can weave security-by-design into every hop of modern, cloud-native systems.... Read more

15:30

Networking & sponsor crawl

Main lobby

16:00

Gustavo Martins T Borges

Hello World in Production: Building Cloud-Native applications that survive the real world.

Advolve.ai
This talk you’ll see how small, practical steps can make your application resilient, scalable, and ready for production without overengineering. Perfect for developers, SREs, and DevOps engineers who want to understand what production-ready really means in cloud environments.... Read more

16:30

Rodrigo Candido Leme

Supercharging SRE with Azure’s AI-Powered Age

Microsoft
AI transforms Site Reliability Engineering by automating incident detection, accelerating root cause analysis, and predicting outages before they happen—boosting uptime, reducing toil, and empowering SREs to focus on strategic improvements.... Read more

17:00

Wrap up

Scan each other's QR codes & head to a nearby pub!
portuguese • Track track 2

10:00

Coffee break

Main lobby

10:30

Levi Leopoldino Alves

Comunidades de SRE e DevOps: conectando pessoas, processos e propósito no Brasil

Matera
Comunidades de SRE e DevOps: conectando pessoas, processos e propósito no Brasil **Principais lições de estar entre as maiores comunidades de tecnologia do país.** Esta sessão provoca uma reflexão: muitos engenheiros de SRE e DevOps possuem vasto conhecimento, mas acabam sendo reconhecidos apenas dentro de suas empresas. Fora delas, ninguém os vê ou se inspira neles. Sabemos que quem não é visto é esquecido, e quem não compartilha não inspira. Queremos mostrar como a comunidade, especialmente no contexto brasileiro, pode se tornar a ponte entre conhecimento e reconhecimento, fortalecendo tanto os profissionais quanto as empresas. Também trazemos um ponto importante: precisamos falar não apenas sobre histórias de sucesso, mas principalmente sobre falhas, pois é nelas que mais aprendemos e crescemos como comunidade. Ao incentivar profissionais e empresas a se aproximarem ainda mais da comunidade no Brasil, transformando sua marca em algo memorável. Nesta sessão, vamos abordar os seguintes tópicos: **Conhecimento invisível não transforma** “Quem não é visto é esquecido. Quem não é lembrado, não inspira.” O problema do talento escondido **“A comunidade precisa saber o que você sabe, não apenas a sua empresa.”** Visibilidade cria oportunidades **“A marca não é só da empresa, é também da comunidade.”** O papel da comunidade no Brasil **“A sua marca é a comunidade. A sua comunidade é a sua marca.”** O poder do fracasso **“Histórias de sucesso inspiram. Histórias de fracasso transformam.”** O movimento de dentro para fora **“A sua empresa se destaca mais quando os seus profissionais se destacam mais.”** Chamada para ação **“Quem não é visto é esquecido. Quem não compartilha não inspira. Quem não inspira não transforma.”** --- **Esta sessão será apresentada em português** ... Read more

11:00

Alexandre Melo Ferreira

Stack de Observabilidade com Grafana Cloud

Grafana Labs
Nessa talk, vamos configurar um cluster Kubernetes para enviar telemetria para Grafana Cloud e monitorar de ponta a ponta nosso ambiente utilizando Métricas de K8S com componentes padrão como node_exporter e cadvisor, Traces no formato Opentelemetry e correlação com Logs e como bônus,Assistant de AI... Read more

11:30

Luiz Siqueira & Leonardo Marques

Chaos Engineering: Como Usar o Dynatrace para Transformar Falhas em Aprendizado

Banco Bradesco
Como o Bradesco transformou o Chaos Engineering em uma prática contínua e automatizada de experimentos controlados, integrando Dynatrace, Ansible e Azure Chaos Studio para validar hipóteses, fortalecer padrões de resiliência e acelerar o aprendizado das squads em ambientes cloud native.... Read more

12:00

Alexandre Tavares

Diferencas entre DataOps e DevOps: Entendendo Práticas e Importancias na Era Digital

C6 Bank
Você está convidado para uma palestra imperdível que irá explorar as diferenças e similaridades entre DataOps e DevOps, duas práticas essenciais no desenvolvimento moderno de software e na gestão de dados. O que você vai aprender: A definição e os objetivos de DevOps e DataOps. As principais diferenças entre as duas práticas e como elas se complementam. A importância de cada uma no cenário atual das empresas voltadas para tecnologia. Exemplos de sucesso de organizações que implementaram essas práticas com eficiência. Público-alvo: Esta palestra é ideal para profissionais de tecnologia, cientistas de dados, desenvolvedores, gerentes de produto, e todos aqueles que desejam compreender melhor como as organizações podem alavancar suas operações de dados e software.... Read more

12:30

Lunch & networking

Main lobby

13:30

Andre Bonfa & Pedro Alex da Costa

Preparar, Operar, Aprender: O Papel do PRR e do Postmortem na Engenharia de Confiabilidade

Vivo
O desafio de transformar falhas em combustível para a excelência! Nesta palestra, exploramos como o PRR e Postmortems fortalecem a cultura de confiabilidade, aceleram aprendizados e elevam a maturidade da operação.... Read more

14:00

Anderson Dorigao, Willian Yamashita & Mateus Rodrigues

Continuous profiling e resiliencia: Aplicando boas práticas de SRE no desenvolvimento Java

Banco Bradesco
Descubra como práticas de SRE aliadas ao continuous profiling elevam a resiliência de aplicações Java. Veja exemplos práticos com Dynatrace e Grafana para detectar gargalos e fortalecer a estabilidade dos seus sistemas.... Read more

14:30

Ademar Gregio Junior & Ramon Maia

Conduzindo FinOps com Confiabilidade: Como os SREs Reduziram os Custos de Nuvem em 30% Sem Comprometer os SLAs

Accenture
Nossa equipe de SRE trabalhou em parceria com FinOps para automatizar otimizações de nuvem em tempo real no Kubernetes — redimensionando pods, reequilibrando clusters e ajustando dinamicamente os tipos de máquinas. Essa colaboração alcançou mais de 30% de redução de custos enquanto mantinha os SLAs, provando que confiabilidade e eficiência financeira podem andar juntas.... Read more

15:00

Felipe de Freitas Campos

Microserviços serverless: diferentes designs, mesmas dores

GFT Technologies
A adoção de microserviços serverless promete maior agilidade e escalabilidade, mas, apesar das diferentes abordagens de design, as equipes enfrentam desafios semelhantes. Questões como observabilidade, latência, custos imprevisíveis e complexidade de integração continuam sendo pontos críticos. Este trabalho discute como arquiteturas distintas convergem para os mesmos problemas e o que pode ser feito para mitigá-los.... Read more

15:30

Networking & sponsor crawl

Main lobby

16:00

Emerson Silva

Kubernetes além do deploy: automação inteligente com K8sGPT e AIOps

4Linux
Nesta palestra, vamos explorar como aplicar AIOps no dia a dia da operação de clusters Kubernetes utilizando o K8sGPT. Mostrarei como SREs podem transformar ruído em insight, utilizando IA para interpretar sinais e sugerir correções automaticamente.... Read more

16:30

Alan Delcaro

Platform Engineering with Dynatrace for SRE: Intelligent Automation and Observability

Dynatrace
Learn how Platform Engineering with Dynatrace empowers SRE teams to move beyond reactive dashboards. Discover practical ways to integrate observability and automation for proactive reliability, safe deployments, and continuous optimization.... Read more

17:00

Amaury Borges Souza

Proteja Pipelines de SRE Terraform e AWS: Aplicando o Shift Left na Confiabilidade

FIAP
Confiabilidade sem segurança é mera sorte. Nesta palestra, veja como as práticas do Shift Left capacitam SREs a automatizar a segurança, prevenir incidentes precocemente e entregar sistemas resilientes com confiança.... Read more

17:30

Marcelo da Silva Pires

Construindo um Operator para o DevLake

Bosch
Nesta talk mostrarei as motivações para a construção de um Operator para o Apache DevLake, como começar, lições aprendidas e etc.... Read more

18:00

Wrap up

Scan each other's QR codes & head to a nearby pub!
Time english portuguese
09:30 KeynoteHow We Built ClickStack - an open source, open telemetry native Observability stack
Andre Murbach Maidl • ClickHouse
10:00 Coffee break
10:30 Agentic AI for SREs: How I casually developed my first MCP server
Rod Anami • Kyndryl
Comunidades de SRE e DevOps: conectando pessoas, processos e propósito no Brasil
Levi Leopoldino Alves • Matera
11:00 Business Observability with Dynatrace
Danne Aguiar • Kyndryl
Stack de Observabilidade com Grafana Cloud
Alexandre Melo Ferreira • Grafana Labs
11:30 Observability Strategy: From Metrics to Meaningful Reliability
Tiago Dias Generoso • Kyndryl
Chaos Engineering: Como Usar o Dynatrace para Transformar Falhas em Aprendizado
Luiz Siqueira & Leonardo Marques • Banco Bradesco
12:00 Enhancing SRE with AI Agents on AWS: Intelligent Automation for Incident Response and Operations
Joao Fernando Helena Filho & Gabriel Leite • AWS
Diferencas entre DataOps e DevOps: Entendendo Práticas e Importancias na Era Digital
Alexandre Tavares • C6 Bank
12:30 Lunch & networking
13:30 Designing for Failure: Proven Techniques for Reliable Applications
Douglas Bussoli Mugnos • Netskope
Preparar, Operar, Aprender: O Papel do PRR e do Postmortem na Engenharia de Confiabilidade
Andre Bonfa & Pedro Alex da Costa • Vivo
14:00 Staging Is Dead: How Ephemeral Environments Redefine Platform Engineering
Miguel Di Ciurcio Filho • Cloud Programming Shell (CPS1)
Continuous profiling e resiliencia: Aplicando boas práticas de SRE no desenvolvimento Java
Anderson Dorigao, Willian Yamashita & Mateus Rodrigues • Banco Bradesco
14:30 eBPF: Why is everyone talking about it and what does that mean to you?
Igor Eulalio Morgado Lopes • Orca Security
Conduzindo FinOps com Confiabilidade: Como os SREs Reduziram os Custos de Nuvem em 30% Sem Comprometer os SLAs
Ademar Gregio Junior & Ramon Maia • Accenture
15:00 The Anatomy of a Secure Request: Ten Layers of Defense from DNS to Database
Bruno Paiuca • Opsteam
Microserviços serverless: diferentes designs, mesmas dores
Felipe de Freitas Campos • GFT Technologies
15:30 Networking & sponsor crawl
16:00 Hello World in Production: Building Cloud-Native applications that survive the real world.
Gustavo Martins T Borges • Advolve.ai
Kubernetes além do deploy: automação inteligente com K8sGPT e AIOps
Emerson Silva • 4Linux
16:30 Supercharging SRE with Azure’s AI-Powered Age
Rodrigo Candido Leme • Microsoft
Platform Engineering with Dynatrace for SRE: Intelligent Automation and Observability
Alan Delcaro • Dynatrace
17:00 Wrap up Proteja Pipelines de SRE Terraform e AWS: Aplicando o Shift Left na Confiabilidade
Amaury Borges Souza • FIAP
17:30 Construindo um Operator para o DevLake
Marcelo da Silva Pires • Bosch
18:00 Wrap up

Speakers

Ademar Gregio Junior
& Ramon Maia
Accenture
Alan Delcaro
Dynatrace
Alexandre Melo Ferreira
Grafana Labs
Alexandre Tavares
C6 Bank
Amaury Borges Souza
FIAP
Anderson Dorigao,
Willian Yamashita
& Mateus Rodrigues
Banco Bradesco
Andre Bonfa
& Pedro Alex da Costa
Vivo
Andre Murbach Maidl
ClickHouse
Bruno Paiuca
Opsteam
Danne Aguiar
Kyndryl
Douglas Bussoli Mugnos
Netskope
Emerson Silva
4Linux
Felipe de Freitas Campos
GFT Technologies
Gustavo Martins T Borges
Advolve.ai
Igor Eulalio Morgado Lopes
Orca Security
Joao Fernando Helena Filho & Gabriel Leite
AWS
Levi Leopoldino Alves
Matera
Luiz Siqueira
& Leonardo Marques
Banco Bradesco
Marcelo da Silva Pires
Bosch
Miguel Di Ciurcio Filho
Cloud Programming Shell (CPS1)
Rod Anami
Kyndryl
Rodrigo Candido Leme
Microsoft
Tiago Dias Generoso
Kyndryl

Venue

Kyndryl Campinas / Hortolândia

Rodovia Jornalista Francisco Aguirre Proença
SP101, Km 09 - S/N - Chácaras Assay, Hortolândia - SP, 13186-900, Brazil

Minors are not allowed to attend or participate in this event.

Sponsors & Partners

Want to become a sponsor? Get in touch!
Let's talk!
We'll email you and share prospectuses for relevant events.
We'd like to (one or more)
Pick at least one
Conferences (one or more)
Pick at least one
Regions (one or more)
Pick at least one
Budget
Pick one