Addi

Senior/Staff Platform Engineer

Addi
Apply
2 months ago
Bogotá, ColombiaSenior / Staff+

Responsibilities

  • Optimize Java/JVM CI pipelines using build caching, parallelization, incremental compilation, test parallelization, and flakiness detection.
  • Deliver automated SLO dashboard instrumentation, error-budget enforcement, and multi-window burn-rate alerting for platform services.
  • Operate observability and continuous-profiling capabilities across production JVM services, including CPU, heap, thread, metrics, tracing, and logging analysis.
  • Build developer-facing platform capabilities such as service catalogs, golden-path templates, scaffolding tools, automated runbook generation, and LLM-based log triage.
  • Design and maintain platform pipelines, SDKs, and integrations that simplify service instrumentation for product teams.
  • Use DX and reliability metrics such as DORA metrics, build-time percentiles, pipeline reliability, and time-to-first-deployment to guide platform improvements.
  • Diagnose complex build, runtime, and infrastructure problems and translate technical findings into business impact.
  • Mentor product engineers and promote platform adoption, architectural practices, and shared observability ownership.

Requirements

  • 3–5 years of professional experience building or operating platforms serving Java/JVM-based backend systems at scale.
  • Strong software architecture knowledge, including distributed-system tradeoffs, service boundaries, API design, and data consistency patterns.
  • Hands-on knowledge of JVM garbage collection, classloading, thread modeling, heap analysis, JIT behavior, and Java application performance diagnosis.
  • Experience designing developer-facing internal platforms, service catalogs, golden paths, scaffolding tooling, and developer-experience metrics.
  • Deep CI/CD expertise, including remote caching, test parallelization, flakiness detection, and incremental build strategies.
  • Expertise with observability stacks covering metrics, distributed tracing, structured logging, continuous profiling, pipelines, SDKs, and integrations.
  • Experience defining SLO/SLI frameworks, error-budget policies, multi-window burn-rate alerts, and reliability ownership practices.
  • Experience with continuous profiling in production JVM environments and translating flame graphs into code-level fixes.
  • Strong Linux fundamentals and understanding of process scheduling, memory management, file descriptors, networking, cgroups, namespaces, containers, and Kubernetes scheduling.
  • Experience integrating LLM tooling into team-level developer workflows, automated documentation, or AI-assisted diagnostics.
  • Strong problem-solving, architectural judgment, communication, collaboration, and mentoring skills.

Benefits

  • Work on financial products intended to improve access to shopping, payments, banking, and credit in Colombia.
  • Opportunity to help shape the company’s technology, strategy, culture, and values during a period of rapid growth.
  • Work with an international, high-performing team in a collaborative environment.
  • Competitive compensation, equity ownership, and benefits.

Tech Stack

DockerGrafanaJavaKubernetesLinuxPrometheus

Categories

Addi

About Addi

501-1,000 employees
Contact me