2 months ago
Bogotá, ColombiaSenior / Staff+
Responsibilities
- Optimize Java/JVM CI pipelines using build caching, parallelization, incremental compilation, test parallelization, and flakiness detection.
- Deliver automated SLO dashboard instrumentation, error-budget enforcement, and multi-window burn-rate alerting for platform services.
- Operate observability and continuous-profiling capabilities across production JVM services, including CPU, heap, thread, metrics, tracing, and logging analysis.
- Build developer-facing platform capabilities such as service catalogs, golden-path templates, scaffolding tools, automated runbook generation, and LLM-based log triage.
- Design and maintain platform pipelines, SDKs, and integrations that simplify service instrumentation for product teams.
- Use DX and reliability metrics such as DORA metrics, build-time percentiles, pipeline reliability, and time-to-first-deployment to guide platform improvements.
- Diagnose complex build, runtime, and infrastructure problems and translate technical findings into business impact.
- Mentor product engineers and promote platform adoption, architectural practices, and shared observability ownership.
Requirements
- 3–5 years of professional experience building or operating platforms serving Java/JVM-based backend systems at scale.
- Strong software architecture knowledge, including distributed-system tradeoffs, service boundaries, API design, and data consistency patterns.
- Hands-on knowledge of JVM garbage collection, classloading, thread modeling, heap analysis, JIT behavior, and Java application performance diagnosis.
- Experience designing developer-facing internal platforms, service catalogs, golden paths, scaffolding tooling, and developer-experience metrics.
- Deep CI/CD expertise, including remote caching, test parallelization, flakiness detection, and incremental build strategies.
- Expertise with observability stacks covering metrics, distributed tracing, structured logging, continuous profiling, pipelines, SDKs, and integrations.
- Experience defining SLO/SLI frameworks, error-budget policies, multi-window burn-rate alerts, and reliability ownership practices.
- Experience with continuous profiling in production JVM environments and translating flame graphs into code-level fixes.
- Strong Linux fundamentals and understanding of process scheduling, memory management, file descriptors, networking, cgroups, namespaces, containers, and Kubernetes scheduling.
- Experience integrating LLM tooling into team-level developer workflows, automated documentation, or AI-assisted diagnostics.
- Strong problem-solving, architectural judgment, communication, collaboration, and mentoring skills.
Benefits
- Work on financial products intended to improve access to shopping, payments, banking, and credit in Colombia.
- Opportunity to help shape the company’s technology, strategy, culture, and values during a period of rapid growth.
- Work with an international, high-performing team in a collaborative environment.
- Competitive compensation, equity ownership, and benefits.
