About this role
At IBM Software, we transform client challenges into solutions. Building the world’s leading AI-powered, cloud-native products that shape the future of business and society. Our legacy of innovation creates endless opportunities for IBMers to learn, grow, and make an impact on a global scale. Working in Software means joining a team fueled by curiosity and collaboration. You’ll work with diverse technologies, partners, and industries to design, develop, and deliver solutions that power digital transformation. With a culture that values innovation, growth, and continuous learning, IBM Software places you at the heart of IBM’s product and technology landscape. Here, you’ll have the tools and opportunities to advance your career while creating software that changes the world. About the Role We're looking for a Staff Software Engineer I to lead the design and delivery of foundational control plane platforms that power Confluent Cloud. In this role, you will own highly complex technical initiatives that span multiple services and engineering teams, helping shape the architecture, scalability, and reliability of our cloud platform. You will combine deep expertise in distributed systems with strong execution and cross-functional leadership, identifying high-impact opportunities and driving them from concept through implementation. This is a highly influential role focused on solving complex engineering challenges, improving platform capabilities, and delivering durable business and customer value. What You'll Do Own the end-to-end architecture, design, and delivery of complex control plane systems, including APIs, controllers, orchestration workflows, and data models that support Confluent Cloud products. Lead ambiguous, open-ended technical initiatives by defining requirements, evaluating trade-offs, establishing technical direction, and driving execution across multiple teams and services. Improve platform reliability and operational excellence by building resilient systems with robust observability, well-defined SLOs, comprehensive runbooks, and safe deployment and rollback mechanisms. Partner with engineering organizations across Cloud Platform, Kafka, Compute, Security, Traffic, SRE, and other teams to align on architecture, design decisions, and long-term platform strategy. Mentor engineers across multiple career levels, provide thoughtful design and code reviews, and help elevate engineering standards throughout the organization. Enhance developer productivity and experience by improving tooling, automation, CI/CD pipelines, testing strategies, and operational workflows. Influence technical strategy within your domain by identifying high-impact opportunities, developing roadmaps, and helping prioritize initiatives aligned to business objectives. Contribute to engineering culture through technical documentation, design reviews, knowledge sharing, internal presentations, technical mentoring, and external thought leadership where appropriate. * Experienced builder: Typically, 8+ years of software engineering experience, with a strong track record of delivering complex backend or distributed systems to production. * Distributed systems & cloud expert: Deep hands‑on experience with at least some of: * Distributed systems design (consistency models, failure modes, data modeling, scalability). * Cloud platforms (AWS, GCP, or Azure) and cloud‑native architectures. * Kubernetes or similar orchestration platforms. * Strong systems and coding skills: Proficiency in one or more of Go, Java or Scala, and comfort working across services, infrastructure, and automation. * Architect & executor: Able to define end‑to‑end designs, break them into milestones, de‑risk early, and land them on time with high quality. * Operationally rigorous: You think in terms of SLOs, failure modes, observability, and incident response; you design for safe change and graceful degradation. * Great communicator: You write clear design docs, explain trade‑offs crisply, and can lead technical discussions with diverse stakeholders (engineers, PMs, leadership). * Leader without authority: You’ve successfully led cross‑team projects, influenced technical direction beyond your immediate code, and helped others level up. * Values‑aligned: You care about customer impact, reliability, long‑term maintainability, and helping the team win, not just shipping features. * Experience building control‑plane systems (APIs, operators/controllers, metadata services, provisioning/orchestration workflows). * Background with Apache Kafka or other streaming/data systems. * Prior work on multi‑region, high‑availability, or disaster‑recovery architectures. * Experience in security‑sensitive infrastructure (identity, certificates, secrets, mTLS, policy) or compliance‑driven environments. * Contributions to open source projects, public talks, or technical blogs in relevant areas. Chez IBM Software, nous transformons les défis de nos clients en solutions. Nous développons les produits infonuagiques natifs et alimentés par l’intelligence artificielle parmi les plus avancés au monde, qui façonnent l’avenir des entreprises et de la société. Notre héritage d’innovation crée d’innombrables occasions pour les IBMistes d’apprendre, de progresser et d’avoir un impact à l’échelle mondiale. Travailler au sein d’IBM Software, c’est rejoindre une équipe animée par la curiosité et la collaboration. Vous collaborerez avec diverses technologies, partenaires et industries pour concevoir, développer et livrer des solutions qui alimentent la transformation numérique. Grâce à une culture qui valorise l’innovation, le développement professionnel et l’apprentissage continu, IBM Software vous place au cœur de l’écosystème des produits et des technologies d’IBM. Ici, vous disposerez des outils et des possibilités nécessaires pour faire progresser votre carrière tout en créant des logiciels qui changent le monde. Nous recherchons un(e) Ingénieur(e) logiciel principal(e) I pour diriger la conception et la livraison d’une plateforme fondamentale de plan de contrôle qui alimente Confluent Cloud. Dans ce rôle, vous serez responsable de projets hautement techniques couvrant plusieurs services et équipes, tout en façonnant l’architecture et la fiabilité de notre plateforme cloud. Vous combinerez une expertise approfondie des systèmes distribués, une forte capacité d’exécution et un leadership transversal afin d’identifier des problèmes à fort impact et de les mener de l’idée à des résultats durables. Ce que vous ferez Assurer la conception et la livraison de bout en bout de systèmes complexes du plan de contrôle (API, contrôleurs, workflows d’orchestration, modèles de données) qui soutiennent les produits Confluent Cloud. Piloter des initiatives techniques complexes et peu définies, en clarifiant les exigences, en définissant l’approche et en coordonnant l’exécution entre équipes et services. Élever les standards de fiabilité et d’exploitation en concevant des systèmes résilients avec une forte observabilité, des SLO clairs, des guides opérationnels (runbooks) et des mécanismes sécurisés de déploiement et de retour arrière. Collaborer avec diverses organisations (Cloud Platform, Kafka, Compute, Security, Traffic, SRE et autres) afin d’aligner les conceptions, les compromis techniques et la vision à long terme de la plateforme. Encadrer et soutenir des ingénieurs de différents niveaux, effectuer des revues de conception et de code de haute qualité et favoriser le développement de l’équipe d’ingénierie. Améliorer continuellement l’expérience des développeurs pour la pile technologique du plan de contrôle (outillage, automatisation, CI/CD, stratégie de tests) afin de réduire les tâches répétitives et d’accroître la productivité. Influencer la stratégie technique de votre domaine en identifiant les opportunités à fort impact, en proposant des feuilles de route et en aidant à prioriser les travaux selon les objectifs d’affaires. Contribuer à la culture d’ingénierie par la documentation, les revues d’architecture et le partage de connaissances (présentations internes, wikis ou contenu externe lorsque pertinent). Bâtisseur expérimenté : généralement 8 ans ou plus d’expérience en développement logiciel, avec un solide historique de livraison de systèmes backend ou distribués complexes en environnement de production. Expert des systèmes distribués et du cloud avec une expérience pratique approfondie dans plusieurs des domaines suivants : Conception de systèmes distribués (modèles de cohérence, modes de défaillance, modélisation des données, évolutivité). Plateformes cloud (AWS, GCP ou Azure) et architectures cloud natives. Kubernetes ou plateformes d’orchestration similaires. Solides compétences en systèmes et en programmation : maîtrise d’un ou plusieurs des langages suivants : Go, Java ou Scala, et aisance à travailler à travers les services, l’infrastructure et l’automatisation. Architecte et exécutant : capable de définir des architectures complètes, de les découper en jalons, de réduire les risques dès le départ et de livrer à temps avec un haut niveau de qualité. Rigueur opérationnelle : compréhension des SLO, des modes de défaillance, de l’observabilité et de la gestion des incidents; conception de systèmes favorisant des changements sécuritaires et une dégradation maîtrisée. Excellent communicateur : capacité à rédiger des documents d’architecture clairs, à expliquer efficacement les compromis techniques et à animer des discussions avec divers intervenants (ingénieurs, gestionnaires de produit et dirigeants). Leader sans autorité hiérarchique : expérience démontrée dans la direction de projets interéquipes, l’influence sur l’orientation technique au-delà de son périmètre immédiat et le développement des autres. Aligné sur les valeurs de l’entreprise : souci de l’impact client, de la fiabilité, de la maintenabilité à long terme et de la réussite collective. Expérience dans la conception de systèmes de plan de contrôle (API, opérateurs/contrôleurs, services de métadonnées, workflows de provisioning et d’orchestration). Connaissance d’Apache Kafka ou d’autres systèmes de diffusion de données et de streaming. Expérience avec des architectures multirégionales, hautement disponibles ou de reprise après sinistre. Travail préalable dans des environnements d’infrastructure sensibles à la sécurité (identité, certificats, gestion des secrets, mTLS, politiques de sécurité) ou soumis à des exigences de conformité. Contributions à des projets open source, conférences publiques ou blogs techniques pertinents. Canada Software Engineering Remote Professional Multiple Cities (0026) IBM Canada Limited - IBM Canada Limitee