Salary: CA$125,000–CA$145,000 + benefits
Location: Remote ( occasional Montréal-area datacenter visits )
We’re looking for a Senior Systems & Infrastructure Specialist to help operate, troubleshoot, and evolve a production infrastructure built primarily on open-source technologies.
This is a hands-on infrastructure role for someone who enjoys understanding how systems work behind the scenes: operating systems, virtualization, storage, networking, databases, and high availability.
Our platform supports business-critical services and is designed around redundancy, fault tolerance, performance, and long-term stability.
This is not a cloud-only DevOps role. Most of our infrastructure is self-managed, and we are looking for someone comfortable working directly with the systems underneath the application layer.
What You’ll Work WithVirtualization & Storage
- Proxmox VE
- Ceph - production clusters, tuning, troubleshooting, recovery, and high availability
- ZFS - architecture, performance tuning, replication, snapshots, and recovery
Operating Systems
- FreeBSD - approximately 90% of our server fleet
- Linux - primarily Debian / Ubuntu
Strong Linux administrators are welcome. Prior FreeBSD experience is valuable but not mandatory; we support a ramp-up into FreeBSD for someone with strong Unix/Linux fundamentals.
Networking & High Availability
- HAProxy and Nginx
- OPNsense / firewalling
- TCP/IP, routing, VLANs, and network troubleshooting
- Load balancing, health checks, redundancy, and failover architectures
- Diagnosing failures across multiple layers of the infrastructure
Databases & Production Services
You do not need to be a specialist DBA, but you should be comfortable operating database-backed production systems and understanding their failure modes.
Experience with areas such as:
- MySQL / MariaDB administration
- Replication and high availability
- Backup and restore
- Performance troubleshooting
- Locks, connections, slow queries, and resource contention
Specialist and vendor support can be brought in where appropriate. We expect you to understand the systems well enough to identify problems, make sound operational decisions, and work effectively with specialists when deeper expertise is required.
Automation & Operations
- Shell scripting and automation
- Configuration management and repeatable deployments
- Monitoring, logging, alerting, and capacity planning
- Backup and disaster-recovery planning
- Root-cause analysis and production troubleshooting
Nice to Have
Experience with any of the following is useful but not required:
- Cisco Nexus switches
- vPC configurations
- Advanced VLAN and datacenter networking
- Datacenter hardware and physical infrastructure
- Large-scale hosting or service-provider environments
What You’ll Be Doing
You’ll have meaningful ownership of the infrastructure rather than simply executing tickets.
Typical responsibilities include:
- Designing and maintaining highly available production infrastructure
- Operating and improving virtualization, storage, networking, and operating-system platforms
- Troubleshooting complex system, storage, database, and network problems
- Identifying bottlenecks and failure points across the stack
- Improving monitoring, reliability, backups, and recovery procedures
- Participating directly in architecture and technology decisions
- Automating repetitive operational work
- Coordinating with specialist vendors or consultants when appropriate
- Performing occasional datacenter work such as racking, cabling, and hardware replacement
Physical datacenter presence is rare - typically once or twice per year.
What We’re Looking For
We’re looking for broad systems knowledge rather than someone who happens to be an expert in every technology we use.
You should have:
- Significant experience operating production Linux, Unix, or BSD infrastructure
- Strong understanding of networking, storage, operating systems, and performance
- Experience designing or operating redundant and highly available systems
- Strong production troubleshooting skills
- Comfort working close to the operating system and hardware
- The ability to investigate problems systematically across application, network, operating-system, storage, and database layers
- Enough depth to understand why a system behaves the way it does, rather than relying entirely on managed services or abstraction layers
- A genuine interest in open-source technologies and well-designed infrastructure
Most importantly, we’re looking for someone who can take ownership of a technical problem, understand the architecture around it, and work through it methodically.
Why This Role
- Remote-first
- Real infrastructure ownership
- Direct involvement in technical and architecture decisions
- Very little bureaucracy
- Broad technical scope
- Opportunity to work deeply with open-source infrastructure
- Specialist support available when a problem requires deeper product-specific expertise
If you enjoy understanding how infrastructure actually works - and why it sometimes doesn’t - this role should be a good fit.
----------------------------------------------------------------------------------------------------------------------
Salaire : 125 000 $ à 145 000 $ CAD + benefices
Lieu : Télétravail - présence occasionnelle en centre de données dans la région de Montréal
Nous recherchons un(e) Spécialiste principal(e), systèmes et infrastructure pour participer à l’exploitation, au diagnostic et à l’évolution d’une infrastructure de production basée principalement sur des technologies open source.
Il s’agit d’un rôle d’infrastructure très concret destiné à une personne qui aime comprendre ce qui se passe derrière les différentes couches d’un système : systèmes d’exploitation, virtualisation, stockage, réseautique, bases de données et haute disponibilité.
Notre plateforme supporte des services critiques et repose sur des principes de redondance, de tolérance aux pannes, de performance et de stabilité à long terme.
Environnement techniqueVirtualisation et stockage
- Proxmox VE
- ZFS - architecture, optimisation des performances, réplication, snapshots et récupération
Systèmes d’exploitation
- FreeBSD - environ 90 % de notre parc de serveurs
- Linux - principalement Debian / Ubuntu
Les administrateurs Linux expérimentés sont les bienvenus. Une expérience préalable avec FreeBSD constitue un atout, mais n’est pas obligatoire; une période d’adaptation est prévue pour les candidats ayant de solides bases Unix/Linux.
Réseautique et haute disponibilité
- HAProxy et Nginx
- OPNsense / pare-feu
- TCP/IP, routage, VLAN et diagnostic réseau
- Répartition de charge, vérifications d’état, redondance et mécanismes de bascule
- Diagnostic de problèmes touchant plusieurs couches de l’infrastructure
Bases de données et services de production
Nous ne recherchons pas nécessairement un DBA spécialisé, mais la personne doit être à l’aise avec l’exploitation de systèmes de production reposant sur des bases de données et comprendre leurs principaux modes de défaillance.
Une expérience dans les domaines suivants est particulièrement utile :
- Administration MySQL / MariaDB
- Réplication et haute disponibilité
- Sauvegarde et restauration
- Diagnostic de problèmes de performance
- Verrous, connexions, requêtes lentes et contention des ressources
Nous pouvons faire appel à des spécialistes ou au soutien des fournisseurs lorsque nécessaire. Nous nous attendons toutefois à ce que la personne responsable de l’infrastructure comprenne suffisamment les systèmes pour identifier les problèmes, prendre de bonnes décisions opérationnelles et travailler efficacement avec ces spécialistes.
Automatisation et exploitation
- Scripts shell et automatisation
- Gestion de configuration et déploiements reproductibles
- Supervision, journalisation, alertes et planification de capacité
- Sauvegardes et plans de reprise après sinistre
- Analyse des causes profondes et résolution d’incidents de production
Atouts
Une expérience avec certaines des technologies ou environnements suivants constitue un atout :
- Switches Cisco Nexus / vPC
- VLAN et réseautique avancée en centre de données
- Matériel et infrastructure physique de centre de données
- Environnements d’hébergement ou de fournisseur de services à grande échelle
Responsabilités
Le poste offre une véritable responsabilité technique sur l’infrastructure; il ne s’agit pas simplement d’exécuter des billets.
Les responsabilités comprennent notamment :
- Concevoir et maintenir des infrastructures de production hautement disponibles
- Exploiter et faire évoluer les plateformes de virtualisation, de stockage, de réseautique et les systèmes d’exploitation
- Diagnostiquer des problèmes complexes touchant les systèmes, le stockage, les bases de données ou le réseau
- Identifier les goulots d’étranglement et les points de défaillance dans l’architecture
- Améliorer la supervision, la fiabilité, les sauvegardes et les mécanismes de reprise
- Participer directement aux décisions d’architecture et aux choix technologiques
- Collaborer avec des spécialistes ou fournisseurs lorsque leur expertise est nécessaire
- Effectuer occasionnellement des interventions en centre de données : installation de matériel, câblage et remplacement de composantes
La présence physique en centre de données est rare - généralement une ou deux fois par année.
Profil recherché
Nous recherchons avant tout une personne possédant une compréhension générale et approfondie des systèmes, plutôt qu’un spécialiste de chacune des technologies que nous utilisons.
Vous devriez avoir :
- Une expérience importante dans l’exploitation d’infrastructures Linux, Unix ou BSD en production
- De l’expérience avec des architectures redondantes ou hautement disponibles
- De solides compétences en diagnostic et résolution de problèmes de production
- La capacité d’analyser méthodiquement un problème à travers les différentes couches : application, réseau, système d’exploitation, stockage et base de données
- Un intérêt marqué pour les technologies open source et les infrastructures bien conçues
Nous recherchons surtout quelqu’un qui peut prendre en charge un problème technique, comprendre l’architecture qui l’entoure et progresser méthodiquement jusqu’à sa résolution.