661,119open jobs
38,508companies
97,957added this week
Browse all
Salary
$87k – $209k per year (Estimated)
Location
In office (Stuttgart)
Seniority
Architect
Employment
Full-Time
Overview
Company
Impact
Profile match
Belmont Lavan is an IT consulting and system integration enterprise specializing in enterprise software solutions and technology staffing. The company focuses on designing, implementing, and supporting custom enterprise resource planning (ERP), customer relationship management (CRM), cloud infrastructure, and cybersecurity platforms. Headquartered in Edinburgh, Scotland, it delivers digital transformation services across various industries throughout Europe, North America, and globally.

Wir suchen einen **Lead / Principal AI Infrastructure Architect**, der die durchgängige Verantwortung für den Entwurf, die Bereitstellung und die Optimierung der Infrastruktur für groß angelegte Workloads im Bereich Künstliche Intelligenz (KI) und maschinelles Lernen (ML) übernimmt.

Der Schwerpunkt der Rolle liegt auf der Architektur hochskalierbarer und kosteneffizienter Rechenumgebungen, einschließlich **GPU-Clustern, Plattformen für verteiltes Training, Infrastruktur für Model-Serving, Netzwerktechnik, Speicherlösungen, Orchestrierung sowie cloudbasierten KI/ML-Plattformen**.

Sie übersetzen Geschäftsziele, Service-Level-Anforderungen, Sicherheitsstandards und technische Rahmenbedingungen in robuste Infrastrukturarchitekturen. Sie evaluieren alternative Lösungen, treffen fundierte Architekturentscheidungen und stellen sicher, dass die Plattformen auf **Leistung, Skalierbarkeit, Zuverlässigkeit, Sicherheit und Kosteneffizienz** ausgelegt sind.

Als technische Führungskraft übernehmen Sie die architektonische Leitung, etablieren Engineering-Standards und Best Practices, betreuen (mentoren) Ingenieure und Architekten und arbeiten eng mit Kunden und Stakeholdern zusammen, um Infrastrukturstrategien und Roadmaps zu definieren.

Requirements

Absolut. Ich habe diese Stellenbeschreibung auf die gleiche Weise bereinigt: Arbeitgeberspezifische Formulierungen und Wiederholungen wurden entfernt, die Sprache gestrafft und **Verantwortlichkeiten, technische Anforderungen sowie Führungserwartungen** klar voneinander abgegrenzt - bei gleichzeitiger Wahrung des Senioritätsniveaus und der Kernanforderungen.

# Lead / Principal AI Infrastructure Architect

## Über die Position

Wir suchen einen **Lead / Principal AI Infrastructure Architect**, der die durchgängige Verantwortung für den Entwurf, die Bereitstellung und die Optimierung der Infrastruktur für groß angelegte Workloads im Bereich Künstliche Intelligenz (KI) und maschinelles Lernen (ML) übernimmt.

Der Schwerpunkt der Rolle liegt auf der Architektur hochskalierbarer und kosteneffizienter Rechenumgebungen, einschließlich **GPU-Clustern, Plattformen für verteiltes Training, Infrastruktur für Model-Serving, Netzwerktechnik, Speicherlösungen, Orchestrierung sowie cloudbasierten KI/ML-Plattformen**.

Sie übersetzen Geschäftsziele, Service-Level-Anforderungen, Sicherheitsstandards und technische Rahmenbedingungen in robuste Infrastrukturarchitekturen. Sie evaluieren alternative Lösungen, treffen fundierte Architekturentscheidungen und stellen sicher, dass die Plattformen auf **Leistung, Skalierbarkeit, Zuverlässigkeit, Sicherheit und Kosteneffizienz** ausgelegt sind.

Als technische Führungskraft übernehmen Sie die architektonische Leitung, etablieren Engineering-Standards und Best Practices, betreuen (mentoren) Ingenieure und Architekten und arbeiten eng mit Kunden und Stakeholdern zusammen, um Infrastrukturstrategien und Roadmaps zu definieren.

## Kernaufgaben

### KI/ML-Infrastrukturarchitektur

* Übernahme der Gesamtverantwortung für Architektur und Design der Infrastruktur für groß angelegte KI/ML-Systeme - vom ersten Konzept bis zur Implementierung und Bereitstellung.

* Entwurf der Infrastruktur für verteiltes KI/ML-Training, Inferenz und Model-Serving-Workloads.

* Architektur und Optimierung des gesamten Rechen-Stacks, einschließlich **Rechenleistung, GPUs/Beschleunigern, Netzwerktechnik, Speicher, Orchestrierung und Model-Serving**.

* Evaluierung von Architekturalternativen und Treffen fundierter Entscheidungen auf der Basis von Leistung, Skalierbarkeit, Zuverlässigkeit, Kosten, Sicherheit und Kundenanforderungen.

* Sicherstellung, dass die Infrastrukturarchitekturen mit vereinbarten geschäftlichen SLAs, technischen Standards und betrieblichen Anforderungen im Einklang stehen.

### GPU- und Distributed Computing

* Entwurf und Optimierung groß angelegter **GPU- und beschleunigerbasierter Cluster** für KI/ML-Workloads.

* Evaluierung und Auswahl geeigneter GPU-/Beschleunigertechnologien basierend auf den Anforderungen der Workloads.

* Entwurf von Hochleistungsnetzwerken und Interconnect-Architekturen für verteiltes Training.

* Architektur von Speicherlösungen, die KI/ML-Workloads mit hohem Durchsatz unterstützen.

* Identifizierung und Behebung von Infrastruktur-Engpässen, die sich auf Training, Inferenz, Durchsatz oder Skalierbarkeit auswirken. * Optimierung der Infrastruktur hinsichtlich Leistung, Energieverbrauch, Auslastung und Kosten.

### Cloud-KI/ML-Architektur

* Fungieren als technischer Experte für mindestens eine der großen Hyperscaler-Plattformen, wie z. B. **AWS, Microsoft Azure oder Google Cloud**.

* Anwendung fundierter Kenntnisse in den Bereichen Cloud-KI/ML-Dienste, Rechenplattformen, Beschleuniger (Accelerators), Netzwerk, Speicher, Orchestrierung und Preismodelle.

* Bewertung von Cloud-Architekturoptionen und Empfehlung von Lösungen, die den Anforderungen an Workload, Sicherheit, Leistung und Kosten entsprechen.

* Entwurf skalierbarer Cloud- und Hybrid-Infrastrukturen für KI/ML-Workloads auf Unternehmens- und Großskalenebene.

* Identifizierung von Möglichkeiten zur Optimierung der Cloud-Auslastung und der Infrastrukturkosten.

### Architekturbewertung und Governance

* Leitung von Bewertungen und Überprüfungen bestehender und geplanter KI/ML-Infrastrukturumgebungen.

* Identifizierung von Architekturlücken, technischen Risiken, Leistungsengpässen, Skalierbarkeitsproblemen und Optimierungspotenzialen.

* Festlegung von Strategien zur Problembehebung und Erarbeitung technischer Empfehlungen.

* Etablierung von Architekturstandards, Mustern (Patterns) und Best Practices für die KI-Infrastruktur.

* Dokumentation von Architekturentscheidungen, Annahmen, Abwägungen (Trade-offs) und technischen Begründungen.

* Sicherstellung der Einhaltung relevanter Sicherheits-, Regulierungs-, Governance- und Kundenstandards.

### Infrastruktur-Roadmap und Kapazitätsplanung

* Definition und Pflege der Technologie-Roadmap für die KI/ML-Infrastruktur.

* Entwicklung von Kapazitätsplänen unter Berücksichtigung der Anforderungen von Geschäftsbereichen, Produkten und KI/ML-Workloads.

* Prognose des Bedarfs an Rechenleistung, Speicher, Netzwerkkapazität und Beschleunigern.

* Entwicklung von Kostenmodellen für die Infrastruktur und Identifizierung von Möglichkeiten zur Kostenoptimierung.

* Planung der technologischen Weiterentwicklung, des Workload-Wachstums und der Plattform-Skalierbarkeit.

### Automatisierung, Bereitstellung und Betrieb

* Entwurf von Bereitstellungs- und Automatisierungsstrategien für eine zuverlässige, reproduzierbare und skalierbare KI/ML-Infrastruktur.

* Etablierung geeigneter **CI/CD- und Infrastructure-as-Code-Ansätze** für KI/ML-Plattformen und -Workloads.

* Unterstützung der automatisierten Bereitstellung von KI-Systemen, Modellen und Datenpipelines in Produktionsumgebungen.

* Definition von Betriebsprozessen zur Gewährleistung von Zuverlässigkeit, Skalierbarkeit und Reproduzierbarkeit.

* Etablierung von Strategien für Monitoring und Observability über Infrastruktur- und MLOps-Umgebungen hinweg.

* Definition und Überwachung von **SLAs**.

Free account
Stop reading job ads. Get the ones that fit.
One free account turns this page into a shortlist built around your stack, your level and your pay.
Match on every job. Stack, seniority, pay and location, scored against your profile.
661,119 open roles. Read straight off company career pages, refreshed every day.
Unlimited applications. Every one you send is tracked in one place, on-site or on a company board.
3 tailored CVs a month. Rewritten for the exact job you are applying to. Included free.
Create a free account Continue with Google
Free forever. No card. Under a minute.

Your match

How well do you fit this role?
Two answers are enough for a real match. No account needed.
Check my fit
Answers stay in this browser until you create an account.

Recommended for you based on this role

Similar stack
Same company
Stuttgart
$317k – $423k per year • Remote/Hybrid • TS/SCI • Full-Time • 10+ years exp • Herndon
AI/ML
AI Agents
OpenAI
DevOps
GCP
Azure
AWS
Apply
Cloud Engineer III 10 hours ago
$76k – $160k per year (Estimated) • Remote/Hybrid • Full-Time • 3+ years exp • Bachelor's Degree • Cleveland
AI/ML
AWS Bedrock
Amazon SageMaker
DevOps
Terraform
Puppet
Ansible
GCP
Chef
Azure
AWS
Apply
Sr. AI DevOps Engineer 11 hours ago
$129k – $180k per year • In office • Public Trust • Full-Time • 10+ years exp • Bachelor's Degree • Rockville
Python
Java
PowerShell
DevOps
CloudFormation
Azure
CI/CD
Windows Server
Git
AWS
Nginx
Amazon EC2
Incident Management
Amazon S3
IAM
Management
Agile
Scrum
Apply
$119k – $150k per year • Equity • In office • Full-Time • 5+ years exp • Boston
Python
JavaScript
Python
Flask
SQLAlchemy
FastAPI
Django
AI/ML
Copilot
Cursor
Claude Code
Frontend
Vue.js
Svelte
React.js
DevOps
Rest API
GitLab CI
CI/CD
Jenkins
AWS
Docker
Kubernetes
Apply
$22k – $63k per year (Estimated) • Remote/Hybrid • Full-Time • Bucharest
Python
SQL
PowerShell
Databases
PostgreSQL
PostGIS
DevOps
Azure
CI/CD
Jenkins
Configuration Management
Analytics
ETL/ELT
Management
Agile
SpaceTech
QGIS
GeoServer
Apply
$63k – $134k per year (Estimated) • In office • Contractor • Stockholm
SQL
C#
C++
C#
.NET
Databases
Apache Kafka
DevOps
CI/CD
Jenkins
Git
Docker
Kubernetes
Management
Scrum
Apply
$72k – $154k per year (Estimated) • In office • Contractor • Malmö
JavaScript
TypeScript
SQL
C#
C#
.NET
AI/ML
Model Context Protocol
Function Calling
AI Agents
Human-in-the-Loop
LLM Guardrails
Multi-Agent Systems
Frontend
GraphQL
React.js
styled-components
DevOps
Azure
CI/CD
Design
Figma
Apply
$40k – $119k per year (Estimated) • In office • Contractor • Gothenburg
Apply
$49k – $111k per year (Estimated) • In office • Contractor • Amsterdam
Apply
In office • Contractor • Västerås
Apply
$37k – $80k per year (Estimated) • In office • Full-Time • Essen • Dresden • Stuttgart • Hamburg • Mannheim
Apply
$29k – $57k per year (Estimated) • Remote • Full-Time • Stuttgart
Apply
$30k – $48k per year (Estimated) • Remote/Hybrid • Part-Time • Stuttgart
AI/ML
Midjourney
Design
Adobe Photoshop
Apply
$38k – $89k per year (Estimated) • In office • Full-Time • 2+ years exp • Berlin • Stuttgart • Hamburg • Munich
Apply
$34k – $52k per year (Estimated) • In office • Internship • Stuttgart
Apply
See all jobs
This is one of many
661,119 more open roles from verified company boards, updated every day.