KI-Infrastruktur-Entwicklung für Wissensmanagement
🏛 Ausgeschrieben von FERCHAU GmbHWir suchen einen erfahrenen Entwickler zur Konzeption und Implementierung einer lokalen KI-Infrastruktur für unternehmensweites Wissensmanagement. In diesem Projekt werden Sie eine sichere, datenschutzkonforme Lösung aufbauen, die Large Language Models (LLMs) optimal nutzt.
Ihre Aufgaben umfassen den Aufbau und Betrieb einer lokalen KI-Infrastruktur mit Fokus auf Datenschutz und Sicherheit. Sie integrieren interne Datenquellen über APIs und Datenbanken in KI-Anwendungen und implementieren moderne Inferenz-Frameworks wie vLLM, Ollama oder vergleichbare Lösungen. Dabei entwickeln Sie prototypische Use Cases wie semantische Suche und intelligente Dokumentensuche basierend auf Retrieval-Augmented Generation (RAG).
Ein weiterer Schwerpunkt liegt auf der Konzeption einer nachhaltigen, skalierbaren On-Premise-Architektur sowie dem Plattformbetrieb. Sie arbeiten an Microservices-Architekturen und stellen sicher, dass die Lösung produktionsreif ist.
Für diese Rolle benötigen Sie fundiertes Wissen zu Large Language Models und deren praktischen Einsatzmöglichkeiten. Erfahrung mit Inferenz-Frameworks wie vLLM, Ollama oder Light LLM ist erforderlich. Sie sollten sehr gute Python-Kenntnisse mitbringen sowie praktische Erfahrung mit Docker-Containerisierung. Kenntnisse in der API- und Datenbankintegration sowie RAG-Technologien sind wichtig. Verständnis für Datenschutz und sichere Systemarchitektur runden Ihr Profil ab.
Das Projekt läuft über 3–6 Monate mit möglicher Verlängerung. Der Umfang beträgt 5–10 Stunden pro Woche mit hohem Remote-Anteil und gelegentlichen Vor-Ort-Terminen. Start ist ab sofort.
Skills erklärt
- Large Language Models (LLMs)
- LLMs sind trainierte neuronale Netzwerke, die große Mengen an Textdaten verarbeitet haben und zur Textgenerierung, Analyse und Beantwortung von Fragen eingesetzt werden.
- Ollama
- Framework oder Tool zum lokalen Ausführen von großen Sprachmodellen auf dem eigenen Computer; wird für KI-Anwendungen ohne Cloud-Abhängigkeit genutzt.
- MCP
- Zertifizierungsprogramm von Microsoft für Cloud-Plattformen, das Fachkenntnisse in Microsoft-Technologien nachweist.
- Python
- Universelle Programmiersprache für Webentwicklung, Datenanalyse, Automatisierung und künstliche Intelligenz.
- Docker
- Software-Plattform zur Containerisierung, die Anwendungen mit ihren Abhängigkeiten in isolierten Umgebungen verpackt.
- API-Integration
- Verbindung von Softwaresystemen über standardisierte Schnittstellen zum Datenaustausch.
- Datenbanken
- Systeme zur strukturierten Speicherung, Verwaltung und Abfrage von großen Datenmengen; werden in praktisch allen IT-Anwendungen eingesetzt.
- RAG
- Technik, bei der ein KI-Modell externe Datenquellen abfragt, um seine Antworten mit aktuellen oder spezifischen Informationen zu ergänzen.
- Microservices-Architekturen
- Architekturmuster, bei dem eine Anwendung in viele kleine, unabhängige Services aufgeteilt wird, die über Schnittstellen kommunizieren. Ermöglicht flexible Skalierung und Wartung einzelner Komponenten.
- SAP
- Enterprise-Resource-Planning-System zur Verwaltung von Geschäftsprozessen wie Finanzen, Personal, Logistik und Produktion in Unternehmen.
- Confluence
- Atlassian-Softwaretool zur Erstellung, Verwaltung und gemeinsamen Bearbeitung von Dokumentationen und Wikis im Team.
- Datenschutz
- Fachbereich und Maßnahmen zum Schutz personenbezogener Daten vor unbefugtem Zugriff, Missbrauch und Verlust.
Als IT-Freelancer automatisch auf Projekte wie dieses bewerben
Nexus ist die KI-gestützte Plattform für IT-Freelancer, die täglich neue Projektausschreibungen analysiert und passgenaue Bewerbungstexte generiert – vollautomatisch, in Sekunden. Kein manuelles Schreiben mehr: Nexus liest die Ausschreibung, erkennt die gefragten Skills und erstellt einen individuellen Bewerbungstext, den du per Klick versendest.
- ✓ Projektausschreibungen direkt von Anbietern aus dem DACH-Raum
- ✓ KI-Bewerbungstext in unter 30 Sekunden – individuell auf jedes Projekt zugeschnitten
- ✓ Automatischer Versand per E-Mail + Anlage in Pipedrive
- ✓ Kostenlos starten – keine Kreditkarte erforderlich
Häufige Fragen zu Nexus
- Was ist Nexus und für wen ist es geeignet?
- Nexus richtet sich an selbstständige IT-Freelancer, die regelmäßig auf Projektausschreibungen antworten. Die Plattform automatisiert den gesamten Bewerbungsprozess – von der Analyse der Ausschreibung bis zum Versand der Bewerbung.
- Wie schreibt Nexus den Bewerbungstext?
- Nexus analysiert die Projektbeschreibung mit Claude (Anthropic) und gleicht die Anforderungen mit deinem hinterlegten Profil ab. Der generierte Text ist individuell, professionell und direkt versendbar – du kannst ihn vor dem Absenden noch anpassen.
- Welche Projektplattformen werden unterstützt?
- Nexus erhält Projekte direkt von Projektanbietern aus dem DACH-Raum – neue Ausschreibungen erscheinen automatisch in deiner Pipeline, ohne dass du Plattformen manuell durchsuchen musst.
- Kostet Nexus etwas?
- Der Einstieg ist dauerhaft kostenlos. Für professionelle Nutzung mit erweiterten Funktionen gibt es kostenpflichtige Pläne – ohne versteckte Kosten oder automatische Verlängerung.
Passende Freelancer
Profile die zu den Skills dieses Projekts passen
- Enterprise Architect | AI Platform Strategist | Technology Consultant100 €/h
Enterprise Architect und AI Platform Strategist mit über 25 Jahren Erfahrung in der Entwicklung, Architektur und Skalierung komplexer Softwareplattformen sowie der Integration moderner AI-Technologien in Enterprise-Umgebungen.
Nie wieder Bewerbungen schreiben.
Nexus matcht deine Skills und schreibt Bewerbungen automatisch.
Kostenlos registrieren →Keine Kreditkarte erforderlich
Tipp
Zeiterfassung & Projektverwaltung
Projekte, Stunden und Rechnungen in einer App. Flow ist die schlanke Lösung für IT-Freelancer und Agenturen – kostenlos starten.
Flow ausprobierenÄhnliche Projekte
- Photonics Process Integration Expert
- Data Scientist/KI-Entwickler (m/w/d) - Vision AI & Dokumentenverarbeitung
- AI Solution Architect (m/w/d)
- Data- und Test-Engineer für KI-Systeme
- Information Retrieval Engineer (m/w/x)
- Data Scientist / Machine Learning Engineer (m/w/d)
- AI Engineer - Agentic Workflow Automation
- Computer Vision & Machine Learning Engineer - Perception Systems
- AI4Dev Service Owner
- GenAI Engineer (Conversational AI, RAG & Agentic AI)
- Forward Deployed AI Engineer
- Senior AI Engineer - Enterprise AI Solutions
- Copilot/AI Enablement Specialist mit Copilot-Studio/Low-Code (m/w/d)
- RAG DevOps Engineer (m/w/d)
- Senior GenAI Engineer (Ref. #26270)
Tipp
Konferenzraum in Hamburg
Für das nächste Kunden- oder Teammeeting in Hamburg: vollausgestattet mit Beamer, Whiteboard und Videokonferenz – ab 49 €/h, direkt am Gänsemarkt.
Konferenzraum mieten