Skills
Wie es arbeiten soll.
Die Checklisten, Formate und Abläufe Ihres Teams als versionierte Anweisungen. Teilen Sie einen Skill mit Personen, Gruppen oder allen; veröffentlichen Sie eine neue Version, und jeder Chat und jeder Agent nutzt sie.
Das KI-System, das Ihre IT betreibtApache-2.0-Kern
Chat für alle, Agenten in Chrome und Office, SDKs für Ihre Entwickler und die Modelle auf Ihren eigenen GPUs. Wofür große Unternehmen ganze Abteilungen brauchen, betreibt Ihre IT als ein System.
$ pipx install fadenstack
$ faden deploy
Ein Linux-Server mit Docker. Ihre GPU-Maschinen kommen über die Konsole hinzu.
Warum ein System
Ein Team betreibt die GPUs, ein anderes das Gateway, ein drittes den Chat, und noch ein weiteres entscheidet, welche Daten wohin dürfen. Die meisten Organisationen haben diese Teams nicht. Fadenstack gibt Ihrer IT all das als ein System, auf Ihren eigenen Servern, gesteuert aus einer Konsole.
| Bereich | Womit Organisationen meist dastehen | Mit Fadenstack |
|---|---|---|
| Chat | Chatbot-Konten, Team für Team eingekauft | Ein Chat für alle, mit Modellen Ihrer Wahl |
| Agenten | In jeder Anwendung ein anderer Assistent mit eigenen Regeln | Agenten in Chrome und Office, die denselben Regeln folgen wie der Chat |
| Anwendungen | Jedes Projekt bindet eigene API-Schlüssel ein | Ein Endpunkt und ein SDK für jede Anwendung |
| Know-how | Prompts, zwischen Dokumenten und Chats hin- und herkopiert | Geteilte, versionierte Skills, mit einem Nachweis, welcher verwendet wurde |
| Personenbezogene Daten | Ein Richtliniendokument – und Hoffnung | Nach Ihrer Richtlinie maskiert, bevor ein Modell sie sieht |
| Modelle und GPUs | Ein GPU-Server, den irgendwann jemand eingerichtet hat | Maschinen, Cluster und Modelle, gesteuert aus der Konsole |
| Kontrolle | Getrennte Rechnungen und kein Audit-Trail | Nutzung, Kosten und Audit pro Anfrage, an einer Stelle |
Was jeder Teil Ihrer Organisation bekommt
Er funktioniert wie die Chat-Assistenten, die man bereits kennt, mit Ihren Dokumenten, den geteilten Skills Ihres Teams und den Tools, die die IT angebunden hat.
$ einen Skill nutzen, den Ihr Team geschrieben hat
Ein OpenAI-kompatibles /v1 und dazu Open-Source-SDKs für .NET und TypeScript, die Sitzungen, Tools und ein fertiges Chat-Panel mitbringen. Jede Anwendung erhält über diesen einen Endpunkt die Skills, das Wissen und die Tools der Organisation, unter denselben Regeln wie der Chat.
from openai import OpenAI
client = OpenAI(
base_url="https://ai.example.internal/v1",
api_key="<Ihr Fadenstack-Schlüssel>",
)
reply = client.chat.completions.create(
model="team-assistant",
messages=[{"role": "user",
"content": "Fasse Ticket 4471 zusammen"}],
)
print(reply.choices[0].message.content)
Benutzer und Rollen, Modelle und GPU-Maschinen, Skills, MCP-Server, Datenschutzregeln, Nutzung pro Benutzer und das Audit-Protokoll, an einer Stelle, auf Ihren Servern.

Agenten
Assistenten im Browser und in Office, kostenlos nutzbar. Sie antworten mit den Modellen Ihrer Organisation, über Ihren Fadenstack-Server, und sie fragen, bevor sie etwas ändern.

Liest die Seite, die Sie geöffnet haben, beantwortet Fragen dazu, liest PDFs, vergleicht Tabs und schreibt in Formulare und E-Mails, an denen Sie gerade arbeiten.

Ein Dokument zusammenfassen, ein Diagramm hinzufügen, einen Entwurf kommentieren. Standardmäßig wartet jede Änderung auf die Zustimmung des Nutzers, und die meisten lassen sich rückgängig machen.

Liest die Unterhaltung, entwirft die Antwort und überlässt Ihnen das Senden. Er sendet nie selbst etwas.
Welches Modell antwortet, wer den Agenten nutzen darf und welche Tools der App er ausführen darf.
Der Server hält die Regeln und die Nutzung; der Chatverlauf bleibt in der App.
Derselbe Assistent außerhalb von Browser und Office.
Einmal verwaltet
Jeder Chat und jeder Agent greift auf dieselben drei Dinge zurück, und die IT verwaltet jedes davon an einer Stelle.
Skills
Die Checklisten, Formate und Abläufe Ihres Teams als versionierte Anweisungen. Teilen Sie einen Skill mit Personen, Gruppen oder allen; veröffentlichen Sie eine neue Version, und jeder Chat und jeder Agent nutzt sie.
Wissen
Ihre Dokumente, vom Modell selbst durchsucht, mit der Quelle in der Antwort.
Tools
MCP-Server werden einmal auf dem Server registriert, gehostete oder Ihre eigenen, und jeder Agent, der es darf, kann sie aufrufen.
Agenten können auch eigene Tools mitbringen, etwa für das geöffnete Dokument oder für Dateien auf dem Rechner des Nutzers. Die Richtlinie jeder Sitzung entscheidet, wo Tools laufen.
Der Weg einer Anfrage
Chats, Agenten und Anwendungen nehmen alle denselben Weg durch Fadenstack, und jede Anfrage wird festgehalten: wer sie gesendet hat, welches Modell geantwortet hat, wo sie lief und welche Skills und Tools sie genutzt hat.
Limits greifen, und der Name des Modells findet seine Route.
Verlauf, die Skills des Teams und die erlaubten Tools kommen zur Anfrage hinzu.
Wo Ihre Richtlinie es vorsieht, werden personenbezogene Daten maskiert, bevor sie ein Modell erreichen.
Ihre Maschinen, Ihr Netzwerk oder ein Provider, den Sie zugelassen haben.
Auf dem Server oder auf der Seite des Nutzers; Ihre PII-Richtlinie gilt auch für ihre Ergebnisse.
Die Antwort wird zurückgestreamt; das Audit-Protokoll hält fest, was verwendet wurde.
Ihre Daten bleiben Ihre
Fadenstack ordnet jedes Modell danach ein, wo es läuft: auf Ihren Maschinen, in Ihrem privaten Netz oder bei einem externen Provider. Das Dashboard zeigt die Aufteilung, der Trace jede einzelne Anfrage.
Ansehen
Kurze Videos für jede Zielgruppe: die ganze Idee in neunzig Sekunden, ein Tag mit Fadenstack und die Schritte vom leeren Server zur ersten Antwort.
Loslegen
Ein Linux-Server betreibt Fadenstack, und er braucht keine GPU. Die Maschinen mit GPUs kommen über die Konsole hinzu.
$ pipx install fadenstack
$ faden deploy
✓ Docker and Compose v2 found
✓ Configuration written # zufällige Schlüssel und Datenbankpasswörter
✓ HTTPS with a certificate for this server
✓ Services started
Console https://ai.example.internal
API https://ai.example.internal/v1
# die Zeile aus Maschinen → Maschine hinzufügen
$ curl -fsSLO https://ai.example.internal/api/install/faden-agent.sh \
&& sudo sh faden-agent.sh --join https://ai.example.internal
✓ NVIDIA GPU found
✓ Agent running as a service
… Waiting for approval. Code on this machine: K7Q-4TD
✓ Approved in the console. Joined as gpu-01
Hugging Face durchsuchen › Chat-Modelle
an-open-chat-model
✓ Passt auf Ihren Cluster: 2 Maschinen, 2 GPUs
Einstellungen für dieses Modell ausgefüllt
Angeboten als team-assistant
[ Bereitstellen ]
# der Chat
https://ai.example.internal
# die Agenten: Chrome, Word, Excel, PowerPoint, Outlook
Server https://ai.example.internal
# Ihre Anwendungen: jeder OpenAI-Client
base_url "https://ai.example.internal/v1"
Dokumentation
help.fadenstack.com
Auch in jeder Installation unter /help enthalten, passend zu Ihrer Version.
developers.fadenstack.com
Alles, was Sie brauchen, um auf Fadenstack aufzubauen.
Editionen
Apache-2.0
Kostenlos
Der ganze Server, Open Source.
/v1-APIKostenlos nutzbar
Kostenlos
Für jeden Fadenstack-Server.
Kommerzielle Lizenz
Auf Anfrage
Für regulierte Teams, auf derselben Plattform.
Geplante Funktionen sind das, was wir als Nächstes bauen; Umfang und Zeitpunkt können sich ändern.
Editionen vergleichenWarum dieser Name
Der rote Faden ist der leitende Gedanke, der sich durch etwas hindurchzieht und es als Ganzes zusammenhält.
Die Wendung geht auf Goethes Die Wahlverwandtschaften (1809) zurück. Er beschreibt dort einen roten Faden, der in jedes Tau der englischen Royal Navy eingesponnen ist, „den man nicht herauswinden kann, ohne alles aufzulösen“, und an dem selbst kleine Stücke als Eigentum der Krone zu erkennen sind.
Fadenstack ist dieser Faden durch die KI Ihrer Organisation. Chat-Assistenten, Agenten, Daten, Modelle, Tools und Infrastruktur werden einmal verbunden, an einer Stelle geregelt und sind von Anfang bis Ende nachvollziehbar.
Auf einem Linux-Server installieren, eine GPU-Maschine über die Konsole hinzufügen und Ihre Leute einladen.