技能
怎么做。
团队的检查清单、格式和流程,作为有版本的指令保存。可共享给个人、组或所有人;发布新版本后,每个聊天和智能体都会使用它。
由您的 IT 部门运行的 AI 系统Apache-2.0 核心
人人可用的聊天,Chrome 和 Office 中的智能体,面向开发者的 SDK,以及运行在您自己 GPU 上的模型。大公司要靠好几个部门才能做到的事,您的 IT 部门用一套系统就能运行。
$ pipx install fadenstack
$ faden deploy
一台装有 Docker 的 Linux 服务器。您的 GPU 机器从控制台加入。
为什么是一套系统
一个团队负责 GPU,另一个负责网关,再一个负责聊天,还有一个决定哪些数据可以去往哪里。大多数组织没有这些团队。Fadenstack 把这一切作为一套系统交给您的 IT 部门,运行在您自己的服务器上,通过一个控制台管理。
| 领域 | 组织通常的现状 | 使用 Fadenstack |
|---|---|---|
| 聊天 | 各团队分别购买的聊天机器人账号 | 所有人共用一个聊天,使用您选择的模型 |
| 智能体 | 每个应用里都有不同的助手,各有各的规则 | Chrome 和 Office 中的智能体,遵循与聊天相同的规则 |
| 应用 | 每个项目各自配置自己的 API 密钥 | 所有应用共用一个端点和一个 SDK |
| 经验 | 提示词在文档和聊天之间来回复制 | 共享、有版本的技能,并记录用了哪一个 |
| 个人数据 | 一份制度文件,外加侥幸心理 | 按您的策略,在模型看到之前脱敏 |
| 模型和 GPU | 某人曾经搭好的一台 GPU 服务器 | 机器、集群和模型,都在控制台中运维 |
| 监督 | 账单各自分散,也没有审计记录 | 每个请求的用量、成本和审计,集中在一处 |
组织中的各方能得到什么
它用起来就像大家已经熟悉的聊天助手,并能使用您的文档、团队共享的技能以及 IT 部门接入的工具。
$ 即可使用团队编写的技能
一个兼容 OpenAI 的 /v1,以及适用于 .NET 和 TypeScript 的开源 SDK,提供会话、工具和现成的聊天面板。每个应用都通过这一个端点获得组织的技能、知识和工具,并遵循与聊天相同的规则。
from openai import OpenAI
client = OpenAI(
base_url="https://ai.example.internal/v1",
api_key="<您的 Fadenstack 密钥>",
)
reply = client.chat.completions.create(
model="team-assistant",
messages=[{"role": "user",
"content": "总结 4471 号工单"}],
)
print(reply.choices[0].message.content)
用户和角色、模型和 GPU 机器、技能、MCP 服务器、隐私规则、每个用户的用量以及审计日志,集中在一处,运行在您的服务器上。

智能体
浏览器和 Office 中的助手,可免费使用。它们通过您的 Fadenstack 服务器,使用组织的模型回答,并在更改任何内容之前先征求同意。

读取您打开的页面并回答相关问题,阅读 PDF,比较标签页,并写入您正在处理的表单或邮件。

总结文档、添加图表、批注草稿。默认情况下,每项更改都要等用户确认,而且大多数更改可以撤销。

阅读邮件会话,起草回复,留给您来发送。它从不自行发送任何内容。
由哪个模型回答、谁可以使用智能体,以及它可以运行应用的哪些工具。
服务器保存规则和用量;聊天记录保留在应用中。
同样的助手,用在浏览器和 Office 之外。
一次管理
每个聊天和每个智能体都取用同样的三样东西,IT 部门在一处分别管理它们。
技能
团队的检查清单、格式和流程,作为有版本的指令保存。可共享给个人、组或所有人;发布新版本后,每个聊天和智能体都会使用它。
知识
您的文档,由模型自己检索,并在回答中注明来源。
工具
MCP 服务器只需在服务器上注册一次,无论是托管的还是您自己的,每个获得许可的智能体都可以调用。
智能体也可以自带工具,例如打开的文档或用户电脑上的文件。每个会话的策略决定工具在哪里运行。
请求如何流转
聊天、智能体和应用都沿同一条路径经过 Fadenstack,每个请求都会被记录:谁发送的、哪个模型回答的、在哪里运行,以及用到了哪些技能和工具。
应用限额,并根据模型名称找到路由。
历史记录、团队的技能和允许的工具加入请求。
在您的策略要求时,个人数据会在到达模型之前被脱敏。
您的机器、您的网络,或您允许的提供商。
在服务器上或在用户一侧运行;您的隐私策略也适用于工具返回的结果。
回答以流式方式返回;审计日志记录用到了什么。
数据归您所有
Fadenstack 按运行位置对每个模型分类:您的机器、您的私有网络,或外部提供商。仪表盘显示各部分占比;追踪记录显示每个请求。
观看
为每类读者准备的短视频:九十秒讲清整体思路,Fadenstack 的一天,以及从一台空服务器到第一个回答的步骤。
开始使用
一台 Linux 服务器运行 Fadenstack,它不需要 GPU。带 GPU 的机器从控制台加入。
$ pipx install fadenstack
$ faden deploy
✓ Docker and Compose v2 found
✓ Configuration written # 随机密钥和数据库密码
✓ HTTPS with a certificate for this server
✓ Services started
Console https://ai.example.internal
API https://ai.example.internal/v1
# 来自“机器 → 添加机器”的命令
$ curl -fsSLO https://ai.example.internal/api/install/faden-agent.sh \
&& sudo sh faden-agent.sh --join https://ai.example.internal
✓ NVIDIA GPU found
✓ Agent running as a service
… Waiting for approval. Code on this machine: K7Q-4TD
✓ Approved in the console. Joined as gpu-01
搜索 Hugging Face › 聊天模型
an-open-chat-model
✓ 适配您的集群:2 台机器,2 块 GPU
设置 已按此模型填好
提供名称 team-assistant
[ 托管 ]
# 聊天
https://ai.example.internal
# 智能体:Chrome、Word、Excel、PowerPoint、Outlook
服务器 https://ai.example.internal
# 您的应用:任何 OpenAI 客户端
base_url "https://ai.example.internal/v1"
版本
Apache-2.0
免费
完整的服务器,开源。
/v1 API免费使用
免费
适用于每一台 Fadenstack 服务器。
商业许可
按需报价
面向受监管的团队,基于同一平台。
计划中的功能是我们接下来要构建的内容;其范围和时间可能会有变化。
比较各版本名字的由来
在德语中,der rote Faden(红线)指贯穿某件事物始终、把它串联成一个整体的主线。
这个说法源自歌德的 Die Wahlverwandtschaften(《亲和力》,1809 年)。他写到,英国皇家海军的每一根绳索里都织进了一根红线:不把绳索拆散就无法把它抽出来,哪怕只是一小段绳索,也能认出它属于王室。
Fadenstack 就是贯穿您组织 AI 的那根红线。聊天助手、智能体、数据、模型、工具和基础设施只需连接一次,在一处统一管控,并且端到端可追溯。