fadenstack

由您的 IT 部门运行的 AI 系统Apache-2.0 核心

一套 AI 系统,服务整个组织。

人人可用的聊天,Chrome 和 Office 中的智能体,面向开发者的 SDK,以及运行在您自己 GPU 上的模型。大公司要靠好几个部门才能做到的事,您的 IT 部门用一套系统就能运行。

$ pipx install fadenstack
$ faden deploy

一台装有 Docker 的 Linux 服务器。您的 GPU 机器从控制台加入。

三块板像 Fadenstack 标志那样叠放:最上面是聊天、智能体和应用,中间是 Fadenstack,最下面是您的 GPU 机器,一根线贯穿三层。
  1. 人员和应用聊天 · Chrome · Office · 您的应用
  2. Fadenstack统一端点 · 技能 · 知识 · 工具 · 策略
  3. 您的 GPU 机器您的模型 · 仅在您允许时使用外部提供商
  • 在德国开发
  • 运行在您的硬件上
  • 兼容 OpenAI 的 /v1
  • 控制台支持 EN · DE · FR · ES · 中文
  • Apache-2.0 核心

为什么是一套系统

大公司要靠好几个部门才能做到的事。

一个团队负责 GPU,另一个负责网关,再一个负责聊天,还有一个决定哪些数据可以去往哪里。大多数组织没有这些团队。Fadenstack 把这一切作为一套系统交给您的 IT 部门,运行在您自己的服务器上,通过一个控制台管理。

领域组织通常的现状使用 Fadenstack
聊天各团队分别购买的聊天机器人账号所有人共用一个聊天,使用您选择的模型
智能体每个应用里都有不同的助手,各有各的规则Chrome 和 Office 中的智能体,遵循与聊天相同的规则
应用每个项目各自配置自己的 API 密钥所有应用共用一个端点和一个 SDK
经验提示词在文档和聊天之间来回复制共享、有版本的技能,并记录用了哪一个
个人数据一份制度文件,外加侥幸心理按您的策略,在模型看到之前脱敏
模型和 GPU某人曾经搭好的一台 GPU 服务器机器、集群和模型,都在控制台中运维
监督账单各自分散,也没有审计记录每个请求的用量、成本和审计,集中在一处

组织中的各方能得到什么

三类人,一套系统。

面向所有人

运行在您自有模型上的聊天助手。

它用起来就像大家已经熟悉的聊天助手,并能使用您的文档、团队共享的技能以及 IT 部门接入的工具。

  • 项目、文件以及保持私密的历史记录
  • 输入 $ 即可使用团队编写的技能
  • 手机上也能用,支持五种语言
Fadenstack 聊天:一个 Python 问题,由组织自己集群上的模型回答。
聊天,由您自己机器上的模型回答
面向开发者

一个端点,外加用于智能体的 SDK。

一个兼容 OpenAI 的 /v1,以及适用于 .NET 和 TypeScript 的开源 SDK,提供会话、工具和现成的聊天面板。每个应用都通过这一个端点获得组织的技能、知识和工具,并遵循与聊天相同的规则。

  • OpenAI 客户端可用于聊天、模型和向量嵌入:只需更改地址和密钥
  • 智能体自带工具,这些工具在用户一侧运行
  • 文档和示例见 developers.fadenstack.com
您的应用 · python
from openai import OpenAI

client = OpenAI(
    base_url="https://ai.example.internal/v1",
    api_key="<您的 Fadenstack 密钥>",
)

reply = client.chat.completions.create(
    model="team-assistant",
    messages=[{"role": "user",
               "content": "总结 4471 号工单"}],
)
print(reply.choices[0].message.content)
面向 IT

一个控制台,管理一切。

用户和角色、模型和 GPU 机器、技能、MCP 服务器、隐私规则、每个用户的用量以及审计日志,集中在一处,运行在您的服务器上。

  • 一行命令加一个批准码,即可添加一台 NVIDIA 机器
  • 挑选模型;模型市场会告诉您它是否适配
  • 查看每个回答是在哪里计算的
管理仪表盘:所有请求都在内部处理,没有需要关注的事项,以及今天的关键指标。
管理仪表盘

智能体

Fadenstack,就在大家工作的地方。

浏览器和 Office 中的助手,可免费使用。它们通过您的 Fadenstack 服务器,使用组织的模型回答,并在更改任何内容之前先征求同意。

Chrome 侧边栏中的浏览器智能体,把一个维护页面总结成三个要点和一张表格。
Chrome

浏览器智能体

读取您打开的页面并回答相关问题,阅读 PDF,比较标签页,并写入您正在处理的表单或邮件。

Excel 智能体在添加图表之前先征求同意,然后报告它创建的图表。
Word · Excel · PowerPoint

Office 中的智能体

总结文档、添加图表、批注草稿。默认情况下,每项更改都要等用户确认,而且大多数更改可以撤销。

Outlook 智能体起草一封回复,留给用户审阅和发送。
Outlook

邮件智能体

阅读邮件会话,起草回复,留给您来发送。它从不自行发送任何内容。

由 IT 部门一次设置

由哪个模型回答、谁可以使用智能体,以及它可以运行应用的哪些工具。

对话保留在设备上

服务器保存规则和用量;聊天记录保留在应用中。

桌面智能体 开发中

同样的助手,用在浏览器和 Office 之外。

了解智能体的全部信息

一次管理

技能、知识和工具,服务每个聊天和智能体。

每个聊天和每个智能体都取用同样的三样东西,IT 部门在一处分别管理它们。

技能

怎么做。

团队的检查清单、格式和流程,作为有版本的指令保存。可共享给个人、组或所有人;发布新版本后,每个聊天和智能体都会使用它。

知识

知道什么。

您的文档,由模型自己检索,并在回答中注明来源。

工具

能做什么。

MCP 服务器只需在服务器上注册一次,无论是托管的还是您自己的,每个获得许可的智能体都可以调用。

在服务器上在用户一侧两者兼有

智能体也可以自带工具,例如打开的文档或用户电脑上的文件。每个会话的策略决定工具在哪里运行。

请求如何流转

顺着线索,追踪每个请求。

聊天、智能体和应用都沿同一条路径经过 Fadenstack,每个请求都会被记录:谁发送的、哪个模型回答的、在哪里运行,以及用到了哪些技能和工具。

  1. 1

    限额与路由

    应用限额,并根据模型名称找到路由。

  2. 2

    上下文

    历史记录、团队的技能和允许的工具加入请求。

  3. 3

    隐私

    在您的策略要求时,个人数据会在到达模型之前被脱敏。

  4. 4

    模型

    您的机器、您的网络,或您允许的提供商。

  5. 5

    工具

    在服务器上或在用户一侧运行;您的隐私策略也适用于工具返回的结果。

  6. 6

    回答与审计

    回答以流式方式返回;审计日志记录用到了什么。

示例隐私
您输入给王丽起草一封关于 4471 号发票的回复。
模型看到给<PERSON>起草一封关于 4471 号发票的回复。

数据归您所有

知道每个回答是在哪里计算的。

Fadenstack 按运行位置对每个模型分类:您的机器、您的私有网络,或外部提供商。仪表盘显示各部分占比;追踪记录显示每个请求。

  • 只有在您添加并允许后,才会使用外部提供商
  • 默认使用 HTTPS,服务器与您的机器之间使用双向 TLS
  • 在德国开发,运行在您自己的服务器上
安全与隐私
AI 流量请求在哪里处理
最近 7 天
95% 内部
  • 您的机器82%
  • 私有网络13%
  • 外部提供商5%
  • 未知0%
控制台视图 · 示例数据

观看

安装之前,先看一看。

为每类读者准备的短视频:九十秒讲清整体思路,Fadenstack 的一天,以及从一台空服务器到第一个回答的步骤。

随版本发布推出 时长 1:30
面向所有人

90 秒了解 Fadenstack

随版本发布推出 时长 3:00
用户和采购方

Fadenstack 的一天

随版本发布推出 时长 7:00
运维人员

从安装到首个回答

全部六个视频

开始使用

从一台空服务器到第一个回答。

一台 Linux 服务器运行 Fadenstack,它不需要 GPU。带 GPU 的机器从控制台加入。

服务器 · bash
$ pipx install fadenstack
$ faden deploy
✓ Docker and Compose v2 found
✓ Configuration written  # 随机密钥和数据库密码
✓ HTTPS with a certificate for this server
✓ Services started

  Console  https://ai.example.internal
  API      https://ai.example.internal/v1
系统要求和完整指南

文档

帮助面向使用它的人,开发文档面向基于它构建的人。

help.fadenstack.com

帮助

也内置于每个安装中,位于 /help,对应您运行的版本。

  • 使用:聊天、技能、浏览器和 Office 智能体
  • 管理:用户、模型、智能体、隐私规则、用量
  • 运维:安装、升级、机器、HTTPS、备份
打开帮助

developers.fadenstack.com

开发者

基于 Fadenstack 构建所需的一切。

  • 兼容 OpenAI 的 API 及其参考文档
  • .NET 和 TypeScript SDK:智能体、工具、聊天面板
  • MCP 服务器和技能格式
打开开发者文档

版本

核心开源,上层智能体免费。

Apache-2.0

社区版

免费

完整的服务器,开源。

  • 聊天、控制台和 /v1 API
  • 技能、知识和 MCP 服务器
  • 个人数据脱敏和数据驻留视图
  • GPU 机器、集群和模型
  • 角色、治理规则和审计日志
开始使用

免费使用

智能体

免费

适用于每一台 Fadenstack 服务器。

  • 适用于 Chrome 的浏览器智能体
  • Windows 上的 Word、Excel、PowerPoint 和 Outlook
  • 桌面智能体 开发中
  • 开源 SDK,用于构建您自己的智能体
查看智能体

商业许可

企业版 计划中

按需报价

面向受监管的团队,基于同一平台。

  • 单点登录
  • 针对提示词、回答和工具调用的内容策略
  • 限制每个智能体的工具可以做什么
  • 带导出功能的审计员视图
  • 附带 SLA 的支持服务
联系我们

计划中的功能是我们接下来要构建的内容;其范围和时间可能会有变化。

比较各版本
从正面看

名字的由来

der rote Faden

在德语中,der rote Faden(红线)指贯穿某件事物始终、把它串联成一个整体的主线。

这个说法源自歌德的 Die Wahlverwandtschaften(《亲和力》,1809 年)。他写到,英国皇家海军的每一根绳索里都织进了一根红线:不把绳索拆散就无法把它抽出来,哪怕只是一小段绳索,也能认出它属于王室。

Fadenstack 就是贯穿您组织 AI 的那根红线。聊天助手、智能体、数据、模型、工具和基础设施只需连接一次,在一处统一管控,并且端到端可追溯。

用一套系统运行组织的 AI。

安装在一台 Linux 服务器上,从控制台添加一台 GPU 机器,然后邀请您的同事。