Modality-First
连接,创造。

连接文字、图像、声音与视频,搭建自己的 AI 工作流。

开源内核 · 自选模型 · 支持自行部署

文本
图像
音频
三维
视频
结果也是材料,可以继续连接。
一个工作流 / 四步

一份文档,接着做。

放入文档。

文档留在画布上,可重复使用。

提取文字。

提取文字,接入下一步。

从这里分两路。

一份文本,同时生成摘要和语音。

再接入一张图。

音频配上角色图像,生成说话视频。

工作流示意 · 需配置对应插件滚动展开工作流

先想能做什么,
再选用什么模型。

换一个模型,不必重搭整条流程。

为什么 TongFlow 从模态出发 →
你想从什么开始?
从这里开始 转换 继续延伸
文本
生成文本
文本
生成图像
图像
语音合成
音频

能力示例;运行需配置兼容插件。

基本操作

添加、转换、组合、拆分。

添加

输入文字、文件或链接。

转换

在图像、文字、视频之间转换。

组合

把图像和声音组合成视频。

拆分与批量

拆成多个部分,再逐项处理。

向下滚动,看连接如何变化

按要做的事来连接。

01

文档摘要与朗读

文档 文本 摘要 音频
02

图像转视频或三维

图像 转换 视频 / 三维
03

视频分段与转录

视频 片段 音频 文本

MODALITY-FIRST

材料、能力、模型,分别组织。

结果,也是新的起点

上传和生成的材料,都能继续连接。

能力在前,模型在后

切换兼容模型,保留已有流程。

人与 Agent,共用一种结构

在画布上搭建,也能让 Agent 生成并继续编辑。

向下滚动,看连接如何变化

图像提供外观,视频提供动作。

用兼容的动作迁移插件,把两份材料组合成视频。

查看源代码
TongFlow 画布中,一张猫的图像与一段舞蹈参考视频连接到动作迁移节点
播放示例

云版、自托管,或通过代码构建。

共享开源内核,按需连接插件与供应商。

TongFlow 云版

配置 API 密钥或 Modal 账户,即可运行。

进入工作台

与 Agent 一起构建

用 TongFlow 包或 DSH 插件构建,在画布上编辑。

了解 DSH 插件
下载 macOS / Windows 版 ↗桌面版连接云工作台,需要联网使用。

开始前,你可能想知道

TongFlow 是什么?

TongFlow 是一款用于搭建多模态 AI 工作流的开源创造工具。你可以在画布上连接文字、图像、音频、视频、三维和文档,完成信息提取、转换、生成与组合。每一步通过兼容插件及其模型或处理程序执行,可使用云工作台,也可自行部署。

Modality-first 是什么意思?

以文字、图像、声音等信息形态作为基本材料,用能力连接它们,再由模型实现这些能力。不同工作流因此可以共用一套构建方式。

任意内容都能直接连接吗?

连接需要符合每个能力的输入输出类型,运行还需要兼容的插件。设计允许自由组合,当前能执行哪些步骤则取决于已有能力。

它只能生成图片和视频吗?

不止生成。理解图像、提取文字、转录语音、拆分视频、组合材料,也都是这套体系中的操作。你可以按自己的目标搭建流程。

运行工作流需要准备什么?

使用云工作台或自行部署应用,再配置所选插件需要的凭据。Modal 插件需要 Modal 账户,API 插件需要对应供应商的密钥。

费用如何计算?

云工作台收取订阅费,模型 API 和 GPU 用量由你的供应商另行计费。TongFlow 不出售生成积分。订阅价格和试用规则见定价页。

定价 →