云端智能体
完全运行在供应商的服务器上。上手方便,但您的数据、上下文和密钥都在供应商那里,开关也在:一次故障、一次条款变更或一个被停用的账户,都会让智能体停摆,无论原因为何。
本地优先的 AI 智能体运行在您自己的电脑上,而不是供应商的云端。这意味着什么、与云端及自托管方案有何差别、为何关乎隐私、成本与控制权,都在这里。
本地优先不只是程序从哪里启动的问题。一个智能体有四个活动部件:负责规划决策的控制循环、逐步积累的记忆、运行的工具,以及用来思考的语言模型。在 Veyllo(VAF)中,前三者始终运行在您自己的硬件上。只有模型这一处,由您在本地与托管之间选择。这一划分正是与云端智能体的全部区别:在那里,四者都在供应商手里。
运行智能体的三种方式,以及各自的数据在哪里。
完全运行在供应商的服务器上。上手方便,但您的数据、上下文和密钥都在供应商那里,开关也在:一次故障、一次条款变更或一个被停用的账户,都会让智能体停摆,无论原因为何。
运行在您运维的基础设施上,通常是一台您管理的服务器。控制权在您这边,但服务器也要您来运行和维护。
运行在您自己的电脑上,在自己的窗口里。安装程序为您配好本地服务器和账户,数据留在您手中。没有需要开通或维护的远程基础设施。这是 Veyllo 的默认运行方式。
本地优先与自托管有交集:两者的控制权都在您这边。本地优先特指智能体运行在您所在之处、您的设备上。用 Veyllo 两者皆可:本地运行,或把 harness 自托管到您自己的服务器上。
本地优先不等于一个人用。就连桌面应用也只需一个开关即可向网络开放,无需单独安装服务器。您的电脑、家里的闲置机器或公司服务器成为主机,局域网内所有人通过 HTTPS 访问。
vaf server on),VAF 即可在局域网内通过 HTTPS 访问。普通桌面安装就够了,不需要单独的服务器。本地优先智能体的其他一切都已定型。真正由您做的决定是这一个,而且以后随时能改。
Veyllo 把语言模型变成一个在本地干活的智能体:跨会话记忆的持久向量记忆、完整工具集(网页、代码、文件、浏览器)加上您通过 MCP 接入的一切、可分派的子智能体,以及沙箱中的代码执行。用本地模型运行,或在需要云端后端时指向托管的 OpenAI 兼容 Veyllo API。开源,AGPL-3.0,另有商业许可证可选。
控制循环、记忆和工具都运行在您的设备上;只有当您选择托管模型时,模型才可能在别处。云端智能体把这一切都放在供应商的服务器上,包括每次请求的上下文。
在控制权归谁上两者相同,在工作发生在哪里上不同。自托管把软件搬到您管理的服务器上;本地优先把它放到您面前的电脑上,无需开通服务器。Veyllo 两者皆可,自托管的主机还能服务整个团队。
不必。Veyllo 是本地优先的:您可以把智能体连同模型完全运行在自己的电脑上。托管的 Veyllo API 是可选项:如果您不想自己跑模型,它提供 VAF 所需的模型(文本、视觉与语音)。
能。打开网络共享后,VAF 即可在局域网内通过 HTTPS 访问,普通桌面安装也一样。每个人用自己的账户登录,记忆和任务相互隔离;一个主机服务所有人,没有按席位订阅。
能。Veyllo API 兼容 OpenAI。把任意 OpenAI SDK 或 HTTP 客户端指向 api.veyllo.app/v1,使用您的 Veyllo 密钥即可。支持对话与视觉。
能。VAF 已发布到 PyPI:pip install --pre vaf 安装核心运行时,您可以在框架之上构建自己的 AI 智能体、工具和解决方案,包括您自己的 harness。服务器或记忆栈等可选组件以同样方式安装,VAF 文档中的嵌入指南有逐步讲解。VAF 处于 alpha 阶段期间需要 --pre 参数。
Veyllo Agentic Framework(VAF)双许可:开源使用适用 AGPL-3.0,需要不同条款的团队可选商业许可证。
Veyllo 运行在 macOS、Windows 和 Linux 上:桌面应用、服务器或终端均可。