Koncepcja

Agenci AI local-first

Agent AI local-first działa na Twoim własnym komputerze, a nie w chmurze dostawcy. Wyjaśniamy, co to znaczy, czym różni się od konfiguracji chmurowych i self-hostowanych i dlaczego ma znaczenie dla prywatności, kosztów i kontroli.

Co właściwie działa lokalnie?

Local-first to nie tylko pytanie, gdzie program startuje. Agent ma cztery ruchome części: pętlę sterowania, która planuje i decyduje; pamięć, która narasta; narzędzia, które uruchamia; i model językowy, którym myśli. W Veyllo (VAF) trzy pierwsze zawsze działają na Twoim sprzęcie. Jedyne miejsce wyboru między lokalnym a hostowanym to model. Ten podział to cała różnica względem agenta chmurowego, u którego wszystkie cztery są u dostawcy.

Różnica

Chmura, self-hosting, local-first

Trzy sposoby uruchomienia agenta — i gdzie w każdym z nich mieszkają Twoje dane.

Agent chmurowy

Działa w całości na serwerach dostawcy. Łatwo zacząć, ale dane, kontekst i klucze są u niego — wyłącznik też: awaria, zmiana regulaminu albo zawieszone konto zatrzymują agenta, niezależnie od powodu.

Agent self-hostowany

Działa na infrastrukturze, którą prowadzisz — zwykle na serwerze pod Twoją opieką. Kontrola jest po Twojej stronie, ale serwer też: to Ty go utrzymujesz.

Agent local-first

Działa na Twoim własnym komputerze, we własnym oknie. Instalator przygotuje lokalny serwer i konto, a dane zostają u Ciebie. Zero zdalnej infrastruktury do stawiania i pilnowania. Tak Veyllo działa domyślnie.

Local-first i self-hosting się przecinają: w obu kontrola jest po Twojej stronie. Local-first oznacza konkretnie, że agent działa tam, gdzie Ty — na Twoim urządzeniu. Z Veyllo możesz i tak, i tak: lokalnie albo self-hostując harness na własnym serwerze.

Lokalnie nie znaczy w pojedynkę

Jeden host, cały Twój zespół.

Local-first nie znaczy jednoosobowo. Nawet aplikacja desktopowa otwiera się na sieć jednym przełącznikiem, bez osobnej instalacji serwera. Twój komputer, zapasowa maszyna w domu albo firmowy serwer staje się hostem, a wszyscy w sieci lokalnej łączą się po HTTPS.

Server
Udostępnianie jednym przełącznikiem. Przestaw przełącznik w aplikacji (albo wykonaj vaf server on) — i VAF jest dostępny w Twojej sieci po HTTPS. Wystarczy zwykła instalacja desktopowa, osobny serwer nie jest potrzebny.
Osobne konto dla każdego. Każdy ma własną, odizolowaną przestrzeń: pamięć, zadania i ustawienia osobno. Nikt nie widzi cudzych.
Bez opłat za użytkownika. Jedna instancja obsługuje cały zespół albo dom. Uruchamiasz raz, zamiast płacić za każdą osobę.
Dlaczego to ważne

Co Ci to daje.

Prompty, które nigdzie nie podróżują. Tekstu, który nie opuszcza komputera, nie da się logować, przechowywać, użyć do treningu ani wydać na żądanie. Z modelem lokalnym dotyczy to całego łańcucha przetwarzania, nie tylko zapisu.
Między Tobą a pracą nie stoi dostawca. Nikt nie podniesie cen, nie wycofa modelu, na którym polegasz, nie zmieni limitów ani nie zawiesi konta. Konfiguracja, która działa dziś, działa i za rok — z tymi samymi wagami modelu.
Prąd zamiast tokenów. Model lokalny nie wystawia rachunku za tokeny. Długie konteksty, powtarzane przebiegi i nocne partie kosztują tyle, co komputer na biegu jałowym — dlatego zadania cykliczne i wieloetapowe stają się osiągalne.
Działa bez połączenia. W pociągu albo w zamkniętej sieci agent pracuje dalej na modelu lokalnym — z pamięcią i plikami włącznie.
Jedyny prawdziwy wybór

Model lokalny czy hostowany?

Cała reszta w agencie local-first jest już ustalona. Oto decyzja, która naprawdę należy do Ciebie — i którą można później zmienić.

Model lokalny. Działa na Twoim GPU albo CPU. Nic nie opuszcza komputera, nie ma rachunku za tokeny; szybkość i jakość zależą od sprzętu. Małe modele dobrze radzą sobie z codziennymi szkicami, streszczeniami i plikami; wymagające rozumowanie chce mocnego GPU.
Model hostowany. Agent nadal działa lokalnie — na zewnątrz wychodzi tylko wywołanie modelu. Czołowe modele stają się dostępne bez kupowania sprzętu, rozliczane za tokeny; prompt i załączone pliki trafiają do dostawcy modelu.
Oba — przełączane zadaniem. Większość konfiguracji kończy jako mieszanka: model lokalny do rutyny i spraw poufnych, hostowany do twardych orzechów. Zmiana to jedna linijka konfiguracji, więc wybór nigdy nie jest ostateczny.
Jak robi to Veyllo

Co Veyllo dokłada nad modelem.

Veyllo zamienia model językowy w agenta pracującego lokalnie: trwała pamięć wektorowa pamiętająca między sesjami, pełen zestaw narzędzi (sieć, kod, pliki, przeglądarka) plus wszystko, co podłączysz przez MCP, subagenci do delegowania i wykonywanie kodu w sandboksie. Uruchom na modelu lokalnym albo wskaż hostowane, zgodne z OpenAI Veyllo API, gdy chcesz zaplecza w chmurze. Open source, AGPL-3.0, dostępna licencja komercyjna.

FAQ

Pytania i odpowiedzi.

Czym jest agent AI local-first?

Pętla sterowania, pamięć i narzędzia działają na Twoim urządzeniu; gdzie indziej może być tylko model — jeśli wybierzesz hostowany. Agent chmurowy trzyma to wszystko na serwerach dostawcy, łącznie z kontekstem każdego zapytania.

Czy local-first to to samo co self-hosting?

Pokrywają się w tym, kto ma kontrolę, różnią w tym, gdzie dzieje się praca. Self-hosting przenosi oprogramowanie na serwer pod Twoją opieką; local-first stawia je na komputerze przed Tobą, bez żadnego serwera. Veyllo potrafi jedno i drugie, a self-hostowany host obsłuży cały zespół.

Czy żeby korzystać z Veyllo, muszę wysyłać dane do chmury?

Nie. Veyllo jest local-first: agenta możesz uruchomić w całości na własnym komputerze, z modelami włącznie. Hostowane Veyllo API jest opcją: dostarcza modele, na których działa VAF (tekst, obraz, mowa), jeśli nie chcesz prowadzić własnych.

Czy z jednej instalacji Veyllo może korzystać kilka osób?

Tak. Włącz udostępnianie w sieci, a VAF będzie dostępny w Twojej sieci lokalnej po HTTPS — nawet ze zwykłej instalacji desktopowej. Każdy ma własne konto z odizolowaną pamięcią i zadaniami; jeden host obsługuje wszystkich bez opłat za użytkownika.

Czy z Veyllo API mogę używać SDK OpenAI?

Tak. Veyllo API jest zgodne z OpenAI. Skieruj dowolne SDK OpenAI albo klienta HTTP na api.veyllo.app/v1 i użyj swojego klucza Veyllo. Obsługiwane są czat i obraz.

Czy mogę budować własnych agentów AI na VAF?

Tak. VAF jest na PyPI: pip install --pre vaf instaluje rdzeń środowiska, a na frameworku budujesz własnych agentów, narzędzia i rozwiązania — łącznie z własnym harnessem. Dodatki, jak serwer czy stos pamięci, instalują się tak samo, a przewodnik osadzania w dokumentacji VAF prowadzi krok po kroku. Flaga --pre jest potrzebna, póki VAF jest w wersji alfa.

Na jakiej licencji jest Veyllo?

Veyllo Agentic Framework (VAF) ma podwójną licencję: AGPL-3.0 dla użycia open source oraz licencję komercyjną dla zespołów, które potrzebują innych warunków.

Jakie systemy operacyjne są obsługiwane?

Veyllo działa na macOS, Windows i Linuksie — jako aplikacja desktopowa, na serwerze albo z terminala.

Agenci AI local-first — wyjaśniamy · Veyllo