Как работает GenKaKu
Процесс
Пользователь → Оркестратор → Воркер → токены возвращаются → Пользователь
- Вы отправляете сообщение из интерфейса чата genkaku.app
- Оркестратор получает ваш запрос и находит воркер, обслуживающий нужную модель
- Воркер запускает инференс на своём GPU и передаёт токены обратно через оркестратор
- Вы видите ответ в реальном времени, слово за словом
Оркестратор
Оркестратор — это сервер на Node.js, использующий Socket.io для связи в реальном времени. Он обрабатывает:
- Аутентификацию — проверку пользователей и воркеров через Privy
- Очередь задач — управление входящими запросами и сопоставление их со свободными воркерами
- Реестр воркеров — отслеживание онлайн-статуса воркеров, их возможностей и текущей нагрузки
- Маршрутизацию — направление задач нужному типу воркера для запрошенной модели
- Выбор воркера — выбор свободного воркера для задачи (взвешенно-случайный по измеренным токенам/сек)
- Вызовы инструментов — запуск веб-поиска по запросу модели и возврат результатов
- Статистику — трансляцию сетевой статистики в реальном времени каждые 5 секунд
Оркестратор не хранит разговоры. Он маршрутизирует трафик и передаёт дальше.
Воркеры
Воркеры — это приложения для ПК, которые запускаются на вашей машине и обслуживают задачи инференса для сети GenKaKu. Скачайте приложение GenKaKu Worker, войдите в систему, и ваш GPU начнёт зарабатывать — без настройки через командную строку.
Воркер использует Ollama для обслуживания моделей, с поддержкой ускорения CUDA (NVIDIA), Metal (Apple Silicon) и Vulkan (AMD/Intel). Он запускает Qwen3.8 27B Uncensored — основную текстовую модель сети — и обрабатывает каждое сообщение в чате и каждый запрос API, маршрутизированный к нему.
Требования к оборудованию: NVIDIA GPU с 16GB+ памяти (рекомендуется 24GB), карта AMD с 24GB+ или Mac на Apple Silicon с 32GB+. Производительность зависит от оборудования, но ожидайте 25+ токенов в секунду на приличном GPU.
Когда воркер не обслуживает задачи, он работает в фоновом режиме в простое. Вы также можете запустить его в режиме виджета — компактный оверлей, показывающий загрузку GPU, доход в USDC и заработок в $GENKAKU. Встроенный учебный ассистент на базе локальной модели Ollama помогает устранять проблемы, не выходя из приложения.
Как подключается
- Вы открываете приложение GenKaKu Worker и входите через свой аккаунт GenKaKu
- Приложение регистрируется у оркестратора и объявляет возможности вашего GPU
- Оркестратор маршрутизирует задачи к вашему воркеру, когда он свободен и ваша модель соответствует запросу
- Ваш GPU выполняет инференс и передаёт токены обратно через оркестратор
- Вы зарабатываете USDC за каждую выполненную задачу — видно в панели приложения
Заработок
Воркеры зарабатывают USDC пропорционально выполненной работе. Ставка зависит от обслуживаемой модели и текущего спроса сети. Заработок начисляется в реальном времени и отображается как в приложении для ПК, так и в панели вашего аккаунта GenKaKu.
Награды
Помимо заработка в USDC, воркеры получают награды в $GENKAKU на основе качества обслуживания. Формула наград учитывает несколько факторов производительности:
Метрики производительности, увеличивающие награды:
- Токенов в секунду — более быстрые GPU генерируют больше токенов и получают бо́льшие награды
- Низкая задержка — быстрые времена отклика между вашим воркером и оркестратором
- Время работы — чем дольше вы находитесь онлайн и доступны, тем больше зарабатываете
- Процент выполнения задач — успешное завершение задач без ошибок или тайм-аутов
- Стабильность соединения — стабильное и надёжное сетевое подключение
- Постоянство — стабильная производительность со временем, а не случайные всплески
Факторы, снижающие награды:
- Разрыв соединения во время задачи
- Медленная генерация токенов
- Высокая задержка или нестабильная сеть
- Невыполненные задачи или задачи с превышением времени
- Частые отключения
Награды за простой: Даже когда задачи не назначаются, пребывание в онлайн-режиме приносит небольшую бонусную награду в $GENKAKU — сеть вознаграждает воркеров за поддержание мощности и готовность к обслуживанию.
Воркеры изображений
Воркеры изображений — это ещё один тип воркеров: независимые GPU, запускающие ComfyUI для генерации изображений. Они доступны как инструмент generate_image, который текстовая модель может вызвать, когда вы просите картинку, так и через API изображений — в обоих случаях воркер изображений рендерит результат.
Маршрутизация задач
| Полоса | Тип воркера | Модель |
|---|---|---|
Чат + qwen3.8-27b-uncensored | Воркер для ПК (Ollama) | Qwen3.8 27B Uncensored |
| Генерация изображений | ComfyUI | Chroma1-HD |
Выбор воркера
Когда задача готова, оркестратор рассматривает свободных воркеров, обслуживающих запрошенную модель, и выбирает одного взвешенно-случайным образом. Вес каждого воркера — его измеренная средняя скорость токенов/сек (с нижним порогом, чтобы даже самые медленные воркеры получали часть трафика). Более быстрые воркеры получают больше задач, но работа и заработок распределяются по всему пулу, а не всегда достаются самому быстрому воркеру.
Веб-поиск
Веб-поиск управляется моделью. Сама модель решает, когда вызывать инструмент web_search. Когда она это делает, оркестратор выполняет поиск (Brave Search API), передаёт результаты обратно модели как результат инструмента, и модель продолжает — это круговой запрос, а не предварительная загрузка. Затем модель отвечает, опираясь на реальный, актуальный веб-контент, и указывает источники.
Потоковая передача токенов
Ответы передаются в реальном времени. По мере генерации каждого токена воркером он отправляется через оркестратор пользователю немедленно. Не нужно ждать полного ответа — вы видите, как он пишется вживую, как в любом другом чат-ИИ, только вычисления происходят на чьём-то GPU через сеть.