Saltar al contenido principal

Modelos

No hay niveles. GenKaKu sirve un modelo de texto a todos, más un modelo de imagen separado. Todos son sin censura.

Qwen3.8 27B Uncensored

  • Costo: cobrado por token, aproximadamente 1 crédito para un mensaje típico
  • IDs de modelo: qwen3.8-27b-uncensored, qwen3.8-27b-uncensored-think
  • Se ejecuta en trabajadores nativos a través de ollama — GPUs de consumidor, no un centro de datos
  • Sin censura — comportamiento de rechazo eliminado

Esto es lo que usa el chat, y lo que ejecuta c0mpute code. No hay nada que seleccionar: cada mensaje va al mismo modelo, y cada trabajador nativo en la red ejecuta la misma compilación.

Qué puede hacer:

  • Búsqueda web y herramientas — el modelo decide cuándo buscar, llama a la herramienta, y responde basado en los resultados con citas. A través de la API puedes pasarle tus propias funciones de la misma manera.
  • Visión — envíale una imagen y la lee. (Entrada de imagen. Crear imágenes es el modelo de imagen de abajo.)
  • Modo de pensamiento — cadena de pensamiento extendida antes de responder, para problemas más difíciles. No hay sobrecargo. Los tokens de pensamiento son tokens de salida, así que una respuesta con pensamiento cuesta más solo porque es más larga.

Generación de imágenes

  • Costo: 10 créditos por imagen
  • Chroma1-HD en trabajadores de imagen dedicados, sin censura

Disponible tanto como una herramienta que el modelo de texto llama cuando le pides una imagen, como un endpoint directo. Consulta Generación de imágenes.

Qué cuesta qué

El texto se cobra por token. Una tarifa cubre cada modelo de texto, así que el modelo que eliges cambia la respuesta, no el precio.

USD por 1M tokens
Entrada$0.15
Salida$0.90

Un crédito es $0.001. Las solicitudes se redondean hacia arriba a créditos enteros con un mínimo de 1, así que un mensaje típico de aproximadamente 1,200 tokens de entrada y 600 de salida cuesta aproximadamente 1 crédito.

QuéCréditos
Mensaje típicoaproximadamente 1
Imagen10

La longitud es el precio. Una pregunta corta cuesta menos que una larga, y una respuesta larga cuesta más que una corta. No hay cargo separado por pensamiento.

La mayoría de las personas nunca pagan por mensaje, porque un plan otorga créditos cada día. Los créditos también vienen de recargar con USDC a 500 créditos por dólar.

Cuando envías un mensaje mantenemos el máximo que podría costar, luego cobramos lo que realmente costó cuando la respuesta termina y devolvemos lo demás. Si un trabajo falla o te desconectas, todo el hold se reembolsa.

Qué significa "sin censura"

Los modelos de IA corporativos (ChatGPT, Claude, Gemini) están entrenados para rechazar ciertos temas. Pregunta sobre cualquier cosa que la empresa considere sensible y obtienes un rechazo. Estas no son características de seguridad — son políticas de contenido impuestas por corporaciones.

Las compilaciones sin censura que ejecuta GenKaKu han tenido este entrenamiento de rechazo eliminado. Responden a tus preguntas directamente sin restricciones impuestas por corporaciones.

Búsqueda web

La búsqueda web es dirigida por el modelo. El mismo modelo decide si una pregunta necesita información actual; cuando la necesita, el orquestador ejecuta la búsqueda (Brave Search API), extrae contenido de los primeros resultados, y se lo devuelve al modelo como resultado de herramienta. El modelo luego responde basado en contenido web real y actualizado, y cita sus fuentes.

Eso significa que puede responder preguntas sobre eventos recientes y buscar cosas, en lugar de adivinar desde datos de entrenamiento.