LLM local - con la tecnología de Gemma

Moose puede pensar en
tu equipo.

¿Quieres una IA que nunca salga de tu escritorio? Moose ejecuta un modelo Gemma real justo en tu portátil, totalmente sin conexión - ilimitado, privado y gratis. Y es una función, no un requisito: pásate a gestionado o trae tu propia clave de OpenRouter cuando quieras que los modelos de frontera hagan el trabajo.

Funciona sin conexión. Compatible con Windows y macOS.

Hi, Moose · Chat Gemma 4B · local
redáctame una respuesta de FAQ concisa sobre "¿es privada la IA local?"
en ello. lo estoy procesando con Gemma aquí mismo - nada va a la nube.
Ejecutándose en tu equipo
$0
costo
0
tokens enviados
100%
en el dispositivo
$0
Por consulta, siempre
El modelo local no tiene factura por token. Chatea, haz briefs y redacta todo lo que quieras.
Ilimitado
Chats, con memoria
Moose tiene presente tu contexto y tus proyectos en cada conversación.
Nada
Sale de tu escritorio
En el modelo local, los prompts, el contexto y los borradores se quedan en disco. La nube siempre es tu elección explícita.
Elige tu tamaño

Un modelo que encaja en el portátil que ya tienes.

Gemma viene en tres tamaños. Empieza en pequeño con un equipo más antiguo, o carga el grande en una estación de trabajo para el análisis más profundo. El modelo se descarga una vez, y luego funciona totalmente sin conexión - y puedes cambiar en cualquier momento.

Se descarga en segundo plano, y luego funciona sin conexión para siempre.
Usa tu GPU cuando puede, tu CPU cuando no.
Cambia de tamaño cuando quieras - el costo se mantiene exactamente igual.
Elige el tamaño de tu modelo
Ligero
Gemma 2B
8 GB RAM · ~3.5 GB
Equilibrado
Gemma 4B
16 GB RAM · ~5.4 GB
Máximo
Gemma 26B
32 GB RAM · ~17 GB
Gemma 4B≈1.2s por respuesta

El valor predeterminado del día a día. Briefs e insights sólidos sin espera perceptible. La mayoría se queda aquí.

Mejor para
Trabajo del día a día
Necesita
16 GB RAM
Privado por defecto

Local significa local. Tu trabajo se queda en tu disco.

Cuando ejecutas el modelo local, la IA vive junto a tus archivos: los prompts, los borradores y el contexto nunca salen del equipo. La nube solo entra en juego a través de algo que configuras tú mismo: un plan gestionado, una clave de OpenRouter que añades, o un CMS que conectas para publicar.

Se queda en tu equipo
Cada prompt que escribes al modelo local
Tu contexto, tu voz de marca y tu memoria
Borradores, briefs y tu biblioteca
Los datos de Search Console que conectas
Sale solo si tú lo dices

Las cosas salen cuando eliges la nube: un plan gestionado en el que ejecutamos los modelos de frontera por ti, tu propia clave de OpenRouter o un CMS que conectas para publicar. Cada uno es voluntario.

Una tarea de plan gestionado - nuestra nube, sin claves que gestionar
Una tarea de frontera - a través de la clave de OpenRouter que añadiste
Una publicación - solo a un CMS que conectaste
Trae tu propia clave

¿Quieres un modelo de frontera en el circuito? Conecta tu clave.

Cuando un trabajo requiere ChatGPT, Claude o Gemini, conecta tu clave de OpenRouter y Moose enruta esa tarea concreta a través de ella. Le pagas a OpenRouter a la tarifa del proveedor - nunca un recargo para nosotros. ¿Prefieres cero configuración? El plan gestionado ejecuta modelos de frontera por ti, sin claves. En cualquier caso, el modelo local siempre está ahí, gratis.

Sin recargo, nunca. Tu clave de OpenRouter, facturada a las tarifas del proveedor.
Enrutado por tarea. Envía fuera solo los trabajos que necesitan potencia de frontera.
Tu clave se queda en local. Almacenada en tu equipo, nunca en el nuestro.
Modelos conectados
Hi, Moose - Local AI - Gemma 4
Siempre activo · gratis · privado
Predeterminado
OpenRouter · tu clave
Una sola clave · facturado por OpenRouter
Conectado
Enruta aChatGPTClaudeGemini+ más
Preguntas frecuentes

Preguntas frecuentes sobre privacidad y modelos de IA local

¿Cómo protege Hi, Moose mis datos?

Cuando usas el modelo local, tus prompts, contexto, borradores, voz de marca, memoria, biblioteca y datos conectados de Search Console se quedan en tu equipo. El modelo funciona junto a tus archivos y, una vez descargado, puede trabajar totalmente sin conexión. Los servicios en la nube solo se usan cuando los eliges expresamente.

¿Qué información sale de mi ordenador cuando uso la IA local?

En las tareas del modelo local no sale nada de tu ordenador. Solo se envía información cuando decides usar una acción en la nube, como un plan gestionado, enviar una tarea a través de una clave de OpenRouter que hayas añadido o publicar en un CMS que hayas conectado.

¿Puedo usar la IA de Hi, Moose sin costes por consulta?

Sí. El modelo local Gemma no tiene factura por token ni por consulta. Puedes chatear, crear briefs y redactar sin límites de uso local. Si decides enviar tareas concretas a través de OpenRouter, esas tareas las factura OpenRouter a la tarifa del proveedor.

¿Qué tamaños de modelo de IA local hay disponibles?

Hi, Moose ofrece Gemma en tres tamaños locales: Light Gemma 2B, Balanced Gemma 4B y Max Gemma 26B. Light está pensado para equipos antiguos con 8 GB de RAM, Balanced es la opción del día a día con 16 GB de RAM y Max es para análisis más profundos en estaciones de trabajo con 32 GB de RAM. Puedes cambiar de tamaño cuando lo necesites.

¿Puedo conectar ChatGPT, Claude o Gemini a Hi, Moose?

Sí. Añade tu propia clave de OpenRouter para enviar tareas seleccionadas a modelos de frontera como ChatGPT, Claude o Gemini. Tu clave se guarda en tu equipo, no en los servidores de Hi, Moose. También puedes elegir un plan gestionado para acceder a modelos de frontera sin gestionar ninguna clave, y seguir usando el modelo local gratis.

LLM local - con la tecnología de Gemma

Tu portátil puede hacer
el trabajo de pensar.

Gratis de descargar, uso local ilimitado, privado por defecto. Añade tu clave de OpenRouter o un plan gestionado cuando quieras potencia de frontera.

Descargar para MacDescargar para Windows