LLM local - com a tecnologia Gemma

O Moose consegue pensar
na sua máquina.

Quer IA que nunca sai da sua secretária? O Moose corre um modelo Gemma real mesmo no seu portátil, totalmente offline - ilimitado, privado e gratuito. E é uma funcionalidade, não uma exigência: escolha um plano gerido ou traga a sua própria chave OpenRouter sempre que quiser modelos de fronteira a pensar.

Corre offline. Funciona no Windows e macOS.

Hi, Moose · Conversa Gemma 4B · local
esboça-me uma resposta de FAQ concisa sobre "a ia local é privada"
já vai. estou a correr isto pelo Gemma mesmo aqui - nada vai para a nuvem.
A correr na sua máquina
$0
custo
0
tokens enviados
100%
no dispositivo
$0
Por consulta, sempre
O modelo local não tem conta por token. Converse, faça briefings e rascunhos à vontade.
Ilimitado
Conversas, com memória
O Moose tem em mente o seu contexto e projetos em todas as conversas.
Nada
Sai da sua secretária
No modelo local, prompts, contexto e rascunhos ficam em disco. A nuvem é sempre a sua escolha explícita.
Escolha o seu tamanho

Um modelo que cabe no portátil que já tem.

O Gemma vem em três tamanhos. Comece pequeno numa máquina mais antiga, ou carregue o grande numa estação de trabalho para a análise mais profunda. O modelo descarrega uma vez e depois corre totalmente offline - e pode mudar a qualquer momento.

Descarrega em segundo plano, corre offline para sempre depois disso.
Usa a sua GPU quando pode, o seu CPU quando não pode.
Mude de tamanho quando quiser - o custo mantém-se exatamente o mesmo.
Escolha o tamanho do seu modelo
Leve
Gemma 2B
8 GB de RAM · ~3,5 GB
Equilibrado
Gemma 4B
16 GB de RAM · ~5,4 GB
Máx
Gemma 26B
32 GB de RAM · ~17 GB
Gemma 4B≈1,2s por resposta

A predefinição do dia a dia. Briefings e análises fortes sem espera percetível. A maioria das pessoas fica por aqui.

Ideal para
Trabalho do dia a dia
Precisa de
16 GB de RAM
Privado por predefinição

Local significa local. O seu trabalho fica no seu disco.

Quando corre o modelo local, a IA vive ao lado dos seus ficheiros: prompts, rascunhos e contexto nunca saem da máquina. A nuvem só entra em cena através de algo que você mesmo configurou: um plano gerido, uma chave OpenRouter que adicionou, ou um CMS que liga para publicar.

Fica na sua máquina
Cada prompt que escreve ao modelo local
O seu contexto, voz da marca e memória
Rascunhos, briefings e a sua biblioteca
Dados do Search Console que liga
Só sai se você mandar

As coisas saem quando você escolhe a nuvem: um plano gerido em que corremos os modelos de fronteira por si, a sua própria chave OpenRouter ou um CMS que liga para publicar. Cada um é opcional.

Uma tarefa de plano gerido - a nossa nuvem, sem chaves para gerir
Uma tarefa de fronteira - através da chave OpenRouter que adicionou
Uma publicação - só para um CMS que ligou
Traga a sua própria chave

Quer um modelo de fronteira no ciclo? Ligue a sua chave.

Quando um trabalho pede ChatGPT, Claude ou Gemini, ligue a sua chave OpenRouter e o Moose encaminha essa tarefa através dela. Paga à OpenRouter à tarifa do fornecedor - nunca uma margem para nós. Prefere zero configuração? O plano gerido corre modelos de fronteira por si, sem chaves. De qualquer forma, o modelo local está sempre lá, gratuito.

Sem margem, nunca. A sua chave OpenRouter, faturada à tarifa do fornecedor.
Encaminhamento por tarefa. Envie para fora só os trabalhos que precisam de potência de fronteira.
A sua chave fica local. Guardada na sua máquina, nunca na nossa.
Modelos ligados
Hi, Moose - Local AI - Gemma 4
Sempre ativo · gratuito · privado
Predefinição
OpenRouter · a sua chave
Uma única chave · faturado pela OpenRouter
Ligado
Encaminha paraChatGPTClaudeGemini+ mais
LLM local - com a tecnologia Gemma

O seu portátil consegue
fazer o raciocínio.

Gratuito para descarregar, uso local ilimitado, privado por predefinição. Adicione a sua chave OpenRouter ou um plano gerido sempre que quiser potência de fronteira.

Descarregar para MacDescarregar para Windows