LLM local - com a tecnologia Gemma

O Moose consegue pensar
na sua máquina.

Quer IA que nunca sai da sua secretária? O Moose corre um modelo Gemma real mesmo no seu portátil, totalmente offline - ilimitado, privado e gratuito. E é uma funcionalidade, não uma exigência: escolha um plano gerido ou traga a sua própria chave OpenRouter sempre que quiser modelos de fronteira a pensar.

Corre offline. Funciona no Windows e macOS.

Hi, Moose · Conversa Gemma 4B · local
esboça-me uma resposta de FAQ concisa sobre "a ia local é privada"
já vai. estou a correr isto pelo Gemma mesmo aqui - nada vai para a nuvem.
A correr na sua máquina
$0
custo
0
tokens enviados
100%
no dispositivo
$0
Por consulta, sempre
O modelo local não tem conta por token. Converse, faça briefings e rascunhos à vontade.
Ilimitado
Conversas, com memória
O Moose tem em mente o seu contexto e projetos em todas as conversas.
Nada
Sai da sua secretária
No modelo local, prompts, contexto e rascunhos ficam em disco. A nuvem é sempre a sua escolha explícita.
Escolha o seu tamanho

Um modelo que cabe no portátil que já tem.

O Gemma vem em três tamanhos. Comece pequeno numa máquina mais antiga, ou carregue o grande numa estação de trabalho para a análise mais profunda. O modelo descarrega uma vez e depois corre totalmente offline - e pode mudar a qualquer momento.

Descarrega em segundo plano, corre offline para sempre depois disso.
Usa a sua GPU quando pode, o seu CPU quando não pode.
Mude de tamanho quando quiser - o custo mantém-se exatamente o mesmo.
Escolha o tamanho do seu modelo
Leve
Gemma 2B
8 GB de RAM · ~3,5 GB
Equilibrado
Gemma 4B
16 GB de RAM · ~5,4 GB
Máx
Gemma 26B
32 GB de RAM · ~17 GB
Gemma 4B≈1,2s por resposta

A predefinição do dia a dia. Briefings e análises fortes sem espera percetível. A maioria das pessoas fica por aqui.

Ideal para
Trabalho do dia a dia
Precisa de
16 GB de RAM
Privado por predefinição

Local significa local. O seu trabalho fica no seu disco.

Quando corre o modelo local, a IA vive ao lado dos seus ficheiros: prompts, rascunhos e contexto nunca saem da máquina. A nuvem só entra em cena através de algo que você mesmo configurou: um plano gerido, uma chave OpenRouter que adicionou, ou um CMS que liga para publicar.

Fica na sua máquina
Cada prompt que escreve ao modelo local
O seu contexto, voz da marca e memória
Rascunhos, briefings e a sua biblioteca
Dados do Search Console que liga
Só sai se você mandar

As coisas saem quando você escolhe a nuvem: um plano gerido em que corremos os modelos de fronteira por si, a sua própria chave OpenRouter ou um CMS que liga para publicar. Cada um é opcional.

Uma tarefa de plano gerido - a nossa nuvem, sem chaves para gerir
Uma tarefa de fronteira - através da chave OpenRouter que adicionou
Uma publicação - só para um CMS que ligou
Traga a sua própria chave

Quer um modelo de fronteira no ciclo? Ligue a sua chave.

Quando um trabalho pede ChatGPT, Claude ou Gemini, ligue a sua chave OpenRouter e o Moose encaminha essa tarefa através dela. Paga à OpenRouter à tarifa do fornecedor - nunca uma margem para nós. Prefere zero configuração? O plano gerido corre modelos de fronteira por si, sem chaves. De qualquer forma, o modelo local está sempre lá, gratuito.

Sem margem, nunca. A sua chave OpenRouter, faturada à tarifa do fornecedor.
Encaminhamento por tarefa. Envie para fora só os trabalhos que precisam de potência de fronteira.
A sua chave fica local. Guardada na sua máquina, nunca na nossa.
Modelos ligados
Hi, Moose - Local AI - Gemma 4
Sempre ativo · gratuito · privado
Predefinição
OpenRouter · a sua chave
Uma única chave · faturado pela OpenRouter
Ligado
Encaminha paraChatGPTClaudeGemini+ mais
Perguntas frequentes

Perguntas frequentes sobre privacidade e modelos da IA local

Como é que a Hi, Moose protege os meus dados?

Quando usa o modelo local, os seus prompts, contexto, rascunhos, voz de marca, memória, biblioteca e dados ligados da Search Console ficam no seu computador. O modelo trabalha ao lado dos seus ficheiros e, depois de descarregado, pode funcionar totalmente offline. Os serviços na nuvem só são usados quando os escolhe explicitamente.

Que informação sai do meu computador quando uso a IA local?

Nas tarefas do modelo local, nada sai do seu computador. Só é enviada informação quando opta por uma ação na nuvem, como usar um plano gerido, encaminhar uma tarefa através de uma chave OpenRouter que adicionou ou publicar num CMS que ligou.

Posso usar a IA da Hi, Moose sem custos por pedido?

Sim. O modelo local Gemma não tem qualquer fatura por token ou por pedido. Pode conversar, criar briefings e escrever sem limites de utilização local. Se optar por encaminhar tarefas específicas através da OpenRouter, essas tarefas são faturadas pela OpenRouter à tarifa do fornecedor.

Que tamanhos de modelo de IA local estão disponíveis?

A Hi, Moose oferece o Gemma em três tamanhos locais: Light Gemma 2B, Balanced Gemma 4B e Max Gemma 26B. O Light foi pensado para computadores mais antigos com 8 GB de RAM, o Balanced é a opção do dia a dia com 16 GB de RAM e o Max serve para análises mais profundas em estações de trabalho com 32 GB de RAM. Pode mudar de tamanho sempre que precisar.

Posso ligar o ChatGPT, o Claude ou o Gemini à Hi, Moose?

Sim. Adicione a sua própria chave OpenRouter para encaminhar as tarefas que quiser para modelos de fronteira como o ChatGPT, o Claude ou o Gemini. A sua chave fica guardada no seu computador, não nos servidores da Hi, Moose. Também pode escolher um plano gerido para aceder a modelos de fronteira sem gerir qualquer chave, mantendo o modelo local disponível gratuitamente.

LLM local - com a tecnologia Gemma

O seu portátil consegue
fazer o raciocínio.

Gratuito para descarregar, uso local ilimitado, privado por predefinição. Adicione a sua chave OpenRouter ou um plano gerido sempre que quiser potência de fronteira.

Descarregar para MacDescarregar para Windows