SEC.00//LLM-HUB.SYS // UNIDADE DE IA PRIVADA

IA que funciona
no modo avião.

Mais de 15 modelos de IA rodando 100% no seu celular. Chat, imagens, vídeo, música, código — zero sinal, zero contas, zero rastreamento.

MODO AVIÃO
REDELINK: ONLINE
NÚCLEONÚCLEO NO DISPOSITIVO: EM EXECUÇÃO
ESPÉCIME AO VIVO // FLUXO DE TOKENS0 tok/s
$ escreva um haicai sobre áreas sem sinal
▊
fluxo de tokens simulado — a inferência acontece no seu dispositivo
SEC.00B // INSPETOR DE PACOTES

Toda requisição de saída. Bloqueada.

Veja o app tentar ligar para casa. Não há casa para ligar.

0 TRACKERS/0 ACCOUNTS/0 BYTES SENT
OUTBOUND FIREWALL // LIVE
▊
SEC.02//TESTES DE CAMPO
01Ferramenta em destaque: Gerador de imagem

Gere imagens incríveis, 100% no dispositivo

Experimente a magia do Stable Diffusion sendo executado totalmente offline no seu celular. Impulsionado por compiladores nativos de NPU e GPU para inferência ultra-rápida.

01.1
Geração offline 100% privada
Prompts, sementes e imagens geradas permanecem estritamente no armazenamento do seu dispositivo local. Zero solicitações a servidores externos.
01.2
Acelerado por Qualcomm NPU e GPU
Otimizado para aceleradores móveis (CPU/GPU/NPU) utilizando motores de alta velocidade MNN e QNN para chips Snapdragon.
01.3
Ponto de controle Absolute Reality SD1.5
Gere belas artes, fotorrealistas e altamente detalhadas offline com modelos de alta fidelidade eficientes em recursos.
01.4
Sem assinaturas, arte infinita
Sem limites diários de tokens, sem filas de espera e sem barreiras premium. Gere quantas imagens quiser, quando quiser.
Stable Diffusion 1.5GPU/NPU ativadoSem servidores
REC ● OFFLINE
02Ferramenta em destaque: Vibes Coder

Projete aplicativos e sites, pré-visualize em tempo real

Um ambiente completo de programação móvel impulsionado por modelos locais. Escreva descrições em linguagem natural e assista a páginas web dinâmicas e funcionais se renderizarem diante dos seus olhos — sem servidor em nuvem.

02.1
Pré-visualizações instantâneas de HTML/JS/CSS
Escreva descrições, gere código frontend completo e execute-o em um sandbox local seguro com pré-visualização em tempo real.
02.2
Modelos de código 100% no dispositivo
Aproveite a inteligência de programação local alimentada pelos modelos quantizados de última geração rodando nativamente no seu hardware.
02.3
Espaço de testes puramente local
Sem dependências externas, zero consumo de dados móveis e privacidade absoluta. Programe e execute com segurança 100% offline.
02.4
Prototipagem rápida e iterativa
Faça ajustes na hora. Peça adições (como 'adicionar um interruptor' ou 'mudar para modo escuro') e veja as atualizações instantaneamente.
Sandbox HTML/CSS/JSProgramador LLM no dispositivoPré-visualização offline
REC ● OFFLINE
03Ferramenta em destaque: Agente de IA

Execute comandos Termux, Controle aplicações e mapas

Um agente de IA autónomo no dispositivo para Android e iOS. Gere e execute comandos shell no Termux, visualize mapas, componha mensagens e gira o calendário—100% offline.

03.1
Execução de comandos Termux
Gere scripts CLI e execute comandos shell diretamente no terminal integrado da aplicação.
03.2
Mapas e localizações interativas
Pesquise localizações, veja coordenadas e exiba mapas interativos a qualquer momento.
03.3
Automação de SMS e mensagens
Escreva e envie mensagens de texto e notificações de forma autónoma via APIs locais do Android.
03.4
Gestão de calendário no dispositivo
Crie, pesquise e atualize eventos no calendário sem utilizar servidores externos.
Executor Shell TermuxMapas interativosSMS e mensagensAutomação de calendário
REC ● OFFLINE
04Ferramenta em Destaque: Gerador de Música

Gere música no dispositivo, totalmente offline

Execute o Google Magenta Realtime 2 no iOS ou o Stable Audio Small no Android e gere música no dispositivo.

04.1
Google Magenta Realtime 2 (iOS)
Gere áudio expressivo em tempo real e composições musicais diretamente no Apple Silicon.
04.2
Stable Audio Small (Android)
Síntese de som ultra-rápida e geração de áudio de alta qualidade otimizada para dispositivos móveis.
04.3
100% no dispositivo e privado
Toda a síntese musical é executada offline. Zero requisições ao servidor, total privacidade.
04.4
Síntese de áudio em tempo real
Gere faixas de música de alta qualidade instantaneamente com aceleração por GPU.
Google Magenta Realtime 2Stable Audio Small100% No dispositivo
REC ● OFFLINE
SEC.03//MANIFESTO DE MODELOS

Baixe uma vez. Rode para sempre.

Mais de 15 modelos, quantizados para o seu bolso. Escolha seus pesos, mantenha-os no dispositivo.

Gemma-3529MB
Llama-3.21.2GB
Phi-4 Mini3.67GB
IBM Granite 4.07B
LiquidAI LFM1.2B
Ministral-33B
Whisper ASRLEVE
Kokoro TTSLEVE
Gemma-3529MB
Llama-3.21.2GB
Phi-4 Mini3.67GB
IBM Granite 4.07B
LiquidAI LFM1.2B
Ministral-33B
Whisper ASRLEVE
Kokoro TTSLEVE
Gemma-3 1B
GOOGLE
Modelos de texto otimizados para celular com aceleração de GPU. Múltiplas quantizações e janelas de contexto (1.2k-4k)
INT4 - 529MB · INT8 - 1005MB-1024MBTEXTO
Gemma-3 GGUF Multimodal
GOOGLE
Modelos multimodais GGUF com projetores de visão para aceleração de CPU/GPU/NPU
4B (3.0GB) · 12B (7.7GB)VISÃO
Gemma-3n Multimodal
GOOGLE
Modelos multimodais com recursos de texto, visão e áudio. Ativação seletiva de parâmetros
E2B (3.15GB) · E4B (4.33GB)VISÃO
Llama-3.2 (LiteRT)
META
Modelos INT8 da Meta para inferência no dispositivo com contexto de 4k
1B (2.01GB) · 3B (5.11GB)TEXTO
Llama-3.2 GGUF
META
Modelos Llama em formato GGUF com contexto de 128k e suporte a CPU/GPU/NPU
1B & 3B - Multiple quantizationsTEXTO
IBM Granite 4.0 H-Tiny
IBM
Modelo empresarial compacto com janela de contexto de 128k e múltiplas quantizações
7B - Q2_K to f16 (2.59GB-13.9GB)TEXTO
IBM Granite 4.0 H-Small
IBM
Modelo empresarial de alta qualidade com janela de contexto de 128k
32B - Q2_K to f16 (11.8GB-64.4GB)TEXTO
Phi-4 Mini
MICROSOFT
Modelo eficiente da Microsoft para raciocínio avançado com suporte a GPU em dispositivos de 8GB+
INT8 (3.91GB)TEXTO
LFM-2.5 1.2B Instruct
LIQUIDAI
Modelo de instruções eficiente da LiquidAI com contexto de 128k. Disponível nos formatos GGUF e ONNX
GGUF & ONNX variantsTEXTO
LFM-2.5 1.2B Thinking
LIQUIDAI
Modelo de raciocínio com modo 'thinking' e contexto de 128k. Disponível em GGUF e ONNX
GGUF & ONNX variantsTEXTO
LFM-2.5 VL 1.6B
LIQUIDAI
Modelo de visão-linguagem com suporte a entrada de texto e imagem com contexto de 128k
GGUF with vision projectorsVISÃO
Ministral-3 3B
MISTRALAI
Modelo de instruções multimodal com suporte a visão e contexto de 262k. Disponível em GGUF e ONNX
GGUF & ONNX variantsVISÃO
Absolute Reality SD1.5
STABLE DIFFUSION
Modelo de geração de imagens para criar imagens a partir de prompts de texto
MNN (CPU) · QNN (NPU)IMAGEM
Gecko-110M
GOOGLE
Modelo de embeddings compacto para o sistema de memória RAG com várias opções de dimensões
64D-1024D embeddingsRAG
EmbeddingGemma-300M
GOOGLE
Embeddings de texto de alta qualidade para recuperação RAG aprimorada
High-quality embeddingsRAG
Whisper ASR
OPENAI
Modelo de reconhecimento automático de fala (ASR) de última geração para converter voz/áudio em texto offline
Highly lightweight quantizationsTEXTO
Kokoro TTS
KOKORO
Modelo de texto para fala (TTS) de última geração para síntese de voz altamente natural no dispositivo
Extremely lightweight & efficientTEXTO
SEC.05//FIELD MANUAL

12 ferramentas. Zero sinal necessário.

Toda ferramenta abaixo roda totalmente offline. Escolha sua zona morta.

SCENARIO A//TÚNEL
01
Chat de IA
Conversas multiturno com mais de 15 modelos de IA. Memória RAG, pesquisa web e leitura automática por voz (TTS).
02
Transcritor
Converta voz ou áudio em texto offline usando Whisper ASR e modelos Gemma.
03
Detector de golpes
Analise textos, imagens ou links para identificar possíveis golpes com avaliação de risco por IA.
SCENARIO B//AVIÃO
04
Tradutor
Traduza texto, imagens (OCR) e áudio em mais de 50 idiomas. Funciona de forma totalmente offline.
05
Gerador de imagem
Gere imagens a partir de descrições de texto com Stable Diffusion — acelerado por GPU/NPU.
06
Gerador de vídeo
Crie vídeos de IA a partir de descrições de texto ou imagens no dispositivo — totalmente offline.
SCENARIO C//PORÃO
07
Vibes Coder
Ambiente completo de desenvolvimento no dispositivo. Escreva uma descrição e pré-visualize HTML/JS/CSS instantaneamente em um sandbox seguro.
08
Auxiliar de escrita
Gramática, estilo, paráfrase, ajuste de tom e geração de código — tudo no dispositivo.
09
creAItors
Crie personalidades de IA personalizadas e poderosas — de narradores piratas a arquitetos de sistemas completos.
SCENARIO D//ROAMING
10
VibeVoice
Chat de voz de IA mãos livres com conversas naturais, alimentado por Whisper ASR e Kokoro TTS para entrada/saída de voz em tempo real.
11
Agente de IA
Agente autónomo no dispositivo para executar comandos Termux, exibir mapas interativos, enviar mensagens e gerir o calendário.
12
Gerador de Música
Execute o Google Magenta Realtime 2 no iOS ou o Stable Audio Small no Android e gere música no dispositivo.
13
Upscaler de Imagem
Aumente a resolução e melhore imagens no dispositivo — totalmente offline.
▸ 100% PRIVADO▸ SEM NECESSIDADE DE INTERNET▸ ZERO COLETA DE DADOS▸ CÓDIGO ABERTO▸ ACELERADO POR GPU/NPU
SEC.06//BOOT SEQUENCE

Do download ao offline em três comandos.

Baixe os pesos uma vez. Todo o resto acontece no seu hardware.

llmhub — zsh
$ llmhub pull gemma-3n-e4b
# download .task weights from HuggingFace — once
$ llmhub load --backend litert
# load into MediaPipe LLM Inference API
$ llmhub chat
# local inference on CPU/GPU — 0 bytes leave the device
$ ▊
SEC.08//ESTUDO DE CASO
Estudo de caso em destaque | Apoiado pela Y Combinator

Destaque na RunAnywhere:
De Android para iOS em seis semanas

Leia o estudo de caso oficial da RunAnywhere (apoiada pela YC) sobre como o LLM Hub levou mais de 15 modelos de IA 100% no dispositivo para o iOS.

Apoiado pela YCSDK RunAnywhereNo iOS em 6 semanas
signal.caseStudy.alt
SEC.09//FAQ
FAQ

Perguntas Frecuentes

Tudo o que você precisa saber sobre o LLM Hub, rodando de forma 100% privada no dispositivo.

SEC.10//TRANSMITIR

Comece a usar IA privada hoje mesmo

Código aberto. Sem contas. Sem rastreamento. Apenas IA potente sendo executada inteiramente no seu dispositivo Android ou iOS.

SEM CONTAS · SEM RASTREAMENTO · CÓDIGO ABERTO