SEC.00//LLM-HUB.SYS // 私有AI单元

飞行模式下
依然运行的AI。

15+ 个AI模型100%在手机本地运行。聊天、图像、视频、音乐、代码——零信号、零账号、零追踪。

飞行模式
网络连接:在线
核心端侧核心:运行中
实时样本 // TOKEN流0 tok/s
$ 写一首关于信号盲区的俳句
▊
模拟的token流——推理在您的设备上进行
SEC.00B // 数据包检查器

每一次对外请求。均被拦截。

看着应用试图打电话回家吧——根本没有家可打。

0 TRACKERS/0 ACCOUNTS/0 BYTES SENT
OUTBOUND FIREWALL // LIVE
▊
SEC.02//实地测试
01精品工具推荐:AI 图像生成

生成绝美画作,100% 离线安全

在手机上直接运行 Stable Diffusion。依托先进的本地 NPU 和 GPU 编译器,实现闪电般快速的边缘端推理。

01.1
100% 隐私安全的离线生成
您的输入提示词、随机种子(Seed)和生成的画作全部保存在本地设备上。绝不向外部服务器发送任何请求。
01.2
骁龙 NPU 与 GPU 专属加速
针对移动端加速器(CPU/GPU/NPU)进行了深度优化,完美适配骁龙芯片的 MNN 和 QNN 高速底层后端。
01.3
Absolute Reality SD1.5 精品权重
使用超低硬件功耗的精品高保真模型权重,离线生成细节生动、光影真实的超写实艺术画作。
01.4
完全免费,无限量创作
没有每天的生图额度限制,无需排队等待,没有订阅付费墙。随时随地,无限生图。
Stable Diffusion 1.5GPU/NPU 加速已启用无需云端服务器
REC ● 离线
02精品工具推荐:Vibes Coder

手机上的全功能沙盒,所见即所得

基于本地大模型的移动端全功能编程小助手。通过自然语言下达指令,眼见为实地看网页组件在您眼前动态渲染成型 — 无需云端服务器开发包。

02.1
HTML/JS/CSS 页面实时预览
通过自然语言交互即时生成前端代码,在安全的本地沙盒中一秒渲染出可运行、可交互的网页。
02.2
100% 离线本地编程模型
搭载尖端的轻量级量化代码大模型,直接调用设备本机的全部硬件算力,运行稳定高效。
02.3
纯本地极致隐私沙盒
零外部网络依赖,完全不消耗任何手机移动流量。100% 绝对安全的本地开发环境。
02.4
极速迭代,所说即所得
随时调整需求。可以说 '添加一个夜间模式切换开关' 或 '将主色调改为墨绿色',网页即时刷新更新。
HTML/CSS/JS 本地沙盒本地大模型代码助手完全离线预览
REC ● 离线
03重磅功能:AI 智能体

运行 Termux 命令, 操控应用与地图

专为 Android 与 iOS 打造的端侧自律 AI 智能体。可在 Termux 内生成并执行 Shell 命令、动态渲染位置地图、撰写与发送短信、管理日历日程—100% 离线运行。

03.1
Termux 终端命令执行
在内置终端环境中生成 CLI 脚本并直接执行 Shell 命令。
03.2
交互式位置与地图
查找位置、查看坐标并按需动态渲染交互式地图视图。
03.3
短信与消息自动化
通过 Android 本地 API 自主撰写并发送短信与系统通知。
03.4
端侧日历日程管理
无需任何外部服务器,在设备本地创建、查找和更新日历事项与提醒。
Termux 脚本执行器交互式地图短信与消息日历日程自动化
REC ● 离线
04特色工具:音乐生成器

端侧离线生成高质量音乐

在 iOS 上运行 Google Magenta Realtime 2 或在 Android 上运行 Stable Audio Small,全本地生成音乐。

04.1
Google Magenta Realtime 2 (iOS)
在 Apple 芯片上实时生成富有表现力的音频与音乐创作。
04.2
Stable Audio Small (Android)
专为移动设备优化的超快速声音合成与高品质音频生成。
04.3
100% 端侧隐私安全
所有音乐合成均在本地离线运行,无服务器请求,保障创作隐私。
04.4
实时音频合成
借助 GPU 加速,即刻生成高品质音乐曲目。
Google Magenta Realtime 2Stable Audio Small100% 端侧运行
REC ● 离线
SEC.03//模型清单

下载一次。永久运行。

15+ 个模型,为口袋而量化。选择你的权重,保存在本地设备上。

Gemma-3529MB
Llama-3.21.2GB
Phi-4 Mini3.67GB
IBM Granite 4.07B
LiquidAI LFM1.2B
Ministral-33B
Whisper ASR轻量
Kokoro TTS轻量
Gemma-3529MB
Llama-3.21.2GB
Phi-4 Mini3.67GB
IBM Granite 4.07B
LiquidAI LFM1.2B
Ministral-33B
Whisper ASR轻量
Kokoro TTS轻量
Gemma-3 1B
GOOGLE
针对移动设备优化的文本模型,支持 GPU 加速。多种量化与上下文窗口 (1.2k-4k)
INT4 - 529MB · INT8 - 1005MB-1024MB文本
Gemma-3 GGUF Multimodal
GOOGLE
配备视觉投影器的 GGUF 多模态模型,支持 CPU/GPU/NPU 加速
4B (3.0GB) · 12B (7.7GB)视觉
Gemma-3n Multimodal
GOOGLE
具备文本、视觉和音频能力的多模态模型。选择性参数激活
E2B (3.15GB) · E4B (4.33GB)视觉
Llama-3.2 (LiteRT)
META
Meta 的 INT8 模型,用于设备端推理,4k 上下文
1B (2.01GB) · 3B (5.11GB)文本
Llama-3.2 GGUF
META
GGUF 格式的 Llama 模型,128k 上下文,支持 CPU/GPU/NPU
1B & 3B - Multiple quantizations文本
IBM Granite 4.0 H-Tiny
IBM
紧凑型企业模型,128k 上下文窗口,多种量化
7B - Q2_K to f16 (2.59GB-13.9GB)文本
IBM Granite 4.0 H-Small
IBM
高质量企业模型,128k 上下文窗口
32B - Q2_K to f16 (11.8GB-64.4GB)文本
Phi-4 Mini
MICROSOFT
微软的高效模型,擅长高级推理,在 8GB+ 设备上支持 GPU
INT8 (3.91GB)文本
LFM-2.5 1.2B Instruct
LIQUIDAI
LiquidAI 的高效指令模型,128k 上下文。提供 GGUF 和 ONNX 格式
GGUF & ONNX variants文本
LFM-2.5 1.2B Thinking
LIQUIDAI
支持「思考」模式的推理模型,128k 上下文。提供 GGUF 和 ONNX
GGUF & ONNX variants文本
LFM-2.5 VL 1.6B
LIQUIDAI
视觉-语言模型,支持文本和图像输入,128k 上下文
GGUF with vision projectors视觉
Ministral-3 3B
MISTRALAI
多模态指令模型,支持视觉,262k 上下文。提供 GGUF 和 ONNX
GGUF & ONNX variants视觉
Absolute Reality SD1.5
STABLE DIFFUSION
根据文本提示生成图像的模型
MNN (CPU) · QNN (NPU)图像
Gecko-110M
GOOGLE
用于 RAG 记忆系统的紧凑型嵌入模型,多种维度可选
64D-1024D embeddingsRAG
EmbeddingGemma-300M
GOOGLE
高质量文本嵌入,增强 RAG 检索
High-quality embeddingsRAG
Whisper ASR
OPENAI
最先进的自动语音识别 (ASR) 模型,可离线将语音转换为文本
Highly lightweight quantizations文本
Kokoro TTS
KOKORO
最先进的文本转语音 (TTS) 模型,在设备上生成高度自然的语音合成
Extremely lightweight & efficient文本
SEC.05//FIELD MANUAL

12款工具。无需信号。

以下每个工具都完全离线运行。选择你的信号盲区。

SCENARIO A//隧道
01
本地 AI 聊天
支持与 15+ 款本地大模型进行多轮对话。支持 RAG 记忆库、本地网页搜索和 TTS 语音自动朗读。
02
离线语音听写
使用 Whisper ASR 和 Gemma 多模态大模型,完全离线将长语音或音频文件精准转录为文本。
03
AI 反诈检测
利用本地 AI 风险评估,深度分析文本、截图或网址链接,识别潜在网络诈骗。
SCENARIO B//飞机
04
多语种翻译
完全离线翻译文本、图片(OCR 光学识别)和语音,支持 50 多种语言。
05
AI 图像生成
采用 Stable Diffusion 离线生图,完美支持 GPU/NPU 硬件加速。
06
视频生成器
完全离线在设备上根据文本或图像提示生成 AI 视频。
SCENARIO C//地下室
07
Vibes Coder
移动端本地全功能编程沙盒。输入自然语言描述,即可在安全沙盒中一键预览精美的 HTML/JS/CSS 页面。
08
写作小助手
完全离线支持语法校对、文本润色、段落重组、语气调整及代码生成。
09
creAItors 自定义角色
打造专属的 AI 角色人格 — 从幽默的加勒比海盗到全栈系统架构师,完全由您设定。
SCENARIO D//漫游
10
VibeVoice 语音通话
解放双手的 AI 语音通话功能,由 Whisper ASR 和 Kokoro TTS 驱动,支持自然流畅的连续对话、语音输入与实时语音应答。
11
AI 智能体
端侧自律 AI 智能体,可在应用内生成并运行 Termux 终端命令、显示交互式地图、发送消息及管理日历。
12
音乐生成器
在 iOS 上运行 Google Magenta Realtime 2 或在 Android 上运行 Stable Audio Small,全本地生成音乐。
13
图片超分 (放大)
在设备本地对图片进行超分辨率放大与画质增强 — 完全离线。
▸ 100% 隐私安全▸ 完全无需联网▸ 零数据收集▸ 开源合规▸ GPU/NPU 双重加速
SEC.06//BOOT SEQUENCE

三条命令,从下载到离线。

权重只需获取一次。之后的一切都在你的硬件上完成。

llmhub — zsh
$ llmhub pull gemma-3n-e4b
# download .task weights from HuggingFace — once
$ llmhub load --backend litert
# load into MediaPipe LLM Inference API
$ llmhub chat
# local inference on CPU/GPU — 0 bytes leave the device
$ ▊
SEC.08//案例研究
YC 孵化企业重磅案例研究 | RunAnywhere

RunAnywhere 官方案例:6 周完成 Android 至 iOS 全面移植

阅读由 YC 资助企业 RunAnywhere 撰写的官方案例研究,了解 LLM Hub 如何利用 RunAnywhere SDK 将 15+ 款 100% 端侧 AI 模型移植至 iOS 并实现高速本地推理。

YC 资助企业RunAnywhere SDK6 周完成 iOS 移植
signal.caseStudy.alt
SEC.09//FAQ
常见问题

常见问题解答

关于 LLM Hub 您需要了解的一切 — 100% 完全在您的本地设备上私密运行。

SEC.10//发送

开启您的本地私密 AI 全新体验

完全开源。免注册,零数据追踪。在您的 Android 或 iOS 设备上,感受无损的本地大模型澎湃算力。

无账户 · 无追踪 · 开源