支持的模型
在 Jetson 设备上运行最新的 AI 大模型
共 36 个模型
Gemma 3(5)
Gemma 3 4B
Google Gemma 3 系列 4B 语言模型
Gemma 3 1B
Google Gemma 3 系列 1B 轻量语言模型,适合资源受限设备
Gemma 3 270M
Google Gemma 3 系列 270M 超轻量语言模型
Gemma 3 12B
Google Gemma 3 系列 12B 中型语言模型
Qwen3(5)
Qwen3-VL-8B-Instruct
Qwen3-VL-8B-Instruct 是阿里云通义千问团队开发的一款80亿参数的多模态大模型,在同系列中兼具强大的性能和更友好的部署成本
Alibaba
Qwen3 30B-A3B
阿里巴巴 Qwen3 系列 MoE 模型,30B 总参数仅激活 3B,兼顾性能与效率
Alibaba
Qwen3-8B
阿里巴巴 Qwen3 系列的中型语言模型,8B 参数,原生支持思考模式,适合单 GPU 部署的通用文本任务
Alibaba
Qwen3 4B
阿里巴巴 Qwen3 系列的小型语言模型,4B 参数,适合资源受限的边缘设备部署
Alibaba
Gemma 4(2)
Qwen(1)
Qwen3.8-27B-GGUF
Unsloth 团队发布的 Qwen3.8-27B 量化版(GGUF 格式)模型卡,Apache-2.0 许可,约 1.7k 点赞。模型基于 Qwen3.5 架构演进,是开源 Qwen 家族目前最强一代:27B 参数的稠密因果语言模型,配备视觉编码器,原生支持图文与视频理解。亮点包括:灵活思维控制(思考模式默认开启、可按请求关闭,支持 reasoning_effort 调节推理深度);更强的智能体规划与环境反馈处理能力;改进的工具调用解析;兼容 Codex 等智能体工具。存储约 16.3GB,提供多种量化档位(Q3_K、Q4_K_M、Q5_K_M、IQ4_NL、UD-Q4_K_XL 等)及 mmproj 视觉投影。
Alibaba
Nemotron(3)
Nemotron-3-Nano-Omni
NVIDIA 推出的全模态 MoE 推理模型,30B 总参数仅激活 3B,原生支持文本、图像、音频、视频四种输入,256K 上下文
NVIDIA
Nemotron3 Nano 30B-A3B
NVIDIA Nemotron3 Nano MoE 模型,30B 总参数仅激活 3B
NVIDIA
Ministral 3(6)
Ministral 3 14B Instruct
Mistral AI 推出的 14B 指令型视觉语言模型,262K 上下文,FP8 精度
Mistral AI
Ministral 3 14B Reasoning
Mistral AI 推出的 14B 推理型视觉语言模型,262K 上下文,FP16 精度
Mistral AI
Ministral 3 8B Reasoning
Mistral AI 推出的 8B 推理型视觉语言模型,262K 上下文,FP16 精度
Mistral AI
Ministral 3 3B Reasoning
Mistral AI 推出的 3B 推理型视觉语言模型,262K 上下文,FP16 精度,专注逻辑推理和问题求解
Mistral AI
Ministral 3 8B Instruct
Mistral AI 推出的 8B 指令型视觉语言模型,262K 上下文,FP8 精度
Mistral AI
Ministral 3 3B Instruct
Mistral AI 推出的 3B 指令型视觉语言模型,262K 上下文,FP8 精度,支持多语言、函数调用和视觉理解
Mistral AI
Gemma(1)
FunctionGemma
Google 推出的函数调用专用 Gemma 模型,270M 参数,专为工具调用和结构化输出优化
Qwen3.5(5)
Qwen3.5 9B
阿里 Qwen3.5 系列 9B 视觉语言模型,262K 上下文,支持图文理解、工具调用和代理
Alibaba
Qwen3.5 4B
阿里 Qwen3.5 系列 4B 视觉语言模型,262K 上下文,AWQ 4bit 量化适合 Jetson Orin 部署
Alibaba
Qwen3.5 35B-A3B
阿里 Qwen3.5 系列 MoE 视觉语言模型,总参数 35B 仅激活 3B,262K 上下文,支持图文理解、函数调用和多语言
Alibaba
Qwen3.5 27B
阿里 Qwen3.5 系列 27B 稠密视觉语言模型,262K 上下文,支持图文理解、推理、函数调用和多语言
Alibaba
Qwen3.5 0.8B
阿里 Qwen3.5 系列最小视觉语言模型,0.8B 参数,262K 上下文,BF16 精度,适合快速原型和轻量边缘部署
Alibaba
Llama 3.2(1)
Llama 3.2 3B
Meta Llama 3.2 系列 3B 小型语言模型,专为边缘和移动设备优化
Meta
GPT OSS(2)
Llama 3.1(1)
Llama 3.1 8B
Meta Llama 3.1 系列 8B 通用语言模型,多语言支持和强大的指令遵循能力
Meta