模型分类

AI 模型广场

探索最新最热门的 AI 模型,涵盖 LLM、视觉、音频等多种类型,助你选型与集成。

tiny Qwen2ForCausalLM 2.5

Apache-2.0
tiny Qwen2ForCausalLM 2.5 是基于阿里通义千问 Qwen2 架构的轻量化实验版本。它在保持 Qwen 系列优秀中文理解能力的同时,极大压缩了参数规模,旨在为开发者提供一个低资源消耗的测试基准。该模型非常适合用于快速验...
trl-internal-testing 文本生成
15.6M 0

Qwen3.6 35B A3B NVFP4

apache-2.0
Qwen3.6 35B A3B NVFP4 是由 NVIDIA 提供的基于通义千问系列的优化版本。该模型采用了 NVFP4 低精度量化技术,旨在通过大幅降低显存占用,在不牺牲太多性能的前提下,提升在 NVIDIA GPU 上的推理吞吐量。对...
nvidia 文本生成
12.2M 0

Llama 3.2 1B Instruct

llama3.2
Llama 3.2 1B Instruct 是 Meta 推出的超轻量级指令微调模型。它最大的价值在于将强大的 Llama 家族能力下放到端侧,由于参数量仅 1B,它可以在手机、笔记本甚至低功耗嵌入式设备上流畅运行,无需依赖云端 API。对...
meta-llama 文本生成
8.9M 0

Llama 3.1 405B

Llama 3.1
开源大语言模型
Meta 文本生成 405B
8.0M 9.5K

gpt oss 20b

apache-2.0
gpt-oss-20b 是一款基于 Apache-2.0 协议开源的轻量级大模型,参数量在 20B 级别,在性能与部署成本之间取得了较好的平衡。它旨在为开发者提供一个可私有化部署的文本生成基座,能够高效处理摘要提取、代码辅助及通用对话任务。...
openai 文本生成
8.0M 0

Llama 3.1 8B Instruct

llama3.1
Llama 3.1 8B Instruct 是 Meta 推出的轻量级高性能指令微调模型。它在保持小参数量的同时,通过大规模高质量数据训练,在逻辑推理、代码编写和多语言处理上有了显著提升。对于中国开发者而言,该模型最大的价值在于其极高的部署...
meta-llama 文本生成
7.5M 0

Qwen3 8B

apache-2.0
Qwen3-8B 是阿里通义千问系列的最新中量级模型。在保持 8B 参数量带来的极高推理效率的同时,它在中文语境理解、逻辑推理以及代码编写能力上有了显著提升。对于开发者而言,它非常适合部署在消费级显卡上,用于构建本地知识库、自动化工作流或作...
Qwen 文本生成
7.3M 325

Qwen2.5 7B Instruct

apache-2.0
Qwen2.5-7B-Instruct 是阿里巴巴通义千问团队推出的新一代主力尺寸模型。它在保持 7B 轻量级参数量的同时,大幅强化了代码编写、数学推理和指令遵循能力,性能在同量级模型中处于顶尖水平。对于开发者而言,该模型非常适合部署在消费...
Qwen 文本生成
7.2M 502

Qwen2.5 0.5B Instruct

apache-2.0
Qwen2.5-0.5B-Instruct 是阿里通义千问家族中极其轻量化的指令微调模型。尽管参数量仅有 0.5B,但它在保持极低推理成本的同时,具备了出色的基础对话和指令遵循能力。这款模型并非为了替代大型 LLM,而是为端侧部署和特定任务...
Qwen 文本生成
6.8M 0

Qwen3 0.6B

apache-2.0
Qwen3-0.6B 是阿里巴巴通义千问系列中极其轻量化的文本生成模型。它主打“小而强”,在极低的参数规模下尽可能保留了核心的语言理解能力。这款模型非常适合对资源敏感的场景,比如在手机、嵌入式设备上本地部署,或者作为大型工作流中的轻量级前置...
Qwen 文本生成
5.6M 248

OTel 2.0 LLM 31B IT

apache-2.0
OTel 2.0 LLM 31B IT 是一款针对可观测性(Observability)和链路追踪场景优化的指令微调模型。它在 31B 参数规模下,能够精准理解分布式系统的日志、指标和追踪数据,特别适合开发者在排查系统故障、分析性能瓶颈或自...
farbodtavakkoli 文本生成
5.3M 0

Mixtral 8x7B

Apache 2.0
稀疏专家混合模型
Mistral AI 文本生成 47B
5.0M 7.2K

Qwen3 32B

apache-2.0
Qwen3 32B 是通义千问系列的最新进阶型号,精准卡在“性能”与“部署成本”的黄金平衡点上。相比于轻量级模型,它在复杂逻辑推理和多语言处理上有了显著提升,而相比于超大规模模型,它对显存的要求更亲民,非常适合开发者在私有化部署时作为主力推...
Qwen 文本生成
4.4M 338

Qwen3 1.7B

apache-2.0
Qwen3 1.7B 是阿里巴巴通义千问团队推出的轻量级语言模型。虽然参数规模小,但得益于 Qwen 系列强大的预训练语料,它在中文理解和基础逻辑上表现出色,非常适合对资源敏感的开发者。它不是为了替代超大模型,而是为了在端侧设备、边缘计算或...
Qwen 文本生成
1.2M 79

Qwen2.5 1.5B Instruct

apache-2.0
Qwen2.5-1.5B-Instruct 是阿里通义千问团队推出的轻量级指令微调模型。它在极小的参数规模下,通过高质量数据训练,实现了极强的性价比,尤其在中文语境理解、基础代码编写和逻辑推理上表现出色。对于开发者而言,这款模型非常适合部署...
Qwen 文本生成
931.4K 139

DeepSeek R1

mit
DeepSeek R1 是一款主打强化学习(RL)的推理模型,旨在对标 OpenAI o1。它最核心的突破在于通过大规模强化学习提升了逻辑推理、数学证明和代码编写能力,能够通过“慢思考”生成详细的思维链(CoT),让用户清晰看到模型的推理路...
deepseek-ai 文本生成
926.9K 1.4K

Qwen3 Coder 30B A3B Instruct GGUF

apache-2.0
Qwen3 Coder 30B A3B 是一款由阿里巴巴开源、经 Unsloth 优化量化的代码大模型。它采用了 MoE(混合专家)架构,在保持 30B 级别逻辑推理能力的同时,大幅降低了实际运行时的计算开销。对于国内开发者而言,该模型在 ...
unsloth 文本生成
108.1K 28

gpt2

mit
GPT-2 是现代大语言模型的奠基之作,由 OpenAI 开源。虽然在当前 LLM 时代它已不再是性能顶端,但其轻量级的架构使其成为开发者学习 Transformer 原理、构建小型文本生成应用或在本地低功耗设备上部署的理想选择。它无需昂贵...
openai-community 文本生成
46.0K 11