全球 AI 聊天室 · 现在 12 人在线 进去聊聊
DIRECTORY / 02

AI 模型广场|开源大模型与 LLM 目录

开源大模型和多模态模型目录:看能力、参数规模、许可证、下载量和来源页,方便对比 Qwen、Llama 等怎么选、怎么部署。PromptCube 模型广场持续收录。

比较模型为你的下一个工作流找到合适的选择
目录概览
839
已收录条目
24 个主题分类持续更新
02 / MODEL INDEX

找到适合任务的模型

先看清楚,再做选择。每个条目都保留关键上下文。

精选目录839 个结果

gemini-2.5-flash:batch

google
1048576 ctx

Gemini 2.5 Flash Batch 是 Google 推出的高性能“干活型”模型,核心亮点在于其内置的思维链(Thinking)能力。不同于以往追求速度的 Flash 系列,这个版本在保持高响应效率的同时,强化了逻辑推理、复杂代码编写及数学解题的深度。它非常适合处理需要“深思熟虑”的长文本分析或大规模数据处理任务。对于开发者而言,Batch 版本通过异步批处理机制,能以更低的成本处理海量任务。上手门槛较低,如果你习惯使用 Google Cloud 或 Vertex AI 生态,可以无缝衔接。相比于通用型模型,它在处理结构化逻辑和科学计算场景下表现得更像一个严谨的专家,是构建自动化智能工作流的理想选择。

text generationAPI
0 星标查看详情

gemini-2.5-flash

google
1048576 ctx

Gemini 2.5 Flash 是 Google 推出的新一代“全能型选手”,主打高性能与高性价比的平衡。它最大的亮点在于内置了“思维链(Thinking)”能力,不再只是简单地预测下一个字符,而是在处理复杂逻辑、编程难题和数学推导时,会像人类一样进行内部推理。对于开发者而言,它拥有超过 100 万 token 的超长上下文窗口,这意味着你可以直接把整本技术文档或整个项目代码库丢给它,进行深度检索和分析。相比于参数量巨大的 Pro 模型,Flash 版在响应速度和 API 调用成本上更有优势,非常适合集成到需要实时交互、自动化代码审查或大规模数据处理的生产级应用场景中,是追求效率开发者的理想选择。

text generationAPI
0 星标查看详情

gemini-2.5-flash-lite:batch

google
1048576 ctx

Gemini 2.5 Flash-Lite 是 Google 推出的轻量化推理模型,主打“快”与“省”。它在保持 Gemini 系列逻辑能力的基石上,通过极致的架构优化,实现了极低的响应延迟和超高的吞吐量。对于开发者而言,这款模型最核心的价值在于处理大规模、高频次的文本任务,比如自动化数据清洗、长文本摘要提取或大规模内容分类。相比于参数量庞大的旗舰模型,它的上手门槛极低,API 调用成本极具竞争力,非常适合集成到需要实时反馈或处理海量 Batch 任务的生产级应用中,是构建高性价比 AI 工作流的理想选择。

text generationAPI
0 星标查看详情

gemini-2.5-flash-lite

google
1048576 ctx

作为 Google Gemini 系列中的“轻量化先锋”,gemini-2.5-flash-lite 核心目标是解决高并发场景下的响应速度与成本痛点。它并非追求参数规模的暴力堆砌,而是通过极致的推理优化,实现了极低的延迟和极高的吞吐量。对于开发者而言,它非常适合集成到需要实时反馈的 AI Agent、自动化工作流或大规模文本处理任务中。相比于参数量巨大的 Pro 版本,Lite 版在保持了较强逻辑理解能力的同时,大幅降低了 API 调用成本,上手门槛极低,是构建高性价比 AI 应用的首选“小钢炮”。

text generationAPI
0 星标查看详情

gpt-oss-20b

openai
131072 ctx

gpt-oss-20b 是 OpenAI 推出的重量级开源模型,采用了高效的 MoE(混合专家)架构。虽然总参数量达到 21B,但每次推理仅激活约 3.6B 参数,这意味着它能在保持极高性能的同时,大幅降低显存占用和推理成本。对于开发者来说,Apache 2.0 协议意味着极高的自由度,你可以放心地将其集成到商业应用中。它在处理长文本任务时表现出色,128K 的超长上下文窗口让它非常适合做长文档分析或代码库理解。相比于传统的稠密模型,它在保持响应速度的同时,逻辑推理能力也达到了新的高度,是构建轻量化、高性能 AI 应用的理想底座。

text generationAPI
0 星标查看详情

gpt-oss-120b:batch

openai
131072 ctx

gpt-oss-120b:batch 是 OpenAI 推出的高性能开源权重模型,采用了 MoE(混合专家)架构,总参数量达 117B,但在推理时仅需激活约 5.1B 参数。这种设计在保证极高逻辑推理能力的同时,显著提升了响应效率。它特别针对“智能体(Agent)”任务和复杂生产环境进行了优化,非常适合处理长文本分析、自动化工作流以及需要深度思考的逻辑推理场景。对于开发者而言,它在保持大模型能力的条件下,提供了比全量参数模型更优的性价比,是构建自主化 AI 应用的理想底座,上手门槛较低,可通过 API 直接接入现有开发流。

text generationAPI
0 星标查看详情

gpt-oss-120b

openai
131072 ctx

gpt-oss-120b 是 OpenAI 推出的超大规模开源权重模型,采用了 MoE(混合专家)架构,总参数量达 117B,但在推理时仅需激活约 5.1B 参数。这种设计在保持顶级逻辑推理能力的同时,极大地优化了计算效率,非常适合需要高频调用、对响应速度有要求的生产环境。它不仅在通用文本生成上表现稳健,更在 Agent(智能体)任务和复杂逻辑链推理方面展现了极高的潜力。对于开发者而言,它填补了高性能推理模型与低成本部署需求之间的空白,是构建自动化工作流和复杂 AI 应用的理想底座,上手难度适中,可通过 API 直接集成到现有开发流水线中。

text generationAPI
0 星标查看详情

gpt-5-nano:batch

openai
400000 ctx

GPT-5-Nano 是 OpenAI 在 GPT-5 系列中主打“极致响应”的轻量化版本。它放弃了部分复杂的深度逻辑推理,转而追求极高的吞吐量和超低延迟,非常适合对响应速度要求近乎苛刻的实时交互场景。对于开发者而言,它是构建智能助手、自动化工作流或大规模文本处理任务(Batch Processing)的理想选择,能显著降低 API 调用成本。虽然在处理高难度数学或复杂逻辑时可能不如旗舰模型稳健,但在处理简单的意图识别、文本分类或日常对话补全时,其速度优势和性价比极具竞争力,是追求工程效率开发者的首选工具。

text generationAPI
0 星标查看详情

gpt-5-nano

openai
400000 ctx

GPT-5-Nano 是 OpenAI 在 GPT-5 系列中推出的“小钢炮”版本,主打极致的响应速度与超低延迟。它放弃了部分复杂的深层逻辑推理,转而追求在轻量级任务中的爆发力。对于开发者而言,它是构建实时对话助手、自动化工作流插件或移动端端侧应用的理想选择。相比于追求“大而全”的旗舰模型,Nano 更像是一个敏捷的执行者,能够以极低的成本处理高频、简单的文本生成任务。如果你正在寻找一个能无缝集成到现有 API 工作流中,且对响应时间有近乎苛刻要求的工具,GPT-5-Nano 会比庞大的旗舰模型更具性价比。

text generationAPI
0 星标查看详情

gpt-5-mini:batch

openai
400000 ctx

GPT-5-mini:batch 是 OpenAI 推出的轻量化推理模型,旨在平衡性能与成本。它继承了 GPT-5 系列强大的指令遵循能力与安全对齐标准,但在处理逻辑推理任务时更加轻快。对于开发者而言,这款模型最大的优势在于其极高的性价比和低延迟,非常适合处理大规模、非实时的文本处理任务,如长文本摘要、数据清洗或批量化的内容生成。虽然它在极高难度的复杂逻辑上可能稍逊于完整版 GPT-5,但其 400k 的超长上下文窗口让它在处理文档库或长对话时依然游刃有余,是构建高并发、低成本 AI 应用的理想“性价比之选”。

text generationAPI
0 星标查看详情

gpt-5-mini

openai
400000 ctx

作为 OpenAI 最新的轻量化力作,GPT-5-mini 走的是“高性价比推理”路线。它并非为了取代旗舰模型,而是精准切中了开发者对响应速度和成本控制的痛点。在保留了 GPT-5 核心指令遵循能力和安全基准的同时,它通过精简参数,显著降低了推理延迟,非常适合处理日常对话、文本摘要、逻辑分类等轻量级任务。对于需要大规模部署 AI Agent 或构建高频交互应用的开发者来说,它在保证逻辑严密性的前提下,提供了极高的吞吐效率,是平衡模型智能度与工程落地成本的理想选择。

text generationAPI
0 星标查看详情

gpt-5:batch

openai
400000 ctx

作为 OpenAI 的下一代旗舰模型,GPT-5 Batch 版本专为需要高逻辑深度和大规模处理的任务而设计。它在推理能力和代码编写质量上实现了质的飞跃,能够处理极其复杂的逻辑链条,不再仅仅是简单的文本补全,而是具备了更强的“思考”过程。对于开发者而言,Batch 模式提供了更具性价比的异步处理方案,非常适合需要处理海量数据、进行长文本分析或大规模代码重构的自动化工作流。虽然模型参数规模巨大,但通过 API 调用,开发者可以无缝将其集成到现有的生产环境中,是构建高智能化 Agent 或复杂逻辑应用的理想底层引擎。

text generationAPI
0 星标查看详情

gpt-5

openai
400000 ctx

作为 OpenAI 的下一代旗舰模型,GPT-5 不仅仅是参数规模的堆砌,更在逻辑推理和指令遵循的“深度”上实现了质变。它最显著的进化在于能够处理极其复杂的长链条任务,无论是编写高逻辑性的底层架构代码,还是在多步骤的科研推理中保持极高的准确度。对于开发者而言,它在处理复杂上下文时的稳定性大幅提升,能够更精准地理解模糊指令。虽然上手门槛依然是熟悉的 API 调用方式,但其处理复杂问题的“思考过程”更接近人类专家。如果你正在构建需要深度逻辑支撑的 AI Agent 或自动化工作流,GPT-5 将是目前市面上最强力的逻辑引擎。

text generationAPI
0 星标查看详情

gpt-5-pro:batch

openai
400000 ctx

作为 OpenAI 的顶尖力作,gpt-5-pro:batch 是专为处理超大规模、高复杂度任务而设计的进阶版模型。相比前代,它在逻辑推理和代码生成的深度上有了质的飞跃,特别擅长处理需要多步拆解的复杂指令。该版本特别针对“批处理(Batch)”场景进行了优化,这意味着如果你有海量的文本分析、数据清洗或长文档总结需求,使用它能以极高的性价比换取极强的逻辑严密性。虽然其推理能力极强,但对 Prompt 的精确度要求也更高,建议开发者将其作为自动化工作流中的“大脑”核心,而非简单的聊天工具。对于追求极致逻辑表现的开发者来说,它是目前处理重型任务的首选。

text generationAPI
0 星标查看详情

gpt-5-pro

openai
400000 ctx

作为 OpenAI 的巅峰之作,GPT-5 Pro 不仅仅是参数规模的堆叠,更是在逻辑推理深度和指令遵循精度上的质变。它最核心的进化在于“思考过程”的透明化与严密性,能够处理极其复杂的长链条逻辑任务,无论是编写高并发架构的代码,还是进行深度的学术论文拆解,都能表现出极高的可靠性。对于开发者而言,它不仅是一个对话框,更是一个具备强逻辑思维的协作引擎。虽然其高阶能力对 Prompt 的工程化要求更高,但配合其 400k 的超长上下文窗口,在处理整库代码理解或超长文档分析时,其体验将远超目前的各种主流模型。

text generationAPI
0 星标查看详情

gemini-2.5-flash-image

google
32768 ctx

Gemini 2.5 Flash Image(代号 Nano Banana)是 Google 推出的新一代轻量化图像生成模型。它最大的亮点在于不仅能“画图”,更具备极强的上下文理解能力,这意味着你可以通过复杂的逻辑描述或长文本指令来精准控制画面的构图与细节,解决了以往 AI 绘图难以理解复杂语义的痛点。作为 Flash 系列的一员,它的响应速度极快,非常适合集成到需要实时生成视觉内容的 App 或工作流中。对于开发者来说,它通过 API 提供服务,上手门槛低,能与 Google 生态下的其他模型实现无缝的文本-图像协同工作,是构建智能多模态应用的高性价比选择。

text generationAPI
0 星标查看详情

gpt-5-image

openai
400000 ctx

gpt-5-image 是 OpenAI 在多模态理解与图像生成领域的进阶尝试。它并非简单的“文生图”工具,而是将 GPT-5 强大的逻辑推理能力与顶尖的视觉生成技术深度融合。对于开发者而言,它最核心的优势在于极高的指令遵循度(Instruction Following),这意味着你可以通过复杂的自然语言描述,精准控制图像的构图、风格甚至细微的逻辑关系,减少了反复调优 Prompt 的挫败感。无论是需要生成具备严密逻辑结构的示意图,还是高精度的创意素材,它都能通过理解上下文来提供更符合预期的结果。上手难度适中,如果你习惯了 GPT 系列的对话逻辑,几乎可以无缝切换到视觉创作场景。

text generationAPI
0 星标查看详情

gpt-5-image-mini

openai
400000 ctx

gpt-5-image-mini 是 OpenAI 推出的轻量化原生多模态模型,核心逻辑是将强大的 GPT-5 Mini 语言理解力与图像生成能力深度融合。与以往先理解后绘图的“拼凑感”不同,它在指令遵循上表现得极为细腻,能够精准捕捉复杂的语义细节并将其转化为高质量图像。对于开发者而言,它的优势在于极高的响应效率和更低的推理成本,非常适合集成到需要实时图文交互的应用场景中,如智能设计助手或创意写作工具。虽然它在参数规模上做了精简,但在处理长文本指令和复杂构图逻辑时,依然保持了极高的水准,是追求性能与性价比平衡的首选方案。

text generationAPI
0 星标查看详情

gpt-oss-safeguard-20b

openai
131072 ctx

gpt-oss-safeguard-20b 是 OpenAI 基于其开源架构推出的专项安全推理模型。不同于通用的对话大模型,它采用了 21B 参数规模的混合专家(MoE)架构,核心任务是充当 AI 内容的“守门员”。对于开发者而言,它非常适合集成在应用后端,用于自动化内容分类、敏感信息过滤以及提升大模型输出的合规性。由于采用了 MoE 设计,它在处理安全审计任务时响应延迟极低,能有效平衡推理成本与安全性。如果你正在构建需要严格内容风控的 AI 应用,或者需要对现有 LLM 的输出进行实时拦截与合规性检测,这款模型是极佳的专用工具。

text generationAPI
0 星标查看详情

gpt-5.1-codex-mini

openai
400000 ctx

作为 OpenAI Codex 系列的轻量化进化版,gpt-5.1-codex-mini 专为追求极致响应速度的开发者打造。它在保留了强大逻辑推理能力的基础上,大幅优化了推理延迟,非常适合集成到 IDE 插件或自动化代码审查流程中。虽然参数规模较完整版有所精简,但其在代码补全、单元测试生成以及逻辑重构等高频任务上表现极佳。对于资源敏感型项目或需要实时交互的 AI 编程助手场景,它提供了一个性价比极高的选择,上手门槛极低,通过 API 即可无缝接入现有的开发工作流。

text generationAPI
0 星标查看详情

gpt-5.1-codex

openai
400000 ctx

GPT-5.1-Codex 是 OpenAI 针对开发者推出的专项进化版,它不再仅仅是一个能写代码的聊天机器人,而是深度对齐了软件工程全生命周期的‘数字工程师’。相比通用模型,它在处理长上下文逻辑、复杂架构设计以及长程任务执行方面表现尤为突出,能够胜任从单元测试编写到大型模块重构的深度工程任务。对于追求开发效率的团队来说,它更像是集成在 IDE 里的资深架构师,能够理解复杂的工程上下文,而非碎片化的代码片段。上手难度极低,通过 API 即可无缝接入现有的 CI/CD 流水线或自研开发工具链,是构建智能化编程助手或自动化运维系统的核心底座。

text generationAPI
0 星标查看详情

gpt-5.1:batch

openai
400000 ctx

作为 GPT-5 系列中的进阶版本,gpt-5.1:batch 标志着 OpenAI 在逻辑推理与指令遵循上的又一次跨越。它不仅在处理复杂逻辑链条时表现得更像“真人”,在理解人类模糊指令方面也显著提升了准确度。相比于实时对话版本,这个 batch 版本更适合处理大规模、高吞吐量的任务,比如长文档分析、大规模数据清洗或自动化内容生成。对于开发者而言,它拥有 40 万 token 的超长上下文窗口,能轻松吞下整本技术手册或复杂的代码库。上手难度较低,只要你会调用 API,就能通过它实现更智能的自动化工作流,是构建下一代高智商 AI 应用的理想底座。

text generationAPI
0 星标查看详情

gpt-5.1

openai
400000 ctx

作为 GPT-5 系列的进阶版本,GPT-5.1 代表了当前通用推理能力的顶尖水平。相比前代,它最显著的提升在于“听得懂人话”且“想得更深”,不仅在复杂逻辑推理上更加稳健,对长指令的遵循能力也大幅增强,减少了模型常见的“答非所问”现象。对于开发者而言,它更像是一个具备强逻辑思维的协作伙伴,能够处理极其复杂的长文本分析与多步任务拆解。虽然其 API 调用成本可能高于轻量级模型,但对于追求高精度输出、需要构建深度智能 Agent 或处理复杂业务逻辑的应用场景来说,它是目前最值得投入的生产力工具。

text generationAPI
0 星标查看详情

gemini-3-pro-image-preview

google
65536 ctx

Gemini-3-Pro-Image-Preview 是 Google 基于 Gemini 3 Pro 架构推出的进阶版多模态模型。不同于传统的纯绘图工具,它最大的核心竞争力在于“理解力”与“执行力”的深度结合。它不仅能精准捕捉复杂的自然语言指令进行高质量图像生成,更在图像编辑和多模态推理上表现出色,能够理解图片中的逻辑关系并进行精准的局部修改。对于开发者而言,它不仅是一个画图工具,更像是一个具备视觉逻辑的创意助手,非常适合用于需要高度语义对齐的创意设计、复杂场景建模以及自动化视觉内容生成等进阶场景。上手门槛主要在于对 Prompt 精细度的要求,但在处理复杂逻辑指令时,其表现远超基础模型。

text generationAPI
0 星标查看详情