全球 AI 聊天室 · 现在 18 人在线 进去聊聊
DIRECTORY / 02

AI 模型广场|开源大模型与 LLM 目录

开源大模型和多模态模型目录:看能力、参数规模、许可证、下载量和来源页,方便对比 Qwen、Llama 等怎么选、怎么部署。PromptCube 模型广场持续收录。

比较模型为你的下一个工作流找到合适的选择
目录概览
591
已收录条目
24 个主题分类持续更新
02 / MODEL INDEX

找到适合任务的模型

先看清楚,再做选择。每个条目都保留关键上下文。

精选目录591 个结果

gpt-5-nano

openai
400000 ctx

GPT-5-Nano 是 OpenAI 在 GPT-5 系列中推出的“小钢炮”版本,主打极致的响应速度与超低延迟。它放弃了部分复杂的深层逻辑推理,转而追求在轻量级任务中的爆发力。对于开发者而言,它是构建实时对话助手、自动化工作流插件或移动端端侧应用的理想选择。相比于追求“大而全”的旗舰模型,Nano 更像是一个敏捷的执行者,能够以极低的成本处理高频、简单的文本生成任务。如果你正在寻找一个能无缝集成到现有 API 工作流中,且对响应时间有近乎苛刻要求的工具,GPT-5-Nano 会比庞大的旗舰模型更具性价比。

text generationAPI
0 星标查看详情

gpt-5-mini:batch

openai
400000 ctx

GPT-5-mini:batch 是 OpenAI 推出的轻量化推理模型,旨在平衡性能与成本。它继承了 GPT-5 系列强大的指令遵循能力与安全对齐标准,但在处理逻辑推理任务时更加轻快。对于开发者而言,这款模型最大的优势在于其极高的性价比和低延迟,非常适合处理大规模、非实时的文本处理任务,如长文本摘要、数据清洗或批量化的内容生成。虽然它在极高难度的复杂逻辑上可能稍逊于完整版 GPT-5,但其 400k 的超长上下文窗口让它在处理文档库或长对话时依然游刃有余,是构建高并发、低成本 AI 应用的理想“性价比之选”。

text generationAPI
0 星标查看详情

gpt-5-mini

openai
400000 ctx

作为 OpenAI 最新的轻量化力作,GPT-5-mini 走的是“高性价比推理”路线。它并非为了取代旗舰模型,而是精准切中了开发者对响应速度和成本控制的痛点。在保留了 GPT-5 核心指令遵循能力和安全基准的同时,它通过精简参数,显著降低了推理延迟,非常适合处理日常对话、文本摘要、逻辑分类等轻量级任务。对于需要大规模部署 AI Agent 或构建高频交互应用的开发者来说,它在保证逻辑严密性的前提下,提供了极高的吞吐效率,是平衡模型智能度与工程落地成本的理想选择。

text generationAPI
0 星标查看详情

gpt-5:batch

openai
400000 ctx

作为 OpenAI 的下一代旗舰模型,GPT-5 Batch 版本专为需要高逻辑深度和大规模处理的任务而设计。它在推理能力和代码编写质量上实现了质的飞跃,能够处理极其复杂的逻辑链条,不再仅仅是简单的文本补全,而是具备了更强的“思考”过程。对于开发者而言,Batch 模式提供了更具性价比的异步处理方案,非常适合需要处理海量数据、进行长文本分析或大规模代码重构的自动化工作流。虽然模型参数规模巨大,但通过 API 调用,开发者可以无缝将其集成到现有的生产环境中,是构建高智能化 Agent 或复杂逻辑应用的理想底层引擎。

text generationAPI
0 星标查看详情

gpt-5

openai
400000 ctx

作为 OpenAI 的下一代旗舰模型,GPT-5 不仅仅是参数规模的堆砌,更在逻辑推理和指令遵循的“深度”上实现了质变。它最显著的进化在于能够处理极其复杂的长链条任务,无论是编写高逻辑性的底层架构代码,还是在多步骤的科研推理中保持极高的准确度。对于开发者而言,它在处理复杂上下文时的稳定性大幅提升,能够更精准地理解模糊指令。虽然上手门槛依然是熟悉的 API 调用方式,但其处理复杂问题的“思考过程”更接近人类专家。如果你正在构建需要深度逻辑支撑的 AI Agent 或自动化工作流,GPT-5 将是目前市面上最强力的逻辑引擎。

text generationAPI
0 星标查看详情

gpt-5-pro:batch

openai
400000 ctx

作为 OpenAI 的顶尖力作,gpt-5-pro:batch 是专为处理超大规模、高复杂度任务而设计的进阶版模型。相比前代,它在逻辑推理和代码生成的深度上有了质的飞跃,特别擅长处理需要多步拆解的复杂指令。该版本特别针对“批处理(Batch)”场景进行了优化,这意味着如果你有海量的文本分析、数据清洗或长文档总结需求,使用它能以极高的性价比换取极强的逻辑严密性。虽然其推理能力极强,但对 Prompt 的精确度要求也更高,建议开发者将其作为自动化工作流中的“大脑”核心,而非简单的聊天工具。对于追求极致逻辑表现的开发者来说,它是目前处理重型任务的首选。

text generationAPI
0 星标查看详情

gpt-5-pro

openai
400000 ctx

作为 OpenAI 的巅峰之作,GPT-5 Pro 不仅仅是参数规模的堆叠,更是在逻辑推理深度和指令遵循精度上的质变。它最核心的进化在于“思考过程”的透明化与严密性,能够处理极其复杂的长链条逻辑任务,无论是编写高并发架构的代码,还是进行深度的学术论文拆解,都能表现出极高的可靠性。对于开发者而言,它不仅是一个对话框,更是一个具备强逻辑思维的协作引擎。虽然其高阶能力对 Prompt 的工程化要求更高,但配合其 400k 的超长上下文窗口,在处理整库代码理解或超长文档分析时,其体验将远超目前的各种主流模型。

text generationAPI
0 星标查看详情

gemini-2.5-flash-image

google
32768 ctx

Gemini 2.5 Flash Image(代号 Nano Banana)是 Google 推出的新一代轻量化图像生成模型。它最大的亮点在于不仅能“画图”,更具备极强的上下文理解能力,这意味着你可以通过复杂的逻辑描述或长文本指令来精准控制画面的构图与细节,解决了以往 AI 绘图难以理解复杂语义的痛点。作为 Flash 系列的一员,它的响应速度极快,非常适合集成到需要实时生成视觉内容的 App 或工作流中。对于开发者来说,它通过 API 提供服务,上手门槛低,能与 Google 生态下的其他模型实现无缝的文本-图像协同工作,是构建智能多模态应用的高性价比选择。

text generationAPI
0 星标查看详情

gpt-5-image

openai
400000 ctx

gpt-5-image 是 OpenAI 在多模态理解与图像生成领域的进阶尝试。它并非简单的“文生图”工具,而是将 GPT-5 强大的逻辑推理能力与顶尖的视觉生成技术深度融合。对于开发者而言,它最核心的优势在于极高的指令遵循度(Instruction Following),这意味着你可以通过复杂的自然语言描述,精准控制图像的构图、风格甚至细微的逻辑关系,减少了反复调优 Prompt 的挫败感。无论是需要生成具备严密逻辑结构的示意图,还是高精度的创意素材,它都能通过理解上下文来提供更符合预期的结果。上手难度适中,如果你习惯了 GPT 系列的对话逻辑,几乎可以无缝切换到视觉创作场景。

text generationAPI
0 星标查看详情

gpt-5-image-mini

openai
400000 ctx

gpt-5-image-mini 是 OpenAI 推出的轻量化原生多模态模型,核心逻辑是将强大的 GPT-5 Mini 语言理解力与图像生成能力深度融合。与以往先理解后绘图的“拼凑感”不同,它在指令遵循上表现得极为细腻,能够精准捕捉复杂的语义细节并将其转化为高质量图像。对于开发者而言,它的优势在于极高的响应效率和更低的推理成本,非常适合集成到需要实时图文交互的应用场景中,如智能设计助手或创意写作工具。虽然它在参数规模上做了精简,但在处理长文本指令和复杂构图逻辑时,依然保持了极高的水准,是追求性能与性价比平衡的首选方案。

text generationAPI
0 星标查看详情

gpt-oss-safeguard-20b

openai
131072 ctx

gpt-oss-safeguard-20b 是 OpenAI 基于其开源架构推出的专项安全推理模型。不同于通用的对话大模型,它采用了 21B 参数规模的混合专家(MoE)架构,核心任务是充当 AI 内容的“守门员”。对于开发者而言,它非常适合集成在应用后端,用于自动化内容分类、敏感信息过滤以及提升大模型输出的合规性。由于采用了 MoE 设计,它在处理安全审计任务时响应延迟极低,能有效平衡推理成本与安全性。如果你正在构建需要严格内容风控的 AI 应用,或者需要对现有 LLM 的输出进行实时拦截与合规性检测,这款模型是极佳的专用工具。

text generationAPI
0 星标查看详情

gpt-5.1-codex-mini

openai
400000 ctx

作为 OpenAI Codex 系列的轻量化进化版,gpt-5.1-codex-mini 专为追求极致响应速度的开发者打造。它在保留了强大逻辑推理能力的基础上,大幅优化了推理延迟,非常适合集成到 IDE 插件或自动化代码审查流程中。虽然参数规模较完整版有所精简,但其在代码补全、单元测试生成以及逻辑重构等高频任务上表现极佳。对于资源敏感型项目或需要实时交互的 AI 编程助手场景,它提供了一个性价比极高的选择,上手门槛极低,通过 API 即可无缝接入现有的开发工作流。

text generationAPI
0 星标查看详情

gpt-5.1-codex

openai
400000 ctx

GPT-5.1-Codex 是 OpenAI 针对开发者推出的专项进化版,它不再仅仅是一个能写代码的聊天机器人,而是深度对齐了软件工程全生命周期的‘数字工程师’。相比通用模型,它在处理长上下文逻辑、复杂架构设计以及长程任务执行方面表现尤为突出,能够胜任从单元测试编写到大型模块重构的深度工程任务。对于追求开发效率的团队来说,它更像是集成在 IDE 里的资深架构师,能够理解复杂的工程上下文,而非碎片化的代码片段。上手难度极低,通过 API 即可无缝接入现有的 CI/CD 流水线或自研开发工具链,是构建智能化编程助手或自动化运维系统的核心底座。

text generationAPI
0 星标查看详情

gpt-5.1:batch

openai
400000 ctx

作为 GPT-5 系列中的进阶版本,gpt-5.1:batch 标志着 OpenAI 在逻辑推理与指令遵循上的又一次跨越。它不仅在处理复杂逻辑链条时表现得更像“真人”,在理解人类模糊指令方面也显著提升了准确度。相比于实时对话版本,这个 batch 版本更适合处理大规模、高吞吐量的任务,比如长文档分析、大规模数据清洗或自动化内容生成。对于开发者而言,它拥有 40 万 token 的超长上下文窗口,能轻松吞下整本技术手册或复杂的代码库。上手难度较低,只要你会调用 API,就能通过它实现更智能的自动化工作流,是构建下一代高智商 AI 应用的理想底座。

text generationAPI
0 星标查看详情

gpt-5.1

openai
400000 ctx

作为 GPT-5 系列的进阶版本,GPT-5.1 代表了当前通用推理能力的顶尖水平。相比前代,它最显著的提升在于“听得懂人话”且“想得更深”,不仅在复杂逻辑推理上更加稳健,对长指令的遵循能力也大幅增强,减少了模型常见的“答非所问”现象。对于开发者而言,它更像是一个具备强逻辑思维的协作伙伴,能够处理极其复杂的长文本分析与多步任务拆解。虽然其 API 调用成本可能高于轻量级模型,但对于追求高精度输出、需要构建深度智能 Agent 或处理复杂业务逻辑的应用场景来说,它是目前最值得投入的生产力工具。

text generationAPI
0 星标查看详情

gemini-3-pro-image-preview

google
65536 ctx

Gemini-3-Pro-Image-Preview 是 Google 基于 Gemini 3 Pro 架构推出的进阶版多模态模型。不同于传统的纯绘图工具,它最大的核心竞争力在于“理解力”与“执行力”的深度结合。它不仅能精准捕捉复杂的自然语言指令进行高质量图像生成,更在图像编辑和多模态推理上表现出色,能够理解图片中的逻辑关系并进行精准的局部修改。对于开发者而言,它不仅是一个画图工具,更像是一个具备视觉逻辑的创意助手,非常适合用于需要高度语义对齐的创意设计、复杂场景建模以及自动化视觉内容生成等进阶场景。上手门槛主要在于对 Prompt 精细度的要求,但在处理复杂逻辑指令时,其表现远超基础模型。

text generationAPI
0 星标查看详情

gpt-5.1-codex-max

openai
400000 ctx

GPT-5.1-Codex-Max 是 OpenAI 推出的新一代‘智能体化’编程大模型,专门为处理复杂、长周期的软件工程任务而生。与以往侧重代码补全的模型不同,它更强调‘自主性’,能够理解超长上下文并模拟开发者的逻辑链路。对于需要重构大型遗留系统、进行跨文件逻辑分析或编写自动化测试套件的开发者来说,它更像是一个具备推理能力的‘虚拟高级工程师’。虽然通过 API 调用有一定的集成门槛,但其强大的长文本处理能力(400k ctx)使其在处理整个项目仓库时表现卓越,是构建自动化 AI 程序员(AI Agent)的理想底层引擎。

text generationAPI
0 星标查看详情

gpt-5.2:batch

openai
400000 ctx

GPT-5.2:batch 是 OpenAI 推出的 GPT-5 系列最新前沿模型,其核心进化在于“智能分配”与“长程任务”的处理能力。相比前代,它引入了自适应推理机制,能根据任务复杂度动态调整计算资源,这意味着在处理简单指令时响应极快,而在面对复杂逻辑或长文档时则能展现出极强的 Agent(智能体)属性。该模型特别强化了长上下文(Long Context)的稳定性,非常适合需要深度逻辑推理、复杂工作流自动化或大规模文档分析的开发者。对于习惯使用 GPT-4 系列的用户来说,它不仅是性能的平替,更是从“对话框”向“自主智能体”跨越的关键工具,上手门槛依然保持了 API 调用的一致性,但处理复杂工程问题的上限显著提升。

text generationAPI
0 星标查看详情

gpt-5.2

openai
400000 ctx

作为 GPT-5 系列的最新迭代版本,gpt-5.2 标志着模型从单纯的文本生成向“自主智能体(Agent)”的跨越。它最核心的进化在于引入了自适应推理机制,能够根据任务难度动态分配计算资源,这意味着在处理简单问题时响应极快,而在面对复杂逻辑推理时则能“沉思”以确保准确。对于开发者而言,其超长上下文处理能力和更强的任务规划能力,使其非常适合构建复杂的自动化工作流或长文档分析工具。虽然通过 API 调用,但其逻辑深度相比前代有显著提升,是目前构建高阶 AI Agent 的首选底层模型。

text generationAPI
0 星标查看详情

gpt-5.2-pro:batch

openai
400000 ctx

GPT-5.2 Pro Batch 是 OpenAI 推出的进阶版生产力工具,核心进化在于其极强的“智能体化”编程能力与超长上下文处理水平。相比前代,它不仅在逻辑推理上更加稳健,更擅长处理需要多步拆解的复杂工程任务。对于开发者而言,它不仅是一个对话框,更像是一个能理解复杂项目架构的虚拟架构师。该版本特别针对 Batch(批处理)场景进行了优化,适合需要大规模、低延迟成本处理长文档或自动化代码重构的业务流。上手难度主要在于如何设计精细的 Prompt 来激发其推理链,但在处理大规模数据任务时,它的性价比和稳定性表现非常出色。

text generationAPI
0 星标查看详情

gpt-5.2-pro

openai
400000 ctx

作为 OpenAI 的最新力作,GPT-5.2 Pro 在逻辑推理与复杂任务执行上实现了质的飞跃。相比前代,它最显著的进化在于‘智能体化(Agentic)’的编程能力,能够像资深工程师一样进行多步骤的代码设计与调试,而非简单的代码补全。同时,得益于优化的长上下文处理机制,它在处理超长文档或大规模代码库时更加稳健,极少出现‘断片’现象。对于开发者和科研人员来说,这不仅是一个对话框,更是一个具备深度思考能力的协作专家。虽然上手门槛因任务复杂度而异,但通过 API 调用,你可以将其无缝集成到现有的自动化工作流中,实现从逻辑规划到代码落地的全链路闭环。

text generationAPI
0 星标查看详情

gpt-5.2-chat

openai
128000 ctx

GPT-5.2 Chat(又名 Instant)是 OpenAI 5.2 系列中的“轻量化先锋”。它最大的特点是在保持极高响应速度的同时,通过自适应推理技术,在简单对话时快速输出,而在复杂逻辑面前能有选择性地进行深度思考。对于开发者而言,它非常适合构建对实时性要求极高的聊天机器人或智能助手。相比于追求全能但响应较慢的大参数模型,这款模型在保持通用智能水平的基础上,极大地降低了交互延迟,是追求极致用户体验和低成本 API 调用场景下的理想选择。

text generationAPI
0 星标查看详情

gemini-3-flash-preview:batch

google
1048576 ctx

Gemini 3 Flash Preview (Batch) 是 Google 推出的高性能轻量化模型,主打“高性价比”与“快响应”。它在保持接近 Pro 级别推理能力的同时,极大地优化了生成速度,特别适合需要频繁调用、长上下文处理的 Agent(智能体)工作流。对于开发者而言,它在多轮对话逻辑、代码辅助编写以及复杂指令遵循方面表现出色。由于采用了 Batch(批处理)模式,它非常适合处理大规模、非实时的离线任务,如海量文本分类、数据清洗或长文档摘要。相比于追求极致逻辑的重型模型,它更像是一个反应灵敏、能干且省钱的“全能助手”,是构建自动化 AI 工作流的理想选择。

text generationAPI
0 星标查看详情

gemini-3-flash-preview

google
1048576 ctx

Gemini 3 Flash Preview 是 Google 推出的新一代高性能轻量化模型,核心定位是“高速度、高性价比”的思考型模型。它在保持极速响应的同时,推理能力已逼近 Pro 系列,非常适合作为 AI Agent(智能体)的大脑。对于开发者来说,它在多轮对话的逻辑连贯性和复杂代码编写方面表现出色,能够精准调用外部工具执行任务。如果你正在构建需要频繁交互、对延迟敏感且追求高性价比的自动化工作流或编程助手,这款模型是目前市场上极具竞争力的选择,上手门槛极低,通过 API 即可无缝接入现有开发环境。

text generationAPI
0 星标查看详情