模型分类

AI 模型广场

探索最新最热门的 AI 模型,涵盖 LLM、视觉、音频等多种类型,助你选型与集成。

Wan2.1 T2V 1.3B

apache-2.0
Wan2.1 T2V 1.3B 是一款轻量级且高效的文本生成视频模型。相比于动辄数十亿参数的大模型,它在保持较高生成质量的同时,极大地降低了显存门槛,使得开发者在消费级显卡上也能流畅地进行视频创作和快速迭代。该模型擅长处理短视频片段,能够较...
Wan-AI 文生视频
8.1M 184

Sulphur 2 base

Apache-2.0
Sulphur 2 base 是由 SulphurAI 推出的文本生成视频基础模型。它采用了开放的 Apache-2.0 协议,旨在为开发者提供一个灵活的底层能力池。与许多闭源的视频生成工具不同,该模型更侧重于作为“基座”,允许用户在特定领...
SulphurAI 文生视频
357.4K 0

MiniMax H3 Turbo Lora ComfyUI

apache-2.0
MiniMax H3 Turbo Lora 是专为 ComfyUI 设计的视频生成增强插件,旨在通过 Lora 微调技术提升视频生成的可控性和视觉质量。对于习惯使用 ComfyUI 工作流的开发者来说,它将 MiniMax 强大的视频生成能...
drbaph 文生视频
135.1K 0

Wan2.2 I2V A14B Lightning Diffusers

apache-2.0
Wan2.2 I2V A14B Lightning 是一个高性能的图生视频模型,专门针对推理速度进行了‘闪电级’优化。它能将静态图像转化为高质量的动态视频,在保持画面一致性的同时,极大地降低了生成时间。对于习惯使用 Diffusers 库的...
magespace 文生视频
49.1K 0

Wan2.2 Fun Reward LoRAs

apache-2.0
Wan2.2 Fun Reward LoRAs 是由阿里巴巴 PAI 团队推出的针对视频生成模型 Wan2.2 的微调权重集。该项目旨在解决通用视频模型在特定视觉风格或动态效果上难以精准控制的痛点,通过引入奖励模型(Reward Model...
alibaba-pai 文生视频
40.4K 0

i2vgen xl

mit
i2vgen-xl 是由阿里视觉实验室 (Ali-Vilab) 开源的一款高质量图生视频模型。与常见的文生视频工具不同,它专注于将静态图像转化为流畅的动态视频,能有效保持原图的视觉一致性,避免在生成过程中出现严重的形变。对于开发者而言,该模...
ali-vilab 文生视频
35.4K 0

Wan2.1 T2V 1.3B Diffusers

apache-2.0
Wan2.1 T2V 1.3B 是一个轻量级的文本生成视频模型,现已集成至 Diffusers 库中,极大降低了开发者的部署门槛。相比于动辄数十 B 参数的视频大模型,1.3B 版本在保持不错画质的同时,大幅降低了显存占用,使得在消费级 G...
Wan-AI 文生视频
12.6K 14

Wan2.2 TI2V 5B Diffusers

apache-2.0
Wan2.2 TI2V 5B 是一款由 Wan-AI 推出的图生视频模型,目前已通过 Diffusers 库集成,极大降低了开发者的部署门槛。该模型主打高质量的动态还原,能够将静态图片转化为流畅且符合物理逻辑的视频片段。对于习惯使用 Hug...
Wan-AI 文生视频
11.4K 22

Wan2.2 TI2V 5B GGUF

apache-2.0
Wan2.2 TI2V 5B GGUF 是一个基于图生视频(TI2V)能力的轻量化量化版本。它将原版模型通过 GGUF 格式压缩,大幅降低了对显存的依赖,使得个人开发者在消费级 GPU 上也能流畅运行视频生成任务。该模型专注于将静态图像转化...
QuantStack 文生视频
9.3K 18

Wan2.2 T2V A14B GGUF

apache-2.0
Wan2.2 T2V A14B GGUF 是由 QuantStack 提供的量化版本视频生成模型。它将原版 14B 参数的强大视频生成能力通过 GGUF 格式进行压缩,极大地降低了显存占用,让消费级显卡用户也能在本地尝试高质量的文生视频。该...
QuantStack 文生视频
8.6K 17

Wan2.2 T2V A14B Diffusers

apache-2.0
Wan2.2 T2V A14B 是一款由 Wan-AI 推出的高性能文本生成视频模型。该版本通过 Diffusers 库集成,极大地降低了开发者的部署门槛,能够快速适配到现有的 AI 工作流中。它在视频画质、动态流畅度以及对复杂中文/英文提...
Wan-AI 文生视频
5.1K 9

Wan2.1 T2V 14B Diffusers

apache-2.0
Wan2.1 T2V 14B 是一款由 Wan-AI 推出的高性能文本生成视频模型。该版本通过 Diffusers 库集成,极大降低了开发者的部署门槛,支持在主流 AI 框架下快速调用。它在保持 14B 参数量带来的强大语义理解能力的同时,...
Wan-AI 文生视频
4.3K 5

wan 1.3b gguf

apache-2.0
Wan 1.3B GGUF 是由 Calcuis 提供的轻量化视频生成模型量化版本。它将原本庞大的视频生成能力压缩至 1.3B 参数规模,并通过 GGUF 格式优化,使得普通开发者无需顶配 A100 显卡,在消费级 GPU 甚至部分大内存设...
calcuis 文生视频
2.5K 7

Sulphur 2 base GGUF

Apache-2.0
Sulphur 2 base GGUF 是一个基于 GGUF 格式量化的文本生成视频基础模型。对于国内开发者而言,GGUF 格式最大的意义在于大幅降低了显存门槛,使得在消费级 GPU 甚至大内存 Mac 上本地部署视频生成能力成为可能。该模...
Abiray 文生视频
1.4K 7

FastWan2.2 TI2V 5B FullAttn Diffusers

apache-2.0
FastWan2.2 是一款由 FastVideo 推出的 5B 参数量级视频生成模型,主打 TI2V(文本到视频)能力。该版本采用了 FullAttn(全注意力机制)并适配了 Diffusers 库,这意味着开发者可以像调用 Stable...
FastVideo 文生视频
556 4

FineToon Texttovideo

apache-2.0
FineToon 是一款专注于将文本转化为视频的开源生成模型。与追求极致写实的模型不同,它更侧重于风格化的视觉呈现,能够将简单的文字描述转化为具有艺术感或动漫风格的短视频。对于国内开发者而言,由于其采用 Apache-2.0 协议,部署门槛...
AiCoderv2 文生视频
63 0

text to video ms 1.7b

creativeml-openrail-m
Text-to-Video MS 1.7B 是一款轻量级的文本生成视频模型。虽然参数规模仅为 1.7B,但其核心目标是在保证生成质量的同时,大幅降低对显存的依赖,让更多开发者能够在消费级显卡上尝试视频生成。该模型适合用于快速原型开发、短视频...
nachikethmurthy666 文生视频
33 0

caT text to video 2.3b

apache-2.0
caT text-to-video 2.3b 是一款轻量级的文本生成视频模型,由 motexture 提供并采用 Apache-2.0 开源协议。不同于动辄数十亿参数的巨型模型,它在 2.3B 的参数规模下实现了较好的生成效率,适合开发者在...
motexture 文生视频
20 0

text to video model

apache-2.0
这是一个基于 Apache-2.0 协议的开源文本生成视频模型。它旨在将简单的文字描述转化为动态视频片段,适合开发者在自己的应用中集成视频生成能力,或 AI 爱好者尝试低成本的短视频创作。相比于闭源的商业大模型,该模型提供了更高的定制自由度...
Deepak1206 文生视频
20 0