模型分类

AI 模型广场

探索最新最热门的 AI 模型,涵盖 LLM、视觉、音频等多种类型,助你选型与集成。

indonesian roberta base posp tagger

mit
这是一个基于 RoBERTa-base 架构的印尼语词性标注(POS Tagging)模型。对于需要处理印尼语自然语言处理(NLP)任务的开发者来说,它是构建语法分析、命名实体识别或文本挖掘等上游任务的基础工具。该模型专注于 Token 分...
w11wo 命名实体识别
2.7M 0

stanford deidentifier base

mit
Stanford Deidentifier Base 是一款专注于医疗健康领域隐私脱敏的命名实体识别(NER)模型。它能精准识别文本中的患者姓名、日期、地点等敏感个人信息(PHI),帮助开发者在不泄露隐私的前提下处理医疗数据集。该模型基于 ...
StanfordAIMI 命名实体识别
2.2M 0

bert base NER

mit
bert-base-NER 是一个基于 BERT 基础模型微调的命名实体识别(NER)模型。它将预训练模型的语义理解能力转化为对特定实体的捕捉能力,能够从非结构化文本中精准提取出人名、地名、组织机构名等关键信息。对于开发者而言,该模型无需从...
dslim 命名实体识别
1.7M 0

punctuate all

mit
punctuate all 是一个专注于文本标点恢复的 Token 分类模型。它主要解决的是在语音转文字(ASR)或某些低质量文本抓取中常见的“缺失标点”痛点,能通过上下文语义自动补全句号、逗号等符号。对于开发者而言,它不是一个通用聊天模型...
kredor 命名实体识别
631.4K 0

sat 3l sm

mit
Sat 3l sm 是一款专注于文本分词与标记分类(Token Classification)的轻量级 AI 模型。不同于通用的大语言模型,它专注于对文本中的特定元素进行精准识别和标注,类似于一个高效的“文本扫描仪”。由于其参数规模较小且采...
segment-any-text 命名实体识别
567.2K 0

bert portuguese ner

mit
这是一个基于 BERT 架构并针对葡萄牙语进行微调的命名实体识别(NER)模型。它专门用于从非结构化文本中精准提取人名、地名、组织机构名等关键实体。对于需要处理葡语数据的开发者来说,它避开了通用模型在小语种上的识别精度问题。该模型上手门槛低...
lfcc 命名实体识别
508.8K 0

deid roberta i2b2

mit
deid-roberta-i2b2 是一款专注于医疗健康领域脱敏(De-identification)的命名实体识别模型。它基于 RoBERTa 架构,并在权威的 i2b2 医疗数据集上进行了微调,能够精准识别医疗记录中的患者姓名、日期、地...
obi 命名实体识别
470.4K 0

privacy filter

apache-2.0
Privacy Filter 是由 OpenAI 提供的轻量级 Token 分类模型,专门用于在数据进入大模型前自动识别并过滤敏感隐私信息(PII)。对于开发者而言,它像是一个预处理的“过滤器”,能高效识别姓名、邮箱、电话等隐私字段。相比于...
openai 命名实体识别
461.5K 0

xlm roberta base ner hrl

afl-3.0
这是一个基于 XLM-RoBERTa 预训练模型微调的命名实体识别(NER)模型。它最大的特点是支持多语言处理,能够从非结构化文本中自动识别出人名、地名、组织机构等关键实体。对于需要处理全球化数据或多语言混合文本的开发者来说,它比单一语言模...
Davlan 命名实体识别
383.9K 0

KoELECTRA small v3 modu ner

Apache-2.0
KoELECTRA small v3 是一个针对韩语优化的轻量级预训练模型,采用了高效的 ELECTRA 架构。该版本专注于 Token 分类任务(如命名实体识别 NER),在保持极低计算开销的同时,能精准捕捉韩语文本的语义特征。对于需要处...
Leo97 命名实体识别
331.2K 0

bert small pii detection

apache-2.0
bert-small-pii-detection 是一款轻量级的命名实体识别(NER)模型,专门用于检测文本中的个人可识别信息(PII)。它基于 BERT-Small 架构,在保证识别精度的同时,极大地降低了推理延迟和内存占用,非常适合部署...
gravitee-io 命名实体识别
309.5K 0

bert base multilingual cased ner hrl

afl-3.0
这是一个基于多语言 BERT 模型微调的命名实体识别(NER)工具。它在多语言语料上进行了训练,能够识别多种语言文本中的关键实体。对于中国开发者来说,它最大的价值在于其跨语言能力,无需为每种语言单独部署模型即可实现基础的实体提取。上手难度低...
Davlan 命名实体识别
301.9K 0

fullstop punctuation multilang large

mit
这是一个专门用于多语言句末标点预测的 Token 分类模型。在处理非结构化文本或多语言抓取数据时,经常会遇到缺失标点导致语义断句困难的问题,该模型能高效识别文本中的句末位置并补全标点。对于需要进行文本清洗、自然语言处理(NLP)预处理的开发...
oliverguhr 命名实体识别
289.4K 0

bert large cased finetuned conll03 english

Apache-2.0
这是一个基于 BERT-Large 预训练模型,并针对 CoNLL-03 英文数据集微调而成的命名实体识别(NER)模型。简单来说,它能精准地从英文文本中抽取出人名、地名、组织机构名等关键实体。对于需要处理英文语料的中国开发者,该模型提供了...
dbmdz 命名实体识别
2.0K 0

llmlingua 2 bert base multilingual cased meetingbank

apache-2.0
LLMLingua-2 是微软推出的高效 Prompt 压缩模型,该版本基于多语言 BERT 基础模型并在 MeetingBank 数据集上进行了微调。它旨在解决大模型上下文窗口限制和 Token 成本高昂的痛点,通过识别并剔除 Promp...
microsoft 命名实体识别
504 1

ner english fast

Apache-2.0
ner-english-fast 是由 Flair 团队推出的轻量级英文命名实体识别(NER)模型。它专为追求推理速度的场景设计,能够快速从英文文本中提取人名、地名和组织机构等关键实体。相比于大型 Transformer 模型,它的上手门槛...
flair 命名实体识别
91 0

privacy filter nemotron GGUF

apache-2.0
Privacy Filter Nemotron 是一款基于 GGUF 格式的轻量级 Token 分类模型,专门用于在数据进入大模型前自动识别并过滤敏感隐私信息(如姓名、电话、地址等)。对于在意数据安全、希望在本地部署 AI 服务的中国开发者...
LocalAI-io 命名实体识别
5 0