这是一个基于 RoBERTa-base 架构的印尼语词性标注(POS Tagging)模型。对于需要处理印尼语自然语言处理(NLP)任务的开发者来说,它是构建语法分析、命名实体识别或文本挖掘等上游任务的基础工具。该模型专注于 Token 分...
w11wo
命名实体识别
2.7M
0
Stanford Deidentifier Base 是一款专注于医疗健康领域隐私脱敏的命名实体识别(NER)模型。它能精准识别文本中的患者姓名、日期、地点等敏感个人信息(PHI),帮助开发者在不泄露隐私的前提下处理医疗数据集。该模型基于 ...
StanfordAIMI
命名实体识别
2.2M
0
bert-base-NER 是一个基于 BERT 基础模型微调的命名实体识别(NER)模型。它将预训练模型的语义理解能力转化为对特定实体的捕捉能力,能够从非结构化文本中精准提取出人名、地名、组织机构名等关键信息。对于开发者而言,该模型无需从...
dslim
命名实体识别
1.7M
0
punctuate all 是一个专注于文本标点恢复的 Token 分类模型。它主要解决的是在语音转文字(ASR)或某些低质量文本抓取中常见的“缺失标点”痛点,能通过上下文语义自动补全句号、逗号等符号。对于开发者而言,它不是一个通用聊天模型...
kredor
命名实体识别
631.4K
0
Sat 3l sm 是一款专注于文本分词与标记分类(Token Classification)的轻量级 AI 模型。不同于通用的大语言模型,它专注于对文本中的特定元素进行精准识别和标注,类似于一个高效的“文本扫描仪”。由于其参数规模较小且采...
segment-any-text
命名实体识别
567.2K
0
这是一个基于 BERT 架构并针对葡萄牙语进行微调的命名实体识别(NER)模型。它专门用于从非结构化文本中精准提取人名、地名、组织机构名等关键实体。对于需要处理葡语数据的开发者来说,它避开了通用模型在小语种上的识别精度问题。该模型上手门槛低...
lfcc
命名实体识别
508.8K
0
deid-roberta-i2b2 是一款专注于医疗健康领域脱敏(De-identification)的命名实体识别模型。它基于 RoBERTa 架构,并在权威的 i2b2 医疗数据集上进行了微调,能够精准识别医疗记录中的患者姓名、日期、地...
obi
命名实体识别
470.4K
0
Privacy Filter 是由 OpenAI 提供的轻量级 Token 分类模型,专门用于在数据进入大模型前自动识别并过滤敏感隐私信息(PII)。对于开发者而言,它像是一个预处理的“过滤器”,能高效识别姓名、邮箱、电话等隐私字段。相比于...
openai
命名实体识别
461.5K
0
这是一个基于 XLM-RoBERTa 预训练模型微调的命名实体识别(NER)模型。它最大的特点是支持多语言处理,能够从非结构化文本中自动识别出人名、地名、组织机构等关键实体。对于需要处理全球化数据或多语言混合文本的开发者来说,它比单一语言模...
Davlan
命名实体识别
383.9K
0
KoELECTRA small v3 是一个针对韩语优化的轻量级预训练模型,采用了高效的 ELECTRA 架构。该版本专注于 Token 分类任务(如命名实体识别 NER),在保持极低计算开销的同时,能精准捕捉韩语文本的语义特征。对于需要处...
Leo97
命名实体识别
331.2K
0
bert-small-pii-detection 是一款轻量级的命名实体识别(NER)模型,专门用于检测文本中的个人可识别信息(PII)。它基于 BERT-Small 架构,在保证识别精度的同时,极大地降低了推理延迟和内存占用,非常适合部署...
gravitee-io
命名实体识别
309.5K
0
这是一个基于多语言 BERT 模型微调的命名实体识别(NER)工具。它在多语言语料上进行了训练,能够识别多种语言文本中的关键实体。对于中国开发者来说,它最大的价值在于其跨语言能力,无需为每种语言单独部署模型即可实现基础的实体提取。上手难度低...
Davlan
命名实体识别
301.9K
0
这是一个专门用于多语言句末标点预测的 Token 分类模型。在处理非结构化文本或多语言抓取数据时,经常会遇到缺失标点导致语义断句困难的问题,该模型能高效识别文本中的句末位置并补全标点。对于需要进行文本清洗、自然语言处理(NLP)预处理的开发...
oliverguhr
命名实体识别
289.4K
0
这是一个基于 BERT-Large 预训练模型,并针对 CoNLL-03 英文数据集微调而成的命名实体识别(NER)模型。简单来说,它能精准地从英文文本中抽取出人名、地名、组织机构名等关键实体。对于需要处理英文语料的中国开发者,该模型提供了...
dbmdz
命名实体识别
2.0K
0
LLMLingua-2 是微软推出的高效 Prompt 压缩模型,该版本基于多语言 BERT 基础模型并在 MeetingBank 数据集上进行了微调。它旨在解决大模型上下文窗口限制和 Token 成本高昂的痛点,通过识别并剔除 Promp...
microsoft
命名实体识别
504
1
ner-english-fast 是由 Flair 团队推出的轻量级英文命名实体识别(NER)模型。它专为追求推理速度的场景设计,能够快速从英文文本中提取人名、地名和组织机构等关键实体。相比于大型 Transformer 模型,它的上手门槛...
flair
命名实体识别
91
0
Privacy Filter Nemotron 是一款基于 GGUF 格式的轻量级 Token 分类模型,专门用于在数据进入大模型前自动识别并过滤敏感隐私信息(如姓名、电话、地址等)。对于在意数据安全、希望在本地部署 AI 服务的中国开发者...
LocalAI-io
命名实体识别
5
0