LayoutLM is a specialized transformer model designed for Document AI, bridging the gap between raw text and visual spati...
impira
document-question-answering
192.9K
0
The Donut-base model finetuned for DocVQA represents a shift toward OCR-free document understanding. Unlike traditional ...
naver-clova-ix
document-question-answering
67.7K
0
The tiny-doc-qa-vision-encoder-decoder is a lightweight, specialized model designed for efficient document question answ...
fxmarty
document-question-answering
5.5K
0
The Donut-based DocVQA model is an OCR-free transformer designed for document visual question answering. Unlike traditio...
Xenova
document-question-answering
1.6K
0
LayoutLMv2-base-uncased-finetuned-docvqa is a multimodal transformer designed for Document Visual Question Answering (Do...
tiennvcs
document-question-answering
718
0
Llama 3.1 PersianQA is a specialized adaptation of the Llama 3.1 architecture, fine-tuned specifically for document-base...
zpm
document-question-answering
475
0
LayoutLMv3 is a multimodal transformer designed for Document Visual Question Answering (DocVQA). Unlike traditional OCR-...
xhyi
document-question-answering
168
0
The bart-qg-finetune-squad model is a specialized encoder-decoder architecture optimized for question generation (QG) ba...
mghan3624
document-question-answering
89
0
OCR DocVQA Donut is an OCR-free document visual question answering model designed to streamline information extraction f...
jinhybr
document-question-answering
72
0
GLM-4VQ is a specialized model optimized for high-precision document question-answering (DocQA). Unlike general-purpose ...
nikravan
document-question-answering
54
0
The Tiny Doc QA Vision Encoder-Decoder is a lightweight model designed specifically for document-based visual question a...
optimum-intel-internal-testing
document-question-answering
44
0
The VieTable Donut DocVQA model is a specialized document visual question answering tool designed to extract structured ...
YuukiAsuna
document-question-answering
34
0