SwePub
Sök i LIBRIS databas

  Utökad sökning

id:"swepub:oai:DiVA.org:bth-17741"
 

Sökning: id:"swepub:oai:DiVA.org:bth-17741" > ARDIS :

ARDIS : A Swedish Historical Handwritten Digit Dataset

Kusetogullari, Hüseyin, 1981- (författare)
Blekinge Tekniska Högskola,Institutionen för datalogi och datorsystemteknik,Big Data
Yavariabdi, Amir (författare)
KTO Karatay University, TUR,Department of Mechatronics Engineering
Cheddad, Abbas (författare)
Blekinge Tekniska Högskola,Institutionen för datalogi och datorsystemteknik,Big Data
visa fler...
Grahn, Håkan (författare)
Blekinge Tekniska Högskola,Institutionen för datalogi och datorsystemteknik
Johan, Hall (författare)
Arkiv Digital, SWE
visa färre...
 (creator_code:org_t)
2019-03-29
2020
Engelska.
Ingår i: Neural Computing & Applications. - : Springer Nature Switzerland. - 0941-0643 .- 1433-3058. ; 32:21, s. 16505-16518
  • Tidskriftsartikel (refereegranskat)
Abstract Ämnesord
Stäng  
  • This paper introduces a new image-based handwrittenhistorical digit dataset named ARDIS (Arkiv DigitalSweden). The images in ARDIS dataset are extractedfrom 15,000 Swedish church records which were writtenby different priests with various handwriting styles in thenineteenth and twentieth centuries. The constructed datasetconsists of three single digit datasets and one digit stringsdataset. The digit strings dataset includes 10,000 samplesin Red-Green-Blue (RGB) color space, whereas, the otherdatasets contain 7,600 single digit images in different colorspaces. An extensive analysis of machine learning methodson several digit datasets is examined. Additionally, correlationbetween ARDIS and existing digit datasets ModifiedNational Institute of Standards and Technology (MNIST)and United States Postal Service (USPS) is investigated. Experimental results show that machine learning algorithms,including deep learning methods, provide low recognitionaccuracy as they face difficulties when trained on existingdatasets and tested on ARDIS dataset. Accordingly, ConvolutionalNeural Network (CNN) trained on MNIST andUSPS and tested on ARDIS provide the highest accuracies 58.80% and 35.44%, respectively. Consequently, the resultsreveal that machine learning methods trained on existingdatasets can have difficulties to recognize digits effectivelyon our dataset which proves that ARDIS dataset hasunique characteristics. This dataset is publicly available forthe research community to further advance handwritten digitrecognition algorithms.

Ämnesord

NATURVETENSKAP  -- Data- och informationsvetenskap (hsv//swe)
NATURAL SCIENCES  -- Computer and Information Sciences (hsv//eng)

Nyckelord

Handwritten digit recognition
ARDIS dataset
Machine learning methods
Benchmark

Publikations- och innehållstyp

ref (ämneskategori)
art (ämneskategori)

Hitta via bibliotek

Till lärosätets databas

Sök utanför SwePub

Kungliga biblioteket hanterar dina personuppgifter i enlighet med EU:s dataskyddsförordning (2018), GDPR. Läs mer om hur det funkar här.
Så här hanterar KB dina uppgifter vid användning av denna tjänst.

 
pil uppåt Stäng

Kopiera och spara länken för att återkomma till aktuell vy