Zoekresultaten

  • Het is de meesten waarschijnlijk niet ontgaan: onlangs kwam naar buiten dat het KNAW Humanities Cluster de transcriptie-software Loghi heeft ontwikkeld (https://www.nationaalarchief.nl/beleven/nieuws/unieke-transcriptie-software-nu-open-source-beschikbaar). De hoge nauwkeurigheid en de kosteloosheid maakt deze software erg aantrekkelijk voor ons als archieven. Het probleem is (voorlopig) de gebruiksvriendelijkheid. De software wordt momenteel nog doorontwikkeld door het KNAW en het Nationaal...

  • Wij zijn bij HFA bezig met de dossiers van de Zuiderzeesteunwet. Het gescande deel van deze toegang willen we doorzoekbaar maken. De dossiers bestaan uit scans van gedrukte documenten en handgeschreven brieven. Wij willen de scans van de handgeschreven documenten via Trankribus laten vertalen. Dat betekent dat in elk dossier de handgeschreven scans geselecteerd moeten worden. De vraag: bestaat hier een programma voor, zodat we zelf niet scan voor scan hoeven te bekijken? Met vriendelijke gr...

  • Van een Latijns handschrift uit ca 1280 heb ik - geen latinist - een transcriptie gemaakt. Nu het hele boek klaar is ( 32709 woorden) is de CER on Train Set 18,07% en on Validation Set 29,26%. Zelf heb ik dus geen profijt van deze activiteit. Ik vond in de lijst met modellen niet iets wat er op lijkt. Kan het misschien door anderen worden gebruikt? Met vriendelijke groeten, Jan Willem Briët Ibn_ButlanTaqwin_al-Sihhah latine BNF ms6977.tiff.pdf

  • Update: je kunt de VOC-archieven en notariële akten nu ook doorzoeken zonder iets te installeren, via openarch.nl/htr/. In de video-tutorial hieronder wordt uitgelegd hoe je makkelijk in één keer honderdduizenden HTR-transcripties kunt doorzoeken. In de dataset zitten o.a. VOC-akten van het Nationaal Archief en notariële akten uit het Noord-Hollands Archief. Wat je nodig hebt is dit: De transcripties: bit.ly/HTRtranscripties 7-zip, om de zip-bestanden makkelijk uit te pakken AstroGrep,...

  • 4 februari was het zover. Met meer dan een half jaar vertraging hadden we eindelijk een bijeenkomst met de Regionaal Historische Centra over het project De ijsberg zichtbaar maken. In dat project zetten we handgeschreven teksten om naar informatie die de computer kan lezen. We noemen dat transcriberen. We doen dit met kunstmatige intelligentie. We transcribeerden 1 miljoen scans van de VOC van het Nationaal Archief. Het Noord-Hollands Archief en de andere Regionaal Historische Centra doen m...

  • Case study ABBYY op 18e eeuwse Valentijn tekst Heeft iemand goeie ervaring met het trainen van ABBYY? Ik wil een zo perfect mogelijke OCR uitvoeren op de acht delen Valentijn. Transkribus en een door Annemieke Romeijn gemaakt HTR-model is echt heel goed, maar misschien zijn er alternatieven als het gaat om 17e/18e eeuwse gedrukte teksten. Bijgaand een korte case study waar ik beide tools heel praktisch heb vergeleken. Maar misschien kan het beter, of anders. Suggesties zijn welkom! Tevens ee...

  • Beste collega, Met deze blog wil ik je ‘bijpraten’ over het project De ijsberg zichtbaar maken. Hierin ontsluiten we 2 miljoen scans van archieven met semi-automatische handschriftherkenning. Selectie en trainingsmodellen Voor het project selecteerden we scans van handschriften van het Nationaal Archief (NA) en van de Regionaal Historische Centra (RHC’s). Bij het NA kozen we voor het archief van de VOC uit de 17e en 18e eeuw. Daarnaast deden tien RHC’s mee met het aanleveren van notariële a...

  • Het komende najaar start Het Utrechts Archief met twee projecten waarbij we gevangenisregisters door Transkribus willen halen. Best ingewikkeld vanwege de tabel structuur van de data. Het eerste project doen we samen met Creative Coding Utrecht waarbij we niet alleen 19e en 20e-eeuwse gevangenisregisters willen ontsluiten, maar van deze data ook een digitaal kunstwerk voor het voormalige Pieter Baan Centrum en ons eigen publiekscentrum willen maken. De datakunstenaar die het gaat maken is v...

  • Op KIA kun je op verschillende manieren iets delen met de community. Jullie doen dat met zijn allen regelmatig: een goede manier om je collega’s in het land te betrekken bij vraagstukken, oplossingen of evenementen. Je bent vrij om zelf te kiezen hoe je dat doet, maar de verschillende manieren hebben ieder wel voor- en nadelen, met name bij de keuze tussen een Blog of een Update. Lees de blog van collega Harm Pieters in de Helpdesk van KIA: https://kia.pleio.nl/groups/view/52532002/helpdesk/...

  • Graag willen we ons nieuwe project “Oorlog uit eerste hand: Oorlogsbrieven (1935-1950) van het NIOD digitaal” voorstellen, dat vandaag op 1 juli start. Het wordt gefinancierd door het Mondriaanfonds ‘Oorlog uit Eerste Hand’ heeft tot doel de collectie oorlogsbrieven van het NIOD te digitaliseren, conserveren en beter toegankelijk maken. Dit niet alleen in de NIOD-studiezaal, maar ook, waar wetgeving dit toelaat, online via de NIOD-website en het Netwerk Oorlogsbronnen. We beginnen met het d...

  • Werkt automatische tekstherkenning eigenlijk ook al goed op manuscripten met een vorm van archiefschade? Bijgaand (vrij beschikbaar) artikel publiceer ik hierbij naar aanleiding van een kort onderzoek naar de toepassing van bestaande handschriftherkenning op gedigitaliseerde archieven waarbij sprake is van een vermindering van de leesbaarheid van de tekst door materiaalverkleuring en inktvraat. In dit experiment zijn voorbeelden gemaakt om te kunnen meten wat het negatieve effect van arch...

  • Na de publicatie van ons eerste model op Transkribus met ruim 1000 17e-eeuwse brieven van Margaretha Turnor - kasteelvrouwe van Amerongen - is Het Utrechts Archief nu aan het experimenteren met de Text2Image module in Transkribus. We deden dit samen met een groep studenten van de UU met getypte transcripties van wederom 17e-eeuwse brieven uit het familiearchief Martens, een familie die eeuwenlang aan het Janskerkhof in Utrecht woonde. Daarvoor hebben we alle getypte brieven via OCR omgezet na...

  • Heeft iemand ervaring met het koppelen van resultaten uit Transkribus in MAIS-Flexis? Hebben jullie tips op dat gebied? Ik weet dat Transkribus Alto XML kan produceren, maar ik weet niet in hoeverre de bestanden voldoen aan de eisen van MAIS-Flexis.

  • Mijlpaal HTR-modellen maken Begin 2019 startte het Nationaal Archief (NA) met het project De ijsberg zichtbaar maken, waarbij 2 miljoen scans worden ontsloten met behulp van Transkribus, een tool voor automatische handschriftherkenning. De gehele dataset bestaat uit: circa 1 miljoen scans van de VOC uit de 17e en 18e eeuw van het NA; circa 400.000 scans van notariële archieven uit de 19e eeuw van het Noord-Hollands archief (NHA); circa 600.000 scans van notariële archieven...

  • Historische handgeschreven archieven toegankelijk met kunstmatige intelligentie (bericht uit de groep Toegang tot Data geplaatst in september 2019) Het Nationaal Archief heeft de laatste jaren veel gedigitaliseerd. Historische handgeschreven archieven zijn als plaatjes beschikbaar op internet maar de informatie in deze documenten is niet doorzoekbaar. Daar willen we verandering in brengen. In het innovatieve project 'De ijsberg zichtbaar maken' transcriberen we met behulp van m...