For en stund tilbake lyste arkivverket ut penger som skulle kastes på de som ville se på bruk av kunstig idioti i arkivsammenheng. Noen som vet om det kom noe konkret ut av innsatsen? Jeg har gått glipp av annonseringer og kodedeling av eventuelle innsikter og løsninger som kom ut av dette, men tenker det er på tide at jeg ser litt mer på slikt.
Bakgrunnen er at jeg de siste dagene har latt sludderboten min kode en Model Context Protocol-tjeneste som snakker med API-tjeneste i tråd med Noark 5 Tjenestegrensesnitt (med Nikta som implementasjon, naturligvis), som lar meg bruke en kodeagent (testet med opencode) til å oppdatere arkivet.
Tanken er å kunne automatisere plassering i egnet klasse i arkivet, samt enkelt kunne registere nye dokumenter inn i arkivet. Det første jeg gjorde var å be den gå gjennom alle arkiverte epub-filer i mitt testoppsett, se gjennom hver fil for å spore opp aktuelle metadata og sikre at relevante felter ble lagt inn som metadata i arkivstrukturen. Det gikk fint. Siste forsøk var å be den registrere et papirdokument i arkivet med instruks ala dette:
Jeg har mottatt en papirfaktura fra Utleieselskapet AS til Min bedrift AS, fakturanummer 20201 og fakturadato 2026-08-27, med forfallsdato 2026-09-20, for elektrisk kraft. Kan du registrere den i arkivet på egnet sted?
Dette fungerte også utmerket. Så langt har poenget vært å teste ut MCP-implementasjonen for å sikre at den er korrekt og komplett nok til å klare de operasjonene jeg ønsker gjort med arkivet, og sakte men sikkert har jeg oppdaget både mangler med MCP-verktøysettet og API-et til Nikita. Begge deler er under utbedring og bør komme på plass i løpet av høsten.
Takket være alt dette tenkte jeg det var lurt å se hva andre har tenkt rundt bruken av kunstig idioti i arkivsammenheng, og jeg er dermed veldig interessert i rapporter, artikler, git-depot og annet som kan gi meg innsikt i hva som er gjort fra før på feltet.
Noen her som har peiling?
[Petter Reinholdtsen]
Bakgrunnen er at jeg de siste dagene har latt sludderboten min kode en Model Context Protocol-tjeneste som snakker med API-tjeneste i tråd med Noark 5 Tjenestegrensesnitt (med Nikta som implementasjon, naturligvis), som lar meg bruke en kodeagent (testet med opencode) til å oppdatere arkivet.
Da er første utkast klart. Du kan ta en titt på <URL: https://github.com/petterreinholdtsen/noark5-tg-mcp >. Jeg er ikke trygg på at verktøytilgang er stabilt, og mistenker instrukene vil justeres litt etter mer erfaring. Det er byggeregler for Debian-pakke (kjør 'debuild') som kan installeres for enkel bruk. En kan kjøre 'noark5-tg-mcp --list-tools-full' for å se hvilke verktøy og instrukser som tilbys via kodeagent til ens sludderbot. Oppsett og slikt er beskrevet i README-filen. Innlogging med OpenID Connect er ikke testet, så jeg antar det er noe feil der. Har kun testet oppsettet for opencode, claude-innstillingene antar jeg er fri fantasi inntil noe bekrefter det motsatte, men jeg antar det uansett er tilstrekkelig til å forstå hvordan sette opp.
On 2026-08-28 13:50, Petter Reinholdtsen wrote:
For en stund tilbake lyste arkivverket ut penger som skulle kastes på de som ville se på bruk av kunstig idioti i arkivsammenheng. Noen som vet om det kom noe konkret ut av innsatsen? Jeg har gått glipp av annonseringer og kodedeling av eventuelle innsikter og løsninger som kom ut av dette, men tenker det er på tide at jeg ser litt mer på slikt.
https://www.nasjonalarkivet.no/
Bakgrunnen er at jeg de siste dagene har latt sludderboten min kode en Model Context Protocol-tjeneste som snakker med API-tjeneste i tråd med Noark 5 Tjenestegrensesnitt (med Nikta som implementasjon, naturligvis), som lar meg bruke en kodeagent (testet med opencode) til å oppdatere arkivet.
Tanken er å kunne automatisere plassering i egnet klasse i arkivet, samt enkelt kunne registere nye dokumenter inn i arkivet. Det første jeg gjorde var å be den gå gjennom alle arkiverte epub-filer i mitt testoppsett, se gjennom hver fil for å spore opp aktuelle metadata og sikre at relevante felter ble lagt inn som metadata i arkivstrukturen. Det gikk fint. Siste forsøk var å be den registrere et papirdokument i arkivet med instruks ala dette:
Jeg har mottatt en papirfaktura fra Utleieselskapet AS til Min bedrift AS, fakturanummer 20201 og fakturadato 2026-08-27, med forfallsdato 2026-09-20, for elektrisk kraft. Kan du registrere den i arkivet på egnet sted?
Hvilken LLM benytter du? Oolama, Claude.ai, Meta.ai eller OpenAI GPT?
Dette fungerte også utmerket. Så langt har poenget vært å teste ut MCP-implementasjonen for å sikre at den er korrekt og komplett nok til å klare de operasjonene jeg ønsker gjort med arkivet, og sakte men sikkert har jeg oppdaget både mangler med MCP-verktøysettet og API-et til Nikita. Begge deler er under utbedring og bør komme på plass i løpet av høsten.
Takket være alt dette tenkte jeg det var lurt å se hva andre har tenkt rundt bruken av kunstig idioti i arkivsammenheng, og jeg er dermed veldig interessert i rapporter, artikler, git-depot og annet som kan gi meg innsikt i hva som er gjort fra før på feltet.
Noen her som har peiling?
https://github.com/nasjonalarkivet
[Ole Aamot]
Har du funnet noe der som virker relevant? Jeg har ikke lyktes med det.
Hvilken LLM benytter du? Oolama, Claude.ai, Meta.ai eller OpenAI GPT?
Ingen av dem. Jeg bruker for tiden Qwen 3.6 på egen installasjon av llama.cpp.
Finner du noe relevant der? Alt jeg får er "Access forbidden from this IP address".
On 2026-08-30 19:43, Petter Reinholdtsen wrote:
[Ole Aamot]
Har du funnet noe der som virker relevant? Jeg har ikke lyktes med det.
Ja. Jeg sjekket begge.
På finner jeg faktisk en KI-veileder. Forsiden sier uttrykkelig at svarene genereres av kunstig intelligens, og at de kan inneholde feil.
Hvilken LLM benytter du? Oolama, Claude.ai, Meta.ai eller OpenAI GPT?
Ingen av dem. Jeg bruker for tiden Qwen 3.6 på egen installasjon av llama.cpp.
Hva er Qwen 3.6?
Finner du noe relevant der? Alt jeg får er "Access forbidden from this IP address".
Når det gjelder https://github.com/nasjonalarkivet kommer jeg inn uten den IP-blokkeringen du får. Det finnes 18 offentlige repositories. Blant annet ligger Arkade 5, Noark 5-standard, XML-skjemaer og et IIIF-bibliotek der.
Det mest relevante jeg finner ved et raskt søk er imidlertid Noark 5-materialet, særlig metadata- og arkivstrukturene. For eksempel beskrives forfatter, offentligTittel, arkivskaperNavn, dokumentmetadata osv. ganske detaljert.
[Ole Aamot]
På finner jeg faktisk en KI-veileder. Forsiden sier uttrykkelig at svarene genereres av kunstig intelligens, og at de kan inneholde feil.
Jeg tenkte mer på rapporter og kildekode enn at arkivverket har matet innholdet i nettsidene sine til en språkmodell. Uansett, jeg spurte språkmodellen tilgjengelig der om "Arkivverket har utlyst midler og støttet prosjekter relatert til bruk av kunstig idioti (KI) i arkivsammenheng. Hvor kan jeg finne resultatet fra disse prosjektene, gjerne rapporter, kildekode eller annet?" og ble henvist til <URL: https://www.nasjonalarkivet.no/besok-informasjon/arbeid-med-arkivutvikling/a... > som jeg antar er det eneste de har tilgjengelig. Et par stikkprøver sendte meg ikke til noen rapporter som virket relatert til bruk av kunstig idioti, så jeg er like klok.
Hva er Qwen 3.6?
Det er navnet på en modell jeg lastet ned fra huggingface.
Når det gjelder https://github.com/nasjonalarkivet kommer jeg inn uten den IP-blokkeringen du får.
Aha, interessant. Jeg antok den var sperret for alle, men basert på din historie innser jeg at det slipper noen til.