Visar inlägg med etikett metadata. Visa alla inlägg
Visar inlägg med etikett metadata. Visa alla inlägg

söndag 30 augusti 2015

Data, information och bevarande

I veckan meddelades det att Riksarkivet lägger ner sin e-arkivtjänst för myndigheter på grund av liten användning. Tanken har varit att myndigheter kunde leverera material som ska arkiveras digitalt direkt från sina egna dokumenthanteringssystem, vilket skulle vara effektivt på många sätt. 

Ett problem är att det finns skillnader mellan tänket inom arkivering och modern dokumenthantering, som inte fixas i en handvändning. Omvärlden har helt enkelt ställt användarvänlighet, ändamålsenlighet och funktionalitet främst vid sin informationsförvaltning. Ibland på bekostnad av trovärdighet och säkerhet på längre sikt. Arkivsektorn har å andra sidan inte gjort marknadsföringen av sina tjänster och vikten av bevaring och kuratering lättare genom att man utvecklat en tung obligatorisk standard, som lämpar sig för ärendehanteringsystem snarare än dokumenthanteringssystem.

Avsikten med Sähke2-standarden är rätt och bra,
men i praktiken kan den vara utmanande.
"Åtgärder" och "Dokumentstatus" är inte något man
styr sin verksamhet med på alla håll.

Länge har man försökt samordna offentlig informationsförvaltning genom sektorns sk JHS-rekommendationer där man tar ställning till bland annat standarder och best practice. Problemet är att dessa inte är bindande (vilket man med ovanstånde exempel å andra sidan kanske kan vara också tacksam för?). För närvarande råder dessutom en del förvirring kring rekommendationernas status och vart man egentligen är på väg. I Finland görs ju ett omfattande business architecture-arbete, som tillsvidare delvis är på ett rätt abstrakt plan. En sak som framstår väldigt tydlig är ändå att semantisk interoperabilitiet kommer att spela en viktig roll, en annan är att man från finansministeriet driver mycket hårt på att få till stånd resultat. 

Det som gör mig personligen lite tveksam är att man inom JHS ( t ex 191) verkar anpassa hela informationsförvaltningen enligt den krångliga arkivstandarden och ytterligare ökar mängden obligatoriska metadata, i stället för att fokusera på just semantisk interoperabilitet (som att sätta upp ordentliga ontologier och URI-tjänster å det snaraste och se till att de används dvs integreras i dokumenthanteringssystemen).  Riksarkivet har en viktig roll då det gäller långsiktigt bevarande i vårt land, men det ser ut som att omvärlden inte kommer att rätta sig efter traditionell arkivteori. Var går gränserna mellan dokumenthantering, informationsförvaltning och arkivering när allt i praktiken flyter ihop i den digitala världen?

På engelska talar man om data management, som jag skulle gärna översätta det med informationsförvaltning. Till det räknas saker som strategisk planering, livscykelhantering, teknik, arkitektur och dataadministration. Till dataadministrationen, å sin sida, hör saker som metadata och dess kvalitet, själva informationens/datas kvalitet, planering av livcykeln, administrativ hantering av rättigheter, ansvar för aktuell referens- och kontextinformation. 

Det här är saker som blir mycket aktuella då vi talar om långsiktigt digitalt bevarande. Kultur- och undervisningsministeriet har ju enligt sitt uppdrag och mycket klokt investerat i en lösning för ändamålet, som går under namnet PAS. PAS är en tjänst som kan åta sig att bevara digitala material "för evigt". PAS är inte en del av arkivverket, utan en tjänst för dem som ministeriet ger rätt att använda den. Arkivverket ansvarar ju bara för en del av de saker vi kanske vill bevara från vår tid. PAS är snarare ett magasin där olika typer av kulturarv och viktiga informationsresurser kan säkerställas för eftervärlden. 

Utmaningen är att tjänsten i sig på inget sätt kan ansvara för administrationen av innehållet. Varje samling eller dataset som landar i PAS-systemet måste ha en ansvarig instans utanför systemet, som beslutar och tar ansvar till exempel för datas kvalitet och den administrativa hanteringen av rättigheter: till vem och på vilka villkor kan materialet lämnas ut? Frågorna blir ännu mer utmanande då det gäller forskningsdata: vad ska sparas, vad ska kastas, vem tar ansvar för sensitiva data, vem betalar för bevaringen, vem tar ansvar för vad som sker i metadata om kontext eller villkor förändras? För vi diskuterar inte längre i ett perspektiv på några år utan på några hundra år ...

Ansvaret landar vad gäller offentlig förvaltning ändå enligt lagen på Riksarkivet. Arkivväsendet står inför verkligen stora utmaningar: Vad och hur ska man prioritera? Vilka är de kritiska framgångsfaktorerna och hur ska man kunna få det inflytande man behöver för att säkerställa digitala material? Vad gäller forskningsdata är diskussionen i startgroparna. 


Det är spännande och intressanta tider. Finland har inte råd att misslyckas i dessa saker, som kräver ett perspektiv längre än ett kvartal, längre än en valperiod och längre än ett människoliv. Det är samtidigt symtomatiskt och en ytterst försvårande omständighet att själva begreppsapparaten (åtminstone på finska, svenska och engelska) är så oklar och virrig. Ett system i form av en teknisk lösning är inte hela lösningen, det behövs väldigt mycket administrativt arbete och ansvar för innehållets kvalitet, utveckling och användning. På lång sikt. Då behöver alla inblandade faktiskt förstå hur komplexa saker det handlar om.

**

Tillägg:

I statsrevisorernas rapport om läget sägs uttryckligen att man bör värna om förtroendet för arkiven och inte lägga ner VAPA-systemet förrän ett ersättande system satts upp. På inrikesministeriet är man förbluffad: man har precis satsat mycket på att ta i bruk VAPA-systemet. Beslutet att VAPA ska läggas ner kommer från Undervisnings- och kulturministeriet (OKM/7/591/2015).

Tillägg två: Ny klarhet i vad som är på gång kom en dryg vecka senare?

lördag 3 januari 2015

Brages Pressarkiv och Presstanda – början på slutet eller något nytt?

Vad har Zacharias Topelius, Fredrika Tengström, J.L. Runeberg, J.V. Snellman, Elias Lönnrot, Eino Leino, Juhani Aho och Arvid Järnefelt gemensamt? Åtminstone det, att alla dessa storheter var engagerade i tidningsvärlden! Det var i den traditionen professor Otto Andersson och arkivarie Albert Hästesko satte i gång verksamheten vid Brages Urklippsverk år 1910. Tidningspressen var ett otroligt viktigt kulturarv, som man visserligen vid Helsingfors Universitetsbibliotek uppgjort ett sökregister för fram till slutet av 1800-talet, men nu hotades de svällande massorna tidningsmaterial av oanvändbarhet eftersom inget register längre kunde göras vid biblioteket. Man beslöt att i samband med Föreningen Brage i Helsingfors grunda ett urklippsverk. Det var ingen poäng med att spara hela tidningar, för det gjordes ju vid biblioteken, utan det viktigaste var sökbarheten, att strukturera innehållet till ett enormt uppslagsverk. Alltså klippte man ut, ordnade upp och sparade innehållet ur svenskspråkiga tidningar och tidskrifter. Tyvärr gjordes inga lika omfattande projekt på den finska sidan.

Tidningsklipp och klippböcker var för många en viktig tradition och ett sätt att dokumentera och spara information under nästan hela 1900-talet. Detta har gällt både institutioner och privatpersoner. På 1990-talet ändrades världen plötsligt i takt med att webben blev allmännare, och verksamheten upphörde på de flesta håll. Men redan före det hade man på Urklippsverket reagerat på den tekniska utvecklingen inom informationsförvaltning. Under arkivchef Siv Westergårds ledning började man i stället för att klippa tidningar skapa en digital katalog över deras innehåll. Beslutet var mycket rationellt, modernt och inspirerat av den datorisering som brett ut sig i biblioteken i vårt land under 1980-talet. Man beslöt också, klokt nog, att bygga en egen databas som med tiden blev en välfungerande, dynamisk teknisk lösning, inte minst tack var insatser av Peter Hjelt som under många år tekniskt upprätthållit och uppdaterat systemet. Strukturen i databasen Press hämtades till stor del från den allmänna internationella biblioteksstandarden, som är mycket välfungerande. De kloka beslut som fattades i början av digitaliseringen har lett till att vi i dag har en fantastisk resurs i form av en fungerande digital söktjänst på Pressarkivets webbsida. Den saknar mig veterligen motsvarighet i världen i sin noggrannhet och omfattning. Inte ens om man skulle ha alla dessa finlandssvenska tidningar bevarade i fullt maskinläsbar text, skulle man på långt när kunna hitta lika bra i det stora materialet.

Det fanns endast ett riktigt stort krux med den fina planen i början av 1990-talet, och det var de för många släktforskare och akademiker så viktiga dödsannonserna, som inte längre gick att hitta via databasens referenser. Att spara hela tidningar tog också mycket plats, och nittiotalets nedskärningar ledde till att man måste flytta till mindre utrymmen. Alltså återgick man till att klippa, men fortsatte parallellt att indexera materialet i databasen. Fördelen med databasen är förstås att man där kan hitta fram till informationen på många vägar, till exempel via upphovsman eller olika ämnesord eller kategorier, i motsats till ett pappersklipp som kan arkiveras endast på ett ställe. Det bör dessutom påpekas att man vid Brages Pressarkiv, som den moderniserade verksamheten nu kallades, var noga med att använda ämneskategorier och ämnesord som i mån av möjlighet följer bibliotekens dito. Det är en sak som vi kan vara tacksamma över idag, eftersom det att man varit noggrann på dessa punkter nu gör att vi faktiskt har kompatibla, länkbara resurser.

Jag vill gärna förklara lite närmare vad det handlar om. Då man gör enkla sökningar i digitala filer, det må vara löpande text eller en databas, klarar datorn i normala fall att söka efter en viss exakt textsträng. Det innebär att man måste använda en exakt matchande stavning, synonym och böjningsform för att få relevanta sökresultat. Säg att man vill hitta information om händer. Ska man då söka efter ”hand”, ”händer” ... eller kanske ”övre extremiteter”? Eller kanske alla dessa? Man hamnar snabbt i en situation där sökandet blir ganska komplicerat, jobbigt och resultatet opålitligt. Om man dessutom söker endast i själva den löpande texten, kan man snabbt ge upp hoppet att få fram information som faktiskt är relevant. Har man däremot manuellt lagt till ämnesord enligt bestämda regler (i detta fall ”händerna”) kan man kolla upp detta och få fram det man behöver. Denna process som kallas manuell indexering eller innehållsbeskrivning, kräver en del kompetens. Det gäller att känna till både materialet man beskriver och dess kontext så att man faktiskt vet vad som hänger ihop med vad och vad som är relevant. Men det gäller också att veta hur de olika verktygen och teknikerna fungerar, så att man får verkligt mervärde av den arbetsinsats som görs. Har man bra verktyg behöver den som lägger till ämnesorden inte ha mycket kunskap om den bakomliggande tekniken.

Det var just den bakomliggande tekniken på Brages Pressarkiv som vi jobbade allra mest med under min tid där (2011–2014), trots att det också resulterade i en mer modern och användarvänlig söktjänst, kallad Presstanda. Detta kunde göras just tack vare de tidigare kloka besluten och det sakkunniga arbete som gjorts under åren. Tekniken har nämligen gått framåt från textsträngssökandet. I dag strävar man till att systemen och sökningarna också ska innehålla lite mer semantik, det vill säga att de ska innehålla information om de bakomliggande begreppen. Det gör att man kan beakta relationer mellan begrepp, så som synonymer eller över- och underordnade begrepp, eller till och med göra sökningar som är språkoberoende. För att det ska fungera behöver man så kallade ontologier, där all denna information om begreppen finns beskriven och lagrad. I Finland har vi internationellt sett kommit ganska långt inom detta område, för vi har faktiskt en nationell ontologitjänst, Finto, där det är meningen att samla olika ontologier från olika kontexter. Inom Pondus, det finlandssvenska nätverket för länkning av data, kom också bland andra Yle, Kulturforum och Brages Pressarkiv överens om samordning som skapar god kompabilitet mellan de olika informationsresurserna. I dag är nämligen inte den digitala världen endast webbsidor, utan det handlar allt mer om applikationer och flöden, som kräver öppna och helst länkade data för att fungera tillfredställande i en splittrad digital miljö.

Det är alltså ingen lösning att skanna in alla tidningsarkiv eller börja lägga lite lösryckta nyckelord på journalistiska material. Det ger kanske en något bättre sökbarhet, men vi har i databasen Presstanda ett fullständigt unikt koncept och en enorm resurs som verkligen betjänar användarna. Ämnesorden är enhetliga och sökningen täcker alla de finlandssvenska dagstidningarna (utom de senaste årens åländska tidningar, eftersom dessa inte hittills varit redo att satsa på de nya digitala samarbetsformerna). Ämnesorden är försedda med semantisk tilläggsinformation och sökningarna kan mycket enkelt anpassas så att man avgränsar sökningen till enskilda tidningar, skribenter, artikeltyper, tidsperioder och så vidare. Funktionalitet och användarvänlighet är överlägsna till exempel alla tidningarnas egna sökfunktioner. Presstanda ger dessutom möjlighet att enkelt använda dess funktioner i andra tjänster. Om bara tidningarna själva ville det, kunde deras sökningar utnyttja Presstanda i bakgrunden. Hittills har man inte vid tidningarna varit särskilt intresserad av detta. Man ser uppenbarligen inte vikten av sökbarhet i arkiven eller till exempel de möjligheter att erbjuda tidningsläsarna anpassade digitala innehåll som systemet kunde erbjuda. Man fortsätter i stället att producera dåligt strukturerade material för miljoner för att sedan låta det begravas i arkiven, eller färdigpaketerade papperstidningar i digitalt format.

Vid Brages Pressarkiv finns också personal som har åratal av erfarenhet och som känner den finlandssvenska kulturen och hurdana behov som finns där gällande informationssökning mycket bra. Dessa personer, just nu de fastanställda Viveka Högnäs-Mellner, Gun Grönroos och Marika Aminoff-Sundell, har stor rutin och sakkunskap gällande indexering av textjournalistik och informationssökning i tidningsmaterial. Vad vi nu ser hända på olika håll är att man vid de mest upplysta tidningarna börjar inse att en liten, liten insats för att förbättra sökbarheten ökar effektiviteten och trovärdigheten avsevärt. Risken finns dock att man nu på alla tidningar separat börjar lägga till påhittade ämnesord lite hur det passar i all hast, i stället för att skapa en hållbar standardiserad lösning. Och vad vore bättre än en centraliserad finlandssvensk indexeringstjänst med experter, som förmånligt och effektivt skapar enhetlig sökbarhet enligt internationella standarder med öppen och länkad data? Det låter visst lite bekant, konceptet?

Den enda utmaningen är tempot som tidningarna kräver, men detta är en sak som går att lösa om man är redo att tänka om och integrera processerna (inklusive de digitala systemen, ”digital first” som jag nämnde i min inledande kommentar i detta nummer [Nya Argus 12/2014]). Det kräver dock att man tillmäter den expertis som finns vid Pressarkivet den status den är värd. För den är som sagt en unik finlandssvensk resurs och möjlighet, som dessutom är hotad på ett skandalöst sätt.

Presstanda kunde också i framtiden erbjuda en allt större krets textproducenter samma möjligheter att skapa synlighet, flöden och sökbarhet för sina material. En del tidskrifter har redan börjat indexera sina material själva och det finns ingenting som säger att inte enskilda journalister eller sammanslutningar som producerar journalistiska material kunde publicera och marknadsföra sina material via Presstanda direkt till allmänheten. Eller varför inte sina böcker? I princip finns tekniken där, den behöver endast små kompletteringar som kostar en spottstyver i jämförelse med de summor man bollar med i branschen i dag. Via Presstanda kunde man samtidigt publicera, distribuera, kuratera, hitta, prenumerera och konsumera precis exakt sådana material på artikelnivå som man är intresserad av. Tack vare de öppna lösningarna behöver inte konsumenterna nödvändigtvis ens använda Presstanda, utan information kan hitta dem andra vägar, via applikationer, flöden eller länkad data, som till exempel förslag på relaterade material på olika håll.

Frågan är om man är färdig att se på mediefältet i dag och i framtiden ur användarnas perspektiv, och erbjuda dem det de vill ha (inte det de tror att de vill ha). Eller väljer man att lägga ner en indexeringsverksamhet som ligger i framkant både nationellt och internationellt – och bara ”bevara klipparkivet”, vilket man låtit förstå från Svenska litteratursällskapets sida? Det finns en risk att surandet över statens dumma nedskärningar nu leder till att man försitter en chans att skapa en av de nya plattformar som kommer att behövas inom kort. På samma gång gör man sig av med kompetens och verksamheter som är strategiska och kritiska framgångsfaktorer för det svenska i Finland.

Var finns dagens runebergar och lönnrötter och hur ska man kunna trygga att viktiga element av vår kultur inte försvinner eller begravs i ett ogenomträngligt ostrukturerat brus? Hur ska vi försäkra oss om att den finlandssvenska moderna kulturen har digitala rum, forum och kanaler där läsare och skribenter kan hitta varandra, där idéer kan frodas och dialog föras? Hur kan man organisera allt på ett rationellt sätt så att resurser används främst på det viktiga skapandet av texter och andra digitala material som får verklig spridning och genomslag? Det är dessa frågor man borde diskutera. En del av lösningen på alla dessa frågor kunde finnas i Presstanda och Brages Pressarkiv. Men det börjar tyvärr bli bråttom att agera och det krävs vision, strategiskt tänkande och framför allt mod av dem som beslutar om hur tillgångarna fördelas i Svenskfinland.


[Artikeln är tidigare publicerad i Nya Argus 12/2014, som var ett temanummer om finlandsvenska medier]

tisdag 4 november 2014

Kod som poesi och svällande datamassor

Idag fortsätter en av de snofsigare konferenserna jag varit med om i min mentala hemstad Helsingfors, högskolornas it-dagar. Min arbetsgivare CSC är som en central aktör på fältet förstås synligt med i programmet. CSC erbjuder högskolor och universitet många viktiga tjänster och det är faktiskt en av de saker som gör att vårt land har en chans att hålla sig internationellt på en hög nivå vad gäller forskningsinfrastrukturer. Små som vi är globalt sett, ger gemensamma lösningar fina synergier. Finland är på europeisk nivå en viktig aktör t ex vad gäller Eudat-tjänsterna för forskare.

Jag själv uppfattar arbetet med öppen forskning också som en insats för att pressa fram ännu mera synergier och nytta av alla branschens informationssystem. Och det räcker ju förstås inte att man gör det på CSC, utan det handlar om att koordinera och integrera system i hela landet inom forskningssektorn som internationellt sett är stor. Antti Auer från Jyväskylä universitet drog det hela så långt i går som att säga att forskningsinfrastrukturer (underförstått särskilt it-system) håller på att bli en kritisk framgångsfaktor för hela sektorn.

Jag tenderar hålla med honom. För liksom gårdagens keynote Linda Liukas helt kallt konstaterade så blir alla branscher också mjukvarubranscher småningom. Inte minst sådana som handlar om kunskap och information. Det är liksom bättre att vara medveten om det och se det som en chans till kreativitet. 

Linda Liukas både började och slutade sin presentation med Edith Södergran. Liukas arbetar med it-pedagogik och har utarbetat en guide för lärare, eftersom programmering ingår i grundskolans läroplan från 2016. De som ifrågasätter det fiffiga i det hela borde nog få höra hennes föreläsning, som trots några överslag i det hela innehöll många väsentliga poänger kring digitaliseringen av vårt samhälle och vikten av att ge folk (särskilt barn och kvinnor) möjligheter att vara med om att förstå och forma utvecklingen. Datorer och kod är inte farliga, de är roliga redskap för kreativitet.

Själv deltog jag i en panel där vi diskuterade datas betydelse för forskningen i dag och i framtiden. Kvalitet och hantering av de stora datamängderna är en utmaning som vi får försöka tackla så gott vi kan. Avgörande blir nog frågor om god informationsförvaltning och kostnader.


tisdag 13 maj 2014

Tidningstalko!


I går lanserades officiellt det finska Nationalbibliotekets nya webbplats för digitaliserade material. Snabb som ögat, som vanligt, hann Kaisa Kyläkoski kommentera tjänsten redan innan den officiellt publicerades. Själv har jag inte hunnit testa sökningen ordentligt, men jag måste säga att intuitiviteten och användarvänligheten i Talko-tjänsten är berömvärda. Särskilt plus för de många och enkla inloggningssätten. Idén är alltså att man kan klippa i de gamla tidningarna och förse klippen med metadata. Det är mycket lätt att göra och man kan enkelt dela materialet på Facebook. Gärna skulle jag också dela dem över andra tjänster, Pinterest och Twitter nu allra först. Jag saknar också möjligheten att enkelt ladda ner klipp. (Detta som respons till projektet, som gärna ville ha sådan.) 

Överlag är detta både som koncept och som förverkligad tjänst ett jättekliv i rätt riktning, tycker jag. Som övriga utvecklingssätt ser jag möjligheten att anpassa tjänsten för forskningsbehov, så att man kan länka och dela hela samlingar med bestående länkar, samt att utnyttja insamlade metadata mer integrerat i sökningen. Samarbete med utvecklingsarbetet på Riksarkivet skulle säkert gynna alla parter, eftersom det finns många relevanta verktyg på gång på båda håll, dessutom på ett väl kompletterande sätt.

Ämnesorden blir väl kategoriserade om man bemödar sig en aning.
Vidare presenterades Comellus-projektet där man utvecklat ett system för direkt överföring av digitala material från tidningshusen. Kristiina Markkula gav en snabb översikt av de viktigaste trenderna inom media, vilket var mycket intressant. Bland annat sade hon att det går en rätt tydlig gräns i användarbeteende mellan papper och digitala medier vid 45-årsåldern. Upprepade gånger talades det om betydelsen av den långa svansen för att tidningarna ska kunna få sin ekonomi att gå ihop, samt vikten av hittbarhet. Med tanke på det är det lite ledsamt att de finlandssvenska tidningarna envist framhärdar i att bygga slutna silon med dålig sökbarhet. Yles ständigt växande försprång i arbetet med länkad data och flöden baserade på metadata gör inte konkurrenssituationen precis lättare för dem. Att erbjuda anpassade tjänster och flöden och släppa upplagetänket på den digitala sidan skulle vara av största vikt.

onsdag 4 december 2013

Taggar och ämnesord

På dagens Onki-gruppsmöte presenterade Susanna Nykyri intressanta tankegångar som hon också forskat i, det vill säga ämnesordens innersta väsen. Hon kommenterade nu nyckelord som användare sätter på sina bloggar, som ett exempel på hur stor skillnad det kan vara på taggar och ämnesord som professionella indexerare använder. Det är en sak som man bör betänka om man tänker sig att låta allmänheten förse material med beskrivande metadata. Det handlar förstås om ett område det finns mycket forskning kring, hur nyckelord och taggande kan styras och struktureras, så att man får bra kvalitet på sökresultaten.

Jag är inte alls insatt, men ser det som ett faktum att vi lever i en tid då de klara distinktionerna mellan nyckelord och ämnesord, kontrollerade vokabulärer, tesaurier, klasser osv i praktiken övergår i en allt mer glidande skala av tekniker som kan och bör utnyttja, med genomtänkta tekniker, förstås. (Slå förresten inte upp tesaurus i svenska Wikipedia, ordet har en helt felaktig förklaring där och jag hinner inte ändra den nu. Den finska artikeln är däremot på rätt spår.)

Vad som slog mig av de exempel Susanna använde i sin presentation var att taggar ju ofta används som en sorts kommentar till själva texten, ett fenomen som är vanligt i synnerhet på Twitter. Då är inte ens avsikten att hjälpa vid sökningar, eller att förklara innehållet, utan de utgör en sorts metatext till själva inlägget.

Det är ett roligt fenomen. Jag måste omedelbart göra en genomgång av de bloggar jag följer. Jag skippade alla tidskrifter, fackbloggar och sådana som inte har inlägg från de senaste året. Återstod 47 bloggar. Av dem fanns det någon sorts etiketter eller kategorier på 32 stycken. Det var absolut flera än jag väntat mig! Ändå var det snabbt kollat bara två av dem som hade kommenterande "poetiska" etiketter. Det var intressant att notera. Jag tror de facto att många har sådana etiketter och kategorier som faktiskt hjälper läsare att söka i materialet. Men mitt urval är knappast representativt. Synpunkter?




torsdag 12 maj 2011

Är minibilder metadata?

Europeana för en verklig kamp för öppenhet och tryggandet av kulturell allmänning. Samarbetet med Creative Commons resulterade i en "licens" för allmänning. Tanken är skydda fritt material som digitaliseras från att hamna under olika licenser och upphovsrätter. Copyright uppstår ju som bekant inte heller då man digitaliserar material.

Agendan är politisk. Man vill stärka den europeiska kulturen och ekonomin genom att främja tillgången till information av hög kvalitet. Allt material som finns i Europeana (alltså fysiskt dvs metadata, länkar och även minibilder, dvs thumbnails) är i princip allmänning. Europeana driver en mycket framsynt, pragmatisk och modern syn på digitala material.

Problemet är, som vanligt, att lagstiftningen och dess begrepp och premisser är från gångna sekler. Till exempel är det helt löjligt att museer och andra instanser drar sig för att distribuera förhandsvisningsbilder eller till och med minibilder av konstverk på grund av eventuellt oklara upphovsrätter. Europeana erbjuder till och med möjligheten att ha förhandsvisningen på den egna servern. I bästa fall hänvisar man till saker som upphovsrätter. Ännu osakligare svepskäl har hörts. Lyckligtvis finns det kulturarvsorganisationer som rakryggat tar sin uppgift på allvar: kulturen tillhör oss alla. I synnerhet om den omhänderhas med allmännyttiga medel.

Man måste också våga ge användare ansvaret för att respektera copyright där den finns. Kunde man eventuellt i denna världen, i denna tid, anse att upphovsrätten av ett verk inte sträcker sig till en minibild? Det skulle göra livet bra mycket enklare och också ge bättre synlighet för upphovsrättsinnehavaren. Det vore väl en bra sak? Företag agerar gärna på ett sätt som prövar gränser på detta sätt. Men inom arkiv, bibliotek och museer är man ofta mer räddhågsen. Och missar en massa chanser. I värsta fall försvinner delar av den kulturella allmänningen, om man inte ger den fri på webben.

Tillgång är inte det samma som återanvändning. Återanvändning är inte det samma som missbruk. Inte ens fast man gör business på den. Business är tjänster, innovation och arbete för folk.

söndag 26 september 2010

Vad är ett sökgränssnitt och vad är metadata?

Jag fick nyss den ovannämnda frågan mig tillställd och tänkte att svaret kanske kan gläjda någon annan också, än den vänliga person som frågade mig (efter att jag förfallit till dylikt fikonspråk).

Ett sökgränssnitt är helt enkelt det som en användare ser av ett datasystem, exempelvis en databas, på en datorskärm till exempel på webben. Om man söker något material i ett arkiv eller i en bibliotekskatalog, skriver man helt enkelt in i en ruta (eller flera små rutor om man använder s.k. avancerad sökning) sökord och skickar sedan sin sökfråga till systemet genom att klicka på en knapp - "sök" eller motsvarade - eller trycka på radbyte.

Sökfrågan (de ord man skrivit) skickas då från sökgränssnittet in i datasystemet, där det matchas mot informationen som finns lagrad i systemet. Förhoppningsvis får man också sedan tillbaka ett sökresultat som man kan läsa på sin skärm.

Den information som man söker i är ofta så kallad metadata, alltså uppgifter om de olika sakerna och inte inne i själva materialet. Till exempel om man söker i en bibliotekskatalog söker man ju bland uppgifter uttryckligen om böckerna, metadata som någon vänlig bibliotekarie skrivit in, såsom vad boken heter, vem som skrivit den eller ämnesord som berättar vad den handlar om. Om man kan söka i hela innehållet i en bok eller annan text kallas det fulltextsökning, men då måste man ju ha sparat varenda bokstav ur hela boken inne i datasystemet. Sådan sökning är ibland bra, men ofta är den onödigt besvärligt att bygga ett system som kan göra det och att sedan genomföra sökningen och att få ett resultat tillbaka till gränssnittet som duger till något alls.

Man kan söka i Borgå stadsbiblioteks samling genom deras webbgränssnitt som heter Porsse. Då söker man just i metadata om böckerna. Det blir lite svårare att skilja på fulltextsökning och sökning i metadata när det handlar om digitala material, men idén är den samma och söksystemen är olika för olika typer av sökningar.

torsdag 3 september 2009

Voj, voj

I den anglosaxiska världen pågår ett febrilt arbete med den nya Resource Description & Access-standarden (RDA). Man väntar intensivt att den skall bli klar, eftersom det behövs fungerande standarder för katalogisering av det breda spektrum av material som finns i dag. Även inom vårt eget nationella digitala bibliotek har man tänkt sig att man skall utgå från detta regelverk. Den nya katalogiseringsstandardens syfte är att beskriva exakt hur man skall använda olika fält.

Men ack, dokumenten omfattar oräkneliga sidor (innehållsförteckningen är över 100 sidor!!). Jag börjar vara lite benägen att hålla med den något provokativa Henry Gladney: nog borde bibliotekarierna kunna tänka i ny banor! Är det verkligen meningsfullt att författa dylika direktiv i dag?

I viss mån verkar man nog ha tagit ett steg in i databasernas ålder, men marknadsföringen kommer att bli en utmaning utanför bibliotekariernas krets. Också inom biblioteken är jag rädd för att modellen är alldeles för arbetsdryg för att vara värd att utnyttjas fullödigt. Eller ens delvis.

Jag erkänner genast att jag knappast kommer att ens försöka sätta mig in i RDA väldigt grundligt (om alls). Jag är rädd för att genomslagskraften blir lidande. Vilket är synd, för gemensamma regler skulle gynna alla. Samtidigt räcker tyvärr inte Dublin Core eller Google så långt ... Det behövs enkla, klara direktiv.