Posts tonen met het label adaptieve digitale documenten. Alle posts tonen
Posts tonen met het label adaptieve digitale documenten. Alle posts tonen

vrijdag 13 april 2012

Ik lees, ik lees wat jij niet leest (2)

Gisteren beschreef ik dat analoge teksten over het algemeen stabiel zijn: ze beginnen linksboven en eindigen na een lineair proces rechtsonder. David Smits zegt daarover:
‘Een auteur van een boek weet precies wat een lezer gelezen heeft wanneer hij bij een bepaalde pagina is [...]
Bij een website is dat anders. Het is moeilijk om te zien waar de lezer vandaan komt en welke pagina de gebruiker vooraf heeft bekeken. En dat is wel relevant voor dat wat je als auteur op de volgende pagina wil schrijven. Mijn systeem maakt dat op een generieke manier mogelijk voor een auteur. Hij ontwerpt niet alleen de inhoud van zijn pagina's, maar ontwerpt ook een domeinmodel. Daarbij koppelt hij de onderwerpen en de relaties tussen de onderwerpen.'
De uiterste consequentie heeft Smits bij zijn proefschrift toegepast: de tekst bestaat alleen online en is niet alleen een beschrijving van de door hem uitgedachte techniek, maar tegelijk ook de demonstratie ervan.
‘Ik vraag de lezer van mijn proefschrift bijvoorbeeld eerst naar zijn belangstelling. Ben je als leek geïnteresseerd in het onderwerp of zit je als expert in het vakgebied? In dat laatste geval hoef ik je niet lastig te vallen met allerlei hints of verhinderen dat je gedetailleerde stukken moeilijk kunt bekijken. Elke muisklik bevestigt dat de lezer iets heeft gelezen en belangstelling heeft in een nieuw onderwerp. Zo leert het systeem van de gebruiker, past het zich aan en gaat andere pagina's aanbevelen. In principe zou een lezer er niets van moeten merken. In de ideale omstandigheid zul je als gebruiker alleen die dingen lezen waar je naar op zoek was en die je kunt begrijpen.'
Dit had niet alleen tot gevolg dat de promotiecommissie niet met papier, maar met tablets aan tafel zal, maar ook - en daar gaat het mij om - dat ieder lid van de commissie een eigen versie van het proefschrift heeft gelezen! Het proefschrift bestaat niet.
(Op dit moment is dat letterlijk zo. Het proefschrift zou hier moeten staan, maar ik krijg al twee dagen een "Bad Gateway" na de redirect. Jammer, jammer, jammer...)

Ik heb de indruk dat die adaptieve webserver nogal wat gevolgen kan hebben voor de archivering van documenten.

In de voorbeelden van gisteren liet ik al zien dat er al jaren op papier en digitaal minder stabiele teksten zijn. Maar die zijn in wezen maar "spielerei". De ga-je-naar-links-of-ga-je-vechten-boekjes zijn dat letterlijk en de andere voorbeelden zijn 'maar' literatuur. Hierbij was het doel van in ieder geval Walter van den Broeck juist om te laten zien dat de wereld niet zo eenduidig en stabiel is, als wij vaak denken.
Maar bij archieven komen we op een ander vlak. Archieven documenteren gebeurtenissen en zijn "bewijs" van die gebeurtenissen. Dit betekent niet dat archiefstukken "waar" of "neutraal" zijn, maar wel dat het op basis van de archiefstukken mogelijk is om een gebeurtenis te reconstrueren. Vaak gaat het hierbij om de vraag: Wie wist wat op welk moment?
Het antwoord op die vraag hangt af van metadata, zoals onder andere bleek uit de discussie over metadata in de Tweede Kamer en Oswald and the CIA. Natuurlijk, een paraaf of een stempel op een papieren document betekent niet onomstotelijk dat iemand iets ook echt gelezen heeft, of zoals De Grave het zij: De minister is wel geïnformeerd, maar hij was niet op de hoogte.
En nu komt daar dus nog een element bij. Want de minister kan geïnformeerd zijn, hij kan het stuk zelfs gelezen hebben en toch niet op de hoogte zijn.
De slimme software van Smits ging er misschien wel van uit dat de minister allerlei zaken al wist en hij dus allerlei informatie over kon slaan. (Of, maar dat is gemeen, misschien vond de software dat sommige passages voor de minister te ingewikkeld waren en kreeg hij ze daarom niet gepresenteerd.)
In principe zou een lezer er niets van moeten merken, nee, maar je zou het wel moeten kunnen weten.

Wat kan dit betekenen voor archieven?
Volgen mij past hier het citaat van Bearman van gisteren op:
If we wished to preserve the game as an archive, the record of my actual ‘moves’ and their consequences would need to be preserved in a way that was directly tied to the actual game I played; these would be represented independently of the technology in which I played the game.
Op de een of andere manier zal dus het pad dat door het document gevolgd is, duurzaam vastgelegd en raadpleegbaar moeten zijn.
Zou Smits daaraan gedacht hebben? Ik denk dat ik hem maar eens een e-mail stuur met deze vragen.

Wat kan het nog betekenen voor archieven?
Een heel ander aspect van deze adaptieve systemen waar archieven hun voordeel mee zouden kunnen doen, is ze gebruiken bij het maken van (digitale) archieftoegangen. De TU/e gebruikt het systeem van Smits al als GALE (Generic Adaptive Learning Environment):
Gebruikers van GALE beseffen nog nauwelijks dat ze aan de hand worden genomen op basis van hun eigen gedrag. Want GALE onthoudt alle gegevens van een lezer. Iedere muisklik van de gebruiker en elke pagina die hij bezoekt worden in het geheugen van een webserver opgeslagen. Op basis van dat 'verleden' komt telkens nieuwe informatie beschikbaar. Meestal in de vorm van aanbevelingen via gekleurde verwijzingen. Maar het kan ook voorkomen dat de webserver stukken informatie (nog) niet toegankelijk maakt omdat de gebruiker wordt geacht zich eerst te verdiepen in andere materie.
Misschien kun je als archiefdienst op deze manier de bezoekers van de digitale studiezaal allemaal individueel bij de hand nemen en helpen of sturen waar dit nodig is. Interessant materie om nog eens wat langer over na te denken.
Misschien moeten we Smits gewoon eens uitnodigen voor een korte speel-en-deelsessie...

Gerelateerd
De dag dat de Kamer over metadata debatteerde
Gelezen: John Newman - Oswald and the CIA
Ik lees, ik lees wat jij niet leest (1)

T-shirt: Heren T-shirt SSSST Ik lees

donderdag 12 april 2012

Ik lees, ik lees wat jij niet leest (1)

Nou hebben we de poppen aan het dansen...
Eerder deze week verwees Joost Geraets op BREED naar adaptieve digitale documenten en de promotie van David Smits.

Vroeger was het leven simpel
Alles zag er voor iedereen hetzelfde uit. Even toegespitst op teksten: die begonnen altijd linksboven en liepen dan van links naar rechts, van boven naar beneden. (In sommige taalgebieden was dit andersom, van rechtsboven naar linksonder, maar dat maakt in principe geen verschil.)
En, eenmaal vastgelegd, dan bleef de tekst altijd hetzelfde. Het handschrift van de Beatrijs dat hiernaast staat, ziet er na bijna 640 jaar nog hetzelfde uit, wordt, technisch gezien, nog op dezelfde manier gelezen en de huidige lezer, leest precies dezelfde tekst als de lezer uit 1374.

Digitaal werd langzaam alles anders
Bij digitale bestanden veranderde in het begin niet zo heel veel.
Ja, je kon niet alle bestanden op alle computers gebruiken en de grootte van je scherm bepaalde vaak de pagina-opmaak. Maar de tekst was de tekst en bleef de tekst.
Maar, langzaam ontstond het besef dat er door de digitalisering heel veel veranderde. David Bearman illustreerde (p.29) dit in 2005 aan de hand van een computerspel:
in the mid 1980s I played a computer game, on an Apple IIe computer, that introduced me to the economic and social world of France in the Middle Ages or early Renaissance. I recall, now somewhat vaguely, learning that the money I had accumulated was of no use in obtaining the bride I desired; it would have been far better for me to hold on to economically worthless lands and obtain a silly position in the court. If we wanted to ‘preserve’ this game, as a library, we could obtain the logical design together with the rules and options of play in ASCII text that will be easy to read even fifty years from now. If we wanted to preserve my game as a museum, a video of me playing the game and an Apple IIe computer would probably best document the experience, but the video would need to be migrated to new media and formats to be usable in fifty years. If we wished to preserve the game as an archive, the record of my actual ‘moves’ and their consequences would need to be preserved in a way that was directly tied to the actual game I played; these would be represented independently of the technology in which I played the game. In contrast, if we are interested in preserving the game as functional software, we might adopt a strategy of emulating its operating environment, permitting me to play the game again, but if I did this, it would certainly be with different moves than when I played then.
Interessant is hierbij trouwens dat dit "probleem" zich ook al in de analoge wereld voordoet. Je kunt een doos Monopoly met alle bankbiljetten, kanskaarten, huisjes, hotels en de spelregels bewaren, maar daarmee heb je niet "het spel" bewaard.

362.880x Jef Geys
Maar ook in de stabiele boekvorm kwam je dit al tegen.
Zo heb ik vroeger verschillende boekjes gelezen die als een soort computerspel in elkaar zaten. Ze bestonden uit 500 of meer hoofdstukjes en aan het eind van ieder hoofdstuk moest je kiezen:
Ga je linksaf, ga dan naar hoofdstuk 345, ga je rechtdoor en vechten met het monster, ga dan naar hoofdstuk 192.
Hierdoor was ieder boek natuurlijk voor iedereen anders en de enige manier om vast te leggen "wat er gebeurd is", was door de volgorde waarin je de hoofdstukken gespeeld had, vast te leggen.
Vraagje: Weet iemand of die boekjes nog bestaan en hoe ze heten?

Er waren ook wat meer "high brow-varianten" op dit spel.
Walter van den Broeck, een van mijn favoriete auteurs, heeft in 1970 de roman 362.880 x Jef Geys, een multipel uitgegeven. Hierin wordt een deel van het leven van de Vlaamse kunstenaar Jef Geys beschreven in negen hoofdstukken, vanuit negen verschillende perspectieven. In de allereerste uitgave waren de negen hoofdstukken losse katernen: de lezer kon ze lezen in de volgorde die hij zelf wilde. En deze volgorde bepaalde uiteindelijk welk beeld je van Jef Geys kreeg. (Dat verklaart de titel ook meteen, negen hoofdstukken kun je in 9! = 362.880 verschillende volgordes lezen.) Helaas is de uitgave die ik heb, een gewoon gebonden boek, maar de grap is wel dat de volgorde in iedere herdruk weer anders was.

Hypertext novel
In de jaren negentig waren er ook wel auteurs die experimenteerden met hypertext fictie. De eerste op deze manier vormgegeven en gepubliceerde roman is waarschijnlijk Afternoon, a story van Michael Joyce uit 1990. Je kunt dit boek nog altijd op cd bestellen voor $24,95, maar let op:
This title runs on Macintosh Mac OS X 10.3-10.6 (Panther through Snow Leopard) and on 32-bit Windows XP through Windows 7. It is not yet compatible with Mac OS X 10.7 (Lion) and 64-bit Windows 7. New editions for these systems, and for iPad, are in preparation. 
De eerste roman die op deze manier op het www werd gepubliceerd, zou Sunshine69 van Bobby Rabyd zijn. De site bestaat nog en is heerlijk jaren negentig. Hieronder zie je de pagina Hell's Angels Oaklandcolors.
Draadjesboek
Een ander bijzonder boek is Traumgedanken van Maria Fischer, waarin de hypertext in fysieke vorm wordt weergegeven door middel van gekleurde draadjes.
To ease the access to the elusive topic, the book is designed as a model of a dream about dreaming. Analogue to a dream, where pieces of reality are assembled to build a story, it brings different text excerpts together. They are connected by threads which tie in with certain key words. The threads visualise the confusion and fragileness of dreams.
En dat ziet er dan zo uit:



Morgen meer over het onderzoek van Smits en de mogelijke gevolgen hiervan voor archivarissen...