Når ordsky fungerer, og når den villeder
Du har akkurat kjørt en workshop om kommunikasjon i teamet. 47 deltakere har svart på «hva tar du med deg videre?». Du limer svarene inn i en ordskygenerator. «Kommunikasjon» dukker opp som det største ordet. Du tar en skjermdump, deler i Slack, tenker: bra møte.
Bildet oppsummerer hvor ofte ordene forekommer uten å tolke tilbakemeldingene. I 2011 sammenlignet Jacob Harris, senior programvarearkitekt i The New York Times, denne metoden med å prøve å forstå et protein ved bare å telle aminosyrene.
Slik kan ordskyer villede
Tre ofte omtalte mekanismer gjør at ordskyen forteller noe litt annet enn tallene sier:
- Dobbelkoding: lengre ord og bokstaver med over- og underlengder oppleves som større. Alexander et al. (IEEE TVCG, 2018) bekreftet effekten gjennom en rekke delstudier; effekten er reell, om enn mindre enn kritikere hevder.
- Posisjonsbias: Lohmann, Ziegler & Tetzlaff (INTERACT, 2009) fant at øvre venstre kvadrant trakk uforholdsmessig mange fiksasjoner på tvers av layouts, noe forfatterne tilskriver vestlige lesevaner.
- Synonymblindhet: ordskyen matcher bokstavsekvenser, ikke betydning. «Bil» og «kjøretøy» telles som to ting; temaer som uttrykkes på flere måter blir usynlige.
Samlet gjør dette ordskyen til en projeksjonsflate der leseren selv fyller inn betydningen. Jacob Harris formulerte konsekvensen best i Nieman Lab (2011), etter å ha sett ordsky brukt på WikiLeaks’ krigslogger fra Irak: ordskyen kan fortelle deg hvilke ord som forekommer ofte, men ikke hva de betyr.
«Hver gang jeg ser en ordsky presentert som innsikt, dør jeg litt innvendig,» skriver han. For journalistikk, forskning eller enhver beslutning som krever kontekst, er det forskjellen mellom data og støy.
Når ordsky er nyttig
Ordskyer er nyttige for live deltakelse og for å åpne en samtale om korte svar.
Fernanda Viégas og Martin Wattenberg ved IBM argumenterte allerede i ACM Interactions (2008) for at ordskyer er en visualiseringsform som vokste fram utenfor forskningsmiljøet. De beskrev sosial signalisering som én av formatets funksjoner.
Live publikumsengasjement
Når deltakere sender inn ord fra mobilen og ser dem dukke opp på skjermen i sanntid, kan hver enkelt se bidraget sitt bli en del av den felles visningen. Den umiddelbare tilbakemeldingen oppmuntrer til deltakelse.
Samtaleåpner
«Hva husker du best fra forrige økt?» på en ordsky gir et raskt blikk på hva som sitter igjen. Bruk resultatet til å velge et utgangspunkt, og spør deretter hvorfor enkelte ord forekommer ofte.
Her brukes ordskyen som et sosialt eller retorisk verktøy. De visuelle skjevhetene blir viktige når du tolker resultatet kvantitativt, så gå tilbake til de underliggende svarene før du trekker konklusjoner.
Design-tips for bedre ordskyer
Hearst et al. (IEEE TVCG, 2019) ved UC Berkeley testet om bedre design kan redusere biasene. Funnet: ordskyer med semantisk gruppering, der relaterte ord plasseres i samme sone og gjerne får samme farge, gir betydelig bedre forståelse og oppleves mer estetiske enn tradisjonelle Wordle-utforminger.
- Gruppér ord etter tema der det er mulig
- Bruk farger for å markere semantiske grupper
- Vær klar over at publikum ikke nødvendigvis vet at størrelse = frekvens
- For ren utvinning av hovedkonsepter ser en enkel liste ofte ut til å fungere like godt eller bedre (Felix, Franconeri & Bertini 2017, slik Hearst et al. oppsummerer)
Bedre alternativer når ordsky ikke passer
| Hva du prøver å gjøre | Bedre verktøy |
|---|---|
| Presis frekvenssammenligning | Stolpediagram |
| Identifisere temaer i fritekst | Temakoding + representative sitater |
| Gruppere mange fritekstsvar etter betydning | Embedding-basert clustering (BERTopic, Nomic Atlas) |
| Lange svar / setninger | Kvalitativ gruppering, sitatutvalg |
| Rapportering eller journalistikk | Sitater i kontekst + oppsummering |
| Liten gruppe (under 20) | Direkte samtale, åpen runde |
| Måling av sentiment (positivt/negativt) | Likert-skala eller dedikert sentimentanalyse |
Beslutningstabell
Bruk ordsky når
- Målet er publikumsdeltakelse
- Bidrag er 1–2 ord
- 20+ respondenter
- Du vil diskutere de underliggende svarene
- Et raskt inntrykk er tilstrekkelig
Ikke bruk ordsky når
- Presisjon er viktig
- Svarene er setninger
- Negasjon er meningsbærende
- Som eneste beslutningsgrunnlag
- For formell rapportering
- Med færre enn 20 bidrag
En ordsky viser ordfrekvens i et engasjerende format, men utelater kontekst. Den fungerer godt for live deltakelse og som åpning på en diskusjon. Beslutninger og formelle rapporter bør bruke de underliggende svarene og en egnet analysemetode.
Når noen spør hva tilbakemeldingene sier, går du tilbake til selve svarene.
Vanlige spørsmål
Er ordskyer utdaterte?
Ordskyer er fortsatt nyttige for live deltakelse og som samtaleåpner. Kjente svakheter som dobbelkoding, posisjonsbias og synonymblindhet gjør dem uegnet til presis analyse.
Hvorfor ser noen ord større ut selv om de er like hyppige?
Dette er dobbelkoding-problemet, dokumentert av Alexander et al. i IEEE TVCG (2018). Lange ord fyller mer plass enn korte. Ord med bokstaver som har under- og overlengder (b, g, p, y) ser visuelt større ut enn ord uten. Så «begged» ser større ut enn «source» ved samme fontstørrelse, selv om de har samme frekvens.
Hva er et bedre alternativ for å forstå tilbakemeldinger?
Bruk stolpediagram for presis frekvens, kategorisering eller temakoding for temaer og representative sitater for nyanser. En ordsky kan åpne samtalen, mens beslutninger bør bygge på de underliggende svarene.
Fungerer live ordskyer bedre enn statiske?
Live og statiske ordskyer har de samme visuelle skjevhetene. En live ordsky lar deltakerne se bidragene dukke opp og kan starte en samtale. En statisk ordsky krever fortsatt en egen analyse av den underliggende teksten.
Hvor mange respondenter trenger jeg?
Grove tommelfingerregler fra praksis, ikke forskningsbaserte terskler: i store workshops fungerer en live ordsky som regel godt fra rundt 30–50 bidrag og oppover. I små grupper har det vanligvis mindre for seg; under rundt 20 bidrag blir ordskyen mest en sortert liste, og en åpen runde gir mer. Skal du se mønstre du kan stole på og ikke bare tilfeldig variasjon, trenger du vesentlig mer, gjerne nærmere 100.
Er det greit å bruke ordsky på tilbakemeldinger fra workshopen min?
Bruk den som samtaleåpner eller en rask visuell oppsummering. Spør deltakerne hva de tenker om ordene som forekommer oftest, og les deretter alle svarene før du tar beslutninger eller rapporterer konklusjoner.
Kilder
- Alexander, E. C. et al. (2018). Perceptual Biases in Font Size as a Data Encoding. IEEE Transactions on Visualization and Computer Graphics.
- Felix, C., Franconeri, S. & Bertini, E. (2017). Taking Word Clouds Apart: An Empirical Investigation of the Design Space for Keyword Summaries. IEEE VIS.
- Harris, J. (2011). Word clouds considered harmful. Nieman Lab.
- Hearst, M. A. et al. (2019). An Evaluation of Semantically Grouped Word Cloud Designs. IEEE TVCG.
- Lohmann, S., Ziegler, J. & Tetzlaff, L. (2009). Comparison of tag cloud layouts: Task-related performance and visual exploration. I IFIP Conference on Human-Computer Interaction (INTERACT 2009), s. 392–404.
- Viégas, F. B. & Wattenberg, M. (2008). Tag Clouds and the Case for Vernacular Visualization. ACM Interactions, XV.4.
- Grootendorst, M. (2022). BERTopic: Neural topic modeling with a class-based TF-IDF procedure.
Når ordsky likevel er riktig
Live ordskyer lar deltakerne sende inn ord fra mobilen og se den felles visningen oppdateres. Plenora støtter ordsky, avstemning, quiz og idéinnsamling i samme livepresentasjon.