Blogg om lingvistikk og språkstudier
COLA: lingvistikk og språkstudier.
Språkkorpus og ungdomsspråk.
Bloggen handler om språk i bruk. Artiklene utforsker lingvistikk, språkstudier og muntlig ungdomsspråk, med COLA-korpuset av muntlig spansk ungdomsspråk som dokumentarisk grunnlag.
Illustrert samtalepassasje / ikke korpusdata
Hva finnes her?
Språkstudier med COLA språkkorpus og ungdomsspråk
Bloggen tar for seg begreper, språkendring, etymologi og kommunikasjon. Et muntlig korpus gjør samtidig samtaler søkbare og sammenlignbare; COLA språkkorpus dokumenterer ungdommers talemål gjennom prosjektmateriale, publikasjoner og transkripsjoner.
Artiklene forklarer begrepene, mens språkkorpuset viser hvordan de ser ut i faktisk tale. Korpuset selv, med tilgang til tekst og lyd, har sin egen side hos Høgskolen i Østfold: Cola-korpuset.
Transkripsjonene er merket med talerbytte, overlapp og pauser, slik at samtalestrukturen kan leses direkte i teksten. Bibliografien viser hvem som har brukt materialet, til hvilke spørsmål, og hvor arbeidet er publisert. Materialet er spansk: opptakene ble gjort blant ungdom i Madrid, Buenos Aires og Santiago de Chile, og korpuset er kommet til gjennom et samarbeid mellom Universitetet i Bergen og Høgskolen i Østfold.
Samtale som struktur
Et korpus består av stemmer i sammenheng
Feltet er en illustrativ inngang til arkivet. Hvert spor representerer en samtaletur; linjene viser hvordan ytringer følger og overlapper hverandre. Det er ikke en måling av korpusets størrelse.
Kilder i arkivet
Daterte spor i prosjektmaterialet
Tidslinjen samler daterte kilder som faktisk finnes i materialet. Bruk piltastene når tidslinjen har fokus.
Prosjektdokumenter
Transkripsjoner og kilder i korpusmaterialet
| Dokument | Språk | Format | Rolle |
|---|---|---|---|
| Transkripsjoner | Spansk | HTML | Korpusinngang |
| Lenguaje transcrito | Spansk | HTML | Publikasjon |
| COLA-korp-OppG | Norsk | Korpusdokument | |
| CITAS Corpus COLA | Spansk | Forskningsdokument | |
| COLA: A Spanish spoken corpus of youth language | Engelsk | HTML | Artikkel |
| Publikasjoner | Norsk | HTML | Publikasjonsliste |
| Klassifisering | Norsk | HTML | Korpusmetode |
| Aktiviteter | Norsk | HTML | Prosjektaktiviteter |
| Eli Drange | Norsk | HTML | Forskerside |
| Miembros históricos | Spansk | HTML | Deltakere |
Les materialet
Forskningen ligger i dokumentene
Bibliografien omfatter artikler, oppgaver, presentasjoner og konferansemateriale knyttet til prosjektet og muntlig ungdomsspråk.
Fra bloggen
Lingvistikk, bruk og betydning

Visuell kilde
Et historisk korpus bak bloggen
Banneret er hentet fra prosjektets eget materiale. Det viser navnet Proyecto COLA sammen med undertittelen Corpus Oral de Lenguaje Adolescente, slik prosjektet presenterte seg utad mens innsamlingen pågikk.
Hvordan materialet ble til
Et språkkorpus bygget på ungdomsspråk

Prosjektet ble drevet ved Universitetet i Bergen som en fortsettelse av Bergen Corpus of London Teenage Language, forkortet COLT, som hadde dokumentert talemålet til ungdom i London. Tanken var å lage for spansk det som allerede fantes for engelsk, og å lage det med samme framgangsmåte, for det er bare da de to datasettene lar seg sammenligne.
Innsamlingen fulgte metoden fra British National Corpus, beskrevet av Crowdy i 1991. Ungdommene gjorde opptakene selv, med minidisc-spillere de hadde med seg i vanlige samtaler med jevnaldrende, uten voksne til stede. Det siste er et krav i designet og ikke en tilfeldighet: en forsker i rommet gir en annen slags tale, mer påpasselig og mindre spontan. Deltakerne var mellom tretten og nitten år, og de ble i tillegg klassifisert etter sosialt sjikt, slik at en forskjell mellom to byer kan skilles fra en forskjell mellom to grupper.
Materialet er organisert i tre delkorpus etter innsamlingsby: COLAm i Madrid, COLAb i Buenos Aires og COLAs i Santiago de Chile. Opptakene ble transkribert med programmet Transcriber, som knytter hver replikk til en identifisert taler og merker av turer, pauser og overlapp. Det er denne merkingen som gjør COLA språkkorpus søkbart som datasett og ikke bare lesbart som tekst. Uten den ser en avbrytelse og et høflig svar helt like ut på papiret, og forskjellen mellom dem er nettopp det som skal undersøkes.
Det forskerne har lett etter i materialet, er trekk som bare viser seg når folk snakker uten å tenke på hvordan de snakker: pragmatiske markører, tiltaleformer, gruppeleksikon, forsterkere og banning som binder samtalen sammen i stedet for bare å understreke. En egen linje i arbeidet er kontrastiv og sammenligner spansk ungdomsspråk med engelsk og norsk, blant annet om engelske lånord i norsk og chilensk ungdomstale. For en norsk leser er det den nærmeste inngangen til materialet: spørsmålene om lånord og språkendring som bloggen tar opp, er de samme spørsmålene korpuset ble bygget for å svare på med data.
Ofte stilte spørsmål
Spørsmål om korpuset og bloggen
Hva står forkortelsen COLA for?
Corpus Oral de Lenguaje Adolescente, altså muntlig korpus over ungdomsspråk. Navnet ble valgt i forlengelsen av COLT, korpuset over London-ungdommens engelsk, som var samlet inn ved samme universitet tidligere.
Er materialet på norsk?
Nei. Opptakene og transkripsjonene er spanske, fra Madrid, Buenos Aires og Santiago de Chile. Det norske ligger i to andre ting: prosjektet er et samarbeid mellom Universitetet i Bergen og Høgskolen i Østfold, og en del av forskningen sammenligner spansk ungdomstale med norsk, særlig når det gjelder engelske lånord.
Hvorfor er nettopp ungdomsspråk interessant å samle inn?
Fordi det er der endringene kommer først. Ord og vendinger som starter i ungdomsmiljøer, flytter seg ofte oppover i aldersgruppene og ender i vanlig dagligtale noen år etter. Et opptak av femtenåringer i 2003 er derfor også en måling av hva standardspråket kom til å bli.
Kan man lese transkripsjonene rett fram som tekst?
Ikke som prosa. En transkripsjon er merket med talerkoder, klammer for overlapp og tall for pauselengde, og den er laget for å bli søkt i og sitert fra, ikke for å bli lest i ett strekk. Nettopp derfor kan et enkeltfunn plasseres blant de vanlige tilfellene i stedet for å stå alene.
Partnere
