Blogg om lingvistikk og språkstudier

COLA: lingvistikk og språkstudier.
Språkkorpus og ungdomsspråk.

Bloggen handler om språk i bruk. Artiklene utforsker lingvistikk, språkstudier og muntlig ungdomsspråk, med COLA-korpuset av muntlig spansk ungdomsspråk som dokumentarisk grunnlag.

Illustrert samtalepassasje / ikke korpusdata

Hva finnes her?

Språkstudier med COLA språkkorpus og ungdomsspråk

Bloggen tar for seg begreper, språkendring, etymologi og kommunikasjon. Et muntlig korpus gjør samtidig samtaler søkbare og sammenlignbare; COLA språkkorpus dokumenterer ungdommers talemål gjennom prosjektmateriale, publikasjoner og transkripsjoner.

Artiklene forklarer begrepene, mens språkkorpuset viser hvordan de ser ut i faktisk tale. Korpuset selv, med tilgang til tekst og lyd, har sin egen side hos Høgskolen i Østfold: Cola-korpuset.

Transkripsjonene er merket med talerbytte, overlapp og pauser, slik at samtalestrukturen kan leses direkte i teksten. Bibliografien viser hvem som har brukt materialet, til hvilke spørsmål, og hvor arbeidet er publisert. Materialet er spansk: opptakene ble gjort blant ungdom i Madrid, Buenos Aires og Santiago de Chile, og korpuset er kommet til gjennom et samarbeid mellom Universitetet i Bergen og Høgskolen i Østfold.

Samtale som struktur

Et korpus består av stemmer i sammenheng

Feltet er en illustrativ inngang til arkivet. Hvert spor representerer en samtaletur; linjene viser hvordan ytringer følger og overlapper hverandre. Det er ikke en måling av korpusets størrelse.

Illustrasjon av fire samtalesporFire bølgende linjer med markerte ytringspunkter viser turer og svar i en samtale.
A ytringB svarC overlappingD ny tur

Kilder i arkivet

Daterte spor i prosjektmaterialet

Tidslinjen samler daterte kilder som faktisk finnes i materialet. Bruk piltastene når tidslinjen har fokus.

Foredrag om spansk ungdomsspråk

Arkivet viser til et dokumentert foredrag ved Institutt for fremmedspråk i desember 2008.

Arrangementsspor

En bevart arrangementsplakat inngår i dokumentlisten fra prosjektperioden.

Konferanseabstract

Arkivet inneholder en samling relevante abstract fra 2016.

Norske språkartikler

Nettstedet publiserte redaksjonelle introduksjoner til lingvistikk, anglisismer og språkets betydning.

Ord og digital språkbruk

Senere artikler undersøkte etymologi og norsk språk i digitale grensesnitt.

Prosjektdokumenter

Transkripsjoner og kilder i korpusmaterialet

Utvalg av dokumenter i det historiske COLA-arkivet.
DokumentSpråkFormatRolle
TranskripsjonerSpanskHTMLKorpusinngang
Lenguaje transcritoSpanskHTMLPublikasjon
COLA-korp-OppGNorskPDFKorpusdokument
CITAS Corpus COLASpanskPDFForskningsdokument
COLA: A Spanish spoken corpus of youth languageEngelskHTMLArtikkel
PublikasjonerNorskHTMLPublikasjonsliste
KlassifiseringNorskHTMLKorpusmetode
AktiviteterNorskHTMLProsjektaktiviteter
Eli DrangeNorskHTMLForskerside
Miembros históricosSpanskHTMLDeltakere

Les materialet

Forskningen ligger i dokumentene

Bibliografien omfatter artikler, oppgaver, presentasjoner og konferansemateriale knyttet til prosjektet og muntlig ungdomsspråk.

Åpne publikasjoner

Fra bloggen

Lingvistikk, bruk og betydning

01Nedertyske låneord fra hansatiden02Da «De» ble borte fra norsk talespråk03Kodeveksling mellom norsk og engelsk04Hva er et språkkorpus, og hva viser det?05Multietnolekt og debatten om kebabnorsk06Kj-lyden og skj-lyden: en endring i gang07Pragmatiske markører i ungdomsspråk08Hverdagsord med overraskende opphav09Hvordan låneord blir til norske ord10Forsterkere og banning i ungdomsspråk11Dansk arv i det norske skriftspråket12Hva er egentlig lingvistikk?13Hva er anglisisme?14Hvorfor språk er viktig15Etymologien til ordet «casino»16Norsk språkstøtte i mobile grensesnitt17Velkommen til COLA
Historisk banner med teksten Proyecto COLA, Corpus Oral de Lenguaje Adolescente

Visuell kilde

Et historisk korpus bak bloggen

Banneret er hentet fra prosjektets eget materiale. Det viser navnet Proyecto COLA sammen med undertittelen Corpus Oral de Lenguaje Adolescente, slik prosjektet presenterte seg utad mens innsamlingen pågikk.

Se alle de sytten dokumentene i arkivet

Hvordan materialet ble til

Et språkkorpus bygget på ungdomsspråk

Illustrasjon av to lydbølger fra en samtale som går over i jevne, parallelle tekstlinjer, med en minidisc-spiller der opptaket begynner

Prosjektet ble drevet ved Universitetet i Bergen som en fortsettelse av Bergen Corpus of London Teenage Language, forkortet COLT, som hadde dokumentert talemålet til ungdom i London. Tanken var å lage for spansk det som allerede fantes for engelsk, og å lage det med samme framgangsmåte, for det er bare da de to datasettene lar seg sammenligne.

Innsamlingen fulgte metoden fra British National Corpus, beskrevet av Crowdy i 1991. Ungdommene gjorde opptakene selv, med minidisc-spillere de hadde med seg i vanlige samtaler med jevnaldrende, uten voksne til stede. Det siste er et krav i designet og ikke en tilfeldighet: en forsker i rommet gir en annen slags tale, mer påpasselig og mindre spontan. Deltakerne var mellom tretten og nitten år, og de ble i tillegg klassifisert etter sosialt sjikt, slik at en forskjell mellom to byer kan skilles fra en forskjell mellom to grupper.

Materialet er organisert i tre delkorpus etter innsamlingsby: COLAm i Madrid, COLAb i Buenos Aires og COLAs i Santiago de Chile. Opptakene ble transkribert med programmet Transcriber, som knytter hver replikk til en identifisert taler og merker av turer, pauser og overlapp. Det er denne merkingen som gjør COLA språkkorpus søkbart som datasett og ikke bare lesbart som tekst. Uten den ser en avbrytelse og et høflig svar helt like ut på papiret, og forskjellen mellom dem er nettopp det som skal undersøkes.

Det forskerne har lett etter i materialet, er trekk som bare viser seg når folk snakker uten å tenke på hvordan de snakker: pragmatiske markører, tiltaleformer, gruppeleksikon, forsterkere og banning som binder samtalen sammen i stedet for bare å understreke. En egen linje i arbeidet er kontrastiv og sammenligner spansk ungdomsspråk med engelsk og norsk, blant annet om engelske lånord i norsk og chilensk ungdomstale. For en norsk leser er det den nærmeste inngangen til materialet: spørsmålene om lånord og språkendring som bloggen tar opp, er de samme spørsmålene korpuset ble bygget for å svare på med data.

Ofte stilte spørsmål

Spørsmål om korpuset og bloggen

Hva står forkortelsen COLA for?

Corpus Oral de Lenguaje Adolescente, altså muntlig korpus over ungdomsspråk. Navnet ble valgt i forlengelsen av COLT, korpuset over London-ungdommens engelsk, som var samlet inn ved samme universitet tidligere.

Er materialet på norsk?

Nei. Opptakene og transkripsjonene er spanske, fra Madrid, Buenos Aires og Santiago de Chile. Det norske ligger i to andre ting: prosjektet er et samarbeid mellom Universitetet i Bergen og Høgskolen i Østfold, og en del av forskningen sammenligner spansk ungdomstale med norsk, særlig når det gjelder engelske lånord.

Hvorfor er nettopp ungdomsspråk interessant å samle inn?

Fordi det er der endringene kommer først. Ord og vendinger som starter i ungdomsmiljøer, flytter seg ofte oppover i aldersgruppene og ender i vanlig dagligtale noen år etter. Et opptak av femtenåringer i 2003 er derfor også en måling av hva standardspråket kom til å bli.

Kan man lese transkripsjonene rett fram som tekst?

Ikke som prosa. En transkripsjon er merket med talerkoder, klammer for overlapp og tall for pauselengde, og den er laget for å bli søkt i og sitert fra, ikke for å bli lest i ett strekk. Nettopp derfor kan et enkeltfunn plasseres blant de vanlige tilfellene i stedet for å stå alene.

Partnere

komplett oversikt over trygge og sikre gambling- og spillsider