Hyppää sisältöön
    • FI
    • ENG
  • FI
  • /
  • EN
OuluREPO – Oulun yliopiston julkaisuarkisto / University of Oulu repository
Näytä viite 
  •   OuluREPO etusivu
  • Oulun yliopisto
  • Avoin saatavuus
  • Näytä viite
  •   OuluREPO etusivu
  • Oulun yliopisto
  • Avoin saatavuus
  • Näytä viite
JavaScript is disabled for your browser. Some features of this site may not work without it.

A corpus of regional American language from YouTube

Coats, Steven (2019-05-17)

 
Avaa tiedosto
nbnfi-fe2019102534827.pdf (1.319Mt)
nbnfi-fe2019102534827_meta.xml (28.11Kt)
nbnfi-fe2019102534827_solr.xml (28.27Kt)
Lataukset: 

URL:
http://ceur-ws.org/Vol-2364/7_paper.pdf

Coats, Steven
RWTH Aachen University
17.05.2019

Coats, Steven (2019) A corpus of regional American language from YouTube. In: Navarretta, C., et al. (eds.) Proceedings of the Digital Humanities in the Nordic Countries 4th Conference Copenhagen, Denmark, March 5-8, 2019, 2364, pp. 79-91. http://ceur-ws.org/Vol-2364/7_paper.pdf

https://rightsstatements.org/vocab/InC/1.0/
© by the paper’s authors. Copying permitted for private and academic purposes.
https://rightsstatements.org/vocab/InC/1.0/
Näytä kaikki kuvailutiedot
Julkaisun pysyvä osoite on
https://urn.fi/URN:NBN:fi-fe2019102534827
Tiivistelmä

Abstract

Recent years have seen an increase in the number of corpora of regional language variation for English, allowing new types of aggregate analysis to be conducted. While the creation of a corpus from written language material is relatively straightforward, transcribing speech is time-consuming, and thus there are no large corpora of transcribed American speech with broad geographic coverage. This paper describes the creation of a new corpus of regional American English from the automatically generated captions of videos from YouTube channels with a local American focus — mainly channels of regional and local government entities or civic organizations. The corpus, which consists of transcripts of over 29,267 hours of spoken language, will enable the analysis of regional patterns of lexical, morphosyntactic, and other types of variation in spoken American English. Exploratory analysis and mapping of the corpus data indicates regional variation in spoken language is evident.

Kokoelmat
  • Avoin saatavuus [42057]
oulurepo@oulu.fiOulun yliopiston kirjastoOuluCRISLaturiMuuntaja
SaavutettavuusselosteTietosuojailmoitusYlläpidon kirjautuminen
 

Selaa kokoelmaa

NimekkeetTekijätJulkaisuajatAsiasanatUusimmatSivukartta

Omat tiedot

Kirjaudu sisäänRekisteröidy
oulurepo@oulu.fiOulun yliopiston kirjastoOuluCRISLaturiMuuntaja
SaavutettavuusselosteTietosuojailmoitusYlläpidon kirjautuminen