Coral tekst-til-tale datasæt

Description

Datasættet består af oplæsninger fra to professionelle danske talere, en kvinde og en mand, som har indlæst cirka 24 timers dansk tale hver. Datasættet er en del af CoRal-projektet (Danish Conversational and Read-aloud Speech Dataset), som er et bredt samarbejdsprojekt mellem Alexandra Instituttet, Datalogisk institut ved Københavns Universitet (DIKU), Alvenir og Cort. CoRal er finansieret og støttet af Digitaliseringsstyrelsen og Den Danske Innovationsfond. Tekstdata er udvalgt af Alexandra Instituttet og består af sætninger fra lex.dk, sundhed.dk, borger.dk, navne på busstoppesteder og stationer, manuelt filtrerede Reddit-kommentarer samt datoer og tidspunkter. Lyddata er optaget af den offentlige institution Nota, som er en del af Kulturministeriet.

Resources

Name Format Description Link
0 https://huggingface.co/datasets/alexandrainst/coral-tts

Tags

  • lyddata
  • audio-corpus
  • sprog-og-retskrivning
  • kultur
  • text-to-speech
  • tts
  • uddannelse,-kultur-og-sport
  • taledata
  • lydkorpus
  • coral
  • kulturarv
  • tekst-til-tale

Topics

  • EDUC

Categories