What's New

 OBRAZ 
OBRAZ
Description:
The key idea of our project is to convey to the widest possible readership detailed abstracts of the testimonies of Roma and Sinti and thus their personal and irreplaceable experience of the Second World War. We hope that ...
 This item contains 1 file (6.53 MB).
 
Publicly Available Distributed under Creative Commons Attribution Required
 toolService 
toolService
Author(s):
Description:
Tokenizer, POS Tagger, Lemmatizer and Parser models for 147 treebanks of 78 languages of Universal Depenencies 2.15 Treebanks, created solely using UD 2.15 data (https://hdl.handle.net/11234/1-5787). The model documentation ...
 This item contains 1 file (8.53 GB).
 
Publicly Available Distributed under Creative Commons Attribution Required Noncommercial Share Alike
 corpus 
corpus
Description:
*** german version see below *** The ‘Ancillary Monitor Corpus: Common Crawl - german web’ was designed with the aim of enabling a broad-based linguistic analysis of the German-language (visible) internet over time - ...
 This item contains 272 files (53.6 GB).
 
Publicly Available Distributed under Creative Commons Attribution Required Noncommercial Share Alike

Most Viewed Items

Top Last Week
 corpus 
corpus
Author(s):
Zeman, Daniel ; et al.show everyone Zeman, Daniel ; Nivre, Joakim ; Abrams, Mitchell ; Ackermann, Elia ; Aepli, Noëmi ; Aghaei, Hamid ; Agić, Željko ; Ahmadi, Amir ; Ahrenberg, Lars ; Ajede, Chika Kennedy ; Akhundjanova, Arofat ; Akkurt, Furkan ; Aleksandravičiūtė, Gabrielė ; Alfina, Ika ; Algom, Avner ; Alnajjar, Khalid ; Alzetta, Chiara ; Andersen, Erik ; Andrews, Matthew ; Antonsen, Lene ; Aoyama, Tatsuya ; Aplonova, Katya ; Aquino, Angelina ; Aragon, Carolina ; Aranes, Glyd ; Aranzabe, Maria Jesus ; Arıcan, Bilge Nas ; Arnardóttir, Þórunn ; Arutie, Gashaw ; Arwidarasti, Jessica Naraiswari ; Asahara, Masayuki ; Ásgeirsdóttir, Katla ; Aslan, Deniz Baran ; Asmazoğlu, Cengiz ; Ateyah, Luma ; Atmaca, Furkan ; Attia, Mohammed ; Atutxa, Aitziber ; Augustinus, Liesbeth ; Avelãs, Mariana ; Badmaeva, Elena ; Balasubramani, Keerthana ; Ballesteros, Miguel ; Banerjee, Esha ; Bank, Sebastian ; Barbosa, Bryan Khelven da Silva ; Barbu Mititelu, Verginica ; Barkarson, Starkaður ; Basile, Rodolfo ; Basmov, Victoria ; Batchelor, Colin ; Bauer, John ; Bedir, Seyyit Talha ; Behzad, Shabnam ; Belieni, Juan ; Bengoetxea, Kepa ; Benli, İbrahim ; Ben Moshe, Yifat ; Berg, Ansu ; Berk, Gözde ; Bhat, Riyaz Ahmad ; Biagetti, Erica ; Bick, Eckhard ; Bielinskienė, Agnė ; Bilgin Taşdemir, Esma Fatıma ; Bjarnadóttir, Kristín ; Blaschke, Verena ; Blokland, Rogier ; Böbel, Nina ; Bobicev, Victoria ; Boizou, Loïc ; Bonilla, Johnatan ; Borges Völker, Emanuel ; Börstell, Carl ; Bosco, Cristina ; Bouma, Gosse ; Bowman, Sam ; Boyd, Adriane ; Braggaar, Anouck ; Branco, António ; Brokaitė, Kristina ; Burchardt, Aljoscha ; Cabeza, Carmen ; Cáceres Arandia, Natalia ; Campos, Marisa ; Candito, Marie ; Caron, Bernard ; Caron, Gauthier ; Carvalheiro, Catarina ; Carvalho, Rita ; Cassidy, Lauren ; Castro, Maria Clara ; Castro, Sérgio ; Cavalcanti, Tatiana ; Cebiroğlu Eryiğit, Gülşen ; Cecchini, Flavio Massimiliano ; Celano, Giuseppe G. A. ; Çepani, Anila ; Čéplö, Slavomír ; Cesur, Neslihan ; Cetin, Savas ; Çetinoğlu, Özlem ; Chalub, Fabricio ; Chamila, Liyanage ; Chamoreau, Claudine ; Chauhan, Shweta ; Chen, Yifei ; Chi, Ethan ; Chika, Taishi ; Cho, Yongseok ; Choi, Jinho ; Chontaeva, Bermet ; Chun, Jayeol ; Chung, Juyeon ; Cignarella, Alessandra T. ; Cinková, Silvie ; Collomb, Aurélie ; Çöltekin, Çağrı ; Connor, Miriam ; Corbetta, Claudia ; Corbetta, Daniela ; Costa, Francisco ; Courtin, Marine ; Crabbé, Benoît ; Cristescu, Mihaela ; Cvetkoski, Vladimir ; Dahan, Netanel ; Dale, Ingerid Løyning ; Daniel, Philemon ; Davidson, Elizabeth ; de Alencar, Leonel Figueiredo ; Dehouck, Mathieu ; de Laurentiis, Martina ; de Marneffe, Marie-Catherine ; de Paiva, Valeria ; Derin, Mehmet Oguz ; de Souza, Elvis ; Diaz de Ilarraza, Arantza ; Díaz Hernández, Roberto Antonio ; Dickerson, Carly ; Di Felippo, Ariani ; Dinakaramani, Arawinda ; Di Nuovo, Elisa ; Dione, Bamba ; Dirix, Peter ; Do, Hoa ; Dobrovoljc, Kaja ; Döhmer, Caroline ; Doyle, Adrian ; Dozat, Timothy ; Droganova, Kira ; Duran, Magali Sanches ; Dwivedi, Puneet ; Ebert, Christian ; Eckhoff, Hanne ; Eguchi, Masaki ; Eiche, Sandra ; Eiselen, Roald ; Eli, Marhaba ; Elkahky, Ali ; Ephrem, Binyam ; Erina, Olga ; Erjavec, Tomaž ; Eslami, Soudabeh ; Essaidi, Farah ; Etienne, Aline ; Evelyn, Wograine ; Facundes, Sidney ; Farkas, Richárd ; Faryad, Ján ; Favero, Federica ; Ferdaousi, Jannatul ; Fernanda, Marília ; Fernandez Alcalde, Hector ; Fethi, Amal ; Foster, Jennifer ; Fransen, Theodorus ; Freitas, Cláudia ; Fujita, Kazunori ; Gajdošová, Katarína ; Galbraith, Daniel ; Galy, Edith ; Gamba, Federica ; Garcia, Marcos ; García-Miguel, José María ; Gärdenfors, Moa ; Gaustad, Tanja ; Genç, Efe Eren ; Gerardi, Fabrício Ferraz ; Gerdes, Kim ; Gessler, Luke ; Ginter, Filip ; Godoy, Gustavo ; Goenaga, Iakes ; Gojenola, Koldo ; Gökırmak, Memduh ; Goldberg, Yoav ; Goldin, Gili ; Gómez Guinovart, Xavier ; González Saavedra, Berta ; Griciūtė, Bernadeta ; Grioni, Matias ; Grobol, Loïc ; Grūzītis, Normunds ; Guillaume, Bruno ; Guiller, Kirian ; Guillot-Barbance, Céline ; Güngör, Tunga ; Gurevich, Vladimir ; Habash, Nizar ; Hafsteinsson, Hinrik ; Hajič, Jan ; Hajič jr., Jan ; Hämäläinen, Mika ; Hà Mỹ, Linh ; Han, Na-Rae ; Hanifmuti, Muhammad Yudistira ; Harada, Takahiro ; Hardwick, Sam ; Harris, Kim ; Hassert, Naïma ; Haug, Dag ; Heinecke, Johannes ; Hellwig, Oliver ; Hennig, Felix ; Hladká, Barbora ; Hlaváčová, Jaroslava ; Hociung, Florinel ; Hoefels, Diana ; Hohle, Petter ; Howell, Nick ; Huang, Yidi ; Huerta Mendez, Marivel ; Hwang, Jena ; Ikeda, Takumi ; Iliadou, Inessa ; Ingason, Anton Karl ; Ion, Radu ; Irimia, Elena ; Ishola, Ọlájídé ; Islamaj, Artan ; Ito, Kaoru ; Iurescia, Federica ; Jagodzińska, Sandra ; Jannat, Siratun ; Jelínek, Tomáš ; Jha, Apoorva ; Jiang, Katharine ; Jobanputra, Mayank ; Johannsen, Anders ; Jónsdóttir, Hildur ; Jørgensen, Fredrik ; Juutinen, Markus ; Kaşıkara, Hüner ; Kabaeva, Nadezhda ; Kahane, Sylvain ; Kanayama, Hiroshi ; Kanerva, Jenna ; Kara, Neslihan ; Karahóǧa, Ritván ; Kåsen, Andre ; Kayadelen, Tolga ; Kengatharaiyer, Sarveswaran ; Kettnerová, Václava ; Kharatyan, Lilit ; Kirchner, Jesse ; Klementieva, Elena ; Klyachko, Elena ; Kocharov, Petr ; Köhn, Arne ; Köksal, Abdullatif ; Kopacewicz, Kamil ; Korkiakangas, Timo ; Köse, Mehmet ; Koshevoy, Alexey ; Kote, Nelda ; Kotsyba, Natalia ; Kovačić, Barbara ; Kovalevskaitė, Jolanta ; Kowner, Emmanuelle ; Krek, Simon ; Krishnamurthy, Parameswari ; Kübler, Sandra ; Kuqi, Adrian ; Kuyrukçu, Oğuzhan ; Kuzgun, Aslı ; Kwak, Sookyoung ; Kyle, Kris ; Laan, Käbi ; Laippala, Veronika ; Lambertino, Lorenzo ; Landau, Israel ; Lando, Tatiana ; Larasati, Septina Dian ; Lavrentiev, Alexei ; Lee, John ; Lê Hồng, Phương ; Lenci, Alessandro ; Lertpradit, Saran ; Leung, Herman ; Levina, Maria ; Levine, Lauren ; Li, Cheuk Ying ; Li, Josie ; Li, Keying ; Li, Yixuan ; Li, Yuan ; Lim, KyungTae ; Lima Padovani, Bruna ; Lin, Yi-Ju Jessica ; Lindén, Krister ; Liu, Yang Janet ; Ljubešić, Nikola ; Lobzhanidze, Irina ; Loginova, Olga ; Lopes, Lucelene ; Luftiu, Edita ; Lukashevskyi, Arsenii ; Lusito, Stefano ; Lutgen, Anne-Marie ; Luthfi, Andry ; Luukko, Mikko ; Lyashevskaya, Olga ; Lynn, Teresa ; Macketanz, Vivien ; Mahamdi, Menel ; Maillard, Jean ; Makarchuk, Ilya ; Makazhanov, Aibek ; Mambrini, Francesco ; Mandl, Michael ; Manning, Christopher ; Manurung, Ruli ; Marşan, Büşra ; Mărănduc, Cătălina ; Mareček, David ; Marheinecke, Katrin ; Markantonatou, Stella ; Martínez Alonso, Héctor ; Martín Rodríguez, Lorena ; Martins, André ; Martins, Cláudia ; Mašek, Jan ; Matsuda, Hiroshi ; Matsumoto, Yuji ; Mazzei, Alessandro ; McDonald, Ryan ; McGuinness, Sarah ; Mehta, Maitrey ; Ménard, Pierre André ; Mendonça, Gustavo ; Merhav, Hilla ; Merzhevich, Tatiana ; Meurer, Paul ; Miekka, Niko ; Milano, Emilia ; Miller, Aaron ; Minerbi, Yael ; Mischenkova, Karina ; Missilä, Anna ; Mititelu, Cătălin ; Mitrofan, Maria ; Miyao, Yusuke ; Mojiri Foroushani, AmirHossein ; Molnár, Judit ; Moloodi, Amirsaeid ; Montemagni, Simonetta ; More, Amir ; Moreno Romero, Laura ; Moretti, Giovanni ; Mori, Shinsuke ; Morioka, Tomohiko ; Moro, Shigeki ; Mortensen, Bjartur ; Moskalevskyi, Bohdan ; Muischnek, Kadri ; Munro, Robert ; Murawaki, Yugo ; Müürisep, Kaili ; Nainwani, Pinkey ; Nakhlé, Mariam ; Navarro Horñiacek, Juan Ignacio ; Nedoluzhko, Anna ; Nešpore-Bērzkalne, Gunta ; Nevaci, Manuela ; Nguyễn Thị, Lương ; Nguyễn Thị Minh, Huyền ; Nikaido, Yoshihiro ; Nikolaev, Vitaly ; Nitisaroj, Rattima ; Norrman, Victor ; Nourian, Alireza ; Nunes, Maria das Graças Volpe ; Nurmi, Hanna ; Ojala, Stina ; Ojha, Atul Kr. ; Óladóttir, Hulda ; Olúòkun, Adédayọ̀ ; Omura, Mai ; Onwuegbuzia, Emeka ; Ordan, Noam ; Osenova, Petya ; Östling, Robert ; Ott, Annika ; Øvrelid, Lilja ; Özateş, Şaziye Betül ; Özçelik, Merve ; Özgür, Arzucan ; Öztürk Başaran, Balkız ; Paccosi, Teresa ; Palmero Aprosio, Alessio ; Panova, Anastasia ; Pardo, Thiago Alexandre Salgueiro ; Park, Hyunji Hayley ; Partanen, Niko ; Pascual, Elena ; Passarotti, Marco ; Patejuk, Agnieszka ; Paulino-Passos, Guilherme ; Pedonese, Giulia ; Peeters, Oggi ; Peljak-Łapińska, Angelika ; Peng, Siyao ; Peng, Siyao Logan ; Pereira, Rita ; Pereira, Sílvia ; Perez, Cenel-Augusto ; Perkova, Natalia ; Perrier, Guy ; Petrov, Slav ; Petrova, Daria ; Peverelli, Andrea ; Phelan, Jason ; Pierre-Louis, Claudel ; Piitulainen, Jussi ; Pinter, Yuval ; Pinto, Clara ; Pintucci, Rodrigo ; Pirinen, Tommi A ; Pitler, Emily ; Plamada, Magdalena ; Plank, Barbara ; Plum, Alistair ; Poibeau, Thierry ; Ponomareva, Larisa ; Popel, Martin ; Pretkalniņa, Lauma ; Pretorius, Rigardt ; Prévost, Sophie ; Prokopidis, Prokopis ; Przepiórkowski, Adam ; Pugh, Robert ; Puolakainen, Tiina ; Purschke, Christoph ; Pyysalo, Sampo ; Qi, Peng ; Querido, Andreia ; Rääbis, Andriela ; Rabinovich, Ella ; Rademaker, Alexandre ; Rahoman, Mizanur ; Rama, Taraka ; Ramasamy, Loganathan ; Ramisch, Carlos ; Ramos, Joana ; Rashel, Fam ; Rasooli, Mohammad Sadegh ; Ravishankar, Vinit ; Real, Livy ; Rebeja, Petru ; Reddy, Siva ; Regnault, Mathilde ; Rehm, Georg ; Riabi, Arij ; Riabov, Ivan ; Rießler, Michael ; Rimkutė, Erika ; Rinaldi, Larissa ; Rituma, Laura ; Rizqiyah, Putri ; Rocha, Luisa ; Rögnvaldsson, Eiríkur ; Roksandic, Ivan ; Roman, Norton Trevisan ; Romanenko, Mykhailo ; Rosa, Rudolf ; Roșca, Valentin ; Roulon, Paulette ; Rovati, Davide ; Rozonoyer, Ben ; Rudina, Olga ; Rueter, Jack ; Ruffolo, Paolo ; Rúnarsson, Kristján ; Rushiti, Rozana ; Sadde, Shoval ; Safari, Pegah ; Sahala, Aleksi ; Saleh, Shadi ; Salomoni, Alessio ; Samardžić, Tanja ; Sampanis, Konstantinos ; Samson, Stephanie ; Sánchez-Rodríguez, Xulia ; Sanguinetti, Manuela ; Sanıyar, Ezgi ; Särg, Dage ; Sartor, Marta ; Sarymsakova, Albina ; Sasaki, Mitsuya ; Saulīte, Baiba ; Savary, Agata ; Sawanakunanon, Yanin ; Saxena, Shefali ; Scannell, Kevin ; Scarlata, Salvatore ; Schang, Emmanuel ; Schneider, Nathan ; Schuster, Sebastian ; Schwartz, Lane ; Seddah, Djamé ; Seeker, Wolfgang ; Sellmer, Sven ; Seraji, Mojgan ; Shahzadi, Syeda ; Shen, Mo ; Shimada, Atsuko ; Shin, Gyu-Ho ; Shirasu, Hiroyuki ; Shishkina, Yana ; Shohibussirri, Muh ; Shvedova, Maria ; Siewert, Janine ; Sigurðsson, Einar Freyr ; Silva, João ; Silveira, Aline ; Silveira, Natalia ; Silveira, Sara ; Simi, Maria ; Simionescu, Radu ; Simkó, Katalin ; Šimková, Mária ; Símonarson, Haukur Barri ; Simov, Kiril ; Sitchinava, Dmitri ; Sither, Ted ; Smith, Aaron ; Soares-Bastos, Isabela ; Solberg, Per Erik ; Sonnenhauser, Barbara ; Sourov, Shafi ; Sprugnoli, Rachele ; Stamou, Vivian ; Steingrímsson, Steinþór ; Stella, Antonio ; Stephen, Abishek ; Straka, Milan ; Strass, Omer ; Strickland, Emmett ; Strnadová, Jana ; Suhr, Alane ; Sulestio, Yogi Lesmana ; Sulubacak, Umut ; Sung, Hakyung ; Suzuki, Shingo ; Swanson, Daniel ; Szántó, Zsolt ; Taguchi, Chihiro ; Taji, Dima ; Talamo, Luigi ; Tamburini, Fabio ; Tan, Mary Ann C. ; Tanaka, Takaaki ; Tanaya, Dipta ; Tavoni, Mirko ; Tella, Samson ; Tellier, Isabelle ; Testori, Marinella ; Thomas, Guillaume ; Tıraş, Tarık Emre ; Tonelli, Sara ; Torga, Liisi ; Toska, Marsida ; Trosterud, Trond ; Trukhina, Anna ; Tsarfaty, Reut ; Türk, Utku ; Tyers, Francis ; Þórðarson, Sveinbjörn ; Þorsteinsson, Vilhjálmur ; Uematsu, Sumire ; Untilov, Roman ; Urešová, Zdeňka ; Uria, Larraitz ; Uszkoreit, Hans ; Utka, Andrius ; Vagnoni, Elena ; Vajjala, Sowmya ; Vak, Socrates ; van der Goot, Rob ; Vanhove, Martine ; van Niekerk, Daniel ; van Noord, Gertjan ; Varga, Viktor ; Vedenina, Uliana ; Venturi, Giulia ; Villemonte de la Clergerie, Eric ; Vincze, Veronika ; Vissamsetty, Anishka ; Vlasova, Natalia ; Vligouridou, Eleni ; Wakasa, Aya ; Wallenberg, Joel C. ; Wallin, Lars ; Walsh, Abigail ; Wang, John ; Washington, Jonathan North ; Weissweiler, Leonie ; Wendt, Maximilan ; Widmer, Paul ; Wigderson, Shira ; Wijono, Sri Hartati ; Wille, Vanessa Berwanger ; Williams, Seyi ; Winkler, Miriam ; Wintner, Shuly ; Wirén, Mats ; Wittern, Christian ; Woldemariam, Tsegay ; Wong, Tak-sum ; Wróblewska, Alina ; Wu, Qishen ; Yako, Mary ; Yamashita, Kayo ; Yamazaki, Naoki ; Yan, Chunxiao ; Yasuoka, Koichi ; Yavrumyan, Marat M. ; Yenice, Arife Betül ; Yılandiloğlu, Enes ; Yıldız, Olcay Taner ; Yu, Zhuoran ; Yuliawati, Arlisa ; Žabokrtský, Zdeněk ; Zahra, Shorouq ; Zeldes, Amir ; Zhou, He ; Zhu, Hanzhi ; Zhu, Yilun ; Zhuravleva, Anna ; Ziane, Rayan ; Znotiņš, Artūrs
Description:
Universal Dependencies is a project that seeks to develop cross-linguistically consistent treebank annotation for many languages, with the goal of facilitating multilingual parser development, cross-lingual learning, and ...
 This item contains 3 files (650.18 MB).
 
Publicly Available GNU General Public License, version 3.0 Distributed under Creative Commons
 corpus 
corpus
Description:
The ParCzech 3.0 corpus is the third version of ParCzech consisting of stenographic protocols that record the Chamber of Deputies’ meetings held in the 7th term (2013-2017) and the current 8th term (2017-Mar 2021). The ...
 This item contains 40 files (1064.79 GB).
 
Publicly Available Distributed under Creative Commons No Copyright
 corpus 
corpus
Author(s):
Description:
A set of corpora for 120 languages automatically collected from wikipedia and the web. Collected using the W2C toolset: http://hdl.handle.net/11858/00-097C-0000-0022-60D6-1
 This item contains 122 files (18.91 GB).
 
Publicly Available Distributed under Creative Commons Attribution Required Share Alike