Skip to Main content Skip to Navigation
Book sections

Le corpus Polititweets : enjeux institutionnels, juridiques, techniques et philologiques

Résumé : L'analyse du discours politique connaît un renouvellement important, dû notamment aux nouveaux supports et formats d'expression, comme les réseaux sociaux numériques (RSN). Or, ces lieux de production d'écrits sont le plus souvent saisis par des disciplines qui les traitent comme des données sociales, plutôt que comme des discours. Cet article vise à décrire les enjeux philologiques, herméneutiques, et également institutionnels et interdisciplinaires, de la constitution d'un corpus de tweets politiques. Le corpus Polititweets (Longhi et al. 2014 : 34273 messages, 205 utilisateurs) a été élaboré selon le format TEI (avec des pistes d'extension aux formats CMC proposées par un groupe européen qui s'est constitué autour de cette question), afin de tenir compte des éléments spatio-temporels, contextuels, technologiques, interactionnels, thématiques, dialogiques, etc. des messages produits. Il s'agit donc dans un premier temps de décrire le contexte d'élaboration du corpus, la méthodologie et des considérations juridiques. Dans un second temps, nous détaillons les enjeux philologiques de la constitution du corpus, en explicitant les critères qui ont présidé à sa structuration, pour passer d'une base de données à un corpus au format TEI. Dans un dernier temps, nous décrivons la démarche de mise à disposition du corpus et les questions d'« open access ».
Mots-clés : tweets corpus CMC TEI
Document type :
Book sections
Complete list of metadata

Cited literature [7 references]  Display  Hide  Download

https://hal.archives-ouvertes.fr/hal-01270984
Contributor : Julien Longhi <>
Submitted on : Monday, July 18, 2016 - 1:22:36 PM
Last modification on : Monday, February 8, 2021 - 11:54:01 AM

File

article Longhi IRD 2.pdf
Files produced by the author(s)

Identifiers

  • HAL Id : hal-01270984, version 2

Collections

Citation

Julien Longhi. Le corpus Polititweets : enjeux institutionnels, juridiques, techniques et philologiques. Ciara Wigham et Gudrun Ledegen. Corpus de communication médiée par les réseaux : construction, structuration, analyse, Harmattan 2017. ⟨hal-01270984v2⟩

Share

Metrics

Record views

574

Files downloads

1041