0% ont trouvé ce document utile (0 vote)
10 vues49 pages

Transcription de l'arabe parlé en interaction

Transféré par

Hassan Azouzi
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
10 vues49 pages

Transcription de l'arabe parlé en interaction

Transféré par

Hassan Azouzi
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd

Transcription de corpus oraux d’arabe parlé en

interaction. Convention AraPI et annexes.


Lina Choueiri, Loubna Dimachki, Catherine Pinon, Véronique Traverso

To cite this version:


Lina Choueiri, Loubna Dimachki, Catherine Pinon, Véronique Traverso. Transcription de corpus
oraux d’arabe parlé en interaction. Convention AraPI et annexes.. 2019. �hal-02153116�

HAL Id: hal-02153116


[Link]
Preprint submitted on 17 Jun 2019

HAL is a multi-disciplinary open access L’archive ouverte pluridisciplinaire HAL, est


archive for the deposit and dissemination of sci- destinée au dépôt et à la diffusion de documents
entific research documents, whether they are pub- scientifiques de niveau recherche, publiés ou non,
lished or not. The documents may come from émanant des établissements d’enseignement et de
teaching and research institutions in France or recherche français ou étrangers, des laboratoires
abroad, or from public or private research centers. publics ou privés.
Transcription de corpus oraux
d’arabe parlé en interaction :
La convention AraPI

Auteurs :
Véronique Traverso, Catherine Pinon, Loubna Dimashki, Lina Choueiri

Présentation du projet AraPI

• L’équipe (groupe AraPI – Arabe Parlé en Interaction) :


• Ifpo (Véronique Traverso, Catherine Pinon)
• Université libanaise (Loubna Dimashki, Moustafa al-Hajj)
• AUB (Lina Choueiri)
• CNRS - laboratoire ICAR (Joseph Dichy, Carole Etienne)
• CNRS - laboratoire SEDYL (Stefano Manfredi)
• CNRS - laboratoire LLL (Layal Kanaan).

• Les financements :
• Ifpo
• Labex ASLAN
• Laboratoire ICAR (CNRS)
• Université libanaise

• Les objetcifs :
• établir une convention de transcription pour les corpus d’arabe parlé en
interaction
• alimenter une base de données (corpus transcrits et alignés)

• Les publications :
• Traverso, Pinon, Dimachki et Choueiri : « Corpus d’arabe parlé (1) : Quels corpus
d’arabe parlé en libre accès ? », les carnets de l’Ifpo, la recherche en train de se faire à
l’Institut français du Proche-Orient [En ligne] [Link]
• Traverso, Pinon, Dimachki et Choueiri : « Corpus d’arabe parlé (2) : contraintes et
problèmes liés à la réalisation des corpus d’arabe parlé en interaction », les carnets de
l’Ifpo, la recherche en train de se faire à l’Institut français du Proche-Orient [En ligne]
[Link]
• Traverso, Pinon, Dimachki et Choueiri : « Corpus d’arabe parlé (3) : Choix pour la
notation des sons et des phénomènes dans la réalisation de corpus d’arabe parlé », à
paraître dans les carnets de l’Ifpo, la recherche en train de se faire à l’Institut français
du Proche-Orient [En ligne] [Link]
• Pinon, Traverso, Dimachki et Choueiri : « Corpus d’arabe parlé (4) : La convention de
transcription ARAPI pour l’arabe parlé en interaction », à paraître dans les carnets de
l’Ifpo, la recherche en train de se faire à l’Institut français du Proche-Orient [En ligne].
Convention AraPI
Version 1 - juin 2019

ARABE PARLE EN INTERACTION (ARAPI)


CONVENTIONS
Introduction ...................................................................................................................................................................... 3

0................................................................................................Présentation générale de la convention


................................................................................................................................................................................................ 4
0. 0. Forme de la transcription ...........................................................................................................................................................4
0. 1. Une transcription en plusieurs tiers .......................................................................................................................................4
0. 2. Les phénomènes interactionnels ..............................................................................................................................................5
0. 3. L’alphabet de transcription .......................................................................................................................................................5
0. 3. 1. Consonnes ................................................................................................................................................................. 6
0. 3. 2. Voyelles ...................................................................................................................................................................... 6

1. La tier 1 : une transcription interactionnelle .................................................................................................... 7


1. 1. Phénomènes interactionnels ......................................................................................................................................................7
1. 2. Transcription des sons et représentation de la réalité sonore (granularité) ......................................................7
1. 3. Notation de la longueur ...............................................................................................................................................................7
1. 3. 1. Longueur phonologique et longueur expressive............................................................................................. 7
1. 3. 2. Les voyelles longues finales de la graphie arabe............................................................................................. 7
1. 3 3. Les alif-s suscrits de l’orthographe arabe ........................................................................................................... 8
1. 4. Les déterminants ............................................................................................................................................................................8
1. 4. 1. L’article .............................................................................................................................................................................. 8
1. 4. 2. Les démonstratifs ......................................................................................................................................................... 8
1. 5. Les pronoms ......................................................................................................................................................................................8
1. 5. 1. Les pronoms personnels ............................................................................................................................................ 8
1. 5. 2. Le pronom relatif .......................................................................................................................................................... 8
1. 5. 3. Les pronoms interrogatifs......................................................................................................................................... 8
1. 5. 4. Les pronoms démonstratifs...................................................................................................................................... 9
1. 6. Les particules et prépositions ....................................................................................................................................................9
1. 7. Les chiffres .........................................................................................................................................................................................9
1. 8. Autres éléments conventionnels ...............................................................................................................................................9
1. 8. 1. Les expressions figées................................................................................................................................................. 9
1. 8. 2. Les mots ou syntagmes cités en langue étrangère ......................................................................................... 9
1. 8. 3. Les mots étrangers entrés dans les usages ........................................................................................................ 9
1. 8. 4. Les emprunts arabisés ................................................................................................................................................ 9
1. 8. 5. Les régulateurs, marques d’hésitation, acquiescement, négation .........................................................10
1. 8. 6. Les noms propres........................................................................................................................................................10
1. 8. 7. La mention de noms anonymisés.........................................................................................................................10

2. La tier 2 : une transcription morpho-phonologique .................................................................................... 11


2. 1. Phénomènes interactionnels ................................................................................................................................................... 11
2. 2. Transcription des sons............................................................................................................................................................... 11
2. 3. Notation de la longueur ............................................................................................................................................................ 12
2. 3. 1. Longueur phonologique et longueur expressive...........................................................................................12
2. 3. 2. Les voyelles longues finales de la graphie arabe...........................................................................................12
2. 3. 3. Les alif-s suscrits de l’orthographe arabe ........................................................................................................12
2. 4. Les déterminants ......................................................................................................................................................................... 12
2. 4. 1. L’article ............................................................................................................................................................................12
2. 4. 2. Les démonstratifs .......................................................................................................................................................12
2. 5. Les pronoms ................................................................................................................................................................................... 12
2. 5. 1. Les pronoms personnels ..........................................................................................................................................12
2. 5. 2. Le pronom relatif ........................................................................................................................................................13
2. 5. 3. Les pronoms interrogatifs.......................................................................................................................................13
2. 5. 4. Les pronoms démonstratifs....................................................................................................................................13

-1-
Convention AraPI
Version 1 - juin 2019

2. 6. Les particules et prépositions ................................................................................................................................................. 13


2. 7. Les chiffres ...................................................................................................................................................................................... 13
2. 8. La morphologie verbale ............................................................................................................................................................ 13
2. 9. La morphologie nominale ........................................................................................................................................................ 14
2. 10. Autres éléments conventionnels ......................................................................................................................................... 14
2. 10. 1. Le lexique dialectal ..................................................................................................................................................14
2. 10. 2. Les expressions figées ............................................................................................................................................14
2. 10. 3. Les mots ou syntagmes en langue étrangère ...............................................................................................14
2. 10. 4. Les mots étrangers entrés dans les usages ...................................................................................................14
2. 10. 5. Les emprunts arabisés ...........................................................................................................................................14
2. 10. 6. Les régulateurs, marques d’hésitation, acquiescement, négation ......................................................15
2. 10. 7. Les noms propres .....................................................................................................................................................15
2. 10. 8. La mention de noms anonymisés ......................................................................................................................15

3. La tier 3 : une transcription en graphie arabe ............................................................................................... 16


3. 1. Phénomènes interactionnels ................................................................................................................................................... 16
3. 2. Transcription des sons............................................................................................................................................................... 16
3. 3. Les voyelles longues finales de la graphie arabe ........................................................................................................... 16
3. 4. Les déterminants ......................................................................................................................................................................... 16
3. 4. 1. L’article ............................................................................................................................................................................16
3. 4. 2. Les démonstratifs .......................................................................................................................................................17
3. 5. Les pronoms ................................................................................................................................................................................... 17
3. 5. 1. Les pronoms personnels ..........................................................................................................................................17
3. 5. 2. Le pronom relatif ........................................................................................................................................................17
3. 5. 3. Les pronoms interrogatifs.......................................................................................................................................17
3. 5. 4. Les pronoms démonstratifs....................................................................................................................................17
3. 6. Particules et prépositions......................................................................................................................................................... 17
3. 7. Les chiffres ...................................................................................................................................................................................... 17
3. 8. La morphologie verbale ............................................................................................................................................................ 18
3. 9. Autres éléments conventionnels ............................................................................................................................................ 18
3. 9. 1. Les expressions figées...............................................................................................................................................18
3. 9. 2. Les mots ou syntagmes en langue étrangère ..................................................................................................18
3. 9. 3. Les mots étrangers entrés dans les usages ......................................................................................................18
3. 9. 4. Les emprunts arabisés ..............................................................................................................................................18
3. 9. 5. Les régulateurs, marques d’hésitation, acquiescement, négation .........................................................18
3. 9. 6. Les noms propres........................................................................................................................................................19
3. 9. 7. La mention de noms anonymisés.........................................................................................................................19

4. La tier 4 : une traduction ....................................................................................................................................... 20


4. 1. Phénomènes interactionnels ................................................................................................................................................... 20
4. 2. Vouvoiement et ajustements de traduction ..................................................................................................................... 20
4. 3. Expressions figées ........................................................................................................................................................................ 20
4. 4. Mots ou syntagmes en langue étrangère........................................................................................................................... 20
4. 5. Régulateurs, marques d’hésitation, acquiescement, négation................................................................................. 20

5. Liste des documents annexes ............................................................................................................................... 21


Annexe 1 : Convention de transcription pour les phénomènes oraux et interactionnels ...................................... 21
Annexe 2 : Liste des notations conventionnelles ...................................................................................................................... 21
Annexe 3 : Liste des gloses morpho-syntaxiques ..................................................................................................................... 21
Annexe 4 : Règles générales de transcription des dialectes en caractères arabes ................................................... 21
Annexe 5 : Tableau synoptique de la convention AraPI ....................................................................................................... 21

6. Bibliographie ............................................................................................................................................................ 21

-2-
Convention AraPI
Version 1 - juin 2019

INTRODUCTION
Les transcriptions de corpus d’interaction en arabe parlé pour des analyses de
linguistique interactionnelle ou pragmatique en sont encore à leurs balbutiements.
Chaque chercheur est confronté aux mêmes difficultés, et forge ses propres solutions en
fonction des caractéristiques de ses données et de ses objectifs. Les choix effectués, eux,
sont très variés, s’étageant autour de quatre possibilités majeures : une transcription
phonétique, qui cherche à rendre compte de façon précise des spécificités sonores des
productions ; une transcription phonologique, qui ne retient que les variantes distinctives
de la variété concernée ; une translittération, c’est-à-dire une représentation fidèle, lettre
par lettre, de l’orthographe arabe en alphabet latin ; et enfin une transcription en
caractères arabes.

La convention ARAPI a opté pour une transcription en quatre tiers pour rendre les
corpus transcrits exploitables par des chercheurs de diffé rents domaines, é ventuellement
non arabophones, y compris en recourant aux outils informatiques sur script latin ou
arabe. Les quatre tiers concernent 1) une transcription interactionnelle ; 2) une
transcription morpho-phonologique assortie d’une glose ; 3) une transcription en
caractè res arabes ; 4) une traduction en français. Chacune des tiers est pré senté e en dé tail
dans le document qui suit.

La convention est é tablie à partir de corpus syro-libanais, mais elle est conçue pour
ê tre é tendue à d’autres dialectes arabes, moyennant son adaptation à leurs spé cificité s.
De mê me, la convention peut ê tre utilisé e par les chercheurs de diffé rents horizons, quelle
que soit leur spé cialité : chaque chercheur transcrit selon ses besoins, en sé lectionnant la
ou les tiers qui sont né cessaires à sa recherche, voire en ajoutant des é lé ments
conventionnels qu’il doit expliciter, lorsqu'un phé nomè ne qu'il a besoin de repré senter
n'est pas pré vu dans la convention.

-3-
Convention AraPI
Version 1 - juin 2019

0. PRESENTATION GENERALE DE LA CONVENTION


Ce document détaille les conventions établies pour la transcription de sources produites
en arabe parlé en interaction. Il est augmenté de plusieurs annexes. La première détaille
la convention de notation pour les phénomènes oraux. La deuxième propose la liste de
tous les éléments linguistiques conventionnels sous forme de tableaux. Cette liste est
amenée à évoluer avec l’ajout de nouvelles transcriptions au corpus. La troisième annexe
présente les règles générales pour la transcription des dialectes, inspirées de CODA
(Conventional Orthography for Dialectal Arabic, Habash et al. 2012 1 ). La quatrième
récapitule les gloses morphosyntaxiques utilisées dans la tier 2b. Et enfin, la cinquième
est un tableau synoptique qui permet d’appréhender rapidement les différences notables
entre les tiers.

0. 0. Forme de la transcription
La police utilisée pour les tiers 1 et 2a est Courier New, 10 pt, en noir. Pour la tier 2b, 3 et
4, on utilise Times New Roman 11. On insère un saut de ligne entre chaque tier 2.

Les tiers commencent par l’abréviation du pseudonyme du locuteur (généralement en


trois lettres, ex. AMI), suivies d’une tabulation, puis du texte prononcé par le locuteur.
Toute parole transcrite doit être rapportée au locuteur qui l’a produite (voir le détail des
mises en page dans l’annexe 1).

Exemple :

AMI ⇥ transcription interactionnelle (tier 1)


transcription morpho-phonologique (tier 2a)
glose morpho-syntaxique (tier 2b)
‫( ﻛﺘﺎﺑﺔ ﻋﺮﺑﯿﺔ‬tier 3)
traduction dans la langue du chercheur (tier 4)

0. 1. Une transcription en plusieurs tiers


Pour l’é tablissement d’un corpus complet, la transcription est ré alisé e en quatre tiers.

Tier 1 : transcription interactionnelle


La tier 1 est une transcription adapté e aux analyses pragmatiques, discursives et
interactionnelles. Elle fonctionne en lien avec les donné es primaires (enregistrements), et
elle indé pendante de la tier 2. La transcription choisie est phoné tico-phonologique ; elle
conserve le dé coupage en mots et ne pré tend pas rendre compte de toutes les variantes
de prononciation. Elle applique é galement certaines conventions de segmentation des
morphè mes et indique les emprunts aux langues é trangè res.

1
Habash, Nizar & Diab, Mona & Rambow, Owen. (2012). Conventional Orthography for Dialectal Arabic.
Proceedings of the Language Resources and Evaluation Conference (LREC), Istanbul.
2
Ces informations sont pertinentes pour un travail sous word. Elles n’ont plus lieu d'être pour des transcriptions
effectuées à l'aide de logiciels de transcription, qui disposent d'interfaces à multiples tiers (comme ELAN ou Praat).

-4-
Convention AraPI
Version 1 - juin 2019

Tier 2 dédoublée : transcription morpho-syntaxique


La tier 2 correspond à une repré sentation phonologique d’un standard du dialecte
concerné qui intè gre un certain nombre de choix conventionnels (tier 2a). Elle est assortie
d’une glose morpho-syntaxique suivant la ré fé rence LeipzigGlossingRules (tier 2b). Voir
l'annexe 4 pour la liste des étiquettes morpho-syntaxiques et des exemples en arabe
libanais.

Tier 3 : transcription en caractères arabes


La tier 3 est une transcription en caractè res arabes s’inspirant de la convention CODA
(Conventional Orthography for Dialectal Arabic) 3 . Voir dans l'annexe 3 les rè gles
gé né rales pour la transcription des dialectes en caractè res arabes.

Tier 4 : traduction
Enfin la tier 4 propose une traduction. Elle se veut fidè le au sens davantage qu’à la
structure morpho-syntaxique de l’é noncé . Certains é lé ments difficilement traduisibles
font l’objet de notations conventionnelles.

0. 2. Les phénomènes interactionnels


La notation des phé nomè nes interactionnels ne concerne que la tier 1. Celle-ci comporte
tous les é lé ments relatifs à la production de la langue parlé e en interaction :
chevauchements de parole, pauses, enchaı̂nements immé diats, notation sommaire de la
prosodie.
Pour ces phénomènes, la convention AraPI reprend la convention ICOR, qui s’inspire des
conventions de Jefferson (2004) généralement utilisées en linguistique interactionnelle,
avec de légères modifications. Ces conventions sont présentées dans l’annexe 1,
Conventions de transcription pour les phénomènes oraux et interactionnels.
Une version étendue des conventions interactionnelles est consultable sur le site
CORINTE, [Link]

0. 3. L’alphabet de transcription
La convention ARAPI utilise l’alphabet phoné tique international (API) avec quelques
modifications :
- les voyelles longues sont noté es avec un trait suscrit (ā , ū , ı̄, etc.) plutô t qu’avec les
deux points (a:, u:, i:, etc.) dé jà employé s pour la transcription interactionnelle ;
- les consonnes emphatiques sont marqué es avec des points sous les consonnes
non-emphatiques correspondantes (ṣ , ḍ , ṭ , ẓ ). La transcription de l’interdentale
emphatique devrait être le ð avec un point souscrit. Nous la noterons ð.

Dans les tableaux ci-dessous, pour des raisons pratiques, les sons de la langue sont
présentés selon l’ordre de l’alphabet arabe.

3
Habash, Diab et Rambow, “Unified Guidelins and Resources for Arabic Dialect Orthography” [En ligne]
[Link]
Habash, Diab et Rambow, “Conventional Orthography for Dialectal Arabic” [En ligne] [Link]
[Link]/proceedings/lrec2012/pdf/579_Paper.pdf

-5-
Convention AraPI
Version 1 - juin 2019

0. 3. 1. Consonnes

Arabe API Exemple Arabe API Exemple


‫ب‬ b, p baba, paspor ‫ط‬ ṭ ṭawla
‫ت‬ t tīn ‫ظ‬ ð, ḍ, ẓ
̣ ðohor, ḍəhr, būẓa
θaqāfe, talƷ,
‫ث‬ θ, t, s
masalan ‫ع‬ ʕ ʕənd
Ʒamāl, dƷamāl,
‫ج‬ Ʒ, dƷ, g
gamāl ‫غ‬ ɣ ɣēm
‫ح‬ ħ ħabīb ‫ف‬ f, v ʔalf, narvaz
‫خ‬ x ʔəxt ‫ق‬ q, g, ʔ ħuqūq, grīb, ʔarīb
‫د‬ d dār ‫ك‬ k, g ktāb, garāƷ, sangari
hāða, hāda,
‫ذ‬ ð, d, z
ʔəstēz ‫ل‬ l, ḷ lēl, aḷḷāh

‫ر‬ r rās ‫م‬ m mabrūk


‫ز‬ z zēt ‫ن‬ n naƷāħ
‫س‬ s səne ‫ه‬ h hənnen
‫ش‬ ʃ ʃams ‫و‬ w walad
‫ص‬ ṣ ṣēf ‫ي‬ j jōm
‫ض‬ ḍ, ẓ ḍamīr, maẓbūṭ ‫ء‬ ʔ suʔāl

Des caractères arabes particuliers peuvent être utilisés pour la transcription en arabe des
mots étrangers courants contenant les sons [p] ou [v].

Arabe API Exemple


‫پ‬ p ‫( ﭘﻮﯾﺎت‬des pots)
‫ڤ‬ v ‫( ﺳﺎ ﭬﺎ‬ça va)
‫گ‬ g ‫( ﺳﻨﮕﺮي‬plombier)

0. 3. 2. Voyelles

API Exemple API Exemple


a abjaḍ ā ktāb
ɛ bɛrke ē lēʃ, bēt, bēred
e ṭajjeb ī dīk
ə sətt, təffēħa ō ʃōb
i kīfik ū sūʔ
o bjektob ã ã... ok (exclamation)
u suʔāl ̃
ɔ b̃
ɔƷūr
y stydjo ø ʔø (hésitation)

Le son [e] en finale de mot, lorsqu’il ne s’agit pas d’une imāla mais d’un terme étranger,
peut être transcrit ‫ ﯾﮫ‬en arabe. Exemple : kafe / ‫( ﻛﺎﻓﯿﮫ‬café).

-6-
Convention AraPI
Version 1 - juin 2019

1. LA TIER 1 : UNE TRANSCRIPTION INTERACTIONNELLE


La tier 1 est une transcription phonético-phonologique en caractères latins (alphabet
phonétique international adapté), dans laquelle les phénomènes oraux et interactionnels
sont notés.

1. 1. Phénomènes interactionnels

Tous les é lé ments relatifs à la production de la langue parlé e en interaction sont noté s
dans cette tier selon la convention dé taillé e en annexe 1. Les segments inaudibles sont
rendus par xx. En cas de troncation, on transcrit phoné tiquement ce que l’on entend. Les
transcriptions incertaines sont noté es entre parenthè ses.

1. 2. Transcription des sons et représentation de la réalité sonore (granularité)

Les sons sont notés tels qu’ils sont perçus :


- le qaf est noté (q, ʔ ou g), selon sa réalisation.
- les interdentales (θ, ð), sont notées comme elles sont prononcées (s, d, t, z, θ, ð).
- les emphatiques (ṣ, ḍ, ṭ, ð ̣) ne sont notées que si la consonne est réellement vélarisée.
Sinon, on notera leur réalisation (éventuellement : s, d, t, z).
- le [ḷ] emphatique dans aḷḷāh est noté avec un point.
- la hamza initiale n’est pas transcrite ; la hamza médiane et finale n’est transcrite que si
on la prononce.
- l’imāla est noté e par le son [e].

La transcription de la tier 1 ne pré tend pas atteindre une granularité trè s fine pour la
repré sentation des sons prononcé s, notamment les voyelles (c'est pourquoi on parle de
repré sentation phoné tico-phonologique plus que ré ellement phoné tique). Né anmoins, il
n’y a pas d’essai de standardisation des sons transcrits ; le transcripteur note simplement
ce qu’il perçoit.

1. 3. Notation de la longueur
1. 3. 1. Longueur phonologique et longueur expressive
On distingue la longueur phonologique (distinctive) notée par un trait sur la voyelle (ā, ī,
ē, ō, ū) de la longueur expressive notée par les deux points après la voyelle (ba:). La
longueur expressive n’apparaît que dans la tier 1.

1. 3. 2. Les voyelles longues finales de la graphie arabe


Les voyelles longues en finale de mot dans la graphie arabe ne sont pas transcrites avec
une voyelle longue, mais conformément à leur réalisation. Cela concerne notamment :
- les pronoms personnels
- le alif maqṣura ou le alif ṭawīla à la fin des verbes, des pronoms, des noms et des
particules
- la préposition fi
- certains pronoms suffixes.

-7-
Convention AraPI
Version 1 - juin 2019

1. 3 3. Les alif-s suscrits de l’orthographe arabe


On note la voyelle longue uniquement si elle est prononcé e comme telle. Cela concerne
certains dé monstratifs, la particule lākin et le mot allāh. Le nom Allah est transcrit comme
il est prononcé .
Ex. aḷḷa / aḷḷah / aḷḷā / aḷḷāh

1. 4. Les déterminants
1. 4. 1. L’article
L’article est noté comme il est prononcé et sans sé parateur.
Ex. lbēt

1. 4. 2. Les démonstratifs
Le dé monstratif ré duit est noté [ha], accolé à l’article sans sé parateur.
Ex. halbēt

Les dé monstratifs complets sont noté s tels qu’ils sont ré alisé s.
Ex. hajda / haza ; hajde / hajdi / hazihi ; hadōl / hadōle / hajdōle ; hdāk / hadīke ; hāj (liste non
exhaustive).

1. 5. Les pronoms
1. 5. 1. Les pronoms personnels
Les pronoms sont transcrits selon leur ré alisation. Les pronoms suffixes sont transcrits
tels qu’ils se prononcent et sont accolés au verbe, au nom ou à la préposition.
Les pronoms complé ments introduits par la particule [ijjā ] sont noté s conformé ment à
leur ré alisation, collé s à la particule, cette derniè re é tant sé paré e de ce qui pré cè de par
une espace. Exemple de transcription des pronoms (non exhaustif) :

Pronoms isolés Pronoms possessifs Pronoms compléments


ana,ani hijje ktēbe ktēba jāni,jāne jē,ijjē,
enta neħna,ʔēħna ktēbek,ktēbak ktēbna jāk,ijjāk, jēk jāha, jēha
ente ento ktēbek,ktēbik ktēbkon jāki,ijjāki, jāna, jēna
huwwe henne,hennen ktēbo ktēbon jēke jekon
jē, ijjē, jāho jon,jāhon

Ex. bejton, ʔāletlo, fīki, beddik jēha

1. 5. 2. Le pronom relatif
Les relatifs sont noté s au plus proche de la perception et sont sé paré s du mot suivant par
une espace.
Ex. jilli / əlli / li / l

1. 5. 3. Les pronoms interrogatifs


Les interrogatifs sont notés selon leur prononciation.
Ex. kīf, wejn, wēn, fēn, lē, lēʃ, ʃū

-8-
Convention AraPI
Version 19 avril 2019

1. 5. 4. Les pronoms démonstratifs


Les pronoms dé monstratifs sont noté s tels qu’ils sont ré alisé s.
Ex. hēj, ; hajda ; hajde / hajdi ; hadōl / hadōle / hajdōle ; haydēk / hadīke (liste non exhaustive).

1. 6. Les particules et prépositions


Les particules sont notées selon leur prononciation. Elles sont séparées du nom par une
espace, mê me si elles sont accolé es dans la graphie arabe. Voir la liste des pré positions
dans l'annexe 2.
Ex. bi lbēt

1. 7. Les chiffres
Les chiffres sont transcrits phonétiquement.

1. 8. Autres éléments conventionnels


Certains é lé ments qui sont transcrits phoné tiquement en tier 1 feront l’objet de notations
conventionnelles dans les autres tiers. C’est le cas du lexique dialectal courant sans
é quivalent en arabe standard.

1. 8. 1. Les expressions figées


Les éléments à traduction variée (comme jaʕni) sont transcrits en tier 1 mais font l’objet
d’une notation conventionnelle dans les autres tiers. On trouvera en annexe 2 une liste
des notations conventionnelles.

1. 8. 2. Les mots ou syntagmes cités en langue étrangère


Les productions en langue étrangère sont délimitées par des dièses afin de permettre leur
repérage rapide et systématique. Ils sont notés, sans mention de langue, dans
l’orthographe de la langue concernée pour les segments (courts ou longs) dont la
prononciation respecte le standard de la langue concernée, ou en transcription
phonétique si l’on considère que cela apporte des informations pertinentes ou si la langue
n’est pas identifiable.

On utilise, en cas de besoin, l’orthographe adaptée décrite dans la convention ICOR, qui
fait intervenir l’antiquote ` pour les élisions non standard (ex. je l` fais). Voir Annexe 1.

1. 8. 3. Les mots étrangers entrés dans les usages


Les mots étrangers entrés dans les usages sont transcrits phonétiquement, sans dièses.
Ex. ḅāj

1. 8. 4. Les emprunts arabisés


Les emprunts arabisés sont transcrits phonétiquement et notés entre dièses.

-9-
Convention AraPI
Version 19 avril 2019

1. 8. 5. Les régulateurs, marques d’hésitation, acquiescement, négation


La notation des régulateurs, de l’hésitation, de l’acquiescement ou de la négation fait
l’objet de conventions. Voir Annexe 2.

1. 8. 6. Les noms propres


Qu’ils soient remplacés par des pseudonymes ou non, les noms propres sont transcrits
dans leur orthographe courante si elle est connue ou transcrits phonétiquement selon les
cas et notés entre guillemets hauts, avec majuscule initiale. Il peut s’agir d’une personne,
d’un lieu, d’une institution, etc.

1. 8. 7. La mention de noms anonymisés


Les noms propres anonymisés qui sont cités dans les interactions apparaissent entre
guillemets hauts, en entier ou sous leur forme abrégée selon les cas. Cela peut concerner
une personne, un lieu, une institution, etc. S’il s’agit du pseudonyme de l’un des
participants à l’interaction, on le conserve sans guillemets.

- 10 -
Convention AraPI
Version 19 avril 2019

2. LA TIER 2 : UNE TRANSCRIPTION MORPHO-PHONOLOGIQUE


La tier 2a est une transcription morpho-phonologique d’un standard du dialecte
concerné . Elle est noté e en caractères latins (alphabet phonétique international adapté)
et intègre de nombreuses notations conventionnelles. Elle est assortie, en tier 2b, d’une
glose inspiré e des Leipzig Glossing Rules (voir l’annexe 4 et le texte inté gral [En ligne]
[Link] Elle comporte de nombreuses
notations conventionnelles dé taillé es en annexe 2. Les choix de notations
conventionnelles respectent le plus souvent possible la convention de notation des
dialectes arabes CODA et se ré fè rent à l’ouvrage Parlons arabe libanais de Fida Bizri
(L’Harmattan, 2010).

2. 1. Phénomènes interactionnels
Les phé nomè nes interactionnels ne sont pas noté s, à l’exception des pauses noté es par (.)
quelle que soit leur duré e et des chevauchements marqué s par [.
Les segments inaudibles sont rendus par xx.
En cas de troncation, on ajoute un tiret à la fin du mot inachevé .
Les transcriptions incertaines sont noté es entre parenthè ses.

2. 2. Transcription des sons


La tier 2 est un équivalent en caractères latins de la tier 3, elle-même établie en suivant la
convention de notation des dialectes arabes CODA (voir l’annexe 3 et la présentation de
la tier 3 ci-dessous). Cette tier repose sur de nombreuses notations conventionnelles,
puisqu'elle correspond, dès que possible, à une translittération du ductus de l’arabe
standard, tout en préservant de manière conventionnelle les caractéristiques du dialecte
dans lequel l’interaction a lieu.
Les consonnes sont transcrites conformément au ductus standard et les voyelles sont
transcrites phonologiquement. De ce fait, dès que le mot dialectal a son équivalent en
arabe standard, on le translittère selon l’orthographe classique, et lorsque ce n’est pas le
cas, on le transcrit phonologiquement selon une notation conventionnelle renvoyant à un
un standard dialectal. Les notations conventionnelles concernent notamment les
pronoms personnels, les particules, les interrogatifs, les démonstratifs, les désinences
verbales, etc. (voir l’annexe 2).

Voici les règles générales de transcription des sons :


- Le qaf est noté q.
- Les interdentales seront notées θ ou ð.
- Les emphatiques ṣ, ḍ, ṭ, ð ̣.
- La hamza est noté e ʔ en médiane et finale de mot uniquement, et non notée à l'initiale.
- Les sons vocaliques sont réduits aux sons [a] [u] [i] [e] [o] pour les voyelles brèves, à [ā]
[ū] [ī] [ē] [ō] pour les longues.
- L’imāla est transcrite par le son [e].
- Les diphtongues sont rétablies.
- Les voyelles é lidé es sont rétablies.
- Les voyelles é penthé tiques sont supprimé es.

- 11 -
Convention AraPI
Version 19 avril 2019

2. 3. Notation de la longueur
2. 3. 1. Longueur phonologique et longueur expressive
Seule la longueur phonologique est notée en tier 2.

2. 3. 2. Les voyelles longues finales de la graphie arabe


Les voyelles longues finales de l’orthographe arabe standard, même si elles ne sont pas
prononcé es, sont noté es dans la tier 2 qui privilé gie une translitté ration de l’orthographe
arabe standard.
Ex. fī ; ilā ; ʕalā ; maqhā

2. 3. 3. Les alif-s suscrits de l’orthographe arabe


On note systé matiquement une voyelle longue si celle-ci correspond à un alif suscrit dans
l’orthographe standard. Cela concerne certains dé monstratifs, la particule lākin et le mot
allāh.
Ex. lākin, hāðā, allāh

2. 4. Les déterminants
2. 4. 1. L’article
L’article est segmenté au moyen d’un tiret. En dé but d’é noncé , il est systé matiquement
noté [el-]. En cas de liaison, il est toujours noté [-l-] même en cas d’assimilation.
Ex. el-bēt ; bi-l-bēt ; bi-l-rās

2. 4. 2. Les démonstratifs
Le dé monstratif ha est noté avec sé parateur (ha-l-).
Ex. ha-l-kitāb ; bi-ha-l-bajt

Les dé monstratifs complets font l’objet d’une notation conventionnelle.


Ex. hāðā ; hāðihi ; haðūl ; haðāk ; haðīk

2. 5. Les pronoms
2. 5. 1. Les pronoms personnels
Les pronoms suffixes sont segmentés par un tiret.
Les pronoms isolés et suffixes apparaissent sous une forme dialectale conventionnelle.
Les pronoms compléments introduits par la particule [ijjā] seront notés de manière
conventionnelle sous la forme jē-pronom conventionnel.

Pronoms isolés Pronoms possessifs Pronoms compléments


anā hija kitāb-ī kitāb-hā jē-nī jē-hā
enta neħnā kitāb-ka kitāb-nā jē-ka jē-nā
enti entō kitāb-ki kitāb-kon jē-ki jē-kon
huwa hennen kitāb-hu kitāb-hon jē-hu jē-hon

- 12 -
Convention AraPI
Version 19 avril 2019

2. 5. 2. Le pronom relatif
Le relatif est systé matiquement noté jalli, sé paré du mot suivant par une espace, quelle
que soit sa ré alisation.

2. 5. 3. Les pronoms interrogatifs


Les interrogatifs font l’objet d’une transcription conventionnelle, quelle que soit leur
ré alisation. Voir Annexe 2.

2. 5. 4. Les pronoms démonstratifs


Les pronoms dé monstratifs font l’objet d’une notation conventionnelle.
Ex. hāðā ; hāðī ; haðūl ; haðāk ; haðīk

2. 6. Les particules et prépositions


Un tiret sé pare les pré positions monolitè res du mot qui suit. Elles sont noté es
conventionnellement (la-, bi-, wa-, ta-) ; les autres pré positions sont sé paré es du nom par
une simple espace. Voir la liste des pré positions dans l'annexe 2.

2. 7. Les chiffres
Les chiffres sont transcrits conformément à leur équivalent en arabe standard.
Ex. arbaʕat ʕaʃar

2. 8. La morphologie verbale
Le radical du verbe est isolé de l’ensemble des affixes par un tiret. On segmente aussi les
morphè mes de modes/temps et personnes qui font l’objet d’une notation conventionnelle
(voir annexe 2).
Ex. b-ja-ktub-ū

Les pré fixes de conjugaison comme ʕam et raħ sont séparés du verbe par une espace.
Ex. ʕam ja-ktub ; raħ ta-ktub

Le morphème ħa- est segmenté par un tiret du pré fixe de conjugaison.


Ex. ħa-ja-ktub

En cas d’élision du morphème de conjugaison en tier 1, on rétablit en tier 2 le morphème


manquant.
Ex. ʕam fakkir (tier 1) = ʕam u-fakkir (tier 2a)

De même, pour l’inaccompli à valeur modale (sans le préverbe b-) employé après différentes
particules comme ‫ ﺣﺘﻰ‬،‫ ﻻزم‬،ّ‫ ﺑﺪ‬،‫ ﻓﻲ‬, etc., la hamza de la première personne du singulier est
rétablie dans la tier 2 (badd-ī aħƷuz).

- 13 -
Convention AraPI
Version 19 avril 2019

La voyelle du radical et celle des personnes pour les formes dérivées sont notées
conformément à la voyelle présente dans le verbe correspondant en standard (voir
annexe 2).
Ex. b-ja-ʕmal ; b-ju-balliʃ

Pour le détail des conventions concernant la transcription des voyelles de conjugaison et


des verbes conjugués à l’accompli, à l’inaccompli et à l’impératif, voir l’annexe 2.

2. 9. La morphologie nominale
Les marques du genre et du nombre des noms sont segmenté es par un tiret.
Ex. ʕāmil ; ʕāml-e ; ʕāml-īn

2. 10. Autres éléments conventionnels


Certains é lé ments qui sont transcrits phoné tiquement en tier 1 font l’objet de notations
conventionnelles dans les autres tiers. Voir Annexe 2.

2. 10. 1. Le lexique dialectal


Les productions typiquement dialectales font l’objet de notation conventionnelle.

2. 10. 2. Les expressions figées


Pour les éléments très récurrents à l’oral à traduction variée (comme les particules
discursives, par exemple jaʕni) ou les expressions figées d’inspiration coranique ou non,
on utilise une notation conventionnelle composée de quatre lettres capitales (voir annexe
2).
Ex : b-ʃūf-ki INCH

2. 10. 3. Les mots ou syntagmes en langue étrangère


Toutes les productions en langue étrangère sont notées entre dièses afin de permettre
leur repérage rapide et systématique. Elles sont notées sans mention de la langue, dans
l’orthographe de la langue concernée, que les segments soient courts ou longs, ou en
transcription phonétique si l’on ignore la langue en question.
Ex. ENNO Nicolas #hair# badd-hu #bonnet#

2. 10. 4. Les mots étrangers entrés dans les usages


Les mots étrangers entrés dans les usages, dont on fournit une liste non exhaustive en
annexe 2, seront notés entre dièses, dans l’orthographe de la langue et sans mention de la
langue.
Ex. #bonjour# ; #sorry# ; #merci#

2. 10. 5. Les emprunts arabisés


Les emprunts arabisés, dont on fournit une liste non exhaustive en annexe 2, seront notés
entre dièses en transcription et sans mention de la langue.

- 14 -
Convention AraPI
Version 19 avril 2019

Ex. #pojēt# ; #taperwarāt#

2. 10. 6. Les régulateurs, marques d’hésitation, acquiescement, négation


La notation des régulateurs, de l’hésitation, de l’acquiescement ou de la négation font
l’objet de conventions, présentées en annexe 2.

2. 10. 7. Les noms propres


Qu’ils soient remplacés par des pseudonymes ou non, les noms propres sont transcrits
dans leur orthographe courante si elle est connue et notés entre guillemets hauts, avec
majuscule initiale. Il peut s’agir d’une personne, d’un lieu, d’une institution, etc.

2. 10. 8. La mention de noms anonymisés


Les noms propres anonymisés qui sont cités dans les interactions apparaissent entre
guillemets hauts, en entier (avec une majuscule) ou sous leur forme abrégée selon les cas.
Cela peut concerner une personne, un lieu, une institution, etc. S’il s’agit du pseudonyme
de l’un des participants à l’interaction, on le conserve sans guillemets.

- 15 -
Convention AraPI
Version 19 avril 2019

3. LA TIER 3 : UNE TRANSCRIPTION EN GRAPHIE ARABE


La tier 3 propose une transcription en caractères arabes. Elle reprend la convention CODA
pour la transcription des dialectes, avec quelques aménagements (voir l’annexe 3). Selon
cette convention, on se réfère, chaque fois que cela est possible, au ductus de l’arabe
standard. En même temps, on conserve les traits spécifiques du dialecte utilisé, en faisant
émerger un standard dialectal par le biais de différentes notations conventionnelles.

3. 1. Phénomènes interactionnels
Les phé nomè nes interactionnels ne sont pas noté s, à l’exception des pauses noté es par (.)
quelle que soit leur duré e, et des chevauchements marqué s par ]. Les segments inaudibles
sont rendus par xx. En cas de troncation, on ajoute un tiret à la fin du mot inachevé . Les
transcriptions incertaines sont noté es entre parenthè ses. Si le nom des intervenants est
cité dans un énoncé, il figure en caractères latins en trois lettres majuscules, selon le code
donné par le transcripteur.

3. 2. Transcription des sons


La graphie standard est rétablie dès que cela est possible : on ré intè gre toutes les
consonnes selon l’orthographe classique.
- Le qaf est noté ‫ق‬, quelle que soit sa réalisation.
- Les interdentales sont notées ‫ ث‬et ‫ذ‬, quelle que soit leur réalisation.
- Les emphatiques sont notées ‫ص‬, ‫ض‬, ‫ط‬, ‫ظ‬.
- La hamza initiale n’est noté e que si elle correspond à une hamza stable.
- Les gé minations morphologiques sont systé matiquement noté es par une chadda.
- La transcription n’est pas vocalisé e (ni voyelles brè ves, ni alif suscrit).
- Aucun signe de lecture n’est ajouté pour l’article (hamza, waṣla, sukūn et chadda).
- Le tanwīn [an] est noté.

Pour les mots qui n’ont pas de graphie standard et certains termes dialectaux courants,
on se réfère à une notation conventionnelle, présentée dans l’annexe 2.

3. 3. Les voyelles longues finales de la graphie arabe


Les voyelles longues finales figurent conformé ment au ductus classique. Cela concerne
notamment :
- les pronoms personnels dans leur notation conventionnelle (‫)أﻧﺎ‬
- le alif maqṣura ou le alif ṭawīla à la fin des verbes, des pronoms, des noms et des
particules (‫)ﻋﻠﻰ‬
- certains pronoms suffixes (‫)ھﺎ‬.

3. 4. Les déterminants
3. 4. 1. L’article
L’article est toujours noté ‫اﻟـ‬, sans aucun signe de lecture, conformé ment à la graphie
standard.

- 16 -
Convention AraPI
Version 19 avril 2019

3. 4. 2. Les démonstratifs
Le dé monstratif ha- est noté accolé à l’article ‫ھﺎﻟـ‬.
Les autres dé monstratifs font l’objet d’une notation conventionnelle, quelle que soit leur
ré alisation. Voir l’annexe 2.

3. 5. Les pronoms
3. 5. 1. Les pronoms personnels
Les pronoms sont noté s de maniè re conventionnelle.

Pronoms compléments Pronoms possessifs Pronoms isolés


‫إﯾﺎھﺎ‬ ‫إﯾﺎﻧﻲ‬ ‫ﻛﺘﺎﺑﮭﺎ‬ ‫ﻛﺘﺎﺑﻲ‬ ‫ھﻲ‬ ‫أﻧﺎ‬
‫إﯾﺎﻧﺎ‬ ‫إﯾﺎك‬ ‫ﻛﺘﺎﺑﻨﺎ‬ ‫ﻛﺘﺎﺑﻚ‬ ‫ﻧﺤﻨﺎ‬ ‫إﻧﺖ‬
‫إﯾﺎﻛﻦ‬ ‫إﯾﺎﻛﻲ‬ ‫ﻛﺘﺎﺑﻜﻦ‬ ‫ﻛﺘﺎﺑﻜﻲ‬ ‫إﻧﺘﻮا‬ ‫إﻧﺘﻲ‬
‫إﯾﺎھﻦ‬ ‫إﯾﺎه‬ ‫ﻛﺘﺎﺑﮭﻦ‬ ‫ﻛﺘﺎﺑﮫ‬ ‫ھﻨﻦ‬ ‫ھﻮ‬

3. 5. 2. Le pronom relatif
Le relatif sera systé matiquement noté ‫اﻟﻠﻲ‬.

3. 5. 3. Les pronoms interrogatifs


Les interrogatifs font l’objet d’une transcription conventionnelle, quelle que soit leur
ré alisation :
...‫ إﻣﺘﻰ‬،‫ إﯾﻤﺘﻰ‬،‫ ﻗﺪﯾﮫ‬،‫ ﻗﺪﯾﺶ‬،‫ ﺷﻮ‬،‫ إﯾﺶ‬،‫ ﻟﯿﺶ‬،‫ ﻟﯿﮫ‬،‫ ﻣﯿﻦ‬،‫ ﻓﯿﻦ‬،‫ وﯾﻦ‬،‫ﻛﯿﻒ‬
Voir l’annexe 2 pour une liste complè te.

3. 5. 4. Les pronoms démonstratifs


Les pronoms dé monstratifs font l’objet d’une notation conventionnelle, quelle que soit
leur ré alisation. Voir l’annexe 2.
‫ ھﺬﯾﻚ‬،‫ ھﺬاك‬،‫ ھﺬول‬،‫ ھﺬي‬،‫ھﺬا‬

3. 6. Particules et prépositions
Les particules et prépositions monolitères sont attachées conformément à l’orthographe arabe.
Les particules tronquées ne sont pas rétablies et sont traitées comme des monolitères.
Ex. : ‫ ﻋﺎﻟﺒﯿﺖ‬ne sera pas noté ‫ﻋﻠﻰ اﻟﺒﯿﺖ‬

3. 7. Les chiffres
Les chiffres sont transcrits conformément à leur équivalent en arabe standard.
Ex. ‫أرﺑﻌﺔ ﻋﺸﺮ‬

- 17 -
Convention AraPI
Version 19 avril 2019

3. 8. La morphologie verbale
La transcription des verbes conserve les marqueurs modaux du dialecte (b-, ʕam). En cas
d’élision du morphème de conjugaison en tier 1 (ʕam fakkir), le morphème manquant est
rétabli (‫)ﻋﻢ أﻓّﻜﺮ‬. De même, pour l’inaccompli à valeur modale (sans le préverbe b-) employé
après différentes particules comme ‫ ﺣﺘﻰ‬،‫ ﻻزم‬،ّ‫ ﺑﺪ‬،‫ ﻓﻲ‬, etc., la hamza de la première personne du
singulier est rétablie dans la tier 3 (‫)ﺑﺪّي أﺣﺠﺰ‬.

Les tableaux complets de conjugaison à l’accompli, à l’inaccompli et à l’impé ratif figurent


dans l’annexe 2.

3. 9. Autres éléments conventionnels


Des conventions orthographiques sont introduites pour le vocabulaire dialectal ainsi que
pour les emprunts (Voir annexe 2).

3. 9. 1. Les expressions figées


Les éléments à traduction variée ou les expressions figées d’inspiration coranique ou non,
sont écrits en toutes lettres au plus près de l’orthographe standard, selon une notation
conventionnelle qu’on s’attachera à respecter pour faciliter les recherches automatiques
(Annexe 2).

3. 9. 2. Les mots ou syntagmes en langue étrangère


Les productions en langue étrangère sont notées avec les caractères et dans l’orthographe
de la langue concernée.
Ex. #bonnet# ‫ ﺑﺪّه‬#hair# ‫إﻧّﮫ ﻧﻘﻮﻻس‬

3. 9. 3. Les mots étrangers entrés dans les usages


Les mots étrangers entrés dans les usages seront transcrits en caractères arabes, entre
dièses, sans menton de la langue.
Ex. #‫ﺑﻨﺠﻮر‬# ، #‫ﺳﻮري‬# ، #‫ﻣﺮﺳﻲ‬# ، #‫ﭬﺎ ﺳﺎ‬#

3. 9. 4. Les emprunts arabisés


Les emprunts arabisés seront transcrits en caractères arabes, entre dièses, sans menton
de la langue.
Ex. #‫ﺗﯿﭙﯿﺮوارات‬# ، #‫ﭘﻮﯾﺎت‬#

3. 9. 5. Les régulateurs, marques d’hésitation, acquiescement, négation


La notation des régulateurs, de l’hésitation, de l’acquiescement ou de la négation font
aussi l’objet de conventions. Voir Annexe 2.

- 18 -
Convention AraPI
Version 19 avril 2019

3. 9. 6. Les noms propres


Qu’ils soient remplacés par des pseudonymes ou non, les noms propres sont transcrits
dans leur orthographe courante si elle est connue et notés entre guillemets hauts, en
caractères arabes. Il peut s’agir d’une personne, d’un lieu, d’une institution, etc.

3. 9. 7. La mention de noms anonymisés


Les noms propres anonymisés cités apparaissent en entier ou sous leur forme abrégée
selon les cas, entre guillemets hauts et en caractères arabes. Cela peut concerner une
personne, un lieu, une institution, etc. S’il s’agit du pseudo de l’un des participants à
l’interaction, on le conserve en caractères latins et sans guillemets.

- 19 -
Convention AraPI
Version 19 avril 2019

4. LA TIER 4 : UNE TRADUCTION


La tier de traduction offre un accès direct au sens. Les choix de traduction doivent être
guidés par deux principes : l’intelligibilité et la conformité à l’original. On ne fera donc pas
du mot-à-mot et on veillera à ce que le rendu soit compréhensible en français, tout en
s’assurant de rester au plus proche de la structure arabe originale. Par ailleurs, aucun
signe de ponctuation n’est ajouté.

4. 1. Phénomènes interactionnels
Les phé nomè nes interactionnels ne sont pas indiqué s, à l’exception des pauses noté es par
(.) quelle que soit leur duré e, et des chevauchements marqué s par [. Les segments
inaudibles sont rendus par xx. En cas de troncation, on ajoute un tiret à la fin du mot
inachevé . Les é lé ments incertains dans la transcription sont traduits entre parenthè ses.
Comme dans les autres tiers, si le nom des intervenants est cité dans un énoncé, il figure
en caractères latins en trois lettres majuscules, selon le code donné par le transcripteur.

4. 2. Vouvoiement et ajustements de traduction


Les é noncé s où le vouvoiement serait d’usage en français sont traduits en utilisant "vous",
plutôt que "tu".
Les ajouts aidant à comprendre le sens de la traduction seront mentionné s entre {}.

4. 3. Expressions figées
Les éléments à traduction variée (comme jaʕni) ou les expressions figées d’inspiration
coranique ou non, sont notés conformément à la notation conventionnelle établie utilisée
en tier 2, composée de quatre lettres capitales (voir la liste en annexe 2).
Ex : LAYK je passe te voir demain INCH

4. 4. Mots ou syntagmes en langue étrangère


Les mots prononcés dans une langue autre que l’arabe sont traduits en français, mais
figurent entre # pour marquer l’emprunt, la langue utilisée étant indiquée entre double
parenthèses à l’intérieur des dièses en se référant au code ISO. De même, les réalisations
en arabe classique (CLA) ou standard moderne (MSA) figurent entre dièses avec mention
de la langue entre double parenthèses.
Ex : #merci ((FR))#

4. 5. Régulateurs, marques d’hésitation, acquiescement, négation


La notation des régulateurs, de l’hésitation, de l’acquiescement ou de la négation fait
l’objet de conventions (voir l’annexe 2).

4. 6. Les noms propres


Qu’ils soient remplacés par des pseudonymes ou non, les noms propres sont notés dans
leur orthographe courante si elle est connue, sans guillemets mais avec majuscules
initiales.

- 20 -
Convention AraPI
Version 19 avril 2019

5. LISTE DES DOCUMENTS ANNEXES


Annexe 1 : Convention de transcription pour les phénomènes oraux et interactionnels

Annexe 2 : Liste des notations conventionnelles

Annexe 3 : Liste des gloses morpho-syntaxiques

Annexe 4 : Règles générales de transcription des dialectes en caractères arabes

Annexe 5 : Tableau synoptique de la convention AraPI

6. BIBLIOGRAPHIE

BICKEL, B., COMRIE, B., HASPELMATH, M. (2015). Leipzig Glossing Rules [En ligne]
[Link]
BIZRI, F. (2010). Parlons l’arabe libanais, Paris, L’Harmattan.
BLANC, H. (1960). “Stylistic Variations in Spoken Arabic: A Sample of Interdialectal
Educated Conversation”, in C. A. FERGUSON (ed.), Contributions to Arabic Linguistics,
Cambridge, Massachusset, Harvard Middle Eastern Monographs, p. 81-161.
CAUBET, D. (1999). « Arabe maghrébin : passage à l’écrit et institutions », Faits de Langue
13, p. 235-244.
DIAB, M., HABASH, N. (2014). Natural Language Processing of Arabic and its Dialects [En
ligne] [Link]
DICHY, J. (1994). « La pluriglossie de l’arabe », Bulletin d'études orientales 46, Damas,
p. 19-42.
HABASH, N., SOUDI, A., BUCKWALTER, T. (2007). “On Arabic Transliteration”, in SOUDI A., BOSCH
A., NEUMANN G. (eds). Arabic Computational Morphology. Text, Speech and Language
Technology, 38. Springer, Dordrecht.
HABASH, N., DIAB, M., RAMBOW, O. (2012). Conventional orthography for dialectal Arabic [En
ligne] [Link]
HABASH, F., et al. (2018). Unified Guidelines and Resources for Arabic Dialect Orthography
[En ligne] [Link]
ICOR (2013). Convention ICOR [En ligne] [Link]
2013_Conv_ICOR_250313.pdf
IZRE'EL, S., METTOUCHI, A. (2015). “Representation of speech in Corpafroas. Transcriptional
strategies and prosodic units”, in METTOUCHI A., VANHOVE M., CAUBET D. (dir.), Corpus-
based Studies of Lesser-described Languages: The CorpAfroAs corpus of spoken
AfroAsiatic languages, John Benjamins Publishing Company, p. 14-41.

- 21 -
Convention AraPI
Version 19 avril 2019

JEFFERSON, G. (2004). “Glossary of transcript symbols with an introduction”, in LERNER G.


(dir.), Conversation Analysis: Studies from the First Generation, Amsterdam, John
Benjamins, p. 13-31.
MAAMOURI, M, GRAFF, D., JIN, H., CIERI, C. (2004a). Dialectal Arabic Orthography-based
Transcription & CTS Levantine Arabic Collection. EARS PI Meeting and RT-04
Workshop, IBM Executive Conference Center, Palisades, NY, USA; November 7-11,
2004 [En ligne] http:// [Link]/richtrans2004/
MAAMOURI, M, GRAFF, D., JIN, H., CIERI, C. (2004b). “Dialectal Arabic Telephone Speech
Corpus: Principles, Tool design and Transcription Convention”, in Proceedings of
the NEMLAR Arabic Language Resources and Tools Conference Sept. 22-23, 2004.
Cairo, Egypt, p. 55-60 [En ligne]
[Link]
e_speech_corpus_Principles_tool_design_and_transcription_conventions
METTOUCHI, A., VANHOVE, M., CAUBET, D. (dir.) (2015). Corpus-based Studies of Lesser-
described Languages: The CorpAfroAs corpus of spoken AfroAsiatic languages. John
Benjamins Publishing Company.
METTOUCHI, A., CHANARD, C. (2010). “From Fieldwork to Annotated Corpora: the
CorpAfroAs Project”, Faits de Langue-Les Cahiers 2, p. 255-265.
TRAVERSO, V. (2006). Des échanges ordinaires à Damas. Lyon/Damas: PUL/Presses de
l’IFPO.
VAILLANT P., LEGLISE I. (2014). « À la croisée des langues. Annotation et fouille de corpus
plurilingues », Revue des nouvelles technologies de l'information, Cépaduès-Editions,
RNTI-SHS-2, p. 81-100.
ZAGHOUANI W. (2014). “Critical Survey of the Freely Available Arabic Corpora”, Workshop
on Free/Open-Source Arabic Corpora and Corpora Processing Tools [En ligne]
[Link]
ZAWAYDEH Bushra et al. “Guidelines for Transcribing Arabic Dialects” [En ligne]
[Link]
[Link]
ZRIBI I. , GRAJA, M., ELLOUZE, M., JAOUA, M., HADRICH BELGUITH, L., (2013). “Orthographic
Transcription for Spoken Tunisian Arabic”, CICLing 1, p. 153-163.
ZRIBI I., BOUJELBANE R., MASMOUDI A., ELLOUZE M., HADRICH BELGUITH L., HABASH N. (2014). “A
Conventional Orthography for Tunisian Arabic”, LREC 2014, p. 2355-2361.
ZRIBI I., ELLOUZE M., HADRICH BELGUITH L., BLACHE P. (2015). “Spoken Tunisian Arabic Corpus
"STAC": Transcription and Annotation”, Research in Computing Science 90, p. 123-
135.

- 22 -
Annexe 1 : convention de transcription pour les phénomènes oraux
et interactionnels

Phénomène Conventions Exemples

Identité du participant

Participant Toute parole est rapportée au locuteur qui l'a produite, qui est COR hāj
identifié indiqué en début de ligne généralement par son identifiant, qui
est le diminutif de son pseudonyme (utilisé pour des raisons
éthiques et juridiques). L’identifiant est composé d’un, de deux
ou de trois caractères (en majuscules). Dans les documents
word, il est suivi d’une tabulation. Attention: c’est le seul endroit
dans une transcription où l’usage de la tabulation est admis.

Doutes sur Lorsque le locuteur n'est pas identifiable, on utilise des X à la XXX hāj
l’identité du place du pseudo, en spécifiant F(emme) ou H(omme) si possible XXF bāj
XXH salēm
participant et nécessaire.

Tour

Notation du tour La notation du tour est toujours rapportée à un identifiant. Un COR u baʕdēn ħanballeʃ
tour peut s'étendre sur plusieurs lignes. Le paragraphe d'un tour duƔri duƔri #direct#
waḷḷa
est aligné à gauche.

Enchaînement = indique deux tours de parole qui s'enchaînent immédiatement COR kīfek/=
immédiat sans micro-pause entre eux (latching). SAR =kīfak anta

Chevauchement Les crochets [ et ] encadrent le chevauchement dans chacun des SAR hāj lī[na ]
tours concernés. COR [ahlē:n]

Silences et Les pauses d’une durée inférieure à 0,2 secondes sont notées (.) (.)
pauses (micro-pauses)
(0.7)
Au-dessus, elles sont chronométrées à l’aide d’un logiciel au
10ième de seconde près.

Production de la parole

Relation phonie- Pour les productions en arabe, on utilise une transcription SAM ahlēn ʃu xbārik
graphie phonético-phonologique (voir la convention ARAPI).

Pour les productions dans d'autre langues, on utilise une SAR monsieur
transcription orthographique

Elision non En cas de besoin, pour les langues transcrites en orthographe, SAR c'est d‘jà ça
standard on peut recourir à l'élision non standard, notée par une
COR j'ai compris (.)
antiquote ` (suivie d’un espace en fin de mot ; sans espace à j‘ recommmence
l'intérieur du mot).
Cette notation distinguant l'élision standard de l'élision non
standard est importante pour le fonctionnement des outils de
recherche automatique dans les données.

Segments Les segments incompréhensibles sont représentés au moyen COR xxx


inaudibles d’une série de x, chacun valant une syllabe.
Si le nombre de syllabes ne peut être perçu, on note (inaud.) COR (inaud.)
Si le transcripteur hésite entre plusieurs notations, les deux sont
notées entre parenthèses, séparées par des points virgules. SAR (bʔūl; btəʔūl)

Allongement Le son allongé est noté par : (sans espace avant). Les : sont COR wē:nek/
répétés en fonction de la durée perçue de l’allongement. SAR hō:::ne ma ʃeftini
Troncation L'abandon d'un mot en cours de production est noté par - (sans COR ajm- ajmta beddek
espace avant, un espace après, ce qui le distingue du trait teƷi
d'union).

Aspiration L’aspiration est notée par .h (h précédé d’un point sans espace). COR .h: eh:: lima la

Expiration, L’expiration est notée par h COR h:: laʔa akīd lā


soupir

Prosodie

Montée et chute Les montées et chutes intonatives sont notées par « / » et « \ » SAM xallaṣte//
intonative sans espace avant. LEI lā\ lissa
Les fortes montées et chutes sont notées par « // » et « \\ .

Saillance Les segments perçus comme saillants sont soulignés. SAM waḷḷa ma baʕref
perceptuelle

Production vocale

Production Les caractéristiques vocales et du mode de production sont COR <((en riant)) ma
vocale décrites entre doubles parenthèses et précèdent la fī:ni>
transcription, l’ensemble est compris entre chevrons :

Actions et événements. Cela concerne tous les phénomènes décrits et non transcrits, c'est-à-dire qui ne correspondent
pas à des paroles produites par les participants.

Action ou Description entre doubles parenthèses dans le "pavé" du tour, CAR ((tape un numéro
de téléphone))
événement après le pseudo du locuteur en début de ligne
attribuable

Action ou Même notation entre doubles parenthèses, mais sans ((le tonnerre
événement identifiant dans la colonne des pseudos. retentit))
1

Annexe 2 : Liste des notations conventionnelles

0. PRESENTATION DES 4 TIERS ................................................................................................................................... 2


1. TRANSCRIPTION DES SONS ...................................................................................................................................... 2
1. 1. CONSONNES .................................................................................................................................................................................... 2
1. 2. VOYELLES BREVES ......................................................................................................................................................................... 2
1. 3. VOYELLES LONGUES ...................................................................................................................................................................... 3
1. 4. EXEMPLES ....................................................................................................................................................................................... 3
2. LONGUEUR PHONETIQUE ET EXPRESSIVE .......................................................................................................... 4
3. VOYELLES LONGUES EN FIN DE MOT .................................................................................................................... 4
4. TRANSCRIPTION DU ALIF SUSCRIT........................................................................................................................ 4
5. TRANSCRIPTION DE LA HAMZA .............................................................................................................................. 4
6. LES DETERMINANTS ................................................................................................................................................... 4
6. 1. L’ARTICLE ....................................................................................................................................................................................... 4
6. 2. LES DEMONSTRATIFS .................................................................................................................................................................... 4
7. LES PRONOMS ............................................................................................................................................................... 5
7. 1. LES PRONOMS PERSONNELS ......................................................................................................................................................... 5
7. 1. 1. Les pronoms isolés sujets ..................................................................................................................................................5
7. 1. 2. Les pronoms suffixes possessifs ......................................................................................................................................5
7. 1. 3. Les pronoms suffixes compléments ..............................................................................................................................5
7. 1. 4. Exemples ..................................................................................................................................................................................5
7. 2. LE PRONOM RELATIF ..................................................................................................................................................................... 6
7. 3. LES PRONOMS INTERROGATIFS ................................................................................................................................................... 6
7. 4. LES PRONOMS DEMONSTRATIFS .................................................................................................................................................. 6
8. PARTICULES ET PREPOSITIONS ............................................................................................................................. 6
9. LES CHIFFRES ................................................................................................................................................................ 7
10. MORPHOLOGIE VERBALE ....................................................................................................................................... 7
10.1. INACCOMPLI.................................................................................................................................................................................. 7
10.2. INACCOMPLI MODAL .................................................................................................................................................................... 8
10.3. ACCOMPLI ..................................................................................................................................................................................... 8
10.4. IMPERATIF .................................................................................................................................................................................... 8
10. 5. FORMES AUGMENTEES ............................................................................................................................................................... 8
10. 6. EXEMPLES .................................................................................................................................................................................... 9
11. MORPHOLOGIE NOMINALE.................................................................................................................................... 9
12. AUTRES ELEMENTS CONVENTIONNELS.......................................................................................................... 10
12. 1. LES EXPRESSIONS FIGEES (LISTE OUVERTE) .........................................................................................................................10
12. 2. LES MOTS OU SYNTAGMES EN LANGUE ETRANGERE ............................................................................................................10
12. 3. LES MOTS ETRANGERS ENTRES DANS LES USAGES (LISTE OUVERTE) ...............................................................................10
12. 4. LES EMPRUNTS ARABISES (LISTE OUVERTE) ........................................................................................................................11
12. 5. REGULATEURS, MARQUES D’HESITATION, ACQUIESCEMENT, NEGATION .........................................................................11
12. 6. LES NOMS PROPRES ..................................................................................................................................................................11
12. 7. LA MENTION DE NOMS ANONYMISES......................................................................................................................................11
13. LE LEXIQUE DIALECTAL (LISTE OUVERTE) ................................................................................................... 11
2

0. Présentation des 4 tiers

La convention AraPI comprend 4 tiers :


Tier 1 : transcription phonético-phonologique (API modifié)
Tier 2a : translittération morpho-phonologique (API modifié)
Tier 2b : glose morpho-syntaxique
Tier 3 : translittération arabe (avec caractères modifiés)
Tier 4 : traduction

Dans la tier 1, on transcrit phonétiquement sans atteindre un degré de granularité très fin. Dans
les tableaux qui suivent, les exemples donnés pour la tier 1 ne représentent pas toutes les
réalisations possibles.
La tier 3 est une notation conventionnelle du dialecte en caractères arabes : les traits
morphologiques spécifiques au dialecte sont conservés, mais le ductus des mots se rapproche dès
que possible de l’arabe littéral standard. De nombreux éléments courants, tels que les pronoms,
les interrogatifs, etc. font l’objet de notations conventionnelles. La tier 2a est la translittération
de la tier 3 en API.
La tier 2b est une glose (cf. annexe 4 pour une liste des gloses et des exemples).
La tier 4 est une traduction dans la langue du chercheur, qui rend le sens de l’énoncé tout en
s’attachant à rester au plus près de l’original.

1. Transcription des sons


1. 1. Consonnes
Les consonnes sont présentées dans l’ordre alphabétique de l’arabe.

Tier 3 Tier 1 Tier 2a Tier 3 Tier 1 Tier 2a


‫ء‬ ʔ ʔ ‫ط‬ ṭ ṭ
‫ب‬ b, p b ‫ظ‬ ð, ḍ, ẓ
̣ ð
̣
‫ت‬ t t ‫ع‬ ʕ ʕ
‫ث‬ θ, t, s θ ‫غ‬ ɣ ɣ
‫پ‬ p p ‫ف‬ f, v f
‫ج‬ Ʒ, dƷ, g Ʒ ‫ڤ‬ v v
‫ح‬ ħ ħ ‫ق‬ q, g, ʔ q
‫خ‬ x x ‫ك‬ k, g k
‫د‬ d d ‫گ‬ g g
‫ذ‬ ð, d, z ð ‫ل‬ l, ḷ l
‫ر‬ r r ‫م‬ m m
‫ز‬ z z ‫ن‬ n n
‫س‬ s s ‫ه‬ h h
‫ش‬ ʃ ʃ ‫و‬ w w
‫ص‬ ṣ ṣ ‫ي‬ j j
‫ض‬ ḍ, ẓ ẓ

1. 2. Voyelles brèves
Il n’y a aucune vocalisation en tier 3. Pour les termes étrangers se terminant par le son [e], on
peut le transcrire ‫ ﯾﮫ‬en arabe.
3

Tier 1 Tier 2a
a, ə a
ɛ, e, ə e
i, ə i
o, ə o
u, y u

1. 3. Voyelles longues

Tier 3 Tier 1 Tier 2a


‫ا‬ ā ā
‫ي‬-‫ا‬ ē ē
‫ي‬ ī ī
‫و‬ ō ū
‫و‬ ū ū
ʔø ʔø ʔø (hésitation)
hã (marqueur
ã
exclamatif)

ɔƷūr

API Exemple API Exemple


a abjaḍ ā ktāb
ɛ bɛrke ē lēʃ, bēt, bēred
e ṭajjeb ī dīk
ə sətt, təffēħa ō ʃōb
i kīfik ū sūʔ
o bjektob ã ã... ok (exclamation)
u suʔāl ̃
ɔ b̃
ɔƷūr
y stydjo ø ʔø (hésitation)

1. 4. Exemples
Tier 1 Tier 2a Tier 3
zɣīr ṣaɣīr ‫ﺻﻐﯿﺮ‬
rfīʔa rafīqa ‫رﻓﯿﻘﺔ‬
tlēt θalāθ ‫ﺛﻼث‬
masalan maθalan ‫ﻣﺜﻼ‬
iza iðā ‫إذا‬
bi ẓẓabəṭ bi-l-ḍabṭ ‫ﺑﺎﻟﻀﺒﻂ‬
mazbūṭ maḍbūṭ ‫ﻣﻀﺒﻮط‬
ẓāhra ðāhira ‫ظﺎھﺮة‬
ḍall ðalla ‫ظّﻞ‬
aḷḷā, aḷḷāh allāh ‫ﷲ‬
bēt bajt ‫ﺑﯿﺖ‬
jōm jawm ‫ﯾﻮم‬
ktēb kitāb ‫ﻛﺘﺎب‬
sijēse sijāse ‫ﺳﯿﺎﺳﺔ‬
baḥər baḥr ‫ﺑﺤﺮ‬
azraʔ azraq ‫أزرق‬
rās raʔs ‫رأس‬
samā samāʔ ‫ﺳﻤﺎء‬
4

2. Longueur phonétique et expressive


Tier 1 Tier 2a Tier 3
bʕī::d baʕīd ‫ﺑﻌﯿﺪ‬
lē:ʃ lēʃ ‫ﻟﯿﺶ‬
akī::d akīd ‫أﻛﯿﺪ‬

3. Voyelles longues en fin de mot


Tier 1 Tier 2a Tier 3
ana anā ‫أﻧﺎ‬
ʕala ʕalā ‫ﻋﻠﻰ‬
farƷīne farƷī-nī ‫ﻓﺮﺟﯿﻨﻲ‬
fi fī ‫ﻓﻲ‬

4. Transcription du alif suscrit


Tier 1 Tier 2a Tier 3
aḷḷā, aḷḷāh allāh ‫ﷲ‬
lākin, lakin lākin ‫ﻟﻜﻦ‬
hāza, haza hāðā ‫ھﺬا‬
halbēt hāðā l-bajt ‫ھﺬا اﻟﺒﯿﺖ‬

5. Transcription de la hamza
Tier 1 Tier 2a Tier 3
bīr biʔr ‫ﺑﺌﺮ‬
rās raʔs ‫رأس‬
raʔīs raʔīs ‫رﺋﯿﺲ‬
samā samāʔ ‫ﺳﻤﺎء‬
tlēt ijjēm θalāθat ajjām ‫ﺛﻼﺛﺔ أﯾّﺎم‬
ħkīne iħkī-nī ‫اﺣﻜﯿﻨﻲ‬
esmi ism-ī ‫اﺳﻤﻲ‬
ʃū əsmak ʃū ism-ak ‫ﺷﻮ اﺳﻤﻚ‬
xajje ax-ī ‫أﺧﻲ‬

6. Les déterminants
6. 1. L’article
Tier 1 Tier 2a Tier 3
à l’initiale
elləʕbe el-luʕba ‫ااﻟﻌﺒﺔ‬
eddār el-dār ‫اﻟﺪار‬
eʃʃaməs el-ʃams ‫اﻟﺸﻤﺲ‬
elbejt el-bajt ‫اﻟﺒﯿﺖ‬
en liaison
bə lləʕbe bi-l-luʕba ‫ﺑﺎﻟﻠﻌﺒﺔ‬
bi ddār bi-l-dār ‫ﺑﺎﻟﺪار‬
taḥt eʃʃaməs taḥt l-ʃams ‫ﺗﺤﺖ اﻟﺸﻤﺲ‬
zēt ellōn ðāt l-lawn ‫ذات اﻟﻠﻮن‬
ʃakəl bēt elƷirān ʃakl bajt l-Ʒirān ‫ﺷﻜﻞ ﺑﯿﺖ اﻟﺠﯿﺮان‬
tannurt elbenet tannurat l-bint ‫ﺗﻨّﻮرة اﻟﺒﻨﺖ‬

6. 2. Les démonstratifs
Tier 1 Tier 2a Tier 3
5

ha ha ‫ھـ‬
hajda, haza hāðā ‫ھذا‬
hajde, hajdi, hazihi hāðī ‫ھذي‬
hadōl, hadōle haðūl ‫ھذول‬
hdāk haðāk ‫ھذاك‬
hadīk, hadīke haðīk ‫ھذﯾك‬

Tier 1 Tier 2a Tier 3


halktēb ha-l-kitāb ‫ھﺎﻟﻜﺘﺎب‬
bi halbēt bi-ha-l-bajt ‫ﺑﮭﺎﻟﺒﯿﺖ‬

7. Les pronoms
7. 1. Les pronoms personnels
7. 1. 1. Les pronoms isolés sujets
Tier 1 Tier 2a Tier 3
ana, ani anā ‫أﻧﺎ‬
enta enta ‫إﻧﺖ‬
ente enti ‫إﻧﺘﻲ‬
huwwe huwa ‫ھﻮ‬
hijje hija ‫ھﻲ‬
neħna, ʔēħna naħnā ‫ﻧﺤﻨﺎ‬
ento entō ‫إﻧﺘﻮا‬
henne, hennen hennen ‫ھﻨﻦ‬

7. 1. 2. Les pronoms suffixes possessifs


Tier 1 Tier 2a Tier 3
ktēbe kitāb-ī ‫ﻛﺘﺎﺑﻲ‬
ktēbek / ktēbak kitāb-ka ‫ﻛﺘﺎﺑﻚ‬
ktēbek / ktēbik kitāb-ki ‫ﻛﺘﺎﺑﻜﻲ‬
ktēbo kitāb-hu ‫ﻛﺘﺎﺑﮫ‬
ktēba kitāb-hā ‫ﻛﺘﺎﺑﮭﺎ‬
ktēbna kitāb-nā ‫ﻛﺘﺎﺑﻨﺎ‬
ktēbkon kitāb-kon ‫ﻛﺘﺎﺑﻜﻦ‬
ktēbon kitāb-hon ‫ﻛﺘﺎﺑﮭﻦ‬

7. 1. 3. Les pronoms suffixes compléments


Tier 1 Tier 2a Tier 3
jāni, jāne jē-nī ‫إﯾﺎﻧﻲ‬
jāk, ijjāk, jēk jē-ka ‫إﯾﺎك‬
jāki, ijjāki jē-ki ‫إﯾﺎﻛﻲ‬
jē, ijjē, jāho jē-hu ‫إﯾﺎه‬
jē, ijjē, jāha jē-hā ‫إﯾﺎھﺎ‬
jāna jē-nā ‫إﯾﺎﻧﺎ‬
jekon jē-kon ‫إﯾﺎﻛﻦ‬
jon / jāhon jē-hon ‫إﯾﺎھﻦ‬
7. 1. 4. Exemples
Tier 1 Tier 2a Tier 3
bētna, bajtna bajt-nā ‫ﺑﯿﺘﻨﺎ‬
katbətha, katabəta katab-at-hā ‫ﻛﺘﺒﺘﮭﺎ‬
ʕaṭīne, ʕṭīne aʕṭi-nī, aʕṭī-nī ‫ اﻋﻄﯿﻨﻲ‬/ ‫اﻋﻄﻨﻲ‬
ʔāletle qāl-at l-ī ‫ﻗﺎﻟﺖ ﻟﻲ‬
biddi, bəddi badd-ī ‫ﺑﺪّي‬
bəddak, biddak, baddak badd-ka ‫ﺑﺪّك‬
bəddik, biddik, baddik badd-ki ‫ﺑﺪّﻛﻲ‬
6

bəddo badd-hu ‫ﺑﺪّه‬


bədda badd-hā ‫ﺑﺪّھﺎ‬
badna badd-nā ‫ﺑﺪّﻧﺎ‬
bədkon badd-kon ‫ﺑﺪّﻛﻦ‬
bəddon badd-hon ‫ﺑﺪّھﻦ‬

7. 2. Le pronom relatif
Tier 1 Tier 2a Tier 3
jilli, elli, li, l jalli ‫اﻟﻠﻲ‬

7. 3. Les pronoms interrogatifs


Tier 1 Tier 2a Tier 3
kīf kīf ‫ﻛﯿﻒ‬
wejn, wēn wīn ‫وﯾﻦ‬
fejn, fēn fīn ‫ﻓﯿﻦ‬
mīn mīn ‫ﻣﯾن‬
lē lē ‫ﻟﯾﮫ‬
lēʃ lēʃ ‫ﻟﯾش‬
ēʃ ēʃ ‫إﯾش‬
ʃū ʃū ‫ﺷﻮ‬
ʔaddēʃ qaddēʃ ‫ﻗدﯾش‬
ʔadde qaddē ‫ﻗدﯾﮫ‬
ejmata ejmatā ‫إﯾﻣﺗﻰ‬
emta emtā ‫إﻣﺗﻰ‬
ej / ejja aj / aja ‫ أﯾﺔ‬/ ‫أي‬

7. 4. Les pronoms démonstratifs


Tier 1 Tier 2a Tier 3
hajda, haza hāðā ‫ھذا‬
hajde, hajdi, hazihi hāðī ‫ھذي‬
hadōl, hadōle haðūl ‫ھذول‬
hdāk haðāk ‫ھذاك‬
hadīk, hadīke haðīk ‫ھذﯾك‬

8. Particules et prépositions
Toutes les particules et prépositions sont séparées par une espace en tier 1. En tier 2a, les
particules monolitères sont segmentées par un tiret. En tier 3, on respecte les règles
d’orthographe de l’arabe standard.

Tier 1 Tier 2a Tier 3


Particules monolitères
bi ṣṣēf bi-l-ṣajf ‫ﺑﺎﻟﺼﯿﻒ‬
bi lbēt bi-l-bajt ‫ﺑﺎﻟﺒﯿﺖ‬
bi bēt elƷirān bi-bajt l-Ʒirān ‫ﺑﺒﯿﺖ اﻟﺠﯿﺮان‬
bi lxzēne bi-l-xizāne ‫ﺑﺎﻟﺨﺰاﻧﺔ‬
ta jektob ta-ja-ktub ‫ﺗﯿﻜﺘﺐ‬
la jkūn li-ja-kūn ‫ﻟﯿﻜﻮن‬
la lmadām li-l-madām ‫ﻟﻠﻤﺪام‬
ʕa tṭawle ʕa-l-ṭāwile ‫ﻋﺎﻟﻄﺎوﻟﺔ‬
Autres particules
mn əlbidāje min l-bidāje ‫ﻣﻦ اﻟﺒﺪاﯾﺔ‬
foʔ ərrās fawq l-raʔs ‫ﻓﻮق اﻟﺮأس‬
7

9. Les chiffres
Les chiffres sont transcrits phonétiquement en tier 1, mais notés conformément à leur équivalent
en arabe standard dans les tiers 2a et 3.

Tier 1 Tier 2a Tier 3


ṣefer ṣifr ‫ﺻﻔﺮ‬
wāħad wāħid / aħad / iħdā ‫ إﺣﺪى‬/ ‫ أﺣﺪ‬/ ‫واﺣﺪ‬
tnēn iθnajn / iθnatajn ‫ إﺛﻨﺘﯿﻦ‬/ ‫إﺛﻨﯿﻦ‬
tlēte θalāθ / θalāθa ‫ ﺛﻼﺛﺔ‬/ ‫ﺛﻼث‬
arbʕa arbaʕ / arbaʕa ‫ أرﺑﻌﺔ‬/ ‫أرﺑﻊ‬
xamse xams / xamsa ‫ ﺧﻤﺴﺔ‬/ ‫ﺧﻤﺲ‬
sette sitt / sitta ‫ ﺳﺘ ّﺔ‬/ ‫ﺖ‬
ّ ‫ﺳ‬
sabʕa sabʕ / sabʕa ‫ ﺳﺒﻌﺔ‬/ ‫ﺳﺒﻊ‬
tmēne θamānin / θamāniya ‫ ﺛﻤﺎﻧﯿﺔ‬/ ‫ﺛﻤﺎٍن‬
tesʕa tisʕ / tisʕa ‫ ﺗﺴﻌﺔ‬/ ‫ﺗﺴﻊ‬
ʕaʃra ʕaʃar / ʕaʃra ‫ ﻋﺸﺮة‬/ ‫ﻋﺸﺮ‬
ħdaʕʃ aħad ʕaʃar / iħdā ʕaʃra ‫ إﺣﺪى ﻋﺸﺮة‬/ ‫أﺣﺪ ﻋﺸﺮ‬
tnaʕʃ iθnaj ʕaʃar / iθnataj ʕaʃra ‫ إﺛﻨﺘﻲ ﻋﺸﺮ‬/ ‫إﺛﻨﻲ ﻋﺸﺮ‬
tlattaʕʃ θalāθat ʕaʃar ‫ﺛﻼﺛﺔ ﻋﺸﺮ‬
ʕarbaʕtaʕʃ arbaʕat ʕaʃar ‫أرﺑﻌﺔ ﻋﺸﺮ‬
xamstaʕʃ xamsat ʕaʃar ‫ﺧﻤﺴﺔ ﻋﺸﺮ‬
settaʕʃ sittat ʕaʃar ‫ﺳﺘ ّﺔ ﻋﺸﺮ‬
sabaʕtaʕʃ sabʕat ʕaʃar ‫ﺳﺒﻌﺔ ﻋﺸﺮ‬
tmantaʕʃ θamānijat ʕaʃar ‫ﺛﻤﺎﻧﯿﺔ ﻋﺸﺮ‬
tesaʕtaʕʃ tisʕat ʕaʃar ‫ﺗﺴﻌﺔ ﻋﺸﺮ‬
ʕeʃrīn ʕiʃrīn ‫ﻋﺸﺮﯾﻦ‬
tlētīn θalāθīn ‫ﺛﻼﺛﯿﻦ‬
arbʕīn arbaʕīn ‫أرﺑﻌﯿﻦ‬
xamsīn xamsīn ‫ﺧﻤﺴﯿﻦ‬
settīn sittīn ‫ﺳﺘ ّﯿﻦ‬
sabʕīn sabʕīn
‫ﺳﺒﻌﯿﻦ‬
tmēnīn θamānīn
‫ﺛﻤﺎﻧﯿﻦ‬
tesʕīn tisʕīn
‫ﺗﺴﻌﯿﻦ‬
mit miʔa
‫ﻣﺌﺔ‬
eləf alf
‫أﻟﻒ‬

10. Morphologie verbale


Les désinences verbales ne sont segmentées par un tiret que dans la tier 2 où le radical du verbe
est isolé de l’ensemble des affixes (morphèmes de modes/temps et personnes) qui font l’objet
d’une notation conventionnelle.
Attention : la convention s’écarte de la proposition de CODA dans la notation de la conjugaison à
la 1ère personne du pluriel (on note m-n- et pas b-n-).
En cas d’élision du morphème de conjugaison en tier 1 (ʿam fakkir), on rétablit en tier 2 et 3 le
morphème manquant (ʿam u-fakkir). La voyelle du radical et des personnes (pour les formes
dérivées) est transcrite phonétiquement en tier 1 mais devient conventionnelle en tier 2.

Voici les tableaux de conjugaison pour le verbe katab, suivis de différents exemples pour d’autres
verbes.

10.1. Inaccompli
Tier 1 Tier 2a Tier 3
bektob b-a-ktub ‫ﺑﺄﻛﺗب‬
btektob b-ta-ktub ‫ﺑﺘﻜﺘﺐ‬
btektobe b-ta-ktub-ī ‫ﺑﺘﻜﺘﺒﻲ‬
bjektob b-ja-ktub ‫ﺑﯿﻜﺘﺐ‬
8

btektob b-ta-ktub ‫ﺑﺘﻜﺘﺐ‬


mnektob m-na-ktub ‫ﻣﻨﻜﺘﺐ‬
btektobo b-ta-ktub-ū ‫ﺑﺘﻜﺘﺒﻮا‬
bjektobo b-ja-ktub-ū ‫ﺑﯿﻜﺘﺒﻮا‬

10.2. Inaccompli modal


Pour l’inaccompli à valeur modale (sans le préverbe b-) employé après différentes particules
comme ‫ ﺣﺘﻰ‬،‫ ﻻزم‬،ّ‫ ﺑﺪ‬،‫ ﻓﻲ‬, etc., la hamza de la première personne du singulier est rétablie dans les
tiers 2 et 3.

Tier 1 Tier 2a Tier 3


ektob a-ktub ‫أﻛﺗب‬
tektob ta-ktub ‫ﺗﻜﺘﺐ‬
tektobe ta-ktub-ī ‫ﺗﻜﺘﺒﻲ‬
jektob ja-ktub ‫ﯾﻜﺘﺐ‬
tektob ta-ktub ‫ﺗﻜﺘﺐ‬
nektob na-ktub ‫ﻧﻜﺘﺐ‬
tektobo ta-ktub-ū ‫ﺗﻜﺘﺒﻮا‬
jektobo ja-ktub-ū ‫ﯾﻜﺘﺒﻮا‬

10.3. Accompli
Tier 1 Tier 2a Tier 3
katabet, katabt katab-t ‫ﻛﺘﺒﺖ‬
katabet, katabt katab-t ‫ﻛﺘﺒﺖ‬
katabte katab-tī ‫ﻛﺘﺒﺘﻲ‬
katab katab ‫ﻛﺘﺐ‬
katbet katab-at ‫ﻛﺘﺒﺖ‬
katabna katab-nā ‫ﻛﺘﺒﻨﺎ‬
katabto katab-tū ‫ﻛﺘﺒﺘﻮا‬
katabo katab-ū ‫ﻛﺘﺒﻮا‬

10.4. Impératif
Tier 1 Tier 2a Tier 3
ktōb u-ktub ‫اﻛ ﺘ ﺐ‬
ktebe u-ktub-ī ‫اﻛ ﺘ ﺒ ﻲ‬
ktebo u-ktub-ū ‫اﻛ ﺘ ﺒ ﻮ ا‬

10. 5. Formes augmentées

Tier 1 Tier 2a Tier 3


II ħammam ħammam, ju-ħammim ‫ ﯾﺣّﻣم‬، ‫ﺣّﻣم‬
ʔattal qattal, ju-qattil ‫ ﯾﻘﺗ ّل‬، ‫ﻗﺗ ّل‬
III ʕāmal ʕāmal, ju-ʕāmil ‫ ﯾﻌﺎﻣل‬، ‫ﻋﺎﻣل‬
kētab kētab, ju-kātib ‫ ﯾﻛﺎﺗب‬، ‫ﻛﺎﺗب‬
9

IV aẓhar aẓhar, ju-ẓhir ‫ ﯾظﮭر‬، ‫أظﮭر‬


V tħammam tħammam, ja-ta-ħammam ‫ ﯾﺗﮭّﻣم‬، ‫ﺗﮭّﻣم‬
tkassar tkassar, ja-ta-kassar ‫ﺳر‬ّ ‫ ﯾﺗﻛ‬، ‫ﺳر‬
ّ ‫ﻛ‬
VI tʕāmal tʕāmal, ja-ta-ʕāmal ‫ﯾﺗﻌﺎﻣل‬، ‫ﺗﻌﺎﻣل‬
tkētaf tkētaf, ja-ta-kātaf ‫ ﯾﺗﻛﺎﺗف‬، ‫ﻛﺎﺗف‬
VII nkasar nkasar, ja-n-kasir ‫ ﯾﻧﻛﺳر‬، ‫اﻧﻛﺳر‬
nʔaṭaʕ nqaṭaʕ, ja-n-qaṭiʕ ‫ ﯾﻧﻘطﻊ‬، ‫ﻧﻘطﻊ‬
VIII ʃtaɣal ʃtaɣal, ja-ʃtaɣil ‫ ﯾﺷﺗﻐل‬، ‫اﺷﺗﻐل‬
ʕtamad ʕtamad, ja-ʕtamid ‫ﯾﻌﺗﻣد‬، ‫اﻋﺗﻣد‬
X staʔzan staʔzan, ja-sta-ʔzin ‫ ﯾﺳﺗﺄزن‬، ‫ﺳﺗﺄزن‬
staɣfar staɣfar, ja-sta-ɣfir ‫ ﯾﺳﺗﻐﻔر‬، ‫ﺳﺗﻐﻔر‬

10. 6. Exemples
Tier 1 Tier 2a Tier 3
minʔassemon m-nu-qassim-on ‫ﺴﻤﮭﻦ‬ ّ ‫ﻣﻨﻘ‬
jkūn / jikūn ja-kūn ‫ﯾﻜﻮن‬
ʕam jektob ʕam ja-ktub ‫ﻋﻢ ﯾﻜﺘﺐ‬
raħ tektob raħ ta-ktub ‫رح ﺗﻜﺘﺐ‬
ħa jektob ħa-ja-ktub ‫ﺣﯿﻜﺘﺐ‬
ʕam fakkər ʕam ufakkir ‫ﻋﻢ أﻓّﻜﺮ‬
bteʃrabe b-ta-ʃrab-ī ‫ﺑﺘﺸﺮﺑﻲ‬
jaʕmol ja-ʕmal ‫ﯾﻌﻤﻞ‬
semʕet samiʕ-t ‫ﺳﻤﻌﺖ‬
balleʃ ballaʃ ‫ﺑﻠّﺶ‬
biballeʃ b-ju-balliʃ ‫ﺑﯿﺒﻠّﺶ‬
betħebb b-tu-ħibb ‫ﺐ‬
ّ ‫ﺑﺘﺤ‬
mənrūħ m-na-rūħ ‫ﻣﻨﺮوح‬
fallet fall-at ‫ﻓﻠّﺖ‬
nsīna nasī-nā ‫ﻧﺴﯿﻨﺎ‬
ħajaʕtūne ħa-ja-ʕt-ū-nī ‫ﺣﯿﻌﻄﻮﻧﻲ‬
xallīni nām xallī-nī anām ‫ﺧﻠّﯿﻨﻲ أﻧﺎم‬
ʔāletlon qāl-at la-hon ‫ﻗﺎﻟﺖ ﻟﮭﻦ‬
ʔaltella qul-t la-hā ‫ﻗﻠﺖ ﻟﮭﺎ‬
biddi ħƷuz badd-ī aħƷuz ‫ﺑﺪّي أﺣﺠﺰ‬

11. Morphologie nominale


Dans la tier 1, les marques de genre et nombre des participes et des pluriels externes ne sont pas
segmentées. Dans la tier 2a, elles sont segmentées. Conventionnellement, le pluriel externe
masculin est noté -īn.

Tier 1 Tier 2a Tier 3


ʕāmil ʕāmil ‫ﻋﺎﻣﻞ‬
ʕāmle ʕāmil-e ‫ﻋﺎﻣﻠﺔ‬
ʕāmlīn ʕāmil-īn ‫ﻋﺎﻣﻠﯿﻦ‬
mʕallimīn muʕallim-īn ‫ﻣﻌﻠّﻤﯿﻦ‬
mʕallimāt muʕallim-āt ‫ﻣﻌﻠّﻤﺎت‬
10

12. Autres éléments conventionnels

12. 1. Les expressions figées (liste ouverte)


Voici la liste des expressions qui sont codées en tier 2 et 4 et qui font l’objet d’une notation
conventionnelle en tier 3, par ordre alphabétique arabe.

Tier 1 Tier 2a et 4 Tier 3


akīd AKID ‫أﻛﯿﺪ‬
in ʃā ʔaḷḷāh, nʃaḷḷa INCH ‫إن ﺷﺎء ﷲ‬
enno ENNO ‫إﻧّﮫ‬
bass, bǝss BASS ‫ﺑﺲ‬
hallāʔ HALQ ‫ھﻼق‬
lħamdəḷḷa HDLA å ‫اﻟﺤﻤﺪ‬
aḷḷa ʔirħamo ARHM x‫ﷲ ﯾﺮﺣﻤـ‬
lakēn LKAN ‫ﻟﻜﺎن‬
lajke LAYK ‫ﻟﯿﻚ‬
maʃaḷḷa MCHA ‫ﻣﺎ ﺷﺎء ﷲ‬
waḷḷā WALA ‫وﷲ‬
u hēke WHEK ‫وھﺎك‬
jaḷḷā YALA å‫ﯾﺎ‬
jaʕne, jaʕni YANI ‫ﯾﻌﻨﻲ‬

Tier 1 Tier 2a Tier 3 Tier 4


lћamdəḷḷa mēʃe HDLA māʃī l-ћāl ‫ ﻣﺎﺷﻲ اﻟﺤﺎل ﻛﻔﯿﻚ إﻧﺘﻲ‬å ‫اﻟﺤﻤﺪ‬ HDLA ça va et toi
lћāl kīfik ənte kīf-kī enti
lajka:/ kənna LAYK kun-nā badd- ‫ﻟﯿﻚ ﻛﻨﺎ ﺑﺪﻧﺎ ھﺎك ﻧﻌﻤﻞ‬ LAYK on voulait comme
badna hēk naʕmol nā hāk na-ʕmal #réunion# ça faire une #réunion
#réunion# #réunion# ((FR))#

12. 2. Les mots ou syntagmes en langue étrangère


Tier 1 Tier 2a Tier 3 Tier 4

ɔƷūr ṣabāja #bonjour# ‫ أﯾّﺔ‬#‫ﺳﻮري‬# ‫ ﺻﺒﺎﯾﺎ‬#‫ﺑﻨﺠﻮر‬# #bonjour ((FR))# les
sori ajja ṣabāja #sorry# ‫ ﻟﻠﯿﻮم‬#facture # filles #désolée ((GB))#
#facture# la ajja #facture# li- #dernier délai# quelle #facture ((FR))#
ljōm #dernier l-jawm #dernier est pour aujourd’hui
délai# délai# #dernier délai ((FR))#
enno Nicolas ENNO Nicolas #hair# ‫ ﺑﺪه‬#hair# ‫إﻧّﮫ ﻧﻘﻮﻻ‬ ENNO Nicolas a besoin
#hair# baddo badd-hu #bonnet# #bonnet# d’un #bonnet ((FR))#
#bonnet#
pour ses #cheveux
((GB))#

12. 3. Les mots étrangers entrés dans les usages (liste ouverte)
Voici des exemples de mots d’origine étrangère entrés dans les usages : ils figurent en tier 2a dans
l’orthographe de la langue. C’est une liste ouverte qui s’enrichira au fur et à mesure des
transcriptions de nouveaux corpus.

Tier 1 Tier 2a Tier 3 Tier 4


bɔnƷūr / b̃
ɔƷūr #bonjour# #‫ﺑﻨﺠﻮر‬# #bonjour ((FR))#
sori / soɣi #sorry# #‫ﺳﻮري‬# #désolé (e) ((GB))#
mersi #merci# #‫ﻣﺮﺳﻲ‬# #merci ((FR))#
sa va #ça va # #‫ﺳﺎ ﭬﺎ‬# #ça va ((FR))#
hāj #hi# #‫ھﺂي‬# #salut ((GB))#
11

ḅāj #bye# #‫ﺑﺂي‬# #au revoir ((GB))#


oke #okay# #‫أوﻛﻲ‬# #okay ((GB))#

12. 4. Les emprunts arabisés (liste ouverte)


Voici des exemples d’emprunts arabisés : ils figurent en tier 1 et 2a en transcription phonétique.
C’est une liste ouverte qui sera enrichie au fur et à mesure des transcriptions de nouveaux corpus.

Tier 1 Tier 2a Tier 3 Tier 4


#pojēt# #pojāt# #‫ﭘوﯾﺎت‬# #des pots ((FR))#
#taperwarēt# #taperwarāt# #‫ﺗﭘﯾروارات‬# #des tupperwares ((GB))#

12. 5. Régulateurs, marques d’hésitation, acquiescement, négation


Sens Tier 1 Tier 2a Tier 3 Tier 4
clic = non tsk tsk tsk tsk
morphème de négation həʔə həʔə həʔə həʔə
oui ʔē ʔē ‫إﯾﮫ‬ oui
accusé réception minimal ʔm ʔm ʔm ʔm
accusé réception double mhm mhm mhm mhm
tag ha ha ha ha
morphème d'exclamation a::::h, ã āh ‫آه‬ ah
hésitation ʔ ø ʔø ʔø euh
hésitation (mot tronqué) k- ktīr k- kaθīr ‫ﻛـ ﻛﺜﯿﺮ‬ beau- beaucoup

12. 6. Les noms propres


Les noms propres (anonymisés ou non) figurent entre guillemets hauts dans les trois premières
tiers. Il peut s’agir d’une personne, d’un lieu, d’une institution, etc.

Tier 1 Tier 2a Tier 3 Tier 4


mitəl “Woody Allen” miθl “Woody Allen” "‫ ﻣﺜﻞ "وودي آﻟﻦ‬comme Woody
Allen
aflām “Jusef ʃahin” aflām “Jūsuf "‫ أﻓﻼم "ﯾﻮﺳﻒ ﺷﺎھﯿﻦ‬les vieux films de
elʔadīme ʃāhīn” el-qadīma ‫ اﻟﻘﺪﯾﻤﺔ‬Youssef Chahine

12. 7. La mention de noms anonymisés


Dans toutes les tiers de la transcription, les noms propres anonymisés cités apparaissent sous leur
forme intégrale ou abrégée selon les cas. Cela peut concerner une personne, un lieu, une
institution, etc. S’il s’agit du pseudo de l’un des participants à l’interaction, on le conserve sans
guillemets.

Tier 1 Tier 2a Tier 3 Tier 4


marħaba SOF (0.5) kīfik marħaba SOF (.) kīf-ik ‫( ﻛﯿﻔﻚ‬.) SOF ‫ﻣﺮﺣﺒﺎ‬ Salut SOF (.) ça
va
marħaba ja “ƷorƷ” marħaba jā “Georges” "‫ﻣﺮﺣﺒﺎ ﯾﺎ "ﺟﻮرج‬ Salut Georges

13. Le lexique dialectal (liste ouverte)


Dans ce tableau, amené à être enrichi, on a relevé les mots dialectaux et expressions très courants
ou sans équivalents en arabe standard. La tier 1 présente une liste des variantes alors que les tiers
12

2a et 3 proposent la notation conventionnelle correspondante. Les termes figurent dans l’ordre


alphabétique arabe de la tier 3.

Tier 1 Tier 2a Tier 3 Tier 4


alo, a:lo alo ‫أﻟﻮ‬ Allô
oke, okaj oke #‫أوﻛﻲ‬# okay
ənno ʔnno ‫اﻧﮫ‬ que
jā… jā jā… jā ‫أو‬ ou
wala wa-lā ‫أو‬ ou
ūḍa ūḍā ‫أوﺿﻰ‬ chambre, pièce
awwal ma awwal mā ‫اول ﻣﺎ‬ dès que
ajwa ajwā ‫أﯾﻮا‬ oui, bien sûr
ḅāj bāj #‫ﺑﺎي‬# salutation de clôture
1 beħkīki, mneħke ba-ħkī-ik, ‫ ﻣﻨﺤﻜﻲ‬,‫ﺑﺤﻜﯿﻜﻲ‬ je te parle, on se parle
m-na-ħkī (salutation de clôture, à
bientôt)
2
3 bʃūfek nʃālla ba-ʃūf-ik ‫ﺑﺸﻮﻓﻚ إن ﺷﺎء ﷲ‬ je te vois INCH (salutation
INCH de clôture, à bientôt)
baddak / biddak badd-ka ‫ﺑﺪّك‬ tu veux
badda badd-hā ‫ﺑﺪّھﺎ‬ elle veut
beddi ʔəzəʕƷek badd-ī u- ‫ﺑﺪي ازﻋﺠﻚ‬ je vais te/vous déranger
zʕiƷ-ak
baddik ʃī badd-ik ʃī ‫ﺑﺪك ﺷﻲ‬ tu veux quelque chose ?
(pré-salutation de clôture)

barra barra ‫ﺑّﺮا‬ à l’extérieur


barrat… barrat… …‫ﺑّﺮاة‬ à l’extérieur de…
barḍo barḍo ‫ﺑرﺿو‬ encore, aussi
bass bass ‫ﺑﺲ‬ quand, seulement, juste
b ʔaleb bi-qalb ‫ﺑﻘﻠﺐ‬ dans, à l'intérieur
bala bilā ‫ﺑﻼ‬ sans
balke, barke balke ‫ﺑﻠﻜ ﻲ‬ peut-être
tabaʕ tabaʕ ‫ﺗﺒﻊ‬ à, de
tabʕet tabʕet ‫ﺗﺒﻌﺔ‬
tabʕūl tabʕūl
‫ﺗﺒﻌﻮل‬
Ʒuwwa Ʒuwwa ‫ﺟّﻮا‬ à l’intérieur, dedans
Ʒuwwat… Ʒuwwat… …‫ﺟّﻮاة‬ à l’intérieur de…
ħadd ħadd ‫ﺣﺪ‬ à côté de
4 lħamdəlla: meʃe lħāl HDLA māʃī ‫ ﻣﺎﺷﻲ‬å ‫اﻟﺤﻤﺪ‬ HDLA ça va
l-ħāl ‫اﻟﺤﺎل‬
5 lħamdəlla tamēm HDLA tamām ‫ ﺗﻤﺎم‬å ‫اﻟﺤﻤﺪ‬ HDLA très bien, super

dǝɣri duɣrī ‫دﻏﺮي‬ directement


rāħ, raħ raħ ‫رح‬ (particule du futur)
zalame zalame ‫زﻟﻤﺔ‬ gars
zejj zajj ‫ي‬
ّ ‫ز‬ comme
6 salām salām ‫ﺳﻼم‬ (salutation d’ouverture)
ʃwaj, ʃwajj, ʃwejj ʃwaj ‫ﺷﻮي‬ un peu
ʃwajet… ʃwajat- …‫ﺷﻮﯾﺔ‬ un peu de…
ʃī ʃī ‫ﺷﻲ‬ (quelque) chose
ṭajjeb ṭajjib ‫طﯿﺐ‬ bon, bien
13

ʕaʃān, ʕalaʃān ʕaʃān ‫ﻋﺸﺎن‬ pour


fəm, təm fam ‫ﻓﻢ‬ bouche
karmēl karmāl ‫ﻛﺮﻣﺎل‬ pour
kamēn, kamēna kamān ‫ﻛﻤﺎن‬ aussi
lā lā ‫ﻻ‬ non
laʔ, laʔa lāʔa ‫ﻷ‬ certainement pas
lessa, essa lissa ‫ﺴﺔ‬ّ ‫ﻟ‬ pas encore
mbārǝħ mbāriħ ‫ﻣﺒﺎرح‬
mbala, əmbala mbalā ‫ﻣﺒﻼ‬ non, au contraire
madām, madāmtak madām, ‫ﻣﺪام‬ madame
madāmat-ka
madri madrī ‫ ﻣﺪري‬je ne sais pas
mǝʃ, miʃ, muʃ mʃ ‫( ﻣﺶ‬négation)
7 meʃtēʔetlek muʃtāqa ‫ﻣﺸﺘﺎﻗﺔ ﻟﻚ‬ tu me manques
la-ki
miʃān, minʃān miʃān ‫ ﻣﺸﺎن‬pour
mēʃe lħāl māʃī l-ħāl ‫ﻣﺎﺷﻲ اﻟﺤﺎل‬ ça va
mnīħ, mlīħ mnīħ ‫ﻣﻨﯿﺢ‬ bien
mū mū ‫ﻣﻮ‬ (négation)
nijjāl… nijjāl- ‫ﻧﯿﺎل‬ tant mieux pour…
hallaʔ hallaq ‫ھﻼق‬ maintenant
hōn, hōne hunā ‫ھﻨ ﺎ‬ là
honīk, hnēke hunāk ‫ھ ﻨ ﺎك‬ là-bas
hēk hāk ‫ھﯿﻚ‬ comme ça
hāj hāj ‫ھﺎي‬ hi (salutation d’ouverture)
јalla jallāh ‫ﯾﻠﻠﻰ‬ allez
јalla ḅāj jallāh ‫ﯾﻠﻠﻰ ﺑﺎي‬ allez salut
bāj
Annexe 3 : Liste indicative des gloses morpho-syntaxiques

1 première personne IMP impératif


2 deuxième personne INDF indéfini
3 troisième personne INTENS intensifieur
ACC accusatif INTER interrogatif
ACP accompli LOC locatif
ACT actif (vs. passif) M masculin
ADJ adjectif N nom
ADV adverb(ial) NEG négation
AFX affixe NPR nom propre
AGR accord, agreement NOM nominatif
ANN annexion PART particule
ART article PAST passé
AUX auxilaire PRE préposition
CHI nombre cardinal ou ordinal PAS passif
COLL collectif PFX préfixe
COMP complémentiseur (ex. ENNO, PL pluriel
que complétif) POSS possessif
COP copule (pronominal copula) PRO pronom personnel
DAT datif PRV préverbe
DEF défini PRES présent
DEM démonstratif PTA participe actif
DIM diminutif PTP participe passif
DU duel REL relatif
ELAT élatif SFX suffixe
F féminin SG singulier
FUT futur SUPER superlatif
INA inaccompli V verbe
IFX infixe VOC vocatif
Annexe 4 : Transcrire les dialectes arabes en linguistique.
Comparaison des conventions existantes

Document réalisé par Catherine PINON

La transcription des dialectes arabes en caractères arabes est problématique, car il


n’existe aucune orthographe officielle et les différences phonétiques et morpho-
phonologiques peuvent être très importantes d’un dialecte à l’autre. Proposer une
convention de transcription unique adaptable à tous les dialectes faciliterait les
recherches et leur diffusion. Plusieurs propositions ont été faites dans ce sens. Nous avons
choisi ici d’en présenter trois, sur lesquelles reposent les choix de transcription en
effectués dans la convention AraPI : les conventions CODA, AMADAT et BBN. Nous
mentionnerons les règles propres à AraPI quand elles s’écartent des propositions
présentées ici.

La réflexion qui suit sur la transcription des dialectes en caractères arabes ne vise pas
l’établissement d’une orthographe standardisée. Elle propose une comparaison de
systèmes existants, analysant ce qui les rapproche et ce qui les différencie. Il faut garder
en tête que ces conventions de transcription ont pour but de proposer une référence bien
exhaustive et bien explicitée. Son objectif majeur est de permettre le partage des données
entre des chercheurs de différentes disciplines.

Ce document vise, dans le même esprit que les Leipzig Glossing Rules, à déduire des
différentes propositions faites des règles communes, afin d’uniformiser les pratiques de
transcription des dialectes. Après l’énoncé de règles générales, on prendra l’exemple du
dialecte syro-libanais pour illustrer la méthode de transcription à suivre.

Table des matières

1. LES TRAVAUX EXISTANTS ........................................................................................................................................ 2


1. 1. LA CONVENTION CODA ............................................................................................................................................................... 2
1. 2. LA TRANSCRIPTION AMADAT ................................................................................................................................................... 2
1. 3. LES DIRECTIVES BBN ................................................................................................................................................................... 2
2. LES REGLES DE TRANSCRIPTION COMMUNES ................................................................................................... 3
REGLE 1 : UN MOT = UNE SEULE ET UNIQUE TRANSCRIPTION ......................................................................................................... 3
REGLE 2 : UNE ORTHOGRAPHE AYANT COMME REFERENCE LE MSA ............................................................................................. 3
REGLE 3 : UNE MORPHO-SYNTAXE QUI PRESERVE LES SPECIFICITES DIALECTALES..................................................................... 4
REGLE 4 : ADAPTATION, MAIS COHERENCE ET PERTINENCE ........................................................................................................... 5
3. LES REGLES DE TRANSCRIPTION SPECIFIQUES................................................................................................. 5
REGLE 5 : LA TRANSCRIPTION DES MOTS ETRANGERS ...................................................................................................................... 5
REGLE 6 : CODE-SWITCHING ET DIGLOSSIC CODE-SWITCHING ........................................................................................................ 6
REGLE 7 : NOMS PROPRES ET ABREVIATIONS .................................................................................................................................... 6
4. QUESTIONS COURANTES ........................................................................................................................................... 6
5. BIBLIOGRAPHIE COMPLEMENTAIRE .................................................................................................................... 8

1
1. Les travaux existants
Les linguistes travaillant sur l’arabe sont tôt ou tard confrontés à la question de la
transcription de leurs sources. Chaque chercheur fait ses propres choix en fonction de ses
objectifs scientifiques, mais aussi de contraintes techniques qui peuvent peser sur ses
recherches. Il existe plusieurs conventions qui visent à unifier les systèmes de
transcription utilisés par les linguistes arabisants.

1. 1. La convention CODA
La convention CODA (Conventional Orthography for Dialectal Arabic) a été établie par
Nizar Habash, Mona Diab et Owen Rambow du Center for Computational Learning
Systems de l’Université Columbia à New York, en 2011.

> références en ligne :


Habash, Diab et Rambow, “Unified Guidelins and Resources for Arabic Dialect
Orthography” [En ligne] [Link]

Habash, Diab et Rambow, “Conventional Orthography for Dialectal Arabic” [En ligne]
[Link]

1. 2. La transcription AMADAT

Il s’agit d’une transcription dialectale à base orthographique (Dialectal Arabic


Orthography-based transcription) mise au point par Mohamed Maamouri, David Graff,
Hubert Jin, Christopher Cieri et Tim Buckwalter du Linguistic Data Consortium de
l’Université de Pennsylvanie, pour l’étude des conversations téléphoniques
(Conversational telephone speech = CTS) en arabe levantin.

> références en ligne : Maamouri, Graff, Jin, Cieri et Buckwalter, “Dialectal Arabic
Orthography-based Transcription & CTS Levantine Arabic Collection” [En ligne]
[Link]
[Link]

1. 3. Les directives BBN

Les directives pour transcrire les dialectes arabes (Guidelines for Transcribing Arabic
Dialects) ont été proposées par Bushra Zawaydeh, Dave Stallard et John Makhoul de BBN
Technologies en 2002-2003.

> références en ligne : Zawaydeh, Stallard et Makhoul : “Guidelines for Transcribing Arabic
Dialects” [En ligne] [Link]
[Link]

2
2. Les règles de transcription communes

D’une manière générale, les transcriptions se veulent à la fois panarabiques et spécifiques.


Elles visent la facilité d’emploi et la lisibilité. À partir d’un examen détaillé de ces
conventions, nous avons distingué les éléments communs et les règles spécifiques qui s’en
dégagent. Nous en proposons un résumé sous la forme d’un ensemble de règles.

Règle 1 : un mot = une seule et unique transcription

Chaque mot a une unique forme orthographique en transcription, même si sa réalisation


phonétique varie.

Par conséquent, on peut établir pour chaque mot une transcription conventionnelle et une
liste des variantes.

Règle 2 : une orthographe ayant comme référence le MSA

Dès que cela est possible, les choix de transcription sont conformes à l’orthographe de
l’arabe littéral (Modern Standard Arabic ou MSA), qui est assez stable sur l’ensemble du
monde arabe et constitue une référence partagée par tous les arabophones scolarisés. Par
exemple, la cliticisation des particules monolitères, le recours à la šadda pour la
gémination phonologique, l’écriture de l’article ou l’emploi du tāʾ marbūṭa et du alif
maqṣūra sont conformes à l’orthographe standard.

Par conséquent, on cherche à établir pour chaque mot un lien avec le MSA.

- Si le mot a une forme directement apparentée en MSA, utiliser l’orthographe MSA (ce qui
peut donner une forme qui n’existe pas en MSA, cf. exemple 4).

Exemples : (1) Libanais


/kti:R/ ou /kati:R/
‫( ﻛﺜﯿﺮ‬non pas ‫)ﻛﺘﯿﺮ‬ l’interdentale [θ] réalisée [t] est rétablie

(2) Libanais
/daʔǝn/
‫( ذﻗﻦ‬non pas ‫ دﻗﻦ‬ou ‫)دأن‬ le [ð] et le [q] réalisés [d] et [ʔ] sont rétablis

(3) Libanais
/zɣīr/
‫( ﺻﻐﯿﺮ‬non pas ‫) زﻏﯿﺮ‬ le [ṣ] réalisé [z] est rétabli

(4) Libanais
/hadōl/
‫( ھﺬول‬non pas ‫)ھﺪول‬ le [ð] des démonstratifs standard est rétabli,
même si cette forme n’existe pas en MSA.

3
- Dans le cas où la racine commune au dialecte et au MSA a une consonne ajoutée ou élidée,
on rétablit aussi la racine MSA.

Exemples : (5) Libanais


/u-noṣ/
‫( وﻧﺼﻒ‬non pas ‫) وﻧﺺ‬

- On réintègre les voyelles longues de schèmes particuliers même si elles ne sont pas réalisées
et on note les tanwīn-an ً ‫ ا‬.

Exemples : (6) Libanais


/ṭabūr/
‫( طﺎﺑﻮر‬non pas ‫) طﺒﻮر‬ le [ā] réalisé [a] est rétabli

(7) Libanais
/matalan/
ً‫( ﻣﺜﻼ‬non pas ‫) ﻣﺜﻠﻦ‬ le [θ] réalisé [t] est rétabli et [an] est noté [‫]ًا‬

- Si on utilise des textes déjà transcrits en dialecte, on corrige les erreurs typographiques
(métathèses, omission ou ajout d’espaces). Par exemple, on rétablit la bonne orthographe du
yāʾ / alif maqṣūra dans les textes égyptiens.

- Dans le cas où le lien entre la forme dialectale et le MSA n’existe pas, on livre une liste des
transcriptions conventionnelles.

Exemples : (8) Libanais


/doɣri/
‫( دﻏﺮي‬notation conventionnelle)

Règle 3 : une morpho-syntaxe qui préserve les spécificités dialectales

Bien que s’inspirant pour la transcription des sons du ductus classique, les spécificités
morpho-syntaxiques des dialectes sont maintenues.

Par conséquent, on conserve les marques de temps et d’aspect dans la conjugaison, les
terminaisons des pluriels externes, les pré-verbes dialectaux (par exemple, on ne remplace
pas le marqueur de futur ḥa- par sa-) et on conserve les spécificités lexicales dialectales.

Exemple : (9) Libanais


/b-ya-ktub/
‫( ﺑﯿﻜﺘﺐ‬non pas ‫)ﯾﻜﺘﺐ‬

(10) Tunisien
/bdī-t/
‫( ﺑﺪﯾﺖ‬non pas ‫)ﺑﺪأت‬

4
(11) Libanais
/raħ balliʃ/
‫( رح أﺑﻠّﺶ‬non pas ‫)ﺳﺄﺑﺪأ‬

(12) Libanais
/fēto ləmʕalmīn/
‫( ﻓﺎﺗﻮا اﻟﻤﻌﻠّﻤﯿﻦ‬non pas ‫)دﺧﻞ اﻟﻤﻌﻠّﻤﻮن‬

Règle 4 : adaptation, mais cohérence et pertinence

Les chercheurs adaptent les conventions existantes en fonction des objectifs de leur
recherche. Ils doivent alors expliciter leurs choix. Dans tous les cas, les conventions
établies doivent être suivies strictement et les exceptions listées.

3. Les règles de transcription spécifiques

En fonction des objectifs de la recherche, certains choix doivent être faits concernant des
notations particulières.

Règle 5 : la transcription des mots étrangers

Les systèmes CODA, AMADAT et BBN s’accordent sur le fait de transcrire les mots
étrangers en écriture arabe sans recourir à des caractères supplémentaires comme ‫چ‬, ‫پ‬
ou ‫ ڤ‬. On utilise la transcription arabe usuelle si elle existe. Dans le cas contraire, on peut
modifier la valeur de certaines lettres pour ne pas recourir à des caractères
supplémentaires :
- on utilise le bāʾ (‫ )ب‬pour transcrire [p]
- on utilise le tāʾ+šīn (‫ )ﺗش‬pour transcrire [tch]
- on utilise le fāʾ (‫ )ف‬pour transcrire [v]
- on utilise le jīm (‫ )ج‬ou le kāf (‫ )ك‬pour transcrire [g]

Règle 5a (optionnelle) : préséance des formes levantines


En cas de concurrence entre plusieurs transcriptions connues, CODA préfère à la
transcription égyptienne la transcription levantine : on écrit (‫)ﻛراج‬, que l’on transcrive de
l’égyptien ou du libanais.

Règle 5b (optionnelle) : adaptation au standard dialectal


En cas de concurrence entre plusieurs transcriptions connues, AMADAT propose de se
conformer avec les usages locaux : on écrit (‫ )ﻛراج‬si l’on transcrit du libanais et (‫ )ﺟراج‬si
l’on transcrit de l’égyptien.

5
Règle 5c (optionnelle) : caractères arabes supplémentaires
AraPI recourt, dans le cas des emprunts arabisés, à un certain nombre de caractères
supplémentaires, tels que ‫گ‬, ‫ پ‬ou ‫ ڤ‬, en indiquant à l’aide de l’alphabet phonétique
international leur valeur.

Règle 5d (optionnelle) : transcription en caractères latins


AraPI propose de transcrire les segments en langue étrangère en caractères latins, dans
leur orthographe d’origine.

Règle 6 : code-switching et diglossic code-switching

Le marquage du passage d’une langue à une autre n’apparaît pas toujours dans les
différentes conventions.

Règle 6a (optionnelle) : uniformisation (dialectalisation du MSA)


Dans CODA, si un terme est prononcé en MSA, on le transcrit dans le dialecte. Par exemple,
si le mot « homme » est prononcé [raƷul] comme en MSA dans un discours en égyptien, il
sera transcrit ‫[ راﺟل‬rāgəl] conformément à la spécificité lexicale de ce mot en égyptien.

Règle 6b (optionnelle) : marquage du code-switching


Dans AraPI, les mots ou syntagmes en langue étrangère ou dans une variété d’arabe
différente figurent encadrés de #.

Règle 7 : noms propres et abréviations

La transcription des noms propres ou des abréviations peuvent poser problèmes. Dans
l’ensemble des conventions, on suggère d’utiliser la transcription consensuelle quand elle
existe. D’autres propositions sont parfois faites concernant spécifiquement les noms
propres.

Règle 7a (optionnelle) : marquage des noms propres et abréviations


BBN propose de lier par un tiret bas les noms propres et abréviations composées, par
exemple :
‫ﺑرج_اﻟﺑراﺟﻧﺔ‬

Règle 7b (optionnelle) : marquage des noms propres et abréviations


AraPI propose d’entourer la transcription des noms propres par des guillemets. Exemple :
"‫"ﻣﺎرﻛس‬

4. Questions courantes

Les éléments linguistiques les plus courants ne font pas toujours l’objet de règles
détaillées. Voici point par point les propositions partagées par les conventions (quand
elles les abordent), avec la mention des divergences quand le consensus n’est pas établi.

6
Les pronoms isolés et suffixes
Chaque dialecte a son écriture conventionnelle des pronoms. La 2ème personne du féminin
singulier est toujours marquée par un yāʾ : ‫إﻧﺗﻲ – ﻛﻲ‬
Pour les pronoms commençant par un hāʾ, on le note toujours même s’il n’est pas
prononcé.

Les verbes
- on garde l’allongement vocalique des redoublés et des hamzés de 3ème radicale (‫)ﺑدﯾت‬
- on note la 2ème personne du féminin singulier par un yāʾ (‫)ﺑدﯾﺗﻲ‬
- on note la 3ème personne du masculin pluriel par ‫( وا‬le alif n'est pas noté uniquement
s’il y a un suffixe après : ‫ ﺑﯾﻛﺗﺑوھﺎ‬- ‫)ﺑﯾﻛﺗﺑوا‬

Les préverbes sont attachés au verbe s’ils sont monolitères, sinon ils sont séparés par une
espace, conformément à l’écriture arabe.
‫ﺣﺄﻛﺗب – ﺗﯾروح – ﻋم ﺑﺗﻛﺗب – رح ﺑﯾﻛﺗﺑوا‬

La variante négative ‫ ﺷﻲ‬du négatif ‫ ش‬est toujours orthographiée ‫ ش‬à la fin du verbe.

Variantes : Pour CODA, le paradigme de conjugaison du libanais est :


‫ﺑﺄﻛﺗب – ﺑﺗﻛﺗب – ﺑﺗﻛﺗﺑﻲ – ﺑﯾﻛﺗب – ﺑﺗﻛﺗب – ﺑﻧﻛﺗب – ﺑﺗﻛﺗﺑوا – ﺑﯾﻛﺗﺑوا‬
Pour BBN, la 1ère personne du singulier s’écrit sans la hamza : ‫ ﺑﺎﻛﺗب‬. CODA recommande
de ne jamais transcrire ‫ ﻣﻧﻛﺗب‬à la 1ère personne du pluriel, même si c’est prononcé ainsi.
Pour AraPI à l’inverse, on note ‫ ﻣﻧﻛﺗب‬.

Les prépositions
Les particules monolitères sont attachées : ‫واﻟﻛﺗﺎب – ﺑﺎﻟﺑﯾت‬
Les autres particules ne doivent pas être cliticisées : ‫ ﻣﺎ‬de négation, ainsi que ‫ ﻟـ‬+ suffixe.
Par exemple, on écrira ‫( ﻣﺎ ﻗﻠت ﻟﮭﺎش‬pas ‫) ﻣﺎﻗﻠﺗﻠﮭﺎش‬.

Les démonstratifs
Les formes brèves comme ha- sont attachées dans CODA et AraPI, séparées par une espace
dans BBN :
‫ ھﺎ اﻟﺑﯾت‬vs ‫ ﺑﮭﺎﻟﺑﯾت – ﻋﮭﺎﻟﺑﯾت‬- ‫ھﺎﻟﺑﯾت‬

Notation des chiffres et nombres en toutes lettres, jours de la semaine


Pour CODA et AraPI, les chiffres et les nombres écrits en toutes lettres sont conformes à
l’écriture standard, quelle que soit la réalisation. Il en va de même pour les jours de la
semaine. Pour BBN les nombres sont écrits en transcription dialectale (‫)…طﻧﻌﺷر‬.

Les mots courants (chose, eau, viens !)


Pour CODA, on suit les règles du MSA dans les cas suivants :
Convention Variantes non retenues
‫ إﺷﻲ ﺷﻲء‬- ‫ﺷﻲ‬
‫ﻣﺎي – ﻣﻲ – ﻣﺎﯾﺔ ﻣﺎء‬
‫ ﺗﻌﺎﻟوا‬- ‫ ﺗﻌوا ﺗﻌﺎل – ﺗﻌﺎﻟﻲ‬- ‫ﺗﻊ – ﺗﻌﻲ‬

AraPI propose une liste ouverte de mots dialectaux et expressions très courantes.

7
5. Bibliographie complémentaire

La convention CODA appliquée à différents dialectes :


- HABASH, DIAB et RAMBOW, Conventional Orthography for Dialectal Arabic (CODA):
Principles and Guidelines - Egyptian Arabic [En ligne]
[Link]
- HABASH, JARRAR, ALRIMAWI, AKRA, ZALMOUT, BARTOLOTTI et ARAR, Palestinian Arabic
Conventional Orthography Guidelines - Technical Report [En ligne]
[Link]
- SAADANE et HABASH, A Conventional Orthography for Algerian Arabic [En ligne]
[Link]
- TURKI, ADEL, DAOUDA et REGRAGUI, A Conventional Orthography for Maghrebi Arabic [En
ligne]
[Link]
or_Maghrebi_Arabic
- ZRIBI, BOUJELBANE, MASMOUDI, ELLOUZE, BELGUITH et HABASH, A Conventional Orthography
for Tunisian Arabic [En ligne]

8
Annexe 5 : Tableau synoptique de la convention AraPI
Toutes les notations conventionnelles figurent en annexe 1 (phénomènes interactionnels) et annexe 2 (liste des notations conventionnelles).

Éléments
Tier 1 Tier 2a Tier 3 Tier 4
conventionnels
interactionnelle morpho-syntaxique traduction dans la langue du
Transcription (type)
phonético-phonologique (référant arabe standard et standard dialectal) chercheur
Alphabet API modifié arabe (modifié) / latin latin
conventionnelle en mots selon les règles de
Segmentation en mots -
morphémique par tiret (-) la graphie arabe
ICOR modifiée
Interaction aucune notation sauf pauses, enchaînements et chevauchements
Pronoms,
déterminants, notation conventionnelle
transcription phonétique -
particules, (référant arabe standard et standard dialectal)
prépositions
notation conventionnelle
Chiffres transcription phonétique -
(référant arabe standard et standard dialectal)
Morphologie nominale notation conventionnelle
transcription phonétique -
et verbale (référant arabe standard et standard dialectal)
Expressions figées transcription phonétique codage 4 majuscules notation conventionnelle codage 4 majuscules
entre dièses, transcription
Mots ou syntagmes en dans l’orthographe de la
entre dièses, dans l’orthographe de la langue entre dièses, traduits,
langue étrangère langue que les segments
soient courts ou longs mention de la langue par le
code ISO entre doubles
Mots étrangers entrés entre dièses, dans
transcription phonétique entre dièses, transcription parenthèses
dans les usages l’orthographe de la langue
en caractères arabes
Emprunts arabisés entre dièses, transcription phonétique
Régulateurs transcription conventionnelle
entre guillemets hauts entre guillemets hauts entre guillemets hauts
orthographe officielle ou orthographe officielle ou orthographe officielle ou orthographe officielle avec
Noms propres
transcription phonétique transcription standard avec transcription en caractères majuscules
avec majuscules majuscules arabes
Éléments dialectaux transcription phonétique notation conventionnelle en notation conventionnelle en -
courants API modifié caractères arabes

Vous aimerez peut-être aussi