Partie I — Formes verbales, structure de la proposition et interprétation : fondements d’une méthode contrastive
Chapitre 4 — Données, échantillonnage et méthode contrastive
Le présent travail réunit un corpus ciblé de passages permettant de tester, dans des conditions suffisamment contrastées, la relation entre morphologie verbale, structure de la proposition et interprétation. Le terme corpus désigne ici l’ensemble restreint des textes retenus, segmentés et annotés pour les besoins de l’étude ; sa valeur scientifique dépend de l’adéquation entre la sélection des exemples et les questions posées, et non d’une représentativité statistique de l’ensemble de l’hébreu biblique ni de son aptitude à constituer une ressource générale autonome.
Cette conception implique un échantillonnage raisonné et stratifié, qui n’est ni aléatoire ni proportionnel à la taille respective des livres bibliques. Les passages sont choisis parce qu’ils fournissent les contrastes nécessaires à l’analyse — alternance entre formes verbales, variation d’ordre des constituants, différences de polarité ou de mode, structures conditionnelles, enchâssement, changement de domaine énonciatif, parallélisme poétique ou situation diachroniquement informative — et forment un ensemble suffisamment diversifié pour soumettre les hypothèses à des cas favorables aussi bien qu’à des contre-exemples, sans prétendre mesurer la fréquence générale des phénomènes dans toute la Bible hébraïque.
La reproductibilité porte d’abord sur le protocole : à partir du même texte biblique et des mêmes critères, un autre chercheur devrait constituer un ensemble comparable et rencontrer les mêmes types de contrastes, même si le choix exact des versets diffère. Cette distinction entre représentativité générale et adéquation à une question précise est classique en linguistique de corpus, dont la conception dépend de la population étudiée, des types de textes à représenter et surtout des propriétés linguistiques que la recherche entend examiner (Atkins, Clear et Ostler 1992 ; Biber 1993 ; Biber, Conrad et Reppen 1998 ; Sinclair 2005 ; McEnery et Hardie 2012).
4.1. Population de référence et principe d’échantillonnage
La population principale est constituée par l’hébreu biblique tel qu’il est transmis dans le texte massorétique utilisé pour l’étude.
Le mémoire n’entend pas décrire de manière exhaustive toutes les périodes, tous les genres et toutes les variétés représentées dans cette population. Il cherche à observer les quatre grandes formations verbales étudiées — qatal, yiqtol, wayyiqtol et weqatal — dans plusieurs environnements suffisamment différents pour tester la stabilité des analyses proposées.
Six dimensions définissent la variation que l’échantillon doit rendre accessible. La structure textuelle oppose la prose narrative, le discours direct, l’instruction, la loi, la poésie, la sagesse et la prophétie. La morphologie verbale distingue les formes suffixales, préfixales et les formations en waw, ainsi que les modes morphologiquement distincts lorsqu’ils sont visibles. La structure clausale introduit les différences entre proposition principale, enchâssement, antéposition, condition et coordination ; la polarité et la modalité, celles entre affirmation, négation, prohibition, permission, prédiction et engagement. L’organisation temporelle et aspectuelle sépare l’événement singulier, la séquence, l’état, l’habitude et la gnomicité. Une dernière dimension est diachronique ou comparative : elle concerne les passages susceptibles de conserver des distributions plus anciennes et, à titre de contrôle limité, l’araméen biblique.
L’échantillon doit contenir des représentants de chacun de ces domaines sans prétendre reproduire leurs proportions dans la Bible entière.
Critères de sélection
Un passage entre dans l’ensemble de travail s’il satisfait au moins un critère linguistique fort et, pour les dossiers centraux, généralement plusieurs. Le contraste peut d’abord être morphologique : deux formes différentes sont comparées dans un même environnement, comme wayyiqtol et qatal en Gn 1,5 et Gn 1,10, qatal et yiqtol dans le parallélisme de Pr 14,1, ou yiqtol et weqatal dans les constructions normatives ou conditionnelles. Il peut aussi reposer sur un contrôle lexical, lorsqu’un même lexème apparaît dans plusieurs configurations : קרא reste constant en Gn 1,5 et Gn 1,10 tandis que varient la forme verbale et l’ordre des constituants ; les formes de עשה dans des constructions négatives fournissent un autre contrôle de ce type.
Le contraste syntaxique compare une forme dans des structures distinctes — verbe initial ou constituant préposé, proposition principale ou relative, narration ou discours direct, protase ou apodose — afin de déterminer si la différence interprétative relève de la morphologie ou de la structure. Le contraste modal ou de polarité observe au contraire une forme similaire sous plusieurs lectures : permission et conséquence en Gn 2,16–17, prohibition avec אַל ou לֹא, question et engagement en Gn 24,58.
Le contrôle de genre recherche une construction attestée en prose dans un environnement poétique, sapiential ou prophétique lorsque ce déplacement permet de tester le diagnostic hors de la narration. Le contrôle diachronique ou comparatif porte enfin sur des passages qui éprouvent une hypothèse historique ou comparent l’hébreu à une variété sémitique immédiatement voisine ; il motive la présence de poésie archaïque ou archaïsante et du petit dossier d’araméen biblique.
Une sélection stratifiée plutôt qu’un catalogue
L’échantillon est organisé en dossiers linguistiques, chacun réunissant plusieurs exemples autour d’une même question. Gn 1,5 et Gn 1,10 forment ainsi un dossier sur la relation entre forme verbale, ordre des constituants et structure informationnelle, plutôt que deux exemples indépendants.
De même, Ex 20,9 et Ex 33,7 sont rapprochés parce qu’ils présentent tous deux une séquence de type :
forme préfixale → forme suffixale en waw
mais dans deux domaines interprétatifs différents, normatif d’un côté et habituel passé de l’autre.
Cette organisation empêche la multiplication de « sens » attribués à chaque nouvelle occurrence. Le passage n’est conservé que s’il contribue à une question déjà formulée ou s’il révèle un contraste suffisamment nouveau pour justifier une question supplémentaire.
La sélection actuelle est construite autour de plusieurs strates.
La prose narrative fournit les contrôles les plus directs sur la progression événementielle, l’ordre des constituants, l’enchâssement et le changement de locuteur. Les dossiers comprennent notamment Gn 1, Gn 2–3, Gn 25 et d’autres séquences narratives utilisées comme réplications. Les textes de modalité, de loi et de condition permettent de comparer yiqtol, jussif et weqatal en relation avec la négation, la condition et le domaine déontique ; les exemples principaux proviennent de Gn 2, Gn 22, Gn 24, Gn 28 et de l’Exode.
La poésie et la sagesse fournissent un environnement où l’organisation parallèle peut rivaliser avec la séquence linéaire comme principe de structuration ; Pr 14, Ps 40 et Dt 32 en constituent les principaux dossiers. Un ensemble prophétique complémentaire — Gn 49, Nb 24, Is 7, Is 52–53, Is 61, Hab 2 et Am 9 — met les analyses à l’épreuve de passages où se combinent structure syntaxique, temporalité et référence. Ces textes ne forment pas une catégorie grammaticale autonome, mais élargissent la gamme des environnements comparés.
4.2. Fonction des dossiers et extension comparative
La possibilité de réutilisation
Le critère de sélection reste linguistique ; lorsque plusieurs passages testent également un phénomène, leur histoire textuelle et traductionnelle peut cependant servir de critère secondaire en vue d’une réutilisation dans l’étude de la Septante, des citations néotestamentaires ou de l’histoire de l’interprétation. Cette possibilité n’intervient pas comme preuve dans l’analyse de l’hébreu.
Ainsi, Dt 32,8–9 est intéressant d’abord parce qu’il appartient à un ensemble poétique diachroniquement sensible et pose des problèmes de structure et de texte. Le fait qu’il possède également une histoire textuelle importante augmente son intérêt, mais ne détermine pas son analyse linguistique.
Le même principe vaut pour Gn 49,10, Ps 2, Ps 22 LXX : Ps 21 , Ps 40 LXX : Ps 39 , Is 7, Is 53, Hab 2 ou Am 9.
On obtient ainsi un échantillon dont les dossiers restent linguistiquement motivés tout en demeurant réutilisables dans d’autres travaux.
Dossiers à fonctions multiples
Certains passages remplissent plusieurs fonctions : Gn 1,5 et 1,10 combinent contrôle lexical, différence d’ordre et alternance de forme ; Gn 2,16–17, identité de construction morphologique et différence modale ; Gn 22,12 et Ex 20, négation et mode ; Gn 28,20–22, condition, portée et formes en waw ; Ps 40, séquence narrative, poésie et changement de domaine interprétatif ; Dt 32, enfin, poésie, formes préfixales à lecture rétrospective et diachronie.
Ces nœuds analytiques peuvent être mobilisés dans plusieurs chapitres à condition que chacun les interroge sous un angle distinct.
Extension comparative : l’araméen biblique
L’étude, consacrée à l’hébreu biblique, inclut néanmoins un petit ensemble araméen comme contrôle comparatif, sans en faire une seconde population principale.
Le passage retenu, Dn 7,9–14, appartient à la même collection scripturaire et à un environnement historique proche de plusieurs textes hébreux tardifs ; sa morphosyntaxe verbale diffère suffisamment de celle de l’hébreu pour distinguer une propriété particulière de cette langue d’une nécessité sémantique générale ; la séquence contient plusieurs types de prédication où temps, aspect et organisation événementielle peuvent être comparés aux configurations hébraïques ; son histoire de traduction exige enfin de traiter le Vieux Grec et Théodotion comme deux témoins distincts.
Le contrôle araméen répond à une question délimitée, sans postuler l’identité des systèmes verbaux hébreu et araméen :
lorsqu’une interprétation est attribuée à une structure événementielle ou à une relation de clauses plutôt qu’à une forme hébraïque particulière, trouve-t-on un comportement comparable dans un système morphologique voisin ?
Une réponse positive fournirait un contrôle contre une explication excessivement liée à une seule conjugaison hébraïque, sans établir l’universalité de l’analyse.
Le dossier de Dn 7,9–14 est désormais intégré comme contrôle araméen, avec un degré d’analyse encore provisoire. Son annotation emploie les catégories propres à l’araméen biblique — Peal, Peil, Haph‘el, parfait, imparfait, participe et construction périphrastique — sans lui appliquer les étiquettes des conjugaisons hébraïques. Les groupes חָזֵה הֲוֵית et אָתֵה הֲוָה sont enregistrés comme candidats à une lecture progressive ou continue ; מְטָה marque l’arrivée bornée et הַקְרְבוּהִי la présentation causée. Ce contrôle sépare donc la structure événementielle et clausale de son exponence propre à chaque langue, sans postuler des syntaxes TAM identiques (Rosenthal 2006 ; Goldingay 1989 ; Collins 1993).
4.3. Texte de base et unité d’observation
Contrôle textuel
Avant l’annotation linguistique, chaque passage est fixé dans l’édition textuelle retenue pour l’étude ; le texte massorétique constitue le point de départ de la plupart des dossiers, tandis qu’une attention spécifique est requise lorsque la tradition textuelle affecte directement le constituant analysé.
Dans quelques cas — Dt 32,8–9, certains passages des Psaumes, Am 9 ou d’autres textes présentant des variantes anciennes importantes — il faut analyser syntaxiquement la leçon massorétique, puis noter séparément l’existence d’une variante susceptible de recevoir une autre analyse.
Une variante ancienne ne doit pas être introduite silencieusement dans le texte hébreu analysé ; inversement, une lecture différente de la Septante n’autorise pas à modifier le texte de départ afin de le rapprocher de la version grecque.
Cette séparation suit le principe de critique textuelle selon lequel toute analyse linguistique présuppose l’identification préalable de l’objet textuel analysé (Tov 2012).
Dans les dossiers susceptibles d’être réutilisés pour la traduction, le fichier de travail distingue donc MT reading, variant reading et ancient version, sans confondre ces niveaux.
La proposition comme unité d’observation
La clause constitue l’unité linguistique de l’étude ; le verset sert de repère éditorial.
Un même verset peut contenir plusieurs propositions principales, une relative, une condition, un changement de locuteur ou plusieurs cola poétiques.
L’unité principale est donc la clause, tout en conservant le lien avec le passage plus large auquel elle appartient.
La segmentation distingue le qatal de la relative enchâssée entre deux prédicats narratifs en Gn 2,22, la série qui passe du domaine du narrateur à la parole d’un personnage en Gn 3,10, et les clauses regroupées sous la portée d’une même construction conditionnelle en Gn 28,20–22 ; en poésie, elle met en outre la clause en relation avec le colon.
L’échantillon associe donc plusieurs niveaux :
passage → unité poétique ou discursive éventuelle → clause → forme verbale.
4.4. Annotation et séparation des niveaux d’analyse
Annotation minimale
L’annotation n’a pas pour objectif de produire une base universelle capable de représenter toutes les propriétés du texte biblique.
Elle ne conserve que les variables nécessaires aux analyses effectivement menées.
Pour chaque forme centrale, l’identification enregistre la référence, le numéro de la proposition, la langue — hébreu ou araméen — et le dossier analytique. La description morphologique comprend la forme de surface, le lexème, la racine, le binyan ou la catégorie correspondante, les valeurs pertinentes de personne, de nombre et de genre, la classe verbale, le statut du waw et, lorsqu’il peut être établi, celui du jussif, du cohortatif ou de l’opposition entre forme courte et forme longue.
La couche structurelle décrit l’ordre des constituants, un éventuel constituant préverbal, le caractère principal ou dépendant de la proposition, le type de dépendance, le négateur, la particule conditionnelle et l’appartenance éventuelle au discours direct. L’interprétation consigne séparément la lecture temporelle, l’aspect, la modalité, les valeurs habituelle ou gnomique lorsqu’elles sont pertinentes, ainsi que toute analyse concurrente qui doit rester disponible.
Aucune catégorie n’est introduite uniquement parce qu’elle serait techniquement facile à stocker ; l’annotation retient les informations qui permettent de tester une hypothèse.
Séparation entre observation et interprétation
L’annotation distingue ce qui est directement présent dans le texte de ce qui relève de l’analyse. Que וְלַחֹשֶׁךְ précède קָרָא est une observation ; son identification comme topique contrastif est une analyse. De même, la présence d’אַל devant תַּעַשׂ est directement vérifiable, tandis que la caractérisation de l’ensemble comme prohibition situationnelle appartient à l’interprétation.
Cette distinction permet de conserver plusieurs analyses concurrentes sans dupliquer le texte et de réviser une hypothèse sans modifier les données de base.
Le format de travail comporte donc, lorsque nécessaire, les champs observation, preferred_analysis, alternative_analysis et confidence.
Une valeur inconnue peut le rester : aucune clause ne reçoit une classification plus précise que ne le permettent les données.
4.5. Construction des contrastes et réplication
Le contraste constitue l’unité argumentative du mémoire ; les formes isolées sont analysées dans la configuration qui les oppose ou les rapproche.
Chaque dossier procède des données à la propriété contrôlée et à la différence observée, confronte les analyses possibles à un diagnostic, puis formule une conclusion limitée. Trois types de contraste sont privilégiés : le maintien d’un même lexème sous une structure différente en Gn 1,5 et Gn 1,10 ; le maintien d’une même construction morphologique sous deux interprétations en Gn 2,16–17 ; enfin la comparaison de formes apparentées dans des domaines différents en Ex 20,9 et Ex 33,7.
Ces configurations réduisent le nombre de variables qui changent simultanément ; lorsque cette réduction n’est pas possible, l’analyse explicite les facteurs non contrôlés.
Un contraste isolé permet de formuler une hypothèse, dont le poids augmente lorsqu’une occurrence indépendante reproduit la configuration. Le protocole recherche donc une réplication lorsque les données le permettent : Gn 1,5 et Gn 1,10 en fournissent une à l’intérieur du même ensemble, tandis que les emplois habituels de formes suffixales en waw sont contrôlés dans plusieurs passages.
Les prohibitions avec אַל et לֹא sont examinées sur plusieurs lexèmes, et les formes préfixales en poésie historique dans plusieurs ensembles poétiques. Les répétitions peuvent varier dans leur réalisation, à condition de reproduire le contraste théorique soumis au test.
4.6. Stratification et extension du corpus
Stratification par type de texte
La sélection ne cherche pas à reproduire la proportion exacte de prose, poésie et prophétie dans le canon.
Elle cherche à éviter qu’une analyse dérivée d’un seul type de texte soit présentée comme propriété générale du système.
L’ensemble contient donc intentionnellement plusieurs strates, chacune dotée d’une fonction de contrôle. La prose narrative sert à l’analyse des séquences et de l’ordre des constituants ; le discours direct, à celle du centre déictique, de la modalité et de la force illocutoire ; la loi et l’instruction, à celle du déontique, de la négation et de weqatal. La poésie et la sagesse introduisent le parallélisme, la gnomicité et les distributions non narratives, tandis que la prophétie permet d’observer les lectures projectives, les changements de locuteur et les constructions complexes. L’araméen biblique fournit enfin un contrôle comparatif limité.
Cette stratification correspond à la fonction de l’échantillon : maximiser la diversité des environnements pertinents, non reproduire leur fréquence canonique.
Limites de la macrodistribution
Une sélection contrastive gagnerait à être replacée dans un arrière-plan plus large, mais les données gelées ne fournissent pas le dénominateur nécessaire à une macrodistribution de l’ensemble de la Bible hébraïque. La morphologie est exhaustive pour la Genèse et seulement ciblée dans les autres livres. Une figure par grands ensembles textuels donnerait donc à une sélection de dossiers l’apparence trompeuse d’une population complète.
Le présent mémoire renonce en conséquence à toute fréquence canonique ou comparaison quantitative par strate. Il conserve seulement l’usage qualitatif de l’échantillon : demander si une construction dispose d’occurrences comparables, puis vérifier chaque réplication au niveau morphologique, syntaxique et contextuel. La portée des contrastes reste limitée à leur périmètre d’analyse et n’autorise aucune extrapolation de représentativité.
Sélection à partir des configurations
L’échantillonnage peut être partiellement reproduit à partir de requêtes formelles. Une première recherche localise les clauses où wayyiqtol et qatal apparaissent à proximité, puis filtre les résultats selon le maintien du lexème, l’unité de la scène et le changement d’ordre ; elle fournit les candidats du dossier de prose. Une deuxième extrait les séquences yiqtol → weqatal et les répartit entre loi, condition, discours direct et narration habituelle. Cette répartition vise expressément les contre-domaines, au lieu de ne retenir que des exemples conformes à l’analyse initiale.
Une troisième recherche compare les propositions contenant אַל ou לֹא devant une forme préfixale et contrôle pour chacune le lexème, l’opposition morphologique courte/longue et le type de directive. Une quatrième localise les formes préfixales dans les contextes poétiques rétrospectifs afin de constituer les candidats de l’analyse diachronique. Ces requêtes rendent la sélection réplicable sans la réduire à une procédure automatique, puisque le filtre final reste linguistique.
Passages retenus pour l’extension contrôlée
L’extension de l’échantillon s’arrête lorsque les contrastes nécessaires aux trois questions de recherche sont représentés et que l’ajout de nouveaux textes ne crée plus de diagnostic. Cette clôture, qui n’implique ni épuisement de la langue biblique ni désintérêt pour les passages écartés, distingue trois ensembles : les dossiers effectivement intégrés et utilisés, les comparanda déjà disponibles mais volontairement bornés, et les passages examinés puis laissés en réserve après saturation.
Huit dossiers additionnels participent à l’argumentation comme contrôles secondaires : Hab 2,4 ; Ps 2,7 ; Ps 40,7–9 ; Am 9,11–12 ; Gn 49,10 ; Is 7,14 ; Is 53,11–12 ; et Dn 7,9–14. Leur fonction est de répliquer ou de déplacer un diagnostic établi par les dossiers principaux, non de soutenir chacun une généralisation autonome.
Gn 49,10 distingue la matrice négative לֹא + יָסוּר, la borne עַד כִּי + יָבֹא et la prédication nominale finale contenant יִקְּהַת. La variation graphique autour de שילה / שִׁילוֹ demeure indépendante de l’analyse verbale. Le contrôle porte donc sur ce verset et ne vaut pas annotation de tout Gn 49,8–12.
Ps 2,7 met en rapport le cohortatif de proclamation, l’introduction du discours, la proposition nominale citée et le qatal associé à הַיּוֹם. Ps 40,7–9 complète l’étude de Ps 40,2–4 : plusieurs formes suffixales y reçoivent des traductions différentes selon le lexème et le centre déictique, tandis que la différence textuelle grecque exige que le témoin cité soit toujours identifié. Ces deux contrôles restent subordonnés aux analyses poétiques détaillées du chapitre 7.
Hab 2,4 contrôle la relation entre syntaxe nominale, yiqtol et lecture à la fois prospective et générique. La structure de בֶּאֱמוּנָתוֹ est décrite sans transformer le choix entre « foi », « fidélité » et « constance » en fait morphosyntaxique. Am 9,11–12 fournit une chaîne provisoirement analysée comme yiqtol → weqatal → XP + yiqtol → weqatal, puis une proposition de finalité. וַהֲרִסֹתָיו y est traité comme constituant nominal et la divergence entre le texte massorétique et la tradition grecque du v. 12 comme une différence de structure argumentale.
Is 7,14 documente un domaine prospectif composé d’un yiqtol, d’une prédication adjectivale, d’un participe et d’une forme suffixale. Les analyses concurrentes de וְקָרָאת restent ouvertes ; rien n’autorise à étendre mécaniquement cette annotation à Is 7,10–17. Is 53,11–12 décrit pour sa part une réorientation locale de formes suffixales sous תַּחַת אֲשֶׁר et conserve séparément la variante אוֹר. Ici encore, le bornage empêche de présenter l’ensemble d’Is 52,13–53,12 comme entièrement analysé.
Le contrôle araméen de Dn 7,9–14 distingue constructions périphrastiques, événements bornés, causatifs, états et relations du v. 14, ainsi que le Vieux Grec et Théodotion au lieu de les réunir sous une référence indifférenciée à la « LXX ». Le dossier teste ainsi la transférabilité de la procédure d’analyse sans confondre les systèmes morphologiques hébreu et araméen.
Nb 24 et Dt 32 sont disponibles comme comparanda d’emploi délibérément restreint. Pour Nb 24, l’observation porte principalement sur Nb 24,17 et contrôle la poésie oraculaire ainsi que certaines lectures prospectives, sans valoir comme analyse complète de Nb 24,15–19.
Dt 32,8–11 est également mobilisé de façon limitée, car sa tradition textuelle impose de séparer l’établissement du texte de l’analyse linguistique et sa segmentation poétique réclamerait une discussion plus longue que ne le permet sa fonction comparative. Ces deux ensembles attestent la portée possible des diagnostics, sans constituer des dossiers philologiquement clos ou des preuves indépendantes de représentativité.
Gn 3,15, Ps 22, Ps 110,1–4 LXX : Ps 109,1–4 , Is 61,1–2 et Dn 9,24–27 ont été considérés durant la constitution de l’échantillon, puis laissés en réserve une fois la saturation atteinte. Gn 3,15 aurait permis un contrôle supplémentaire des relations pronominales et référentielles ; Ps 22, de l’interaction entre syntaxe, poésie et tradition textuelle ; Ps 110,1–4, de l’articulation entre oracle, impératif et projection ; Is 61,1–2, du rapport entre accomplissement, mission présente et orientation prospective ; Dn 9,24–27, d’une autre configuration comparative en araméen biblique.
Leur exclusion est un choix d’échantillonnage, non un jugement sur leur intérêt linguistique. Les intégrer aurait accru le volume d’exégèse et de critique textuelle sans ajouter un contraste indispensable aux questions du mémoire. Ils constituent ainsi des réserves naturelles pour une enquête ultérieure, mais aucune promesse d’intégration ne demeure attachée à la présente étude.
4.7. Saturation, format et contrôle de qualité
L’ajout de passages s’arrête lorsque les nouveaux exemples ne créent plus de contraste linguistique. Un passage supplémentaire n’est retenu que s’il teste une nouvelle configuration, réplique une configuration importante, fournit un contre-exemple, représente une strate encore absente ou permet un contrôle comparatif particulièrement informatif.
Ces critères subordonnent la sélection au problème linguistique et empêchent que le corpus dérive vers une anthologie de passages importants.
Le format informatique remplit une fonction instrumentale et doit rester lisible sans logiciel spécialisé, vérifiable, filtrable et réutilisable.
Un fichier tabulaire UTF-8 — TSV ou CSV — suffit à la couche analytique principale ; une conversion obligatoire en XML, JSON ou dans un schéma d’annotation complexe n’apporterait aucun avantage théorique et ne se justifierait que pour assurer l’interopérabilité avec un projet externe.
Publié avec le mémoire, le fichier tabulaire permet au lecteur de vérifier les analyses et d’extraire les exemples, mais ses colonnes interprétatives dépendent des chapitres qui définissent les catégories et argumentent les analyses. Il externalise ainsi les observations qui sous-tendent le raisonnement sans constituer un produit analytique autonome.
Pour rendre la sélection vérifiable, la documentation doit identifier la source textuelle qui fournit le texte et la morphologie de référence, expliquer pourquoi chaque passage appartient à l’échantillon, définir les variables annotées et assurer la traçabilité des corrections en les distinguant des analyses qu’elles remplacent.
La reproductibilité porte sur le raisonnement scientifique et sur la justification des corrections.
La fiabilité de l’échantillon repose sur trois opérations complémentaires. La vérification philologique contrôle le texte hébreu ou araméen, la référence et la forme analysée avant leur utilisation. La vérification morphologique relit les formes indépendamment de leur traduction et attribue un statut explicite aux cas ambigus. La vérification analytique formule, pour les dossiers centraux et lorsque les données le permettent, au moins une solution concurrente : l’exactitude de l’identification morphologique ne suffit pas à vérifier un exemple si la conclusion découle circulairement de la catégorie qu’elle prétend démontrer.
Un autre chercheur peut reconstruire un échantillon comparable en partant du même texte ou d’une base morphologiquement analysée comparable, puis en extrayant les quatre classes verbales étudiées et les catégories modales pertinentes. Les exemples sont répartis selon les principaux types de texte et interrogés à partir des configurations contrastives définies plus haut ; la priorité revient à ceux qui comportent un contrôle lexical ou syntaxique. Chaque généralisation doit recevoir au moins une réplication ou un contre-domaine, auxquels s’ajoute un contrôle diachronique et comparatif de taille limitée.
Le choix des versets pourrait varier, mais les mêmes classes de phénomènes devraient être représentées ; la reproductibilité porte sur cette structure de sélection.
4.8. Quantification, transitions et cooccurrences
La quantification intervient à trois niveaux : elle décrit l’échantillon par le nombre de propositions, de formes, de livres et de types de textes représentés ; elle repère les formes qui coexistent ou se succèdent assez souvent pour permettre des comparaisons ; elle évalue enfin, de manière exploratoire, si la récurrence d’une configuration justifie une extension de l’analyse.
En revanche, les chiffres ne sont pas employés pour calculer directement :
le pourcentage des
qatalqui « signifient background »
ou :
la proportion des
yiqtolqui « lexicalisent le futur ».
De telles mesures supposeraient précisément que les catégories interprétatives aient déjà été indépendamment définies.
Les transitions entre formes restent utiles pour repérer les zones d’intérêt : une recherche de qatal → wayyiqtol peut conduire à Gn 25,34, tandis que yiqtol → weqatal peut conduire à Ex 20 ou Gn 28. Leur interprétation exige toutefois une analyse structurale, car la première forme peut appartenir à une relative, une frontière de discours direct peut séparer les propositions, et plusieurs clauses peuvent relever de la portée d’une même condition. Les séquences linéaires ne reçoivent donc pas automatiquement les lectures foreground → background ou projection → consequence.
Les matrices complètes peuvent être conservées dans la documentation secondaire plutôt que développées dans le corps du texte.
4.9. Limites
L’échantillon n’autorise ni une estimation de toutes les fréquences du système verbal biblique, ni des jugements négatifs sur les constructions non attestées ; les différentes parties de la Bible hébraïque ne représentent pas davantage un état synchronique nécessairement homogène.
Le mémoire cherche à établir qu’une équivalence simple rencontre des contre-exemples attestés, qu’un contraste morphologique covarie avec une différence structurale, qu’un même patron se reproduit dans plusieurs environnements et qu’une analyse produit une prédiction vérifiable sur d’autres passages.
Une sélection contrôlée suffit à l’établissement de ce type de résultat.
4.10. Conclusion
L’ensemble de textes utilisé dans cette étude est construit en fonction d’une question : dans quelles conditions la relation entre forme verbale et interprétation cesse-t-elle d’être biunivoque, et quels facteurs structuraux permettent d’expliquer cette variation ?
Les passages constituent un échantillon contrastif, distinct d’un échantillon proportionnel de la Bible hébraïque et stratifié selon la forme verbale, la structure clausale, la modalité et la polarité, le type de discours, le genre, la diachronie et, de manière limitée, la comparaison avec l’araméen biblique.
La sélection privilégie les passages dans lesquels plusieurs variables peuvent être contrôlées, les configurations répétées ou une analyse simple confrontée à un contre-exemple ; l’intégration de textes prophétiques, de passages poétiques fortement interprétés et d’un contrôle araméen élargit ainsi le champ de vérification sans modifier la question de recherche.
Une annotation tabulaire techniquement légère suffit à externaliser les observations nécessaires, dont la valeur scientifique tient à la transparence du lien entre les étapes — passage sélectionné, observation, contraste, analyse et conclusion — plutôt qu’à la sophistication du format. Les chapitres empiriques utilisent cette architecture pour tester successivement les alternances narratives, les constructions modales et conditionnelles et les configurations poétiques.
Références
Atkins, Sue, Jeremy Clear et Nicholas Ostler. 1992. “Corpus Design Criteria.” Literary and Linguistic Computing 7(1): 1–16.
Biber, Douglas. 1993. “Representativeness in Corpus Design.” Literary and Linguistic Computing 8(4): 243–257.
Biber, Douglas, Susan Conrad et Randi Reppen. 1998. Corpus Linguistics: Investigating Language Structure and Use. Cambridge: Cambridge University Press.
Collins, John J. 1993. Daniel: A Commentary on the Book of Daniel. Hermeneia. Minneapolis: Fortress Press.
Goldingay, John E. 1989. Daniel. Word Biblical Commentary 30. Dallas: Word Books.
McEnery, Tony, et Andrew Hardie. 2012. Corpus Linguistics: Method, Theory and Practice. Cambridge: Cambridge University Press.
Rosenthal, Franz. 2006. A Grammar of Biblical Aramaic. 7th expanded ed. Wiesbaden: Harrassowitz.
Sinclair, John. 2005. “Corpus and Text: Basic Principles.” In Developing Linguistic Corpora: A Guide to Good Practice, edited by Martin Wynne, 1–16. Oxford: Oxbow Books.
Tov, Emanuel. 2012. Textual Criticism of the Hebrew Bible. 3rd ed. Minneapolis: Fortress Press.