Les consignes données au modèle sont éditables et versionnées :
chaque enregistrement crée une nouvelle version, rien n'est jamais perdu. Restaurer une
ancienne version (ou le défaut) = la ré-enregistrer. Le prompt de traduction doit contenir
{target} (remplacé par la langue cible).
Les modèles sont téléchargés depuis le stockage interne Kortexya (MinIO,
accès par jeton) vers . Reprise automatique si un
téléchargement est interrompu.
Fourni par l'équipe infra (compte en lecture seule). Vérifié puis enregistré localement — à saisir une seule fois.
Deux moteurs, 100 % locaux (inferencelayer) : Pocket-TTS (219 Mo, voix du catalogue anglais/italien, plus rapide que le temps réel) et Qwen3-TTS 0.6b (2,5 Go, français et 9 autres langues, avec VOTRE voix clonée — 8 s d'enregistrement suffisent ; seule l'empreinte est conservée, pas l'audio). ⚠Qwen3-TTS tourne pour l'instant sur le chemin CPU de parité : comptez ~10 s de calcul par seconde d'audio — le portage iGPU est la prochaine étape.
Chaque dictée arrêtée est enregistrée (audio + transcription + locuteurs)
dans , rangée par workspace. Cliquez une réunion pour la
relire et la réécouter.
« Portez ce vieux whisky au juge blond qui fume sa pipe. Voix ambiguë d'un cœur qui, au zéphyr, préfère les jattes de kiwis. Un bon fromage et du pain frais raviront nos convives dès demain matin, quelle que soit la météo. »
Enregistrez ~10 s de parole naturelle par personne (le texte proposé s'affiche pendant l'enregistrement — le lire garantit une parole continue, mais l'empreinte est indépendante du texte). À l'identification des locuteurs, chaque voix est comparée aux signatures : elle prend son nom. Pour corriger à la main, cliquez une étiquette de locuteur dans la transcription.