Parole (STT et TTS)
Pia comprend le traitement local de la parole — aucune API cloud requise.
Conversion Parole-Texte (STT)
Section intitulée « Conversion Parole-Texte (STT) »Pia exécute la conversion parole-texte localement sur ta machine et propose deux moteurs parmi lesquels tu peux choisir :
- Parakeet (la valeur par défaut) — multilingue et détecte automatiquement la langue parlée.
- Whisper — te permet de choisir une taille de modèle pour équilibrer vitesse et précision.
Choisir un moteur
Section intitulée « Choisir un moteur »- Ouvre Paramètres → Général → Parole
- Sélectionne ton moteur dans le menu déroulant Moteur de reconnaissance vocale
- Clique sur le bouton Télécharger pour obtenir les fichiers requis — tu n’as besoin de le faire qu’une fois par moteur
Parakeet
Section intitulée « Parakeet »Parakeet est le moteur par défaut. Il n’y a pas de taille de modèle à choisir — il fonctionne prêt à l’emploi et détecte automatiquement la langue que tu parles. Clique simplement sur Télécharger pour la configurer.
Avec Whisper, choisis une taille de modèle dans le menu déroulant : Tiny, Base, Small, Medium ou Large. Clique ensuite sur Télécharger pour télécharger ce modèle.
Enregistrement
Section intitulée « Enregistrement »Une fois ton moteur configuré, clique sur l’icône microphone dans le chat pour commencer l’enregistrement.
Conversion Texte-Parole (TTS)
Section intitulée « Conversion Texte-Parole (TTS) »Pia synthétise la voix dans l’application elle-même, hors ligne, et récupère ses voix depuis les propres serveurs de Pia. Il n’y a plus de moteur vocal séparé à télécharger, et les réseaux qui bloquaient l’hébergeur de modèles tiers que Pia utilisait avant peuvent de nouveau installer une voix.
Télécharger une Voix
Section intitulée « Télécharger une Voix »- Ouvre Paramètres → Général → Parole et fais défiler jusqu’à Synthèse vocale
- Fais défiler la liste des voix — chaque carte affiche le nom de la voix, la langue, le genre et la qualité
- Trouve une voix qui te plaît et clique sur Télécharger
- Attends que la barre de progression se termine
Tu peux télécharger autant de voix que tu veux. Alba (anglais britannique) est la voix avec laquelle Pia lit à voix haute par défaut.
Sélectionner une Voix
Section intitulée « Sélectionner une Voix »Une voix est sélectionnée dès que son téléchargement se termine, si bien que la synthèse vocale fonctionne sans étape supplémentaire. La carte affiche un badge Actifs pour confirmer laquelle est utilisée.
Une seule voix peut être active à la fois. Pour changer, clique sur Sélectionner sur une autre voix téléchargée. Si la voix enregistrée n’est plus sur cet appareil, Pia en reprend une autre plutôt que de rester silencieux.
Retirer une Voix
Section intitulée « Retirer une Voix »Retirer de cet appareil sur la ligne d’une voix la supprime et rend l’espace qu’elle occupait. Pia demande d’abord confirmation — “Remove the voice X from this device? You can download it again at any time.” — et si c’était la voix utilisée, Pia bascule sur une autre voix installée.
Deux voix ne sont plus proposées
Section intitulée « Deux voix ne sont plus proposées »Les enregistrements dont Lessac et Ryan ont été tirés sont sous licence recherche et usage non commercial uniquement, donc Pia ne les propose plus. Si tu en avais une de sélectionnée, Pia bascule sur une autre voix installée ou te demande d’en choisir une.
Utiliser TTS
Section intitulée « Utiliser TTS »Une fois qu’une voix est active, les réponses de l’IA sont lues à voix haute automatiquement. Les réponses parlées commencent plus vite qu’avant, et les courtes phrases que Pia prononce pendant qu’il réfléchit sont prêtes dès qu’une voix est installée.
Conversation vocale
Section intitulée « Conversation vocale »Plutôt que de taper et de lire, tu peux simplement parler. Clique sur le bouton Conversation vocale dans la barre de message et Pia ouvre une superposition plein écran : il écoute, réfléchit, répond à voix haute, puis écoute de nouveau. Il utilise le moteur et la voix que tu as configurés ci-dessus.
Déroulement d’un tour de parole
Section intitulée « Déroulement d’un tour de parole »- Écoute — parle normalement. Un indicateur de niveau montre que Pia t’entend.
- Environ une seconde et demie de silence met fin à ton tour automatiquement, sans que tu aies à appuyer sur quoi que ce soit.
- Traitement — Pia transcrit ce que tu as dit et élabore une réponse.
- Parole — la réponse est lue à voix haute et apparaît dans la transcription en cours à l’écran.
- Retour à l’écoute, jusqu’à ce que tu quittes.
Trois boutons se trouvent en bas :
| Bouton | Quand il s’affiche | Ce qu’il fait |
|---|---|---|
| Terminé | Pendant l’écoute | Termine ton tour immédiatement, sans attendre le silence. |
| Arrêter | Pendant la parole | Interrompt la réponse et recommence à écouter. |
| Fin | Toujours | Quitte le mode vocal. |
Tout ce que tu dis et tout ce que Pia répond est ajouté à la conversation dans laquelle tu te trouvais, tu peux donc la faire défiler ensuite comme n’importe quelle autre conversation. Les réponses sont attribuées au persona actif, comme les réponses tapées.
Outils en mode vocal
Section intitulée « Outils en mode vocal »Il n’y a aucun moyen de t’afficher une carte d’approbation quand tu ne regardes pas l’écran, le mode vocal est donc plus strict que la fenêtre de chat. Un outil qui modifie quelque chose ne s’exécute que s’il est déjà couvert :
- tu l’as marqué Toujours autoriser, ou
- l’Autonomie de l’agent est activée et il s’agit de l’un des outils d’écriture propres à Pia
Tout le reste est refusé à voix haute, et Pia te dit de redemander dans la fenêtre de chat.
Confidentialité
Section intitulée « Confidentialité »Tout le traitement de la parole se fait localement sur ton appareil. L’audio n’est jamais envoyé à des serveurs externes.