Qu'est-ce que Listnr ?
Listnr est une plate-forme de production vocale d'IA couvrant la synthèse vocale, le clonage vocal, la parole-texte, la traduction et le doublage, la création vidéo, la production et l'hébergement de podcasts et l'accès aux API des développeurs. Son catalogue officiel revendique plus de 1 000 voix dans 142 langues. Les utilisateurs peuvent coller un script, sélectionner des voix, créer un dialogue multi-interlocuteurs, ajuster la prononciation, les pauses, le rythme et l'émotion, prévisualiser le résultat et exporter l'audio MP3 ou WAV.
Cette étendue est utile pour une équipe qui souhaite un seul espace de travail, du script à la distribution. Un producteur de cours pourrait créer des leçons multilingues, une équipe produit pourrait prototyper une voix IVR et un éditeur de podcast pourrait générer une narration et héberger des épisodes. Le compromis est la complexité : la qualité de la voix, les droits, les quotas, le stockage, les limites vidéo, le comportement de l'API et le consentement nécessitent tous une évaluation distincte. Un grand nombre de voix ne signifie pas que tous les paramètres régionaux sont prêts pour la production.
Listnr annonce le clonage vocal à partir d'un échantillon de cinq secondes. Un échantillon court réduit les frictions de configuration mais augmente le risque de cloner quelqu'un qui n'a jamais accepté. La FAQ du produit indique que le clonage d'une autre personne nécessite un consentement explicite, et les conditions nécessitent un consentement écrit clair et vérifiable de chaque locuteur identifiable. Créez un enregistrement de consentement qui identifie l'intervenant, les finalités autorisées, les canaux, les territoires, la durée, les droits d'édition, la divulgation synthétique, la révocation, la suppression et qui peut accéder au modèle.
Studio, localisation et workflow API
Pour une narration ordinaire, testez la langue exacte, l'accent, les noms, les abréviations, les nombres, les dates, le vocabulaire du domaine, le registre émotionnel et la cohérence de la forme longue. Le mode aperçu et les prononciations personnalisées peuvent réduire les erreurs, tandis que les projets multi-voix prennent en charge les conversations. Ne décrivez pas le résultat comme « impossible à distinguer de l’humain » simplement parce que le fournisseur le fait ; évaluer l’intelligibilité et les préférences de l’auditeur auprès de locuteurs natifs.
Listnr propose également des outils de transcription, de traduction automatique, de doublage adapté au locuteur, de sous-titres, de conversion texte-vidéo et de podcast. Chaque étape automatisée peut aggraver les erreurs. Examinez la transcription avant la traduction, puis demandez à un réviseur compétent de vérifier le sens et l'adéquation culturelle avant de générer le discours. Enfin, inspectez le timing, l’attribution des locuteurs, la prononciation, le volume, les sous-titres, les droits musicaux et la divulgation. Pour l'accessibilité, incluez une alternative textuelle précise et ne supposez pas que la narration synthétique à elle seule satisfait aux exigences d'accessibilité.
L'API TTS peut prendre en charge les applications, les jeux, les chatbots et la publication automatisée. Les acheteurs de production doivent demander des détails sur l'authentification et la limite de débit, les données de latence et de disponibilité, la concurrence, l'idempotence, les tentatives, les horodatages, le streaming, les régions, la maintenance du SDK, les codes d'erreur, la mesure de l'utilisation, la gestion des incidents et un SLA. L'affirmation du produit public selon laquelle la latence de l'API est inférieure à 500 ms est une affirmation du fournisseur et non une garantie spécifique à la charge de travail.
Tarifs actuels et droits commerciaux
La page de tarification vérifiée le 9 août 2026 affiche les forfaits annuels. L'individu coûte 190 $ par an avec 20 000 crédits par mois, décrits comme environ deux heures de génération de voix, 50 Go de stockage et 50 vidéos par mois. Solo coûte 390 $ par an avec 50 000 crédits mensuels, environ cinq heures, 100 Go et 150 vidéos. L'agence coûte 990 $ par an avec 250 000 crédits mensuels, environ 25 heures, 250 Go et 250 vidéos. Tous les trois répertorient le catalogue vocal complet, les exportations et intégrations audio illimitées, ainsi que les droits commerciaux.
Listnr présente également un point d'entrée gratuit, tandis que les pages de comparaison affichent des prix mensuels de 19 $, 39 $ et 99 $. Parce que la vue principale des prix peut changer entre les modes mensuels et annuels, confirmer le montant du paiement, les taxes, la cadence de renouvellement, l'annulation, les remboursements, ce qu'un crédit achète, les multiplicateurs vocaux premium, les frais de génération échouée, la comptabilité vidéo, le stockage après annulation, l'inclusion de l'API, les excédents et le roulement des crédits inutilisés.
Les droits commerciaux ne constituent pas une autorisation complète. Les conditions attribuent les droits de Listnr sur la sortie générée à l'utilisateur là où la loi le permet, mais ne garantissent pas l'unicité ou la non-contrefaçon. L'utilisateur doit posséder ou concéder sous licence le script, la source audio, les images, la musique, les marques déposées, les performances et la voix. Les lois peuvent protéger séparément les intérêts en matière de publicité, de personnalité, biométriques, de travail, de consommation, électoraux et de tromperie déloyale.
Confidentialité, conservation et sécurité
La politique de confidentialité de Listnr traite la voix comme des données biométriques. Il répertorie les données de compte, de paiement, de contenu, d'appareil, d'utilisation et de marketing ; les sous-processeurs nommés incluent AWS, Stripe, PostHog, SendGrid et Intercom. Les régions d'hébergement principales sont décrites comme AWS us-east-1 et eu-central-1. L'audio et la vidéo bruts sont conservés 30 jours par défaut, la sortie générée 90 jours, les modèles vocaux jusqu'à la suppression ou la fermeture du compte, les journaux du serveur 12 mois et les enregistrements de facturation sept ans.
La politique indique que la formation des modèles et l'amélioration de la qualité impliquant des données vocales biométriques nécessitent un consentement volontaire et fournit un paramètre « Exclure mes données de la formation ». Les conditions accordent également à Listnr une licence pour traiter les entrées afin de fournir et d'améliorer le service, avec un consentement explicite requis pour la formation vocale au-delà de la session de sortie initiale. Confirmez la valeur par défaut du paramètre, s'il couvre tous les modèles en amont, les artefacts dérivés précédemment, les sauvegardes et la suppression d'un modèle vocal entraîné.
Listnr répertorie AES-256 au repos, TLS 1.3 en transit, l'accès basé sur les rôles, l'AMF interne, la surveillance et les tests d'intrusion annuels. Il est important de noter que la même politique appelle SOC 2 Type II une « feuille de route de certification ». N'interprètez pas une déclaration de page de tarification sur la sécurité des paiements et les audits Stripe comme une preuve que le service Listnr complet dispose actuellement d'un rapport SOC 2 Type II. Demandez des preuves datées et ciblées, un DPA, les conditions du sous-traitant, un résumé du test d'intrusion, un avis d'incident, la continuité des activités, des journaux d'accès et une confirmation de suppression.
Verdict
Listnr est un candidat crédible à large flux de travail pour les créateurs et les équipes qui souhaitent des fonctionnalités multilingues de voix, de doublage, de podcast et de vidéo dans un seul abonnement. Sa valeur dépend de la qualité réelle de la voix sur les marchés cibles et de l'efficacité avec laquelle les crédits sont mappés aux minutes terminées et approuvées. Exécutez un pilote avec plusieurs scripts et auditeurs natifs avant l’achat annuel.
Mesurez les défauts de prononciation, le temps d'édition, le taux de régénération, le coût du crédit par minute approuvée, la similarité des locuteurs, l'acceptation de la divulgation, la qualité de l'exportation, la stabilité de l'API et le comportement de suppression. Conservez le consentement écrit de l'orateur, n'utilisez jamais de voix clonées à des fins de tromperie ou d'authentification et rendez un éditeur humain responsable de chaque version.
