Qu'est-ce que l'IA Cleanvoice ?
Cleanvoice AI est un éditeur automatisé pour les podcasts, les interviews, les vidéos de têtes parlantes et autres enregistrements de créations orales. Il peut détecter et supprimer les mots de remplissage, les bégaiements, les longs silences, les respirations, les bruits de bouche, les bruits de fond, l'écho et les distractions associées. Studio Sound améliore les enregistrements faibles, le mixage des podcasts équilibre les pistes et la transcription, les résumés, les notes d'émission et le contenu social étendent le flux de travail au-delà du nettoyage audio.
Le produit est conçu pour réduire les éditions répétitives, et non pour faire disparaître le jugement éditorial. Une respiration peut être du bruit dans une phrase et une émotion dans une autre. Une pause peut être un air mort ou un rythme dramatique essentiel. La meilleure évaluation utilise les véritables haut-parleurs, microphones, langues, accents, interruptions, artefacts d'appel à distance, supports musicaux et formats de diffusion de l'équipe.
Modification du workflow de qualité et de révision
Commencez par traiter des copies en double de plusieurs épisodes représentatifs. Testez chaque fonctionnalité indépendamment avant de tout activer en même temps. Comparez l'audio brut et édité à chaque montage, en particulier autour des noms, des chiffres, des rires, des faux départs contenant des corrections, des intervenants qui se chevauchent, des invités silencieux, des discours non natifs et des transitions tonales. La suppression agressive du silence peut rendre la conversation peu naturelle ; l'élimination du mastic peut changer le sens ; le débruit peut créer des artefacts métalliques.
Conservez le master multipiste brut en dehors de Cleanvoice. Exportez la chronologie d'édition lorsqu'elle est disponible, puis effectuez une dernière passe dans une station de travail audio numérique ou un éditeur vidéo. Vérifiez la synchronisation, la fréquence d'échantillonnage, le volume, les pics, la phase, les respirations, la tonalité de la pièce, l'intro et la sortie, l'atténuation de la musique, l'orthographe de la transcription, les étiquettes des haut-parleurs, les liens et les résumés. Une note de spectacle générée peut en toute confiance déformer ce qu'un invité a dit.
Le téléchargement par lots peut appliquer un modèle à plusieurs podcasts distincts, tandis que le traitement multipiste n'entraîne actuellement aucun frais supplémentaire. Ces fonctionnalités améliorent le débit mais mettent également à l’échelle un mauvais préréglage. Créez des modèles, testez les modifications sur un fichier et surveillez les taux de fausses suppressions avant d'appliquer un nouveau paramètre à un catalogue antérieur.
Essai gratuit, crédits et forfaits
Les nouveaux comptes reçoivent 30 minutes de crédits gratuits sans carte de paiement et peuvent utiliser l’ensemble des fonctionnalités. Le téléchargement invité permet un aperçu partiel avant l'inscription, bien que les téléchargements longs puissent être coupés et que les résultats complets nécessitent un compte. Les crédits gratuits n’expirent qu’après avoir été consommés.
Les forfaits payants coûtent 11 $ pour cinq heures, 20 $ pour dix heures et 45 $ pour trente heures. Les crédits achetés sont valables deux ans. Les abonnements mensuels incluent dix heures pour 11 $, trente heures pour 30 $, cent heures pour 90 $ et deux cents heures pour 175 $. Les heures d'abonnement inutilisées sont reportées jusqu'à trois fois la limite mensuelle du forfait pendant que l'abonnement reste actif. Les prix standards excluent la TVA applicable.
Les crédits sont basés sur la durée de la source, avec un minimum d'une minute et arrondis à la hausse. Un fichier de 10 minutes et 20 secondes utilise 11 minutes. L'activation de davantage de fonctionnalités d'édition n'augmente pas les frais et les fichiers multipistes ne sont actuellement pas facturés par piste, bien que la documentation prévienne que cela peut changer. Calculez le coût en utilisant toutes les versions soumises et le retraitement, et pas seulement le runtime publié.
API et opérations de production
Cleanvoice propose des API REST ainsi que des SDK Python et JavaScript pour le téléchargement, le traitement, l'interrogation et le téléchargement. La page actuelle du développeur répertorie les mêmes offres groupées horaires et un niveau personnalisé pour plus de 200 heures, avec des tarifs dépendant de l'échelle et de la combinaison de fonctionnalités. Il annonce un SLA de 99,5 %, une révision DPA, des points de terminaison personnalisés, une prise en charge prioritaire et une rétention zéro en option pour les charges de travail de type entreprise.
Les intégrations de production nécessitent une idempotence, un stockage sécurisé des clés, des délais d'attente, des règles de nouvelle tentative, un rapprochement de l'état des tâches, une vérification des webhooks, une validation de la somme de contrôle, des délais de téléchargement, des alertes de crédit et une gestion des échecs. Ne remplacez pas automatiquement le maître brut. Enregistrez le fichier traité dans un emplacement de quarantaine, exécutez la validation du support et demandez l'approbation avant la publication. Enregistrez l'ID du travail, la source, les paramètres, la durée facturée, la somme de contrôle de sortie, le réviseur et le résultat de la suppression.
Lacunes en matière de confidentialité, de rétention et de contrat
Cleanvoice indique que les fichiers originaux et modifiés sont stockés pendant sept jours, puis définitivement supprimés. Son API documente une opération DELETE antérieure et la page du développeur indique que les fichiers peuvent être supprimés une fois le traitement terminé dans le cadre d'une configuration facultative de rétention zéro. Ceci est utile, mais les « fichiers » peuvent ne pas couvrir automatiquement les transcriptions, les résumés, les métadonnées de travail, les enregistrements de facturation, les journaux de diagnostic, les sauvegardes ou les pièces jointes de support. Confirmez chaque classe de données et preuve de suppression.
Les conditions générales publiques ont été mises à jour pour la dernière fois en juin 2022. Elles indiquent que le site général n'est pas adapté aux exigences HIPAA, FISMA ou GLBA. Les conditions contiennent également une licence large et perpétuelle pour le matériel utilisateur classé comme contributions, y compris l'image et la voix, tout en stipulant que les utilisateurs en conservent la propriété. Il ne ressort pas clairement du langage public si les téléchargements de traitement privé sont régis par cette clause de contribution ou par un accord de service plus étroit.
La page des développeurs annonce le développement de modèles personnalisés mais n'établit pas de promesse universelle sans formation pour les téléchargements ordinaires. Avant de télécharger des interviews inédites, des appels de clients, des discussions sur la santé, le privilège juridique, les voix d'enfants, du matériel biométrique ou des réunions confidentielles, obtenez des réponses écrites sur la formation, l'examen humain, les sous-traitants, l'emplacement, le cryptage, les journaux d'accès, les sauvegardes, la suppression, les incidents, les conditions du DPA et l'accord qui remplace les conditions publiques.
Verdict
Cleanvoice AI dispose d’une boîte à outils de nettoyage inhabituellement large et d’une tarification transparente basée sur la durée. Il est attrayant pour les équipes qui passent des heures sur des éditions répétitives de podcasts et pour les développeurs qui souhaitent plusieurs étapes de traitement audio derrière une seule API.
Sa valeur dépend du contrôle qualité humain et de la gouvernance des données. La suppression automatique peut modifier le rythme ou le sens, et les anciens termes publics laissent des questions importantes pour l'audio confidentiel. Utilisez les 30 minutes gratuites sur des échantillons réels difficiles, conservez les masters, suivez chaque version chargée, écoutez l'exportation finale de bout en bout, supprimez les tâches plus tôt et obtenez une position de données signée avant une utilisation en production réglementée ou sensible.
