whisper
Reconnaissance vocale fiable via une supervision faible à grande échelle. Le format de formation multitâche utilise un ensemble de jetons spéciaux qui servent de spécificateurs de tâches ou de cibles de classification.
Le problème qu’il résout
Reconnaissance vocale fiable via une supervision faible à grande échelle. Le format de formation multitâche utilise un ensemble de jetons spéciaux qui servent de spécificateurs de tâches ou de cibles de classification.
Le contexte du projet sur cette page est accessible gratuitement. Le dépôt GitHub d’origine reste la référence ; la connexion n’est nécessaire que pour enregistrer ou rejoindre la discussion.
Notes de la communauté