Déploiement de FireRedASR-AED-L sur dispositifs embarqués Jetson Orin

Aperçu du projet : Percée en reconnaissance vocale embarquée L'exécution de modèles de reconnaissance vocale sur dispositifs embarqués comme Jetson Orin présente des défis techniques majeurs. Les solutions traditionnelles nécessitent une connexion réseau ou une configuration complexe. L'image FireRedASR-AED-L révolutionne cette approche avec un ...

Publié le 12 juillet à 01h02

Déploiement en production du modèle Fun-ASR-MLT-Nano-2512 : gestion des logs, supervision par PID et scripts de service complets

Introduction et prérequis Le modèle Fun-ASR-MLT-Nano-2512 est un modèle de reconnaissance vocale multilingue développé par le laboratoire Tongyi d'Alibaba. Il prend en charge 31 langues avec une haute précision. Ce modèle de 800 millions de paramètres gère les langues principales comme le chinois, l'anglais, le japonais et le coréen, et offre d ...

Publié le 7 juillet à 01h04

Guide pratique du modèle SenseVoice-small-onnx : reconnaissance vocale multilingue avec détection automatique

Guide pratique du modèle SenseVoice-small-onnx : reconnaissance vocale multilingue avec détection automatique Vous êtes-vous déjà retrouvé dans une situation où un ami vous envoyait un message vocal en cantonais que vous ne compreniez qu'à moitié ? Ou peut-être aviez-vous besoin de transcrire rapidement un enregistrement de réunion en japonais ...

Publié le 5 juin à 20h39

Intégration de la reconnaissance vocale et de la génération de dossiers médicaux structurés pour les consultations cliniques

L'optimisation de la documentation médicale grâce à l'intelligence artificielle représente un enjeu majeur pour les établissements de santé. Cette approche technique combine une reconnaissance vocale avancée avec un système de structuration automatique des données, visant à alléger la charge administrative des praticians tout en améliorant la q ...

Publié le 4 juin à 20h30