Créditos e licenças
OrdoVox é construído com software livre. Agradecemos aos autores dos componentes abaixo.
Transcrição
- Whisper (OpenAI), modelo de reconhecimento de fala, incluindo o large-v3-turbo — licença MIT.
- faster-whisper e CTranslate2 — licença MIT.
Identificação de participantes
- sherpa-onnx (k2-fsa) — licença Apache-2.0.
- ONNX Runtime (Microsoft) — licença MIT.
- pyannote/segmentation-3.0 (Hervé Bredin e colaboradores), modelo de segmentação — licença MIT.
- pyannote.audio (biblioteca, pyannoteAI e colaboradores) — licença MIT.
- Modelo speaker-diarization-community-1 (pyannoteAI e colaboradores) — licença CC-BY-4.0.
- PyTorch — licença BSD-3.
- WeSpeaker ResNet34 e CAM++ (VoxCeleb), modelos de voz — licença Apache-2.0.
Conversão de vídeo em áudio
- FFmpeg — licença GPL-2.0 ou posterior, executado como programa separado.
Os componentes são usados conforme suas licenças. Os nomes citados pertencem aos seus respectivos titulares.