Open movement Italia/Infrastruttura
Definizione dell'infrastruttura open del progetto Open movement Italia e DMP Data Management Plan.
| Tipo di documentazione | Strumento | Link | Accesso | Software | Note |
|---|---|---|---|---|---|
| Progetto | Meta-Wiki | Open movement Italia | Open | Open (MediaWiki) | |
| Report del progetto, documentazione organizzativa del progetto | Meta-Wiki | Open movement Italia/Report | Open | Open | |
| File | Cartella Nextcloud OMG | https://workspace.wikimedia.it/s/yDdGKWHBq8yg7Wq | Open | Open (Nextcloud) | |
| Contatti e aggiornamenti status | Cartella Nextcloud OMG-privacy | https://workspace.wikimedia.it/f/1415645 | Accesso ristretto | Open (ONLYOFFICE) | Accesso Erica Litrenta e Iolanda Pensa |
| Dati report finanziario confidenziali | Accesso ristretto | Open | |||
| email wikimedia.it o email personale | Open (Roundcube) | ||||
| Interviste online | BBB Wikimedia Italia | Stanza BBB Open Movementhttps://meeting.wikimedia.it/rooms/5jf-hh9-ryk-axz/join | Open | Open (BigBlueButton) | Problemi con lo strumento. Ritardo voce/immagine e bassa qualità del suono. Faccia prova intervista con Eleonora Pantò. |
| BBB Wikimedia CH | Stanza Open Movement https://nextcloud.wikimedia.ch/apps/bbb/b/o2AyjjzKSfneaLpc | Open | Open | ||
| Calendario | Nextcloud | Open | |||
| Software editing video | |||||
| Software editing audio |
Nomi dei file
[edit]In generale: Anno-mese-giorno_Titolo_Iniziali autori-versione
Nome file registrazioni audio
[edit]Anno-mese-giorno_Nome persona intervistata_versione. Importante inserire nome della persona intervistata e
- V1 registrazioni audio non editate
- V2 registrazioni audio con primo editing, rimozione
- V3 selezioni e nuovi editing
- Usma-V4 editing prodotto da Usmaradio
Metodologia di trascrizione
[edit]- Scelta dello strumento
Per la trascrizione automatica delle interviste è stato utilizzato Whisper in locale, eseguito tramite Python. Questa scelta ha permesso di mantenere il controllo sui dati, lavorare senza connessione internet e ottenere un buon livello di accuratezza.
- Esecuzione della trascrizione
La trascrizione è stata avviata tramite uno script Python eseguito da terminale. All’interno dello script vengono definiti il file di input, la lingua e il modello utilizzato. È stato scelto il modello “medium” come compromesso tra qualità e tempi di elaborazione. Un esempio della stringa utilizzata è il seguente:
whisper audio.wav --model medium --language it
- Output generati
Il sistema genera automaticamente un file di testo (.txt) con la trascrizione completa e un file di sottotitoli temporizzati (.vtt).