Jump to content

Open movement Italia/Infrastruttura

From Meta, a Wikimedia project coordination wiki

Definizione dell'infrastruttura open del progetto Open movement Italia e DMP Data Management Plan.

Tipo di documentazione Strumento Link Accesso Software Note
Progetto Meta-Wiki Open movement Italia Open Open (MediaWiki)
Report del progetto, documentazione organizzativa del progetto Meta-Wiki Open movement Italia/Report Open Open
File Cartella Nextcloud OMG https://workspace.wikimedia.it/s/yDdGKWHBq8yg7Wq Open Open (Nextcloud)
Contatti e aggiornamenti status Cartella Nextcloud OMG-privacy https://workspace.wikimedia.it/f/1415645 Accesso ristretto Open (ONLYOFFICE) Accesso Erica Litrenta e Iolanda Pensa
Dati report finanziario confidenziali Accesso ristretto Open
Email email wikimedia.it o email personale Open (Roundcube)
Interviste online BBB Wikimedia Italia Stanza BBB Open Movementhttps://meeting.wikimedia.it/rooms/5jf-hh9-ryk-axz/join Open Open (BigBlueButton) Problemi con lo strumento. Ritardo voce/immagine e bassa qualità del suono. Faccia prova intervista con Eleonora Pantò.
BBB Wikimedia CH Stanza Open Movement https://nextcloud.wikimedia.ch/apps/bbb/b/o2AyjjzKSfneaLpc Open Open
Calendario Nextcloud Open
Software editing video
Software editing audio

Nomi dei file

[edit]

In generale: Anno-mese-giorno_Titolo_Iniziali autori-versione

Nome file registrazioni audio

[edit]

Anno-mese-giorno_Nome persona intervistata_versione. Importante inserire nome della persona intervistata e

  • V1 registrazioni audio non editate
  • V2 registrazioni audio con primo editing, rimozione
  • V3 selezioni e nuovi editing
  • Usma-V4 editing prodotto da Usmaradio

Metodologia di trascrizione

[edit]
Scelta dello strumento

Per la trascrizione automatica delle interviste è stato utilizzato Whisper in locale, eseguito tramite Python. Questa scelta ha permesso di mantenere il controllo sui dati, lavorare senza connessione internet e ottenere un buon livello di accuratezza.

Esecuzione della trascrizione

La trascrizione è stata avviata tramite uno script Python eseguito da terminale. All’interno dello script vengono definiti il file di input, la lingua e il modello utilizzato. È stato scelto il modello “medium” come compromesso tra qualità e tempi di elaborazione. Un esempio della stringa utilizzata è il seguente:

whisper audio.wav --model medium --language it
Output generati

Il sistema genera automaticamente un file di testo (.txt) con la trascrizione completa e un file di sottotitoli temporizzati (.vtt).