Cosa promettiamo — e cosa no
Quello che segue è misurato, non stimato. Dove non abbiamo misurato lo diciamo, e diciamo anche da che parte sbaglia.
Fascia 1 — supportata (16 GB o più).
Carica, monta ed esporta episodi fino a 90 minuti. Su parlato reale, annullare un Remove Silence applicato a un episodio da un'ora richiede circa sei decimi di secondo, e ripristinarlo circa sei decimi e mezzo — misurato su un podcast da 64 minuti su una macchina da 31,7 GB senza alcuna paginazione. L'operazione è esatta al bit.
Le due cifre qui sopra sono quelle del motore. Contando anche il ridisegno della forma d'onda — cioè l'attesa vera dell'utente — l'annullamento richiede 821 millesimi di secondo e il ripristino 668: anche su questa lettura, la più severa, restiamo sotto la banda che ci siamo dati.
Il minuto e mezzo che questa pagina dichiarava fino al 16/08/2026 non c'è più, e non è stato annacquato: è stato tolto perché il limite è stato rimosso. La misura vecchia — ~72-74 secondi sullo stesso materiale e sulla stessa macchina — è stata rifatta accanto a quella nuova, nella stessa sessione, servendo il codice vecchio su una seconda porta: il costo si è ridotto di un fattore ~120.
Che cosa era. La lista di modifiche che Remove Silence lasciava dietro di sé si spezzava in 329 tronconi dove il parlato tenuto fra due pause dura meno di 11,3 millesimi di secondo, e ogni troncone costava una ricostruzione piena della traccia. Adesso quei tronconi nascono già uniti e la ricostruzione è una sola.
Le tre ragioni che stavano accanto al vecchio numero restano vere, e due contano ancora.
- Le pause del materiale sono a zero digitale, non fondo di stanza. Su parlato con fondo vero il rilevatore troverebbe meno tratti — oggi conta meno, perché il costo non dipende più da quanti tratti ci sono.
- Il conteggio pulito dei tratti è 1 450 (il 1 462 usato in passato era contaminato dai Gain di un'altra misura). La cifra nuova è presa sul conteggio pulito: 1 450 tratti, 28,87 % di traccia rimossa.
- Nessuna misura esiste ancora su materiale con fondo di stanza: la classe non gated non è stata guardata (U47, blocco D). La direzione dell'errore è la stessa di prima — il caso vero è più facile, non più difficile.
Una cosa nuova che sappiamo, e che va detta: la frequenza della scheda audio della macchina cambia il lavoro. Su un'uscita a 48 kHz un file a 44,1 kHz viene riconvertito in ingresso e il rilevatore vede ~9 % di campioni in più; le cifre qui sopra sono prese alla frequenza nativa del file.
Fascia 2 — supportata con degrado dichiarato (8 GB, con spazio libero su disco).
Carica e monta episodi fino a un'ora: un WAV da 64 minuti si apre in circa 10 secondi e le modifiche sono esatte al bit. Ma serve spazio libero su disco, e serve pazienza: la macchina arriva a chiedere al disco fino a 11 GB di memoria virtuale, e l'esportazione dopo una catena di modifiche può non riuscire. Su questa fascia consigliamo di esportare prima di montare a lungo, e di lavorare su episodi più corti.
Sull'annullamento in fascia 2 non abbiamo un numero nuovo, e lo diciamo invece di stimarlo. La frase «un annullamento può richiedere decine di secondi» è stata tolta perché era misurata sul codice di prima; la misura nuova su 8 GB non è stata fatta — la macchina da 8 GB non era disponibile alla sessione del 16/08/2026. Quello che sappiamo: su 8 GB il costo era struttura × paginazione, e la struttura è scesa di un fattore ~120 sulla macchina da 31,7 GB. La direzione dell'errore è quindi favorevole, ma il numero va misurato prima di essere scritto qui.
Fascia 3 — fuori perimetro.
Non supportiamo: telefoni e tablet (iOS e Android non usano memoria virtuale: la scheda si chiude senza preavviso), macchine sotto gli 8 GB, browser non basati su Chromium, ed episodi oltre i 90 minuti. Non è una stima: sono i casi che non abbiamo misurato, e la direzione dell'errore è sempre la stessa — peggiore, non migliore.
Remove Silence.
La funzione toglie le pause e non taglia parole. L'abbiamo verificato all'ascolto su un podcast reale da un'ora, sui tre punti peggiori che la misura segnalava e su un campione di controllo: gli stacchi sono stretti, e tengono. Chiudendo ogni pausa non si porta più dentro nulla del suono che riprende: il tratto rimosso finisce sull'ultimo campione silenzioso. Un limite misurato e dichiarato: il taglio comincia 11,3 millesimi di secondo prima della pausa, quindi accorcia la coda della parola che la precede — è lo scopo della funzione, ed è così che gli stacchi risultano stretti; in 11 punti su 1 450 pause quella coda contiene ancora voce, più debole di tutti i punti che abbiamo riascoltato senza sentirli. Fino alla correzione dichiaravamo 324 punti e fino a 1,3 millesimi di suono ripreso: quel limite non è stato ammorbidito, è stato rimosso. Lo scriviamo perché è vero, non perché lo noterete.
Su 8 GB il salvataggio di un episodio da 90 minuti riesce e non perde niente, ma l'interfaccia si blocca a scatti fino a tre decimi di secondo durante il ciclo, e fino a 1,65 s a scheda nascosta.