GPT-4 è considerevolmente superiore alla versione precedente nell’elaborazione di codice, almeno in linguaggio python. Siccome un problema dell’API Openai è che non trascrive audio per file oltre i 25 Mb gli ho chiesto un codice che suddividesse un file grande in file di meno di 25Mb, li trascrivesse uno a uno e li salvasse progressivamente in un unico file di trascrizione.
Ci sono stati degli intoppi tecnici, ad esempio sul bitrate dei file Mp3 (la quantità di dati audio codificati che viene trasmessa ogni secondo; non sapevo neanch’io cosa fosse) e delle migliorie (ad esempio il nome del file finale e la directory di salvataggio) ma alla fine ce l’abbiamo fatta. Comunque un paio d’ore alla fine ci sono volute.
prompt#1: è possibile scrivere uno script python per trasformare un file audio in mp3 e dividerlo in file più piccoli di 24Mb?
#2: invece di indicare i path dei file di inpu e ouptput vorrei che cercasse i file nella cartella in cui si trova lo script: che modifica devo fare?
#3: vorrei fare in modo che lo script trascriva tutti i file presenti (che si chiamano tutti segment_n, dove n è un numero progressivo che parte da zero) e li salvi progressivamente su un stesso file in modo da avere alla fine una trascrizione unica. All’inizio di ogni pezzo di trascrizione dovrebbe esserci scritto il nome del file trascritto
per chi può essere utile:
sicuramente è un utilizzo per smanettoni ma il potenziale è enorme. Ah, se lo avessi avuto quando andavo in università…
per ora il prompt fallito è
è possibile fare in modo che se il file non è in formato mp3 venga convertito?
(To convert a file to MP3 format if it is not already in MP3 format, you can check the file’s format using a Python library like `pydub`. If the format is not MP3, you can use `pydub` to convert the file to MP3 format before splitting it.)
Lascia un commento