← Tilbage til projekter

AI og automation · Digitale produkter · Kommunikation

AutomaticKaraoke — når lyd skal blive til noget, man kan arbejde i

En rå lydoptagelse er ikke endnu en redigerbar tekst eller et brugbart undertekstspor. AutomaticKaraoke tager fat i det besværlige mellemled: ord, tid, sprog og manuel kontrol.

Kunde
Eget udviklingsprojekt.
Teknologier
OpenAI, Python
Status
Redaktionelt godkendt case

01

Kundens situation

En rå lydoptagelse er ikke endnu en redigerbar tekst eller et brugbart undertekstspor. AutomaticKaraoke tager fat i det besværlige mellemled: ord, tid, sprog og manuel kontrol.

02

Hvad der endnu var uafklaret

Det skulle afklares, hvordan transskription på ordniveau kunne blive til et redigeringsværktøj, hvor man kan rette timing og tekst uden at starte forfra i et tungt videoredigeringsprogram.

03

Hvordan jeg undersøgte problemet

Projektkilden dokumenterer input og arbejdsgang: rå lyd, Whisper-transskription, dansk og engelsk spor samt eksport til SRT/VTT. Jeg har ikke skrevet den indledende behovsafklaring ned undervejs.

04

Hvordan retningen blev opfundet og afprøvet

Retningen blev et enkelt webredigeringsværktøj oven på en Python/FFmpeg/Whisper-pipeline, så ord og tidskoder kan justeres direkte.

05

Hvad jeg designede eller byggede

Et lokalt værktøj, der genererer ordsynkroniseret JSON og lader brugeren skrubbe, redigere, indsætte eller slette ord samt eksportere SRT og VTT.

06

Resultat og læring

Pipelinen er versionsstyret med fastlåste afhængigheder og `--input`-parameter. Værktøjet er stadig lavet til én sang ad gangen, og det kan endnu ikke eksportere video.

Har I et problem, der fortjener at blive undersøgt først?

Kontakt mig om et projekt