← Tilbage til projekter

AI og automation · Digitale produkter · Kommunikation

AutomaticKaraoke — når lyd skal blive til noget, man kan arbejde i

En rå lydoptagelse er ikke endnu en redigerbar tekst eller et brugbart undertekstspor. AutomaticKaraoke tager fat i det besværlige mellemled: ord, tid, sprog og manuel kontrol.

Kunde
Eget udviklingsprojekt.
Teknologier
OpenAI, Python
Status
Redaktionelt godkendt case

01

Kundens situation

En rå lydoptagelse er ikke endnu en redigerbar tekst eller et brugbart undertekstspor. AutomaticKaraoke tager fat i det besværlige mellemled: ord, tid, sprog og manuel kontrol.

02

Hvad der endnu var uafklaret

Det skulle afklares, hvordan transskription på ordniveau kunne blive til et redigeringsværktøj, hvor man kan rette timing og tekst uden at starte forfra i et tungt videoredigeringsprogram.

03

Hvordan jeg undersøgte problemet

Projektkilden dokumenterer input og arbejdsgang: rå lyd, Whisper-transskription, dansk og engelsk spor samt eksport til SRT/VTT. Den forudgående behovsundersøgelse er ikke dokumenteret.

04

Hvordan retningen blev opfundet og afprøvet

Retningen blev et enkelt webredigeringsværktøj oven på en Python/FFmpeg/Whisper-pipeline, så ord og tidskoder kan justeres direkte.

05

Hvad jeg designede eller byggede

Et lokalt værktøj, der genererer ordsynkroniseret JSON og lader brugeren skrubbe, redigere, indsætte eller slette ord samt eksportere SRT og VTT.

06

Resultat og læring

Pipelinen er dokumenteret som versionstyret med fastlåste afhængigheder og `--input`-parameter. Værktøjet er stadig lavet til én sang ad gangen, og videoeksport er ikke en dokumenteret funktion.

Har I et problem, der fortjener at blive undersøgt først?

Kontakt mig om et projekt