Batchverktyg för att omvandla video och ljud till text
Transkribera video- och ljudfiler till text offline i batch och exportera med ett klick till flera undertext- och textformat: TXT, SRT, VTT, JSON, LRC och CSV.
Verktyget laddas, vänta...
Om onlineverktyget inte kan laddas eller köras, prova skrivbordsverktyget. https://tools.yikeaigc.com/
Verktygsanvändning
Återgå till gamla versionenVerktyg för batchkonvertering av video och ljud till text(programversion)
Eftersom inläsning av offline-taligenkänningsmodeller och avkodning av ljud/video kräver mycket datorkraft finns funktionen endast i Windows-skrivbordsklienten för en stabilare och effektivare upplevelse.
Instruktioner
Programvarans användningsinstruktioner
- Lägg till filer som ska identifieras:Klicka på knappen "Välj fil" eller "Välj mapp" för att lägga till video- eller ljudfiler som ska omvandlas till text. Du kan också dra filer eller mappar direkt till programfönstret. Stöder blandad batchimport av vanliga video- och ljudformat som MP4, MKV, MOV, AVI, FLV, WebM, MP3, WAV, FLAC, M4A med flera.
- Ställ in sparmapp:Välj var bearbetade undertexter och texter ska sparas. Dra och släpp stöds för inställningen. Om "Gå igenom undermappar" är markerat kan du även markera "Behåll ursprunglig sökvägsstruktur", så att utdatafilerna motsvarar källmappens katalogstruktur.
- Välj utdataformat:
- TXT:Ren text, lämpligt för att sammanställa manus och mötesanteckningar
- SRT / VTT:Undertextformat med tidsstämplar, kan användas direkt i videor
- JSON:Strukturerade data, praktiskt för vidareutveckling och programbearbetning
- LRC:Låttextformat, lämpligt för musik och ljudböcker
- CSV:Tabellformat, enkelt att redigera och korrekturläsa i Excel
- Konfigurera igenkänningsparametrar:
- Modellsökväg:Som standard används Paraformer-modellen för kinesisk igenkänning, FSMN för röstaktivitetsdetektering och CT-modellen för interpunktion
- Batchlängd:Ställ in maximal ljudlängd för en enskild inferens
- VAD maximal längd per segment i millisekunder:Styr detaljnivån för uppdelning av talsegment
- Lista med heta ord:Ange egennamn, personnamn och varumärkesord för att förbättra igenkänningsnoggrannheten
- Hoppa över/skriv över-strategi:Välj om befintliga utdatafiler ska hoppas över eller skrivas över
- Starta batchigenkänning:Klicka på knappen "Starta igenkänning". Programmet extraherar automatiskt ljudspår, delar upp talsegment, transkriberar via inferens och lägger till interpunktion. Under bearbetningen kan du se förloppet i loggområdet. Klicka på knappen "Stoppa" om du behöver avbryta.
- Visa och använd resultaten:När igenkänningen är klar kan du öppna den inställda sparmappen och visa filerna i motsvarande format. SRT/VTT-undertexter kan dras direkt till redigeringsprogram eller spelare för användning.
Vanliga frågor
Relaterade verktyg
Generator för rullande text och bildrullningsanimationer
Skapa rullningsanimationer med text eller bilder, förhand...
Batchverktyg för scenindelning av video
Identifierar intelligent scenförändringar i videor och de...
Verktyg för att lägga till MP4-omslag
Lägg till omslagsbilder i MP4-videor i batch, med stöd fö...
Batchverktyg för att konvertera bilder till video
Skapa MP4-videor av bilder i batch, med stöd för övergång...
Batchverktyg för att lägga till bildvattenstämpel på videor
Lägg till bildvattenstämplar i MP4-videor batchvis, med s...
Intelligent verktyg för batchvis bortklippning och sammanslagning av videor
Identifierar och klipper automatiskt bort videons början ...
Verktyg för att slå ihop videor från flera mappar
Stöder satsvis sammanslagning av videor från flera mappar...
Verktyg för massrensning och redigering av videometadata
Rensa metadata som videoinspelningsenhet, GPS och skapand...
Batchverktyg för färggradering av video
Justera ljusstyrka, kontrast, mättnad och färgtemperatur ...