Google lanceert Gemini 3.5 Transcribe, een model dat gesproken audio omzet in opgemaakte tekst zonder tussenkomst van aparte correctiestappen. Waar eerdere transcriptietools ruwe tekst opleverden die nog nabewerkt moest worden, levert Gemini 3.5 direct leesbare output met interpunctie, alinea-indeling en sprekerherkenning.

De stap is relevant voor iedereen die met interviews, vergaderverslagen of dicteerwerk werkt. De belofte is dat de nabewerking die normaal handmatig gebeurde weggvalt. In de praktijk betekent dat niet dat transcriptie gratis wordt, maar wel dat de kosten van de keten dalen.

Google positioneert het model binnen zijn Gemini Enterprise-lijn, die in rap tempo sectoren krijgt: legal, finance, en nu ook transciptie. De strategie is om niet een model voor alles te bouwen, maar per toepassing een variant af te stemmen. Of dat genoeg is om concurrenten die dezelfde markt beogen te verslaan, moet nog blijken.