AI & computing › Generatieve AI & synthetische media
Adobe Firefly krijgt AI-tools voor muziek, stem en geluidseffecten
Adobe maakt drie nieuwe AI-audiotools breed beschikbaar in zijn Firefly-platform: voor muziek, voice-overs en geluidseffecten. Tegelijk voegt het bedrijf Google's nieuwe model Gemini Omni Flash toe aan Firefly, dat naast tekst ook video, audio en beeld als input accepteert.
Adobe breidt zijn generatieve AI-platform Firefly uit met drie audiotools die voorheen in testfase zaten. Generate Music maakt op basis van een tekstopdracht muziek die vrij te gebruiken is voor video's, Generate Speech zet een geschreven script om in een gesproken tekst-naar-spraak-voice-over, en Generate Sound Effects genereert passend geluid bij losse scènes, zoals voetstappen of omgevingsgeluid. Adobe benadrukt dat alle drie de tools zijn vrijgegeven voor commercieel gebruik, wat betekent dat bedrijven en makers de output zonder licentiezorgen mogen inzetten in reclame's, video's en andere content.
Waarom audio nu aan de beurt is
Firefly begon enkele jaren geleden als tool voor het genereren van afbeeldingen, maar Adobe heeft het platform sindsdien uitgebreid met video- en nu dus ook audiogeneratie. Voor videomakers en marketeers is dat een logische stap: een compleet filmpje heeft niet alleen beeld nodig, maar ook muziek, stemgeluid en sounddesign. Door deze onderdelen binnen één platform te integreren, hoeven gebruikers niet meer te schakelen tussen aparte tools voor beeld, video en geluid. Adobe meldt verder dat de Firefly AI Assistant voortaan een beperkt aantal gratis dagelijkse generaties krijgt, en dat functies als Create Storyboard en Create Brand Kit tot de populairste onderdelen van het platform behoren. Storyboards helpen bij het vooraf uitwerken van video-scènes, terwijl Brand Kit bedrijven een consistente visuele stijl laat vasthouden in AI-gegenereerde content.
Gemini Omni Flash sluit aan bij groeiend aanbod modellen
Naast de audiotools heeft Adobe het model Gemini Omni Flash van Google toegevoegd aan Firefly. Dat model is wat techniekvolgers een multimodaal model noemen: het kan niet alleen tekst verwerken, maar ook video, audio en afbeeldingen als input gebruiken om nieuwe content te maken. Daarmee voegt Google zich bij een groeiende lijst externe AI-modellen die al in Firefly beschikbaar zijn, waaronder eerdere Google-modellen en tools van Kling AI, Luma AI en Runway. Voor Adobe past dit in een strategie waarbij Firefly niet één eigen AI-model aanbiedt, maar juist functioneert als centraal platform waarin gebruikers kunnen kiezen uit meerdere AI-leveranciers, afhankelijk van welk model het beste resultaat geeft voor een specifieke taak. Dat maakt Firefly minder afhankelijk van de kwaliteit van één techbedrijf en geeft creatievelingen meer flexibiliteit om te experimenteren met verschillende stijlen en mogelijkheden binnen dezelfde werkomgeving.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Doordat platforms als Firefly steeds meer AI-taken (beeld, video, tekst én audio) onder één dak samenbrengen, verlaagt dit de drempel voor bedrijven en makers om volledig AI-gegenereerde content te produceren. De toevoeging van externe modellen zoals Gemini Omni Flash laat bovendien zien dat concurrerende techbedrijven steeds vaker via elkaars platforms hun technologie aanbieden, in plaats van alles zelf te bouwen.
- Generatieve AI
- Kunstmatige intelligentie die op basis van een tekstopdracht nieuwe content maakt, zoals beeld, muziek of tekst.
- Tekst-naar-spraak
- Technologie die geschreven tekst omzet in gesproken audio, vaak gebruikt voor voice-overs.
- Multimodaal AI-model
- Een AI-model dat meerdere soorten input tegelijk kan verwerken, zoals tekst, beeld, video en audio, in plaats van slechts één vorm.
- Royalty-free
- Content die zonder extra licentiekosten commercieel gebruikt mag worden, ook als die is gegenereerd door AI.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.