Suno ha anunciado el lanzamiento de Speech (beta) el pasado 1 de octubre de 2026, introduciendo un nuevo modelo de audio hablado que la compañía define como el primero capaz de generar voz y música de manera conjunta, resultando en una pista cohesiva. Tras un periodo de pruebas de un mes con un grupo selecto de usuarios, la versión beta ha sido abierta a todo el público, estando disponible tanto en plataformas móviles como en la web.
El anuncio fue formalizado a través de una publicación en el blog oficial de la empresa, redactada por Jack Brody, Director de Producto de Suno. Según detalla Brody, la herramienta Speech permite la creación de audio hablado acompañado de música de fondo original. El sistema está integrado directamente en la interfaz de Suno, permitiendo que los usuarios ingresen una idea, un poema o cualquier texto de su autoría, para luego describir la voz y el estilo musical que desean implementar en la composición.
En las notas de lanzamiento fechadas el 1 de octubre de 2026, la empresa destaca que Speech es el primer modelo que logra crear el discurso y su banda sonora correspondiente en una sola toma. La funcionalidad ha sido desplegada para Android, iOS, web y la sección Create. Para ilustrar las posibilidades de la herramienta, Suno sugiere la creación de contenidos diversos, tales como cuentos para dormir acompañados de piano suave, discursos motivacionales con tambores de estadio o incluso listas de la compra en formato ASMR.
Este lanzamiento se enmarca en lo que Suno denomina "entretenimiento creativo", una categoría que la empresa sostiene que definirá la próxima ola de tecnología de consumo. Jack Brody subrayó que, aunque la música continúa siendo el núcleo de los desarrollos de Suno, la visión de la compañía se ha expandido hacia otras formas de expresión humana. En este sentido, describen a Speech como un nuevo lienzo para las creaciones personales de su comunidad, mencionando que los usuarios ya producen canciones para eventos como cumpleaños, bodas, bromas internas, actos de fe y adoración, así como dedicatorias para hijos y amigos.
Internamente, el equipo de Suno ha experimentado con el modelo durante su fase de desarrollo. Estas pruebas informales incluyeron la conversión de mensajes de texto de amigos en lecturas dramáticas, la adición de bandas sonoras épicas a notas de voz ordinarias y la creación de meditaciones, poemas y cuentos para dormir destinados a sus propios hijos.
No obstante, Suno ha sido transparente sobre el estado actual de la herramienta, advirtiendo que, al ser una beta, presenta ciertas inconsistencias. La empresa señaló que un acento británico puede transformarse ocasionalmente en uno australiano y viceversa, y que algunas "pausas dramáticas pueden resultar muy dramáticas". La compañía afirmó que el objetivo de abrir la beta es precisamente permitir que los usuarios descubran aplicaciones y usos que el equipo de desarrollo no había previsto.
El lanzamiento de Speech es parte de una serie de avances implementados por Suno a lo largo de 2026. El 9 de septiembre de 2026, la firma presentó v6, una nueva generación de modelos musicales desarrollada en colaboración con socios de la industria como BMG, Believe y Warner Music Group. Estos modelos v6 son descritos como los más expresivos, rápidos y de mayor calidad hasta la fecha. La familia v6 se divide en tres versiones: el modelo insignia v6 y el v6-wild orientado a la exploración —ambos para suscriptores Premier y Pro— y el v6-mini, una versión más eficiente y rápida disponible para todos los usuarios.
La tecnología v6 introduce capacidades avanzadas, permitiendo a los creadores editar partes de una canción existente mediante lenguaje natural, generar mashups a partir de múltiples fuentes en una sola solicitud y aislar audio para construir nuevos ritmos. Además, permite crear música basándose en texto, audio, imágenes y video, así como actualizar letras específicas sin necesidad de reconstruir la canción completa, como cambiar un coro para que sea interpretado por un coro gospel.
Suno también informó que organiza campamentos de escritura semanales con compositores, músicos, productores y artistas para optimizar los flujos de trabajo creativos. Paralelamente, han implementado salvaguardas para revisar letras y archivos de audio cargados con el fin de evitar usos no autorizados. A medida que v6 se despliegue totalmente, los modelos anteriores serán retirados. Asimismo, la empresa está desarrollando experiencias de participación voluntaria (opt-in) para artistas individuales, quienes podrán elegir participar y recibir pagos.
El ecosistema de Suno en 2026 también incluye el lanzamiento de v5.5 el 26 de marzo, que introdujo las funciones "Voices" (para grabar o cargar audio propio y cantar en las creaciones), "Custom Models" (entrenamiento personalizado con al menos seis pistas del usuario) y "My Taste" (aprendizaje de géneros y estados de ánimo preferidos). La función Voices llegó a dispositivos móviles el 7 de agosto de 2026.
Finalmente, el 13 de agosto de 2026, se lanzó Studio 2.0 para suscriptores Premier, una estación de trabajo de audio generativo basada en navegador que incluye sintetizadores integrados, edición MIDI, efectos de audio y una barra de chat. Esta plataforma recibió una actualización el 17 de septiembre de 2026 para mejorar la velocidad y precisión de la transcripción de MIDI a audio. Suno ha manifestado su compromiso de seguir mejorando Speech basándose en la retroalimentación de la comunidad sobre lo que funciona y lo que debe evolucionar.






