UTAU es una aplicación japonesa de sintetizador de voz creada por Ameya/Ayame (飴屋/菖蒲). Este programa es similar al software Vocaloid , con la diferencia de que es shareware en lugar de estar bajo una licencia de terceros.
Descripción general
En marzo de 2008, Ameya/Ayame lanzó UTAU, un software shareware gratuito y avanzado de soporte que se podía descargar desde su sitio web principal. UTAU (歌う), que literalmente significa "cantar" en japonés, tiene su origen en la actividad de "Jinriki Bōkaroido" (人力ボーカロイド; Vocaloid Manual) , donde las personas editan una pista vocal existente, extraen fonemas, ajustan el tono y los reensamblan para crear una voz cantada al estilo Vocaloid . UTAU se creó originalmente para ayudar en este proceso mediante síntesis concatenativa . UTAU puede usar archivos WAV proporcionados por el usuario, de modo que se puede sintetizar una voz cantada introduciendo la letra y la melodía de una canción. UTAU venía con el sintetizador de voz "AquesTalk" de AQUEST [ 2 ] para sintetizar las muestras de voz del banco de voz predeterminado, Utane Uta (también apodado Defoko , que significa "Chica Predeterminada" en japonés) en su lanzamiento inicial, después del cual el generador se elimina a sí mismo. Las voces creadas para el programa UTAU también se llaman oficialmente "UTAU", aunque se las conoce coloquialmente como "UTAUloids", una referencia a VOCALOID. También se las llama "voicebanks" (más común en áreas de habla inglesa) y "bibliotecas (de voz)" en Japón. Una miríada de bancos de voz han sido desarrollados por usuarios independientes. Estos bancos de voz normalmente se distribuyen directamente desde sus creadores a través de descargas de internet, pero algunos se venden como parte de proyectos comerciales.
UTAU es principalmente un programa japonés, por lo que muchas de sus voces se crearon específicamente para este idioma. Sin embargo, dado que los usuarios pueden crear sus propios bancos de voz, la comunidad ha ideado métodos para que estos bancos de voz canten en idiomas distintos del japonés. El formato X-SAMPA se usa con frecuencia para bancos de voz en italiano u otros idiomas no japoneses; sin embargo, a veces se utilizan otros sistemas fonéticos, como ARPABET y diversos sistemas fonéticos personalizados. [ 3 ]
Los archivos de proyecto de UTAU se guardan con la extensión " .ust " (Utau Sequence Text). Estos archivos se pueden distribuir libremente, lo que permite que diferentes UTAU canten la misma pieza. Los productores han desarrollado varios métodos para producir sus bancos de sonido, y los resultados de los bancos de voz varían debido a esto. [ 4 ] UTAU no admite el formato MIDI ni el formato .vsq .
Según las capturas de pantalla publicadas en Twitter, Ameya/Ayame añadió compatibilidad con Unicode en una versión más reciente de UTAU que aún no se ha lanzado. La compatibilidad con la región fija de audio y otras codificaciones de audio ya se ha publicado, mientras que la compatibilidad con el frontend aún no se ha lanzado (a fecha de septiembre de 2022). Ameya también actualizó UTAU para que sea compatible con sistemas de 64 bits.
Configuración
El editor es capaz de colocar notas, introducir fonemas y cambiar el tono y el volumen en un piano roll . Solo se puede crear una pista en UTAU, y las notas no se pueden colocar una encima de la otra. Dado que un humano no puede decir dos cosas diferentes al mismo tiempo, esto también es cierto para un Utauloid . Por defecto, solo se muestran las notas en el piano roll, pero se pueden cambiar los ajustes de visualización para mostrar la curva de tono, la intensidad del volumen, la envolvente y los indicadores. UTAU utiliza indicadores para cambiar aspectos de la voz, como con filtros de paso bajo y paso alto, y reduciendo o añadiendo respiración. Estos indicadores difieren según el remuestreador utilizado. La información de la partitura y los datos en el banco de voz se procesan con un remuestreador y wavtool en función de la partitura creada con el editor. Solo se puede utilizar un remuestreador en un único archivo .ust . Se utiliza un filtro de formantes para controlar los cambios en la calidad de la voz, que se puede desactivar.
El archivo de audio que se va a cargar se encuentra haciendo coincidir los símbolos de la nota con el nombre del archivo de audio en la biblioteca de voces. Sin embargo, un archivo prefix.map puede cambiar la subcarpeta de donde se toma la muestra. El tono de la voz sintetizada se ajusta según la diferencia entre el archivo de sonido original y el tono de la nota en el editor. UTAU utiliza filtros de formantes para evitar cambios extremos en la calidad de la voz, los cuales se pueden desactivar. El procesamiento por lotes se utiliza para generar varias notas a la vez. Durante este proceso se crean archivos de caché. Dependiendo del remuestreador, la cantidad de archivos de caché puede aumentar. Hay opciones en el menú para eliminar los archivos de caché al cerrar el programa o después de un cierto período de tiempo.
El software incluye complementos integrados para fusionar vocales automáticamente, así como la opción "Omakase/A la carta" que permite añadir tono y vibrato automáticos a todo el archivo. También se pueden añadir otros complementos creados por los usuarios. Los colores del editor se pueden modificar en el archivo setting.ini.
Voces
Como se mencionó anteriormente, los archivos WAV se pueden importar a UTAU. Un solo banco de voces puede contener cientos, o incluso miles, de estos archivos. Las voces se instalan colocándolas en la carpeta "voice" o arrastrándolas y soltándolas sobre el icono de UTAU. Estas bibliotecas también incluyen un archivo oto.ini que determina la sincronización y la configuración de cada muestra. Al generar audio a partir de los datos de la partitura en el editor, el programa utiliza el archivo oto.ini para configurar la sincronización y la pronunciación. Los archivos oto.ini se pueden crear mediante la interfaz gráfica de usuario de UTAU o con software de terceros desarrollado por los usuarios; el más conocido de estos programas es SetParam. Las tablas de frecuencia ( archivos .frq ) se utilizan para procesar la forma de onda al cambiar el tono en el editor. Algunos remuestreadores utilizan otros tipos de archivo en lugar de .frq . Las voces también pueden incluir archivos de imagen, generalmente en formato .bmp, y diálogos de voz independientes, como algunos Vocaloids . Además, suelen incluir archivos readme con información sobre el software y los términos de uso. También se suelen incluir archivos de información de personajes, conocidos como character.txt, que contienen información que se puede visualizar en la sección "Vista previa de voz" de la interfaz gráfica de usuario. Esta sección muestra el autor del banco de voz, el nombre, un archivo de muestra que se reproduce al hacer clic en el botón "Muestra" y la imagen del banco de voz. Además, puede contener otros parámetros especificados por el creador, como el género.
Algunos bancos de voz son monosilábicos , denominados colectivamente "CV" (consonante-vocal), mientras que otros utilizan trifonos para producir un sonido más suave. [ 4 ] Estos bancos de voz trifonéticos se denominan colectivamente "VCV" (vocal-consonante-vocal). Su creación requiere mucho más tiempo y esfuerzo (aproximadamente siete veces el tamaño de un banco de voz CV, en términos de líneas en el archivo oto.ini ), pero producen un resultado más natural.
Más adelante, las voces de UTAU incluirían fonemas compuestos de vocales y consonantes (VC) para adaptarse a idiomas distintos del japonés. Los métodos que emplean esto incluyen "CVVC" (en el que un fonema VC se coloca entre dos fonemas CV), o un método similar, "VCCV", que se basa en CVVC, pero contiene algunas diferencias (diferenciación entre VC aspiradas y no aspiradas, soporte para grupos consonánticos, etc.). "VCCV" se llama así para diferenciarse de las listas CVVC anteriores de su creador. Dos métodos de grabación de voz menos comunes son CVC, donde un fonema consta de una consonante-vocal-consonante y se divide en el programa usando oto.ini , y un método llamado rentan-jutsu (れんたんじゅつ), en el que una serie de sílabas CV se graban en múltiples archivos wav para crear un resultado más suave sin recurrir a VCV completo.
Dado que los archivos de audio son independientes, pueden utilizarse en otros programas, como por ejemplo un DAW (estación de trabajo de audio digital).
Desarrollo
El desarrollo de UTAU comenzó cuando Ameya empezó a usar Audacity para recombinar muestras de otros cantantes y Melodyne para corregir el tono de las muestras y musicalizarlas. A este proceso se le conocía como "VOCALOID humano". LOLI.COM, un músico que publicaba su propia música rap en Nico Nico Douga , usó su voz para crear Vocaloid humano y lanzó un software de edición de audio que permitía a los usuarios hacer lo mismo. Dado que el proceso de crear "VOCALOID humano" manualmente requería mucho tiempo y esfuerzo, Ameya empezó a desarrollar una nueva herramienta que facilitara el proceso.
La herramienta se anunció en Nico Nico Douga el 11 de enero de 2008. En ese momento, era posible ajustar la duración del sonido, cambiar la envolvente de una nota y generar archivos por lotes. El 5 de febrero de 2008, se publicó un vídeo que mostraba la interfaz gráfica de usuario (GUI). Aquí, era posible estirar la duración de las muestras, crear archivos oto.ini y ajustar las inflexiones de tono de las notas. [ 5 ] El 5 de marzo de 2008, se publicó en Nico Nico Douga un vídeo que explicaba las especificaciones del programa, [ 6 ] y el 15 de marzo de 2008, la herramienta pasó a llamarse UTAU.
El creador era programador de profesión y no especialista en síntesis vocal, pero utilizó conocimientos previos para crear UTAU. Tras su lanzamiento, Ameya continuó mejorando UTAU y comenzó a desarrollarlo en colaboración con otros desarrolladores de conversión de texto a voz. [ 7 ]
En junio de 2008, Ameya rechazó la etiqueta de "Jinriki Bōkaroido" (人力ボーカロイド; Manual Vocaloid) para UTAU, llamándolo software de síntesis de voz para cantar. [ 8 ]
En 2011 se lanzó una versión para Mac llamada UTAU-Synth.
Archivos de audio y derechos de autor
Dado que UTAU puede crear voces cantadas a partir de cualquier archivo WAV, es posible utilizar la voz de una persona ya existente como datos. Con frecuencia, actores, cantantes y celebridades ceden fragmentos de sus voces para su uso en UTAU. El creador, Ameya, llegó a crear una voz utilizando datos del CD de un actor de doblaje.
En mayo de 2008, Ameya decidió dejar de usar datos de audio sin permiso por el momento, a menos que el actor de voz lo permitiera. [ 9 ]
Impacto cultural
Aunque el software es muy popular en Japón, sus orígenes e impacto cultural se deben a la popularidad ya establecida del software Vocaloid. UTAU se hizo famoso por primera vez cuando el creador de Kasane Teto lanzó el personaje, haciéndose pasar por un Vocaloid real como parte de una broma del Día de los Inocentes en 2008. La influencia del software Vocaloid también hizo que ambos programas se usaran comúnmente de forma conjunta. A menudo, las mascotas populares de UTAU, como Kasane Teto, aparecen en medios basados en VOCALOID, como Maker Hikōshiki Hatsune Mix o Hatsune Miku: Project DIVA .
Más tarde, el software UTAU tendría su propio impacto en Vocaloid y otros sintetizadores vocales, con varias voces que hacían referencia a UTAU o que fueron producidas para el motor desde el principio. Por ejemplo, Megurine Luka V4x fue influenciada por la voz de UTAU Gahata Meiji. [ 10 ] Wataru Sasaki, productor de planificación y desarrollo de Crypton Future Media, también habló con alguien muy familiarizado con UTAU y dijo que la conversación fue "muy interesante". [ 11 ] Macne Nana de la serie Macne más tarde se convertiría tanto en una voz de UTAU como en una voz de Vocaloid. El proveedor de voz de Vocaloid Ruby en inglés , Misha, había producido previamente un UTAU en idioma japonés llamado Makune Hachi ( MAKU音ハチ). Además, el vocalista de Dex, Kenji-B, creó a Kenji Baionoto (倍音音ケンジ) para UTAU, y AkiGlancy, la vocalista detrás de la compañera de Dex, Daina, le dio su voz a UTAU Namida (ナミダ) . Kikuko Inoue , la actriz de doblaje de Macne Coco White and Black ( Mac音ココ白・黒) (ver serie Macne ) pasó a expresar un producto de Vocaloid5 con el nombre de Haruno Sora (桜乃そら). El producto viene con dos bancos de voz, Natural y Cool. [ 12 ] Después del lanzamiento de Vocaloid 3 con la voz Tohoku Zunko , sus dos hermanas Tohoku Itako y Tohoku Kiritan recibieron las voces de UTAU. [ 13 ] Kiritan luego realizó una campaña de financiación colectiva para que ella se convirtiera en una Voiceroid . [ 14 ] Además de su influencia en Vocaloid, UTAU ha servido como plataforma de desarrollo para otros sintetizadores de voz cantada comerciales. El más notable de ellos es Synthesizer V de Dreamtonics , que surgió del desarrollo del remuestreador UTAU conocido como Moresampler, ambos desarrollados por Kanru Hua. [ 15 ] [ 16 ] [ 17 ]
Su principal atractivo no radica únicamente en su distribución gratuita en internet, sino también en que permite al usuario insertar su propia voz en la base de datos para su uso musical, abriendo así las puertas al desarrollo de su propia música. UTAU debe su creciente popularidad a su capacidad para proporcionar un método gratuito de creación de voces para música y ha consolidado a numerosos productores musicales que trabajan con el software en sitios como Niconico y YouTube . Los usuarios también lo consideran una alternativa al software Vocaloid, que ofrece una oferta más limitada de voces a un precio elevado y puede no ofrecer los tipos de voz que buscan para su música, ya que la gran base de datos de voces suele tener muchas más probabilidades de ofrecer la voz deseada. Sin embargo, a pesar de la cantidad de bancos de voz que ofrece, el software cuenta con muchos menos productores que trabajan con él que Vocaloid. [ 18 ]
Una emisora de radio programó un programa de 1 hora que contenía únicamente música basada en Vocaloid y UTAU. [ 19 ]
Además, a partir del 19 de julio de 2012 se celebró regularmente un evento llamado The UTAU M@STER. Este evento era la principal reunión de grupos o círculos y se llevaba a cabo de manera similar al evento relacionado con Vocaloid, THE VOC@LOID M@STER, que existía desde 2007. [ 20 ]
Software relacionado
A diferencia de Vocaloid, los archivos UTAU no son restrictivos ya que no se basan en una licencia propietaria. Por lo tanto, es posible usar productos con licencia de código abierto con el software UTAU, como los producidos para la serie Macne ( Mac音シリーズ) , lanzados para los programas Reason 4 y GarageBand . Estos productos fueron vendidos por Act2 y, al convertir su formato de archivo, también pudieron funcionar con el programa UTAU. [ 21 ] Posteriormente, los paquetes Macne Whisper☆Angel Sasayaki, Macne Nana 2S y Macne Petit 2S venían con bancos de voz UTAU preconstruidos.
El banco de voz predeterminado "Defoko" (Utane Uta) toma prestada su voz del software AquesTalk, específicamente la voz "AquesTalk Female-1" producida por A-quest. Se había otorgado permiso para su distribución gratuita con el software. [ 22 ] Utane Koe, la hermana de Uta, también toma prestada su voz del software AquesTalk. Namine Ritsu (波音リツ), un banco de voz originalmente creado para UTAU, también se agregó posteriormente a otro software llamado Sinsy como "Namine Ritsu S". Otro banco de voz desarrollado originalmente para el software UTAU, Yamine Renri (闇音レンリ), también se agregó posteriormente a Synthesizer V. El popular personaje de UTAU, Kasane Teto, se lanzó como una base de datos de voz de IA de Synthesizer V el 27 de abril de 2023. [ 23 ]
Debido al acuerdo de derechos de autor del propio software, no se permite importar software con licencia no abierta, como VOCALOID, al software UTAU. [ 24 ] Los usuarios del software también han desarrollado varios complementos que añaden y mejoran las voces del software. El programa Sugarcape, basado en la misma intención de software libre que UTAU, ya ha entrado en fase beta. [ 25 ] El 27 de mayo de 2011 se lanzó una versión oficial de UTAU para Mac, llamada UTAU-Synth. [ 26 ] Tiene aproximadamente las mismas características que la versión de Windows. La versión UTAU-Synth puede importar tanto voces como canciones creadas con la versión de Windows, pero sus archivos de proyecto y configuraciones de banco de voces no son totalmente compatibles con la versión de Windows. A finales de 2017 se mencionó que Plogue Art et Technologie, Inc. tenía una adaptación de redirección funcional que haría que las voces de UTAU aparecieran en su motor Alter/Ego . [ 27 ]
OpenUTAU es un sucesor no oficial de código abierto de UTAU, desarrollado por el productor de Vocaloid StAkira, con una versión beta lanzada en noviembre de 2021. El software fue diseñado para ser compatible con UTAU, pero con una experiencia de usuario moderna. A diferencia de UTAU, no requiere la configuración regional del sistema en japonés para funcionar correctamente. [ 28 ]
Uso en la música
La primera canción original de UTAU que se lanzó fue "Kenka Wakare" [ 29 ] (japonés: "けんか別れ"; inglés: "Fighting and Breaking up") de nwp8861, quien también fue responsable de "Song of the Eared Robot" [ 30 ] cantada por Kasane Teto . La canción Kenka Wakare fue lanzada por Nico Nico Douga el 10 de mayo de 2008 con el banco de voces Utane Uta [ 31 ] ; se publicó una versión revisada tres días después, el 13 de mayo de 2008.
Las canciones con licencia del álbum Graduation from Lie , con la participación de Kasane Teto, fueron lanzadas para descarga musical por Karen-T, bajo Crypton Future Media , como un lanzamiento especial. Este es el primer lanzamiento con licencia de cualquier UTAU. [ 32 ]
La biblioteca de voces Momo Momone se utiliza en el vídeo viral de YouTube " Nyan Cat ". Es una versión de "Nyanyanyanyanyanyanya!", una canción compuesta originalmente por daniwellP y que utiliza la VOCALOID Hatsune Miku . [ 33 ]
Véase también
Referencias
- ↑ "歌声合成ツールUTΑU ダウンロードページ" [ Página de descarga de UTAU de la herramienta de síntesis de voz para canto ] (en japonés) . Consultado el 31 de octubre de 2025 .
VisualBasic6.0ランタイム
[ Tiempo de ejecución de Visual Basic 6.0 ] - ↑ "Sitio web oficial de Aquestalk" . Sitio web de productos A-quest (en japonés). 30 de enero de 2007.
{{cite web}}: CS1 maint: idioma no reconocido ( enlace ) - ↑ "Tabla de fonemas" . ARPAsing . Consultado el 6 de abril de 2024 .
- 1 2 "Grabación de "Sonido Continuo": UTAU Mejora el Realismo – Vocaloidismo . Vocaloidismo . Archivado del original el 27 de marzo de 2012. Recuperado el 27 de abril de 2016 .
- ^ "自作ツールを使ってテキスト読み上げソフトに「片道キャッチボール」を" . Niconico . 5 de febrero de 2008 . Consultado el 29 de junio de 2021 .
- ^ "人力ボーカロイド支援ツールらしきものを作ってみた その1 導入編" . Niconico . 6 de marzo de 2008.
- ^ "あなたの声で歌うソフト「UTAU」の奇妙な世界" . ASCII.jp . Consultado el 29 de junio de 2021 .
- ↑ ""真の人力Vocaloid"とは" . UTΑUについて. Consultado el 29 de junio de 2021 .
- ↑ Ameya. "テト声の調整に本腰が入った理由 (Por qué me tomé en serio el ajuste de la voz de Teto)" . Consultado el 31 de julio de 2021 .
- ↑ "crypton_wat" . Twitter . Consultado el 27 de abril de 2016 .
- ↑ "crypton_wat" . Twitter . Consultado el 29 de abril de 2016 .
- ↑ "¡井上喜久子のVOCALOID、VOICEROIDがついに登場! ¡新VOCALOID5に対応! 「VOCALOID 桜乃そら」「VOICEROID2 桜乃そら」 26 de julio de 2018" . ahsoft.com . AH-Software . Consultado el 29 de junio de 2021 .
- ^ "東北 イ タ コ, き り た ん の UTAU 音源" . Archivado desde el original el 24 de junio de 2020 . Consultado el 27 de abril de 2016 .
- ^ "クラウド出版" . Consultado el 27 de abril de 2016 .
- ^ Hua, Kanru (23 de septiembre de 2022), libllsm2 , consultado el 3 de octubre de 2022
- ↑ "Libración de libllsm2 – Sitio web de Kanru Hua" . 8 de octubre de 2018. Archivado del original el 8 de octubre de 2018. Consultado el 3 de octubre de 2022 .
- ^ "Moresampler - Sitio web de Kanru Hua" . 8 de octubre de 2018. Archivado desde el original el 8 de octubre de 2018 . Consultado el 3 de octubre de 2022 .
- ↑ "¿Qué tan grande es la comunidad japonesa de Vocaloid?" . Archivado del original el 13 de diciembre de 2010.
- ^ "NHK の本気! ボカロラジオ「エレうた」の高き志" [ ¡Determinación de NHK! Grandes aspiraciones con Vocaloid Radio "Ere Uta" ] (en japonés). Trabajos de medios ASCII . 5 de febrero de 2011 . Consultado el 25 de febrero de 2011 .
- ↑ "「THE UTAU M@STER」Evento exclusivo de UTAU" . Consultado el 27 de abril de 2016 .
- ^ "Mac音ナナ シリーズ" [ Serie Macne Nana ] (en japonés). Acto2. Archivado desde el original el 11 de mayo de 2011 . Consultado el 9 de julio de 2010 .
- ^ "音声合成ライブラリ製品の紹介 - 株式会社アクエスト" . Consultado el 27 de abril de 2016 .
- ↑ "Synthesizer V AI 重音テト" . 2 de abril de 2023. Archivado del original el 3 de abril de 2023. Consultado el 4 de abril de 2023 .
- ↑ "Controversia y modificaciones ilegales de POCALOID" . Wiki de Vocaloid . Consultado el 1 de septiembre de 2019 .
- ^ "Mac で 動 く ボ ー カ ル シ ン セ を 作 る" . Archivado desde el original el 20 de febrero de 2020 . Consultado el 27 de abril de 2016 .
- ↑ "UTAU para Mac: UTAU-Synth" . Vocaloidism . Archivado del original el 27 de marzo de 2012. Consultado el 27 de abril de 2016 .
- ↑ "@chipspeech 17:19—10 de noviembre de 2017 Tweet" . Twitter . Consultado el 1 de diciembre de 2017 .
- ↑ "¿Qué es OpenUTAU?" . STUDIO OGIEN . 16 de noviembre de 2021. Archivado del original el 16 de noviembre de 2021. Consultado el 25 de febrero de 2022 .
- ↑ «【UTAU】Intenté cantar una canción original 【Kenka Wakare (Fighting and Breaking Up)】» . 13 de mayo de 2008.
- ↑ "【UTAU】Canción del robot con orejas (Original)【Kasane Teto】" . 10 de junio de 2008.
- ^ "Página Wiki de Utane Uta/Defoko UTAU" .
- ↑ "Kasane Teto "Graduación de la mentira"" (en japonés). Crypton Future Media . Consultado el 2 de octubre de 2010 .
- ↑ " [ Miku Hatsune ] Nyanyanyanyanyanyanya! [ Original Loop ] (el nombre del nico nico vid) puedes ver que en el título aparece "Miku Hatsune", que se refiere a Miku" . 25 de julio de 2010.
Enlaces externos
- (En japonés) Sitio web oficial (versión para macOS)
- (En japonés) Sitio web oficial
- Blog del desarrollador (en japonés)
- Software de 2008
- Instrumentos musicales electrónicos
- Sintetizadores de software para cantar
- Software de síntesis de voz
- Shareware