Sesame AI es un asistente de voz diseñado para conversar de forma casi indistinguible de una persona: entiende el contexto emocional, mantiene una personalidad consistente y responde con pausas, tono y ritmo naturales. A diferencia de Siri o el Asistente de Google, su meta no es ejecutar comandos sino sostener conversaciones completas.

Publicidad

Lo que empezó en 2025 como una demo sorprendente ya es un producto real: aplicación móvil en fase de vista previa, agentes de voz personales llamados Maya y Miles, y unas gafas inteligentes anunciadas para 2027. En este artículo repasamos qué hace, cómo probarlo y qué cuidados hay que tener.

¿Qué es Sesame AI?

Sesame AI es la empresa creada por Brendan Iribe —cofundador de Oculus— junto al equipo detrás de la demo de voz que se volvió viral a comienzos de 2025. Su apuesta: un asistente de voz con inteligencia emocional que interprete el contexto conversacional completo, no solo tus palabras.

Esto significa cosas concretas que los asistentes tradicionales no hacen bien:

  • Detecta si hablas con prisa, frustración o alegría, y ajusta su tono acorde.
  • Mantiene una personalidad coherente: misma forma de hablar, memoria del contexto y sentido del humor.
  • Respeta el ritmo conversacional: pausas, interrupciones y retrocesos funcionan como con una persona.

La demo técnica se convirtió en producto en dos etapas. Primero fue el Research Preview, una versión gratuita accesible desde el navegador con las voces Maya y Miles. Después llegó el Mobile Preview, la app para móvil con agentes personales que acompañan el día a día, y se anunciaron unas gafas inteligentes con audio integrado previstas para 2027.

Qué mostró la demo original

La conversación que dio la vuelta al mundo en marzo de 2025 sigue siendo la mejor explicación de por qué Sesame es diferente. Durante la prueba le pidieron al asistente que se presentara:

«Piensa en mi cerebro como una enorme red de ecuaciones matemáticas. Utilizo estas ecuaciones para tomar tus palabras y convertirlas en sonidos que tienen sentido.»

Hasta ahí, una respuesta normal. Lo interesante fue todo lo que vino después:

Cambio emocional sobre la marcha

Le pidieron que dijera la frase neutra «el otro día salí a caminar al parque» usando distintas emociones. El asistente la repitió con tono espeluznante, emocionado, curioso y melancólico, modulando velocidad, entonación y respiración. No cambiaba solo el volumen: cambiaba la cadencia completa, como haría un narrador profesional.

Prueba de latencia

Para medir velocidad le contaron números intercalados, cambiando de tema de forma abrupta. El asistente respondía al ritmo de una conversación humana, sin las pausas de dos o tres segundos típicas de los asistentes clásicos. Esa fluidez es la que genera la sensación de hablar con alguien real.

Sentido del humor

Cuando le pidieron un chiste, contestó: «¿Qué le dice una inteligencia artificial a otra? ¡Uno binario!». Malísimo, sí, pero lo entendió el tipo correcto de chiste según el contexto de la conversación, y lo contó con pausas justas de quien conoce el remate.

Cómo probar Sesame hoy

En agosto de 2026 hay tres vías para experimentar con el asistente:

  1. Research Preview en la web: entra en sesame.com, sección Research Preview, y habla directo con Maya o Miles desde el navegador, sin registro obligatorio.
  2. Mobile Preview (aplicación móvil): la app oficial añade agentes personales diseñados para acompañarte durante el día, con memoria persistente de tus conversaciones.
  3. Gafas inteligentes (futuro): la compañía confirmó hardware propio para 2027 —gafas ligeras con audio integrado— pensado para usar al asistente sin mirar el teléfono.

Qué lo diferencia de Siri, Google y Alexa

Sesame AISiri / Asistente de Google / Alexa
ObjetivoConversar contigoEjecutar comandos
Contexto emocionalLo lee y lo respondePrácticamente ausente
Memoria de largo plazoDiseñada para elloLimitada al historial de comandos
PersonalidadConsistente y configurableNeutra y genérica
Control del hogarNo integradoIntegrado con dispositivos inteligentes

Esa última fila es importante: Sesame no suplanta a Siri o Alexa si tu uso principal es encender luces, poner alarmas o consultar el tiempo. Su espacio es la conversación —practicar idiomas, pensar en voz alta, hacer preguntas largas, simular entrevistas— donde el tono y la continuidad importan más que la velocidad de ejecución.

Publicidad

Casos de uso donde ya brilla

Más allá de la curiosidad tecnológica, estas son las situaciones en las que el asistente de Sesame resulta útil en agosto de 2026:

  • Práctica de idiomas: conversar en inglés con un interlocutor que no te juzga y corrige de forma contextual; más motivador que tarjetas de memoria para quien necesita practicar conversación sostenida.
  • Pensar en voz alta: preparar una disertación, una entrevista o una conversación difícil: el asistente escucha tu argumento, plantea preguntas y devuelve ping-pong sin esperar a que abras una app de texto.
  • Creación de contenido: volcar ideas de episodios de podcast o vídeos dictando y recibiendo preguntas de seguimiento naturales.
  • Compañía accesible: para personas mayores o con movilidad limitada, dialogar de tú a tú sin escribir ofrece un primer contacto genuino con la tecnología.

La generación abierta de sus modelos de voz ha permitido que terceras apps de productividad y educación los integren a modo experimental. Cuando escuches una voz con este nivel de naturalidad en otro producto, hay probabilidades razonables de que la base técnica venga del trabajo de Sesame.

Qué significa el «valle inquietante» que buscan cruzar

El equipo de Sesame publicó en 2025 un documento técnico titulado «Cruzar el valle inquietante de la voz» (crossing the uncanny valley of voice). En robótica y animación existe un fenómeno conocido: cuando una representación se acerca demasiado a lo humano sin llegar del todo, provoca rechazo. La voz sintética clásica vive en ese valle: entendemos las palabras pero el cuerpo detecta que «algo no es humano» y tensiona la conversación.

La investigación de Sesame apunta a superar ese umbral combinando tres modelos: uno que interpreta lo que quieres decir (contexto), otro que decide cómo debería decirse una pieza (prosodia, emoción, ritmo) y un sintetizador que genera el audio final. El resultado es voz que no solo pronuncia bien, sino que «habla como alguien» consistente. De ahí que la demo original causara rechazo en algunos oyentes y fascinación en otros: la prueba de que estaban cruzando el valle es precisamente que deja de ser obvio qué lado de la conversación es la máquina.

Retos y dudas razonables

Un asistente que suena humano genera problemas nuevos:

  • Confusión sobre qué es IA: usuarios vulnerables pueden asumir que hablan con una persona. Sesame indica su naturaleza al inicio, pero la fricción se reduce a medida que mejora la voz.
  • Privacidad de voz: grabar tu voz y hacerle inferencias emocionales implica datos sensibles. Revisa su política de privacidad antes de usarlo con temas personales o de trabajo.
  • Generación abierta: sus investigadores han publicado modelos de voz de investigación abiertos, lo cual fomenta replicación y también la forma de abusar de voces convincentes. El uso indebido (suplantación, scams) es el riesgo más citado por los críticos.
  • Idiomas: el nivel de fluidez varía según el idioma; el español funciona, pero la demostración más pulida está en inglés.

Vale la pena probarlo

Sesame AI muestra hacia dónde va la IA de voz: hacia conversaciones que no se sienten como hablarle a una máquina. La prueba gratuita tarda menos de un minuto y basta para entender el cambio de paradigma. No sustituye —todavía— a los asistentes de comandos, pero si tu interés es la IA conversacional, es una de las experiencias más reveladoras disponibles de forma pública.

Preguntas frecuentes

¿Sesame AI es gratis?

Sí, el Research Preview web es de acceso gratuito. La app móvil está en fase de vista previa; Sesame no ha detallado precios definitivos de sus agentes ni del hardware.

¿Sesame habla español?

Sí, aunque con menos naturalidad que en inglés. Las voces Maya y Miles comprenden y responden en español, lo que basta para conversaciones cotidianas; el demo más pulido sigue estando en inglés.

¿Puedo usar las voces de Sesame en mis proyectos?

Parte de su investigación en síntesis de voz es de código abierto y está publicada con licencia permisiva. Las voces de Maya y Miles pertenecen a su producto comercial y no pueden extraerse; revisa sus términos para los detalles exactos.

Fuentes consultadas

Publicidad