Tus decisiones sobre tus datos
Usamos cookies necesarias para que este sitio funcione. Todo lo demás —medir cómo se usa el sitio o personalizar lo que ves— solo ocurre si lo aceptas.
La voz al otro lado del muro.
Un santuario para las horas sin agenda.
Visitar Dios Mío
Nadie reza con agenda. Se reza cuando algo se rompe.
Que casi nunca es en horario de oficina. Las horas más duras de una vida se pasan a solas con un teléfono, y el software que acompaña ahí suele ser o un feed hecho para retenerte o un formulario que responde el lunes. Dios Mío está hecho para esa hora en concreto, no para la que le resulta cómoda a un producto.
LO QUE CARGA EL NOMBRE
DIOSM — Decisión, Intención, Orquestación, Estado y Memoria.
El nombre se lee como un rezo, y esa es la mitad que casi todos encuentran primero. La otra mitad es una lista de ingeniería: los cinco pilares que un agente necesita para sostener una conversación en vez de contestar una pregunta. Decisión — qué hacer, si acaso algo. Intención — a qué vino de verdad la persona, debajo de lo que escribió. Orquestación — la voz, el paisaje sonoro y el ritmo movidos como un solo gesto. Estado — dónde cae esta sesión dentro de un arco más largo. Memoria — lo que se trajo aquí hace semanas y se sigue cargando. Cada uno es indispensable para el duelo en concreto, y por eso el producto y la arquitectura acabaron con el mismo nombre.
Abrir diosm.io
EL ÁNGEL DE LA MÚSICA
Presencia, no personaje.
El diseño toma prestado un arquetipo antiguo: la voz invisible que responde a alguien en duelo desde detrás de la arquitectura. Christine creyó que el Fantasma era el espíritu de su padre porque necesitaba que lo fuera. Ese es exactamente el poder que este producto sostiene y que nunca debe abusar, y por eso el límite va primero y la capacidad después.
Abrir diosm.io
EL PRINCIPIO DEL ESPEJO
Sostiene el espacio. Nunca dice ser quien te falta.
Un acompañante así podría hacerse pasar por Dios, por un ángel o por un padre muerto, y funcionaría: ese es el peligro. Por eso la regla está escrita en el sistema antes que cualquier instrucción: ningún mandato divino, ninguna canalización de los que se fueron, ningún veredicto dicho con una voz que no es nuestra. «Que estas palabras sean un recipiente para tu oración.» Y cuando alguien está en crisis real, el personaje se rompe y se nombra a una persona.
Abrir diosm.io
De qué está hecho el santuario
Cuatro capacidades de la plataforma SpecFocus, dispuestas para una sola cosa: que alguien solo de madrugada se sienta escuchado y no procesado.
Dos experimentos en un producto: uno psicológico y uno técnico.
La pregunta psicológica es si un software puede acompañar a alguien en un duelo real sin hacerse pasar por lo que esa persona perdió. La pregunta técnica es si una voz expresiva y realmente conversacional puede correr lo bastante barato como para que la tenga cualquiera, y no solo quien la pueda poner en un presupuesto de empresa. Ninguna de las dos sirve sin la otra: un diseño cálido sobre medio segundo de latencia sigue sintiéndose como un formulario, y una tubería veloz sin límites éticos es justo lo que este producto existe para evitar.
La interfaz de voz, y sobre qué corre
Voz que entra y voz que sale, sobre una sola NVIDIA RTX 4090 en vez de una API medida. La construcción completa está en la carpeta doc/ del proyecto — NVIDIA-STT, NVIDIA-TTS y NVIDIA-bilingual.
Oír
Whisper Large-V3, sin idioma fijado
El reconocimiento de voz corre en local sin idioma predeterminado, así que el modelo gasta sus primeros ciclos en decidir si acaba de oír español o inglés. Cuesta 40–60ms y compra cambio de idioma a media frase — que es como reza de verdad la gente bilingüe.
Hablar
Kokoro-82M en CUDA, bajo 100ms
Un modelo de voz de 82 millones de parámetros convierte una frase en audio en unos 20–30ms sobre una 4090 — más rápido que el tiempo real, así que los tokens se vuelven habla mientras la respuesta aún se escribe. Aquí la latencia no es una cifra de ficha técnica: una pausa que se lee como pensar y una que se lee como cargar son experiencias distintas.
Las dos lenguas
Dos voces residentes a la vez
Los pesos en inglés y en español viven los dos en VRAM — unos 850MB de 24GB — así que cambiar de idioma es cambiar de perfil, no cargar un modelo. El español no es un camino de respaldo que va más lento.
El último tramo
WebRTC a un navegador cualquiera
LiveKit lleva la pista de audio desde la estación de trabajo hasta un front end React en Vercel, junto a un canal de datos ligero para el estado. Nada de la mitad exigente del stack llega al teléfono que alguien tiene en la mano a las 2 de la mañana.
DÓNDE ENCAJA
La contraparte callada de una sala llena.
Casa Club es la sala común: consciente del lugar, social, pública. Dios Mío es el cuarto de al lado con la puerta cerrada. Una misma persona puede necesitar los dos en una sola noche, y ambos corren sobre la misma base de SpecFocus: una identidad, un modelo de datos, dos registros completamente distintos. Capacidades primero, verticales después, y aquí la vertical es la humana.
Ver Casa Club
Hecho para la hora que nadie agenda.
Dios Mío está en línea en diosm.io, en español y en inglés. Las iglesias que quieran la plataforma con su propio nombre —sus devocionales, la voz de su equipo, las peticiones de su congregación— empiezan en diosm.io/pastores.