現場でモコボイスを使う様子

Con la confianza de empresas e instituciones líderes

  • 大阪府立病院機構
  • 広島大学
  • 公益財団法人 颯田医学奨学会
  • 株式会社ロココ
  • askhub
  • 白河商工会議所
  • トヨタカローラネッツ岐阜
  • 医療法人社団親和会
  • 九州産業運輸株式会社

IA de reconocimiento de vozcreada para ruidoy términos técnicos.

Demuestra precisión en reuniones largas, con términos técnicos y en entornos ruidosos

Transcripción en entornos ruidosos

Tasa de precisión de caracteres para 1 hora de audio · Más alto es mejor

Transcripción del audio de muestra (común a todas las condiciones)

Audio de 1 hora · Leyendo guión

Hoy, con respecto al primer caso, nos gustaría proceder con un examen detallado del préstamo desde la perspectiva de la gestión de crédito. El objetivo es una empresa de fabricación de autopartes, que busca fondos para una nueva inversión de capital.

10x ruido: mocoVoice 86.56%, Gemini 3.1 Pro 57.25%, GPT-transcribe 46.73%, Whisper large-v3-turbo 71.99%

Términos técnicos durante largas duraciones

Tasa de recuperación de términos técnicos · Más alto es mejor

8 horas (622 ocurrencias): mocoVoice 90.84%, Gemini 3.1 Pro 0.16%, GPT-transcribe 66.88%, Whisper large-v3-turbo 50.32%

Evaluado añadiendo ruido artificial a 1 hora de audio y especificando un diccionario de 100 palabras. La tasa de precisión de caracteres es del 100% menos la tasa de error de caracteres (CER). El multiplicador de ruido es la relación de potencia con el audio.

Términos técnicos: Sin diccionario ni ruido añadido. Tasa de recuperación basada en la frecuencia de 100 palabras fijas. Evaluado con audio sintético de múltiples industrias. Gemini experimentó omisiones en transcripciones durante audios largos, reduciendo la tasa de recuperación de términos técnicos.

2026.09.08 / Comparado utilizando audio sintético para las industrias financiera, médica, de construcción y manufacturera

Transcripción

Transcriba quién dijo qué, incluso en lugares ruidosos.

Demostración de carga de archivos de audio y video usando mocoVoice

Click to expand

View use cases and features
Use cases
Grabe y guarde instantáneamente los traspasos de turnos, las reuniones informativas matutinas y los reportes de campo.
Key features
Cancelación de ruido・Separación de hablantes・Vocabulario personalizado

Actas y reportes

Formateado en sus actas y reportes habituales.

Demostración de selección de una marca de tiempo del hablante y revisión de su transcripción de respaldo

Click to expand

View use cases and features
Use cases
Revise rápidamente los pasos de resolución de problemas anteriores o los historiales de traspaso de proyectos.
Key features
Búsqueda cruzada RAG・Audio original・Control de acceso

Búsqueda RAG

Busque comentarios anteriores, verifique con el audio original.

Demostración de búsqueda de registros acumulados mediante búsqueda cruzada RAG

Click to expand

View use cases and features
Use cases
Identifique problemas recurrentes en reuniones y sitios para informar estrategias de gestión y planes de mejora.
Key features
Análisis cruzado・Extracción de temas・Enlaces de origen

CONCEPTO

Voice Lakehouse

Grabaciones directamente a actas,
reportes y búsqueda RAG.

Acumule audio de reuniones y de campo y conviértalo en actas y reportes diarios. Busque en lenguaje sencillo para extraer el comentario exacto junto con su audio original.

Voice Lakehouse
Handovers
On-site Meetings
Work Reports
Business Meetings & Interviews
Auto-generated minutes & reports
RAG search
Original audio playback

El uso es increíblemente sencillo.

Ver el video tutorial

CONFIANZA

IA de transcripción y actas en producción

Ejemplos de actas y reportes diarios generados a partir de audio en sitios de atención médica, manufactura y construcción.

CARACTERÍSTICAS

Encuentre rápidamente quién dijo qué.

Búsqueda cruzada RAG

Busque en reuniones anteriores y llamadas de ventas. Recupere instantáneamente 'quién dijo qué, cuándo' sin buscar en los archivos.

Ejemplo de pantalla de búsqueda cruzada RAG

Separación e identificación de hablantes

Separa automáticamente los hablantes y estima sus nombres. Resuelva disputas de 'él dijo, ella dijo' con registros concretos.

Imagen de asignación de nombres de hablantes a los participantes de la reunión

Audio de larga duración

Procese sesiones de capacitación de todo el día o registros de campo de un día completo sin la molestia de dividir archivos.

Diagrama que muestra soporte para grabaciones de más de 8 horas

Diccionario especializado

Registre la jerga específica del campo. El sistema aprende de las correcciones para alinearse con la terminología preferida de su empresa.

Comparación de antes y después de registrar términos especializados

Formatos de resumen personalizados

Simplemente cargue su formato estándar de actas. Minimice el formato manual mientras crea documentos fáciles de compartir.

Ejemplo de pantalla de formato de resumen personalizado

Verificación de origen

Haga clic en cualquier parte del resumen para saltar directamente al audio de origen. Verifique los hechos antes de compartir.

Ejemplo de pantalla de verificación de origen

Traducción a 99 idiomas

Reconoce conversaciones que mezclan japonés, inglés y chino, haciéndolas compartibles con centros en el extranjero y personal internacional.

Imagen de idiomas compatibles

Gestión organizacional

Gestione el uso y el acceso por centro, departamento o proyecto. Comience con algo pequeño en un departamento y escale sin problemas a toda la empresa.

Ejemplo de pantalla de gestión organizacional

Grabación en entornos ruidosos

Asistencia con la selección de equipos de grabación para garantizar un audio claro en fábricas y sitios de construcción.

Grabación en navegador

Comience a grabar instantáneamente desde su navegador, sin necesidad de aplicación.

Exportación a Word / PDF

Exporte en formatos que son fáciles de distribuir y editar.

Notificaciones de Slack y correo electrónico

Reciba notificaciones instantáneas al finalizar para evitar que se olvide de compartir.

Modelo médico

Codesarrollado con el Hospital de la Universidad de Hiroshima. Reconoce nombres de enfermedades y medicamentos.

Consulta on-premises

Consúltenos para la implementación on-premises para cumplir con estrictos requisitos de seguridad.

PLANES

Transcriba su próxima reunión.

Pruébelo primero

No se requiere tarjeta de crédito

14 días gratis

¥0

  • Tiempo de transcripción ilimitado
  • Acceda a todas las funciones de IA
  • Alquiler gratuito de equipos de grabación
  • Incluye soporte operativo
Probar gratis

De departamento a toda la empresa

Plan Enterprise

Precios personalizados

Adaptado a su número de usuarios y tiempo de grabación. Nos asociamos con usted desde la recopilación de requisitos hasta la adopción total.

  • Uso compartido seguro entre equipos
  • Búsqueda RAG de audio pasado
  • Exportación a plantillas de la empresa
  • Soporte específico de la industria
Contáctenos

Comience solo

Plan Starter

¥690 / mes

Cree una cuenta, luego suscríbase desde dentro de la aplicación.

  • Hasta 200 min por mes
  • Límites en IA de actas, IA de traducción, etc.
  • Para uso individual
Crear una cuenta
モコボイス オンプレ機器が入った専用ボックス

IA de actas on-premise,lista en tan solo 5 días hábiles.

Un mocoVoice on-premise de nueva construcción para organizaciones que no pueden usar la nube, disponible a partir de agosto de 2026.

  • Alta seguridad
  • Para sitios de trabajo fuera de línea
  • Modelo médico disponible
Discutir la prueba

DOCUMENTO

Obtenga una imagen completa del
despliegue en primera línea en un solo folleto.

Un resumen conciso de todo lo que necesita para su revisión interna.

Portada del folleto de producto mocoVoice

Características, casos de éxito,
y seguridad

Descargar gratis →

Preguntas frecuentes

Q.¿En qué se diferencia esto de ChatGPT o Gemini?+

Si bien ChatGPT y Gemini sobresalen en la recuperación de información de propósito general y la generación de texto, mocoVoice es una IA centrada en la voz optimizada para la construcción y búsqueda de conocimiento organizacional, vinculando el audio de primera línea con el texto transcrito.

Ofrecemos una solución integral desde IA específica del campo —incluido nuestro modelo médico codesarrollado con el Hospital de la Universidad de Hiroshima— hasta el software en sí. Más allá del manejo de terminología especializada y formatos de exportación personalizados, mocoVoice se integra perfectamente en los flujos de trabajo reales con un sólido control de acceso y funciones de uso compartido en equipo.

La ventaja más significativa es la capacidad de acceder instantáneamente a los 'datos de audio de origen' directamente desde los resultados de búsqueda de RAG o las actas generadas por IA. Esto minimiza el riesgo de alucinaciones de IA y respalda las decisiones respaldadas por datos primarios confiables.

Q.¿Se puede utilizar en entornos ruidosos?+

Sí. mocoVoice es una IA de reconocimiento de voz diseñada específicamente para la primera línea, no solo para salas de conferencias silenciosas. Se utiliza activamente en entornos de construcción, manufactura y salud. Para condiciones particularmente difíciles, ofrecemos alquileres gratuitos de equipos de grabación adecuados durante su prueba, para que pueda evaluar la precisión con su propio audio de campo antes de decidir.

Q.¿En qué se diferencia de una herramienta de transcripción de reuniones de IA estándar?+

mocoVoice es un servicio de IA de reconocimiento de voz diseñado para flujos de trabajo de primera línea. Más que una simple herramienta de resumen de IA, apoya de manera poderosa las operaciones en los departamentos y centros, especialmente en campos como la salud, la construcción y las finanzas, donde la terminología especializada es constante.

Proporcionamos todas las funciones necesarias para la implementación en el mundo real en un solo lugar: diccionarios especializados, un modelo médico, plantillas de reuniones personalizadas, separación de hablantes, cancelación de ruido, consulta de equipos, control de acceso estricto y búsqueda cruzada RAG.

El mayor diferenciador es que siempre puede acceder al 'audio de origen original' que respalda los resultados generados por IA. Esto permite una verificación precisa y una toma de decisiones basada en información primaria altamente confiable, en lugar de depender de suposiciones de IA.

Q.¿Qué tan preciso es mocoVoice?+

Alcanza una tasa de precisión del 95.16% en un conjunto de datos del sector financiero privado (utilizando el modelo general, al 7 de julio de 2025). Incluso en campos con mucha jerga como la salud, la construcción y las finanzas, la precisión se puede mejorar aún más mediante el registro automatizado de diccionarios y el ajuste específico de casos de uso.

Q.¿Puede manejar terminología especializada en salud, construcción, etc.?+

mocoVoice logra una alta precisión en diversas industrias utilizando un algoritmo de comprensión de contexto patentado. Para sustantivos propios e incluso una comprensión más profunda de la jerga, admitimos el registro de diccionarios automatizado y formatos de resumen personalizados. Para el campo médico, ofrecemos un modelo médico dedicado disponible durante la prueba. Recomendamos encarecidamente probarlo con su audio de campo real durante una prueba.

Q.¿Puedo usar mi propio equipo de grabación?+

Sí, puede usar una PC, un teléfono inteligente o archivos de audio existentes. Si necesita una grabación estable en salas de conferencias o en el lugar, puede elegir y usar sus propios dispositivos de grabación.

Q.¿Apoyan la transcripción de archivos M4A?+

Sí. Admitimos una amplia gama de formatos de archivo, incluidos M4A, MP4 y MOV. Puede cargar y transcribir fácilmente grabaciones de teléfonos inteligentes, audio de grabadoras de voz y archivos de video de reuniones web.

Q.¿Ofrecen un programa de agencia/revendedor?+
Agradecemos las consultas de agencias y socios de ventas. Para obtener detalles sobre los términos y propuestas de ventas, contáctenos a través del Formulario de contacto.