Cambios en el Modelo OpenAI - Guía de Costos y Uso
- Introducción
- Relación Costo-Precisión
- Niveles de Costo del Modelo (de Mayor a Menor)
- Enfoque en la Rentabilidad
- Enfoque en la Precisión
- Modelos Obsoletos
- ¿Por qué se está Dejando de Utilizar?
- Modelos de Transcripción (Transcripción PBX)
- API de Terminales de Grabación de Llamadas Utilizadas
- Modelos
- Modelos de Texto y Análisis (Análisis PBX)
- API de Terminal de Resumen / Sentimiento Utilizada
- Modelos
- Modelos en Tiempo Real (Llamadas en Vivo y Agentes IA)
- Llamadas a Terminales
- Modelos
- Terminal de Texto
- Modelos
Introducción
Esta guía explica la gama de modelos OpenAI disponibles, sus costos asociados y cómo se debe utilizar cada uno de ellos para llamadas PBX, transcripción, análisis y agentes IA. Los objetivos principales de esta guía se pueden resumir de la siguiente manera:
- Reducir los costos de operación.
- Estandarizar los valores predeterminados.
- Hacer que la selección de modelos sea predecible y comprensible.
Para los usuarios que deseen comparar los modelos y precios de OpenAI con más detalle, OpenAI ofrece una página de referencia oficial: https://developers.openai.com/api/docs/models.
Relación Costo-Precisión
Los modelos más pequeños son más económicos y menos precisos.
- nano < mini < base < versioned < pro
Esta regla se aplica a todas las familias de modelos de OpenAI.
Niveles de Costo del Modelo (de Mayor a Menor)
Enfoque en la Rentabilidad
Estos modelos son seguros para cargas de trabajo PBX de gran volumen, como resúmenes de llamadas, análisis de sentimiento y notas de CRM.
Modelo | Nivel de Costo | Uso Recomendado |
gpt-5.4-nano | Más bajo | Tareas sencillas con un volumen extremadamente alto. |
gpt-5.4-mini | Bajo | Modelo estándar - la mejor relación calidad-precio. |
gpt-5.4-mini está configurado como predeterminado, ya que ofrece la mejor relación precio-calidad.
Enfoque en la Precisión
Este modelo solo debe utilizarse cuando se requiera explícitamente una mayor precisión o razonamiento.
Modelo | Nivel de Costo | Notas |
gpt-5.4 | Alto | Resúmenes avanzados, auditorías de control de calidad. |
Modelos Obsoletos
OpenAI deja de utilizar ciertos modelos a medida que invierte en arquitecturas más nuevas y eficientes.
Referencia: https://developers.openai.com/api/docs/deprecations.
¿Por qué se está Dejando de Utilizar?
- Arquitectura antigua.
- Peor relación costo / rendimiento que el mini actual.
- Más costoso para la misma calidad de salida.
Modelos de Transcripción (Transcripción PBX)
Debido a estos cambios, ahora mostramos la selección de modelos en: Sistema → Integraciones → Transcripción → OpenAI.
Esto permite a los Administradores elegir el modelo de transcripción que mejor se adapte a sus necesidades de calidad y costo.
API de Terminales de Grabación de Llamadas Utilizadas
- v1/audio/transcriptions.
- v1/audio/translations.
Modelos
Modelo | Nivel de Costo | Uso Recomendado |
Whisper | El más barato | Predeterminado para la grabación masiva de llamadas. |
gpt-4o-mini-transcribe | Medio | Mejor formateo. |
gpt-4o-transcribe | Más alto | La más alta calidad de transcripción. |
Whisper sigue siendo la opción más rentable para la transcripción de PBX.
Modelos de Texto y Análisis (Análisis PBX)
API de Terminal de Resumen / Sentimiento Utilizada
- v1/chat/completions.
Modelos
- gpt-5.4 (Predeterminado).
- gpt-5.4-mini.
- gpt-5.4-nano.
Modelos en Tiempo Real (Llamadas en Vivo y Agentes IA)
Puede utilizar los enlaces de "Precios" para comparar las diferencias de costo entre los modelos disponibles.
Llamadas a Terminales
- v1/realtime.
Modelos
gpt-realtime-1-5
Terminal de Texto
- v1/responses.
Modelos
- gpt-5.4-mini (Predeterminado).
- gpt-5.4 (Alta Precisión).
Última Actualización
Este documento se actualizó por última vez el 26 de Mayo de 2026
