OpenAI lanzó GPT-4o mini en silencio — el modelo rápido y barato
OpenAI lanzó en silencio GPT-4o mini, una versión más chica, más rápida y más barata de su modelo principal GPT-4o. Corre 60% más rápido que GPT-4o y cuesta 80% menos por token. Ya está disponible por la API de OpenAI y en la app web de ChatGPT, y le gana a GPT-3.5 Turbo en benchmarks de razonamiento, matemáticas y código.
Para una startup como la mía que corre un negocio paralelo, este es el tipo de cambio que le da vuelta a los márgenes de la noche a la mañana. Con ventanas de contexto de 20K, puede leer y resumir un PDF de 300 páginas en segundos. Para el tipo de trabajo que hacemos — triage de tickets de soporte, redactar emails, sacar data de spreadsheets — la velocidad y el precio lo hacen la opción práctica sobre el modelo principal para la mayoría de las tareas del día a día.
Por qué nos importa: los modelos chiquitos que cuestan centavos son la infraestructura silenciosa detrás de los side hustles, las tiendas de la comunidad usando AI para manejar el servicio al cliente, las abuelas que por fin pueden pedirle al teléfono que traduzca una nota del doctor. Esta es la clase de herramienta que hace que la AI sea accesible para la gente, no solo para las big companies con big budgets.
“Más barato y más rápido que el modelo principal — justo el tipo de cambio que redefine quién puede permitirse usar AI.”