Conecta con nosotros

Noticias

Snowflake ofrecerá selección dinámica de modelos de IA en Cortex AI Gateway

Publicado el

Snowflake ofrecerá selección dinámica de modelos de IA en Cortex AI Gateway

Snowflake ha anunciado que ofrecerá enrutado dinámico de modelos de IA dentro de Cortex AI Gateway y de sus principales productos de IA. Para facilitar esta selección de modelo, además, va a ampliar su catálogo para integrar los principales modelos abiertos. Esto permitirá además que la compañía ofrezca una gama de modelos más amplia, tanto propietarios como de código abierto.

De esta manera, los usuarios de sus herramientas podrán optimizar su gasto al utilizar modelos de IA y mejorar la eficiencia de la inteligencia, una métrica que mide la eficacia con que las empresas convierten la capacidad de cómputo, los modelos de IA, sus datos y el contexto del del negocio en valor real.

Con la incorporación del enrutado dinámico de modelos, Snowflake Cortex AI Gateway puede elegir de forma automática el modelo concreto que ofrezca en cada caso y para cada tarea el mejor equilibrio entre calidad y coste. Este enrutamiento también está integrado en otros productos de Ia de Snowflake, como Coco y CoWork, y disponible también para agentes de IA de terceros que usen Cortex AI Gateway.

Esta nueva función redirige las tareas repetitivas o menos complejas a modelos más eficientes, mientras que los trabajos que precisan más capacidad de razonamiento se enrutan a modelos de frontera. Esto permite rebajar el gasto, y evitar costes innecesarios en inferencia, sin tener que gestionar la selección del modelo para cada petición.

Snowflake ampliará además el acceso de los clientes a los principales modelos abiertos a través de Snowflake Cortex AI, como DeepSeek-V4-Flash 0731 y GLM-5.3. Esto sumado a los modelos ya disponibles a través del servicio, con los datos gobernados dentro de Snowflake. Entre otros, la compañía ofrece a través de distintas herramientas de IA modelos de OpenAI, Anthropic, Google, Mistral, SpaceX AI y Meta.

El enrutado dinámico de modelos en Cortex AI Gateway está pensado para que las empresas usen modelos de frontera costosos solo cuando mejoren notablemente un resultado en CoCo, CoWork y agente de IA de terceros. Aparte de elegir automáticamente un modelo para cada solicitud, el enrutamiento dinámico de modelos permite a los clientes controlar qué modelos y proveedores están disponibles.

Esto es especialmente importante para multinacionales que deben gestionar la disponibilidad regional de modelos, así como para compañías de sectores regulados con requisitos de cumplimiento específicos.

A medida que cambian el rendimiento y los precios de los modelos, Cortex AI Gateway puede actualizar las decisiones de enrutado en os productos de IA de Snowflake, como CoCo y CoWork. Así, sus clientes no tiene que rediseñar sus aplicaciones o sus agentes. Además, podrán aprovechar nuevos modelos a medida que aparezcan. Snowflake se encarga de gestionar la complejidad de la elección y de la optimización del modelo en segundo plano.

En vez de tratar cada lanzamiento de modelo abierto como una integración independient, Snowflake está creando un entorno diseñado para estar al día con el ecosistema de modelos abiertos. La compañía valora y optimizar de manera continua cómo se sirven y usan estos modelos en sus productos de IA, lo que lleva a sus clientes a poder usar modelos más nuevos y capaces, con la aplicación de controles de acceso y gobernanza consistentes, tanto en modelos abiertos como en propietarios.

Cortex AI Gateway ofrece además a los administradores visibilidad del uso de tokens y costes. También permite establecer límites de gasto en todas las aplicaciones y agentes de IA. Snowflake Coco amplía estos controles a través del marco de etiquetado y acceso basado en roles de Snowflake. Así, los administradores pueden definir modelos predeterminados, atribuir el consumo a equipos o centro de coste, establecer cuotas por usuario y recibir notificaciones a medida que el consumo se acerca a los límites establecidos.

Sridhar Ramaswamy, CEO de Snowflake, ha destacado que «las empresas son cada vez mucho más rigurosas con respecto a los costes y la rentabilidad de la IA. La cuestión ya no es cuánta IA están utilizando, sino si esa IA se traduce en un valor empresarial significativo. Alcanzar la eficiencia de la inteligencia requiere la flexibilidad de utilizar el mejor modelo para cada tarea a medida que evoluciona el panorama. El papel de Snowflake es absorber esa complejidad para que los clientes puedan centrarse en los resultados mientras nosotros optimizamos la elección del modelo en segundo plano».

Redactora de tecnología con más de 15 años de experiencia, salté del papel a la Red y ya no me muevo de ella. Inquieta y curiosa por naturaleza, siempre estoy al día de lo que pasa en el sector.

Lo más leído