Model Gate News

Actualités importantes sur l'IA avec un contexte pratique

Couverture axée sur le lecteur des modèles d'IA, des API, de l'infrastructure, des outils de développement et des changements importants dans la pratique. Les annonces du service client restent dans la zone du compte authentifié.

MG NEWS

Databricks rend les API de gestion Unity Gateway largement disponibles

Databricks a rendu les API Unity Gateway généralement disponibles pour la gestion des services de modèles, des services de fournisseur et des services MCP. Cette version déplace l'administration de la passerelle vers les workflows d'infrastructure en tant que code et de SDK, avec des conséquences pratiques pour les équipes de plate-forme régissant les modèles d'IA et les outils d'agent.

Lire l'actualité →
MG NEWS

Le compactage de l'API Claude transforme la gestion de contextes longs en un problème de compatibilité de passerelle

Anthropic a ajouté la prise en charge de l'API bêta pour les blocs de compactage de conversation signée et l'édition automatique du contexte dans Claude Messages. Le changement donne aux développeurs un moyen plus structuré de maintenir de longues sessions en vie, mais il crée également de nouvelles questions de compatibilité, de traçage et de facturation pour les passerelles et les équipes d'entreprise.

Lire l'actualité →
MG NEWS

Cloudflare AI Gateway fait du routage BYOK uniquement un contrôle de facturation explicite

Cloudflare AI Gateway peut désormais exiger les informations d'identification du fournisseur et bloquer le recours à la facturation unifiée gérée par Cloudflare. Ce changement transforme BYOK d'une convention en une politique de passerelle exécutoire, avec de réelles conséquences pour les revendeurs, les plateformes partenaires et les équipes qui tentent de maintenir les factures IA prévisibles.

Lire l'actualité →
MG NEWS

L'outil shell hébergé d'OpenRouter intègre la facturation d'exécution au routage multimodèle

OpenRouter a introduit un outil d'exécution de shell hébergé et une API de fichiers pour les modèles d'appel d'outils, tarifés en fonction du temps d'exécution du bac à sable plutôt qu'en fonction des jetons uniquement. La version bêta élargit ce qu'une passerelle multimodèle doit mesurer, gouverner et expliquer aux développeurs et agents de construction.

Lire l'actualité →
MG NEWS

Cloudflare AI Gateway ajoute la tarification des jetons de cache à la comptabilité analytique personnalisée

Cloudflare AI Gateway permet désormais aux développeurs de transmettre des taux de jetons de lecture et d'écriture du cache distincts dans les en-têtes de coûts personnalisés. Le changement est important pour les équipes de passerelle, car l'économie des jetons mis en cache ne peut plus être traitée comme une facturation ordinaire des jetons d'entrée sans fausser les marges et les analyses client.

Lire l'actualité →
MG NEWS

L'API Agents d'OpenAI transforme l'orchestration en une surface de plateforme hébergée

OpenAI a introduit l'API Agents en version bêta publique, offrant aux développeurs un moyen hébergé d'exécuter des sessions d'agent en plusieurs étapes avec des outils, la prise en charge de MCP, le compactage du contexte et des sous-agents parallèles. Le lancement modifie ce que les passerelles API, les systèmes d'observabilité et les contrôles d'entreprise doivent suivre.

Lire l'actualité →
MG NEWS

La modification de la facture AI Gateway de Cloudflare redonne la propriété du grand livre d'utilisation aux équipes de passerelle

Cloudflare AI Gateway a modifié les factures d'utilisation mensuelles pour afficher une seule ligne de coût total par modèle et des identifiants de fournisseur/modèle standardisés sur les factures et les journaux. La mise à jour simplifie le rapprochement, mais elle supprime également la granularité des jetons d'entrée/sortie au niveau de la facture, à moins que les équipes ne la conservent elles-mêmes.

Lire l'actualité →
MG NEWS

GPT-6 Astra pose aux équipes API un nouveau problème de migration OpenAI : capacité, prix et compatibilité à la fois

OpenAI a commencé à déployer GPT-6 Astra avec un nouvel ID de modèle d'API, une fenêtre contextuelle d'un million de jetons, des prix publiés et des limites de migration qui suppriment plusieurs contrôles d'échantillonnage familiers. Pour les équipes de passerelles et d’API d’entreprise, le lancement est autant un événement d’intégration qu’une version de modèle.

Lire l'actualité →
MG NEWS

Claude Fable 5.1 fait passer le routage anthropique du choix du modèle à l'économie du cache

Anthropic a publié Claude Fable 5.1 avec un nouvel ID de modèle d'API, une large disponibilité dans le cloud et des lectures de cache beaucoup moins chères. Pour les passerelles IA et les équipes d'entreprise, le lancement n'est pas simplement une autre ligne de modèles : il change la façon dont le contexte répété, l'utilisation de l'API Batch et les niveaux d'accès restreint doivent être tarifés et régis.

Lire l'actualité →