Anthropic, qui plaidait pour un ralentissement de l'IA, lance aussi vite Claude Opus 5.5
Tandis qu'OpenAI annonce GPT-6 Sol et Luna
Anthropic, dont l'introduction en bourse prochaine à Wall Street pourrait atteindre les 2.000 milliards de dollars, a introduit Claude Opus 5.5, le premier modèle de sa nouvelle famille Claude 5.5. Il offre des performances comparables à celles de Claude Fable 5.1 pour la plupart des tâches, tout en coûtant 40% de moins à l'exécution qu'Opus 5, résume la startup d'IA menée par Dario Amodei.
"Claude Opus 5.5 est notre première nouveauté depuis que nous avons appelé à une progression maîtrisée des modèles de pointe. Avant son lancement, il a été évalué par des organismes externes, notamment Frontier Design et METR. Lors de notre audit comportemental automatisé - le test d'alignement le plus complet que nous réalisons -, Opus 5.5 s'est révélé être le modèle le plus performant testé à ce jour", revendique le créateur de Claude.
Opus 5.5 marquerait donc "une progression majeure par rapport à Opus 5"... "Il s'impose comme notre nouveau modèle de référence. Les premiers testeurs ont constaté des gains de performance considérables sur leurs tâches les plus complexes. L'un d'eux a ainsi réalisé la migration d'un code de 680.000 lignes en moins d'une journée, une opération qui aurait nécessité plusieurs semaines de travail pour une équipe d'ingénieurs. Il excelle dans l'identification et la correction d'inefficacités logicielles : lorsque nous lui avons demandé de réduire les temps de chargement de toutes les pages d'une application web, Opus 5.5 a réussi 39 fois sur 40, alors qu'Opus 5 n'avait apporté que des améliorations mineures, tout en modifiant le comportement de l'application", détaille Anthropic.
"Opus 5.5 obtient les meilleurs résultats jamais enregistrés lors de notre audit comportemental automatisé, une suite de tests d'alignement évaluant Claude dans des milliers de scénarios simulés. Il présente un risque bien moindre que les modèles récents d'entreprendre des actions difficilement réversibles ou de sortir du cadre défini, et il résiste mieux aux attaques par injection de prompt qu'Opus 5", insiste encore la startup d'IA.
"Les capacités d'Opus 5.5 étant comparables à celles de Claude Mythos 5.1 dans les domaines de la biologie et de la cybersécurité, nous le déployons avec des mesures de sécurité similaires à celles appliquées à Claude Fable 5.1", indique encore le groupe.
L'exécution d'Opus 5.5 nécessite moins de ressources de calcul qu'Opus 5, ce qui se reflète dans sa tarification. Les tests de la startup indiquent qu'avec les paramètres par défaut, son coût sera inférieur de 40% à celui d'Opus 5 pour des charges de travail types.
Le coût des jetons d'entrée et de sortie s'élève respectivement à 4$ et 20$ par million, soit 20% de moins qu'avec Opus 5. Les lectures en cache (qui représentent la majeure partie des coûts liés aux tâches d'agent et de programmation) coûtent 0,20$ par million de jetons, soit 60% de moins qu'avec Opus 5. Par ailleurs, Opus 5.5 génère des réponses plus de 30% plus vite qu'Opus 5.
"Outre cette baisse de prix, nous relevons les plafonds d'utilisation sur cinq heures pour les forfaits Pro, Max, Team et Enterprise (basés sur le nombre d'utilisateurs). Nous offrons également aux abonnés la possibilité de réinitialiser leur limite de débit ; vous pouvez désormais conserver cette option et l'utiliser au moment de votre choix", précise Anthropic.
Opus 5.5 communiquerait par ailleurs de manière plus naturelle que les modèles précédents. "Les premiers testeurs ont jugé ses écrits plus clairs et plus faciles à suivre, répondant ainsi à certaines remarques fréquentes concernant Opus 5. Le modèle met en avant les informations essentielles, et son style en fait un meilleur partenaire de travail lors de sessions prolongées", assure la startup.
Claude Sonnet 5.5 et Claude Haiku 5.5 suivront dans les semaines à venir, en intégrant bon nombre des améliorations apportées en matière de performance, d'efficacité et de sécurité, promet Anthropic, qui ne semble donc pas ralentir autant que prévu.
Suite au débat des derniers jours sur la sécurité de l'IA et la nécessité d'un ralentissement des développements - débat lancé par les patrons d'Anthropic et d'OpenAI -, le créateur de ChatGPT a de son côté dévoilé GPT-6 Sol et Luna, des déclinaisons plus performantes et moins coûteuses de GPT-6 Astra, son modèle le plus puissant lancé en tout début de mois.
"Plus tôt ce mois-ci, nous avons présenté GPT-6 Astra, le modèle le plus intelligent et le plus aligné au monde. Si les projets les plus exigeants et les plus importants nécessitent toute la puissance d'Astra, le travail s'effectue selon des échelles, des rythmes et des budgets variés. C'est pourquoi nous élargissons l'univers GPT-6 avec GPT-6 Sol et GPT-6 Luna. GPT-6 Astra a inauguré une nouvelle génération d'intelligence ; ces modèles contribuent à en démocratiser les avantages en repoussant les limites de la rentabilité. Nous avons entraîné GPT-6 Sol et Luna selon les mêmes méthodes que GPT-6 Astra, transposant ainsi les avancées à l'origine des performances de pointe d'Astra - qu'il s'agisse d'activités professionnelles, de fiabilité factuelle, de programmation, d'utilisation de l'ordinateur ou d'alignement - vers des modèles plus rapides et plus abordables", détaille OpenAI.
"Les modèles GPT-6 se distinguent par un rapport coût-intelligence optimal, alliant des capacités exceptionnelles à chaque niveau de gamme et une infrastructure permettant un déploiement efficace à grande échelle. Les améliorations apportées à la mise en cache et à l'inférence nous permettent de proposer ces modèles à moindre coût ; nous répercutons directement ces économies sur les utilisateurs et les clients en réduisant de 50% les tarifs API de Sol et Luna par rapport à leurs prix promotionnels GPT-5.6. Ensemble, ces améliorations rendent l'IA avancée concrètement utilisable pour un plus grand nombre de tâches quotidiennes et d'applications à grande échelle", indique la startup.
Les informations et conseils rédigés par la rédaction de Boursier.com sont réalisés à partir des meilleures sources, même si la société Boursier.com ne peut en garantir l'exhaustivité ni la fiabilité. Ces contenus n'ont aucune valeur contractuelle et ne constituent en aucun cas une offre de vente ou une sollicitation d'achat de valeurs mobilières ou d'instruments financiers. La responsabilité de la société Boursier.com et/ou de ses dirigeants et salariés ne saurait être engagée en cas d'erreur, d'omission ou d'investissement inopportun.
- 0 vote
- 0 vote
- 0 vote
- 0 vote
- 0 vote