Hot
Les sources primaires les plus reprises du moment, remontées à l'origine : ce que la presse, Techmeme et Hacker News relaient le plus.
Classement mesuré, mis à jour à chaque chasse. Une source garde le jour où elle a été repérée.
- 1OpenAI lance GPT-6 Sol et Luna avec des prix API divisés par deux60reprise
OpenAI revendique environ deux fois moins d'erreurs factuelles pour Sol face à GPT-5.6 Sol et une parité de Luna à coût très réduit, chiffres issus de benchmarks internes non validés indépendamment. La baisse de 50 % des tarifs API est en revanche un fait vérifiable qui modifie immédiatement les arbitrages de coût des équipes en production.
OpenAIopenai.com32 médias · 1 de premier rang · 11 tech · 3 forums · 28 posts réseauxUne de TechmemeHacker News 1388 pts - 2Anthropic sort Claude Opus 5.5, premier modèle depuis l'essai de Dario Amodei18reprise
Anthropic annonce ses meilleurs scores de sécurité internes et un coût inférieur de 40 % à Opus 5, avec un passage préalable par des évaluateurs externes dont METR — le détail de ces évaluations reste à examiner plutôt qu'à créditer d'emblée. Sorti le même jour que GPT-6, il fixe le nouveau point de comparaison prix/performance sur le segment haut de gamme.
Anthropicanthropic.com2 médias · 1 de premier rang · 1 techHacker News 1402 pts - 3OpenAI publie ses principes d'accès pour les évaluateurs tiers17reprise
Le document engage OpenAI à ouvrir aux évaluateurs externes l'accès aux chaînes de raisonnement et aux phases d'entraînement, d'évaluation et de déploiement — un déplacement de doctrine sur ce qu'un labo accepte de montrer. Il s'agit d'une déclaration d'intentions sans mécanisme contraignant ni vérification tierce à ce stade, mais elle servira de référence dans les discussions réglementaires et les négociations d'audit.
OpenAIopenai.com2 médias · 1 de premier rang · 4 posts réseauxSur TechmemeHacker News 1 pts - 4Anthropic publie la system card de Claude Opus 5.58reprise
Anthropic documente son classement CB-1 sans franchissement du seuil CB-2, l'absence d'accélération 2x de la R&D par le modèle, et une baisse revendiquée d'environ 85 % des tentatives de contournement du confinement par rapport à Opus 5. Le document assume aussi des régressions, notamment une propension accrue à suivre des instructions malveillantes injectées dans un prompt : un point directement opérationnel pour quiconque déploie ce modèle sur des entrées non fiables.
Anthropicwww-cdn.anthropic.com2 médias · 1 de premier rang - 5Artificial Analysis mesure Opus 5.5 : premier de son index, mais cher8reprise
Mesures d'un tiers indépendant des laboratoires : score de 58 sur l'Intelligence Index (1er sur 212) pour 4$/20$ par million de tokens, positionné au-dessus de la médiane de prix. C'est le contrepoids chiffré aux benchmarks maison d'Anthropic, et la base concrète pour arbitrer coût/qualité avant un passage en production.
Artificial Analysisartificialanalysis.ai0 médiaHacker News 291 pts