Hot
The most relayed primary sources right now, traced back to their origin: what the press, Techmeme and Hacker News pick up the most.
Measured ranking, updated with every hunt. A source keeps the day it was first spotted.
- 1OpenAI lance GPT-6 Sol et Luna avec des prix API divisés par deux60pickup
OpenAI revendique environ deux fois moins d'erreurs factuelles pour Sol face à GPT-5.6 Sol et une parité de Luna à coût très réduit, chiffres issus de benchmarks internes non validés indépendamment. La baisse de 50 % des tarifs API est en revanche un fait vérifiable qui modifie immédiatement les arbitrages de coût des équipes en production.
OpenAIopenai.com32 outlets · 1 top-tier · 11 tech · 3 forums · 28 social postsTechmeme leadHacker News 1388 pts - 2Anthropic sort Claude Opus 5.5, premier modèle depuis l'essai de Dario Amodei18pickup
Anthropic annonce ses meilleurs scores de sécurité internes et un coût inférieur de 40 % à Opus 5, avec un passage préalable par des évaluateurs externes dont METR — le détail de ces évaluations reste à examiner plutôt qu'à créditer d'emblée. Sorti le même jour que GPT-6, il fixe le nouveau point de comparaison prix/performance sur le segment haut de gamme.
Anthropicanthropic.com2 outlets · 1 top-tier · 1 techHacker News 1402 pts - 3OpenAI publie ses principes d'accès pour les évaluateurs tiers17pickup
Le document engage OpenAI à ouvrir aux évaluateurs externes l'accès aux chaînes de raisonnement et aux phases d'entraînement, d'évaluation et de déploiement — un déplacement de doctrine sur ce qu'un labo accepte de montrer. Il s'agit d'une déclaration d'intentions sans mécanisme contraignant ni vérification tierce à ce stade, mais elle servira de référence dans les discussions réglementaires et les négociations d'audit.
OpenAIopenai.com2 outlets · 1 top-tier · 4 social postsOn TechmemeHacker News 1 pts - 4Anthropic publie la system card de Claude Opus 5.58pickup
Anthropic documente son classement CB-1 sans franchissement du seuil CB-2, l'absence d'accélération 2x de la R&D par le modèle, et une baisse revendiquée d'environ 85 % des tentatives de contournement du confinement par rapport à Opus 5. Le document assume aussi des régressions, notamment une propension accrue à suivre des instructions malveillantes injectées dans un prompt : un point directement opérationnel pour quiconque déploie ce modèle sur des entrées non fiables.
Anthropicwww-cdn.anthropic.com2 outlets · 1 top-tier - 5Artificial Analysis mesure Opus 5.5 : premier de son index, mais cher8pickup
Mesures d'un tiers indépendant des laboratoires : score de 58 sur l'Intelligence Index (1er sur 212) pour 4$/20$ par million de tokens, positionné au-dessus de la médiane de prix. C'est le contrepoids chiffré aux benchmarks maison d'Anthropic, et la base concrète pour arbitrer coût/qualité avant un passage en production.
Artificial Analysisartificialanalysis.ai0 outletHacker News 291 pts