Hot
Die meistaufgegriffenen Primärquellen des Moments, bis zum Ursprung zurückverfolgt: was Presse, Techmeme und Hacker News am meisten aufgreifen.
Gemessene Rangliste, bei jeder Jagd aktualisiert. Eine Quelle behält den Tag, an dem sie entdeckt wurde.
- 1OpenAI lance GPT-6 Sol et Luna avec des prix API divisés par deux60Echo
OpenAI revendique environ deux fois moins d'erreurs factuelles pour Sol face à GPT-5.6 Sol et une parité de Luna à coût très réduit, chiffres issus de benchmarks internes non validés indépendamment. La baisse de 50 % des tarifs API est en revanche un fait vérifiable qui modifie immédiatement les arbitrages de coût des équipes en production.
OpenAIopenai.com32 Medien · 1 erstrangig · 11 Tech · 3 Foren · 28 Social-PostsTechmeme-AufmacherHacker News 1388 Pkt. - 2Anthropic sort Claude Opus 5.5, premier modèle depuis l'essai de Dario Amodei18Echo
Anthropic annonce ses meilleurs scores de sécurité internes et un coût inférieur de 40 % à Opus 5, avec un passage préalable par des évaluateurs externes dont METR — le détail de ces évaluations reste à examiner plutôt qu'à créditer d'emblée. Sorti le même jour que GPT-6, il fixe le nouveau point de comparaison prix/performance sur le segment haut de gamme.
Anthropicanthropic.com2 Medien · 1 erstrangig · 1 TechHacker News 1402 Pkt. - 3OpenAI publie ses principes d'accès pour les évaluateurs tiers17Echo
Le document engage OpenAI à ouvrir aux évaluateurs externes l'accès aux chaînes de raisonnement et aux phases d'entraînement, d'évaluation et de déploiement — un déplacement de doctrine sur ce qu'un labo accepte de montrer. Il s'agit d'une déclaration d'intentions sans mécanisme contraignant ni vérification tierce à ce stade, mais elle servira de référence dans les discussions réglementaires et les négociations d'audit.
OpenAIopenai.com2 Medien · 1 erstrangig · 4 Social-PostsAuf TechmemeHacker News 1 Pkt. - 4Anthropic publie la system card de Claude Opus 5.58Echo
Anthropic documente son classement CB-1 sans franchissement du seuil CB-2, l'absence d'accélération 2x de la R&D par le modèle, et une baisse revendiquée d'environ 85 % des tentatives de contournement du confinement par rapport à Opus 5. Le document assume aussi des régressions, notamment une propension accrue à suivre des instructions malveillantes injectées dans un prompt : un point directement opérationnel pour quiconque déploie ce modèle sur des entrées non fiables.
Anthropicwww-cdn.anthropic.com2 Medien · 1 erstrangig - 5Artificial Analysis mesure Opus 5.5 : premier de son index, mais cher8Echo
Mesures d'un tiers indépendant des laboratoires : score de 58 sur l'Intelligence Index (1er sur 212) pour 4$/20$ par million de tokens, positionné au-dessus de la médiane de prix. C'est le contrepoids chiffré aux benchmarks maison d'Anthropic, et la base concrète pour arbitrer coût/qualité avant un passage en production.
Artificial Analysisartificialanalysis.ai0 MediumHacker News 291 Pkt.