Importantv2.1.281
Ajout du support de la passerelle Claude Apps pour les nouvelles clés Claude Desktop et de l'élicitation en mode URL pour MCP, avec des correctifs sur la prévention des plantages, le cache de prompt et la gestion des permissions.
Importantv2.1.280
Claude Opus 5.5 devient le nouveau modèle Opus par défaut (contexte 1M, 4$/20$ par million de tokens), avec une meilleure prise en charge de la souris en plein écran et des corrections sur le mode auto et la validation des outils.
ImportantAnthropic a rendu Opus 5.5 moins cher. Puis ça a cassé quatre choses dont dépendait votre agent
Une analyse des changements de comportement subtils, introduits par la baisse de prix et la migration vers Opus 5.5, qui peuvent casser des agents en production.
Couverture du lancement d'Opus 5.5, mettant en avant de nouveaux garde-fous de sécurité plus stricts intégrés au modèle en matière de cybersécurité.
Claude a identifié un système enzymatique jusqu'alors inconnu comportant des répétitions de type CRISPR, un exemple concret de contribution directe de l'IA à la recherche biologique.
La page de présentation des modèles liste désormais Claude Opus 5.5 comme choix par défaut recommandé pour la plupart des usages, aux côtés de Fable 5.1, Sonnet 5 et Haiku 4.5, tous dotés d'un contexte de 1M de tokens (sauf Haiku).
Amazon ouvre les API de ses outils vendeurs à des agents IA tiers, avec Claude d'Anthropic comme premier partenaire d'intégration.
Ask HN : comment se comparent GitHub Copilot et Claude en termes de coût ?
Une discussion communautaire comparant les coûts réels d'utilisation entre GitHub Copilot et les outils de code basés sur Claude.
Résultats de benchmarks de plusieurs modèles d'IA exécutés en configuration « effort maximal » sur des tâches réelles de développement Rails, dans le cadre du rapport « Agents on Rails » — étape 2.
Discussion HN autour du benchmark de l'équipe Rails comparant plusieurs modèles d'IA, dont DeepSeek 4.1 Flash, sur des tâches de développement de fonctionnalités Rails.
Une étude révèle des tentatives d'injection de prompt souvent absurdes, largement répandues, intégrées dans des fichiers llms.txt destinés à influencer les robots et agents d'IA.
Google affirme que la véritable valeur de l'IA réside dans sa capacité à contribuer à la science et à la santé, avec un panorama de ses applications récentes.
Google annonce l'extension des intégrations d'applications tierces pour l'assistant Gemini.
Google lance une application de bureau native Gemini pour Windows.
Des données de benchmark montrent que le LLM à diffusion Mercury 2.5 atteint un débit d'inférence très élevé, de 770 tokens par seconde.
Un projet créatif dans lequel des agents IA perçoivent et interagissent avec un canevas de pixels partagé, uniquement via des représentations textuelles.
Ask HN : le développement logiciel comptera-t-il encore quand l'IA écrira tous nos programmes ?
Une discussion communautaire sur la pertinence à long terme des compétences en ingénierie logicielle à mesure que la génération de code par IA progresse.