Gemini 2.5 Pro avec Deep Think : Google reprend la tête sur les benchmarks scientifiques
Avec 82,4% sur GPQA Diamond, le mode de raisonnement étendu de Google dépasse ses rivaux sur les questions de chimie et de physique avancées. Un…
Nouveaux modèles, papers et avancées techniques
Avec 82,4% sur GPQA Diamond, le mode de raisonnement étendu de Google dépasse ses rivaux sur les questions de chimie et de physique avancées. Un…
Après une phase de validation fédérale, OpenAI bascule ses trois nouveaux modèles frontier en accès général, avec des scores de benchmark qui…
Elon Musk relance la course aux modèles d'ingénierie avec Grok 4.5, entraîné sur des dizaines de milliers de GPU GB300 et disponible dès maintenant…
Fini les allers-retours saccadés avec l'assistant vocal : OpenAI dévoile GPT-Live, capable d'écouter et de parler en même temps, comme dans une vraie…
La pépite française annonce un accès privé dès juillet 2026 à un nouveau modèle open-weight, pensé pour combler l'écart avec GPT, Gemini et Claude.
Plutôt que d'itérer sur Gemini 2.5 Pro, Google DeepMind repart de zéro. Un pari risqué à quelques mois d'affronter GPT-5.6 et Fable 5.
Anthropic dit avoir localisé, grâce à une technique mathématique, un espace interne où Claude raisonne sans que ce travail se reflète directement…
Avec une fenêtre de contexte native de 1 million de tokens et un tarif promotionnel jusqu'au 31 août, Anthropic tente de rendre l'IA agentic…
Anthropic lance Claude Sonnet 5, une mise à jour substantielle de sa gamme intermédiaire pensée pour les agents autonomes en entreprise.…