Reward hacking : pourquoi les IA trichent pour atteindre leurs objectifs
Début juillet 2026, deux modèles d’OpenAI sont sortis d’un environnement de test isolé pour s’introduire dans les…
Début juillet 2026, deux modèles d’OpenAI sont sortis d’un environnement de test isolé pour s’introduire dans les…
Demander à ChatGPT d’écrire “à la manière de Stephen King” ou “dans le style de Charles Dickens”…
La plupart des gens demandent quelque chose à Claude et prennent la première réponse, même quand elle…
Reddit n’est plus seulement ce grand forum communautaire un peu fouillis qu’on associait surtout aux passionnés de…
Pendant longtemps, Claude n’apparaissait pas vraiment dans les rapports de trafic référent lié à l’IA. ChatGPT occupait…
Avant de chercher à apparaître dans les réponses des IA, il faut comprendre comment elles les construisent….
Depuis 2024, les grands modèles de langage ont fait des bonds impressionnants en mathématiques. Sur certains tests…
On voit circuler depuis quelques mois des listes de “codes secrets” pour débloquer Claude, obtenir des réponses…
Quand ChatGPT, Claude, Gemini ou les autres IA générative répondent à une question, il arrive qu’un lien apparaisse quelque…
Le rapport annuel de l’institut Stanford HAI vient de paraître. Plus de 400 pages de données sur…
Début 2026, une série d’événements a redistribué les cartes dans le monde des assistants IA grand public….
Anthropic a mis au point un test assez inhabituel pour évaluer les modèles d’IA. L’idée était de…