❌

Vue normale

Il y a de nouveaux articles disponibles, cliquez pour rafraîchir la page.
À partir d’avant-hierLEBIGDATA.FR
  • ✇LEBIGDATA.FR
  • Fable 5 est de retour mais… Anthropic a-t-il lourdement baissé ses performances ?
    À moins que vous viviez dans une grotte, vous êtes sans doute au courant que Claude Fable 5 est de retour. Anthropic l’a remis en service le 1er juillet 2026. Cela, après l’avoir suspendu le 12 juin à la suite de préoccupations gouvernementales liées à la sécurité nationale. Cependant, il y a un problème. Claude Fable 5 est devenu moins performant. Du moins, si l’on croit BridgeMind. Sur X, l’entreprise de logiciels spécialisée dans l’IA affirme avoir testé la version du modèle remise en serv

Fable 5 est de retour mais… Anthropic a-t-il lourdement baissé ses performances ?

Par : Ny Ando A.
3 juillet 2026 à 08:54

À moins que vous viviez dans une grotte, vous êtes sans doute au courant que Claude Fable 5 est de retour. Anthropic l’a remis en service le 1er juillet 2026. Cela, après l’avoir suspendu le 12 juin à la suite de préoccupations gouvernementales liées à la sécurité nationale.

Cependant, il y a un problème. Claude Fable 5 est devenu moins performant. Du moins, si l’on croit BridgeMind. Sur X, l’entreprise de logiciels spécialisée dans l’IA affirme avoir testé la version du modèle remise en service le 1er juillet avec BridgeBench. Et devinez quoi ? Les résultats montrent une forte baisse sur plusieurs benchmarks. 

Selon BridgeMind, le score de Claude Fable 5 en débogage passe de 86,2 à 25,9. Celui de la refactorisation chute de 73,6 à 38,4. Et ses performances face aux hallucinations reculent de 75,9 à 61,7. 

FABLE 5 CAME BACK NERFED.

We re-ran the July 1st version of Claude Fable 5 on BridgeBench.

The results are brutal:

Debugging: 86.2 → 25.9
Refactoring: 73.6 → 38.4
Hallucination: 75.9 → 61.7

The new guardrails are kicking in on way too many tasks and falling back to Opus… pic.twitter.com/tcUDDXpZMF

— BridgeMind (@bridgemindai) July 2, 2026
 

Mais alors, pourquoi une telle baisse de performance chez Claude Fable 5 ? 

Eh bien, parce que le modèle est revenu avec de nouvelles protections. Certaines requêtes sont désormais automatiquement redirigées vers Claude Opus 4.8, une version moins puissante.

Lors du benchmark de débogage de BridgeBench, par exemple, seules trois tâches auraient été exécutées directement par Fable 5. Toutes les autres ont été transférées vers Opus 4.8. 

Selon les auteurs du test, cela expliquerait la dégradation. Ce qui est plutôt recevable puisqu’à ce qu’il paraît; les tâches qui continuent d’utiliser pleinement Fable 5 conservent les mêmes performances qu’avant sa suspension. 

Quoi qu’il en soit, cette nouvelle approche d’Anthropic avec Fable 5 ne fait pas l’unanimité. Plusieurs utilisateurs avancés estiment que les capacités du modèle sont inutilement limitées.

Certains vont même jusqu’à parler d’un fonctionnement trompeur, surtout avec les quotas d’utilisation en vigueur. D’autres se montrent pourtant beaucoup plus enthousiastes. 

C’est notamment le cas de Mitchell Hashimoto, cofondateur de HashiCorp. Il affirme obtenir d’excellents résultats en combinant intelligemment Fable 5 et Opus 4.8. 

D’autres utilisateurs reconnaissent cependant que certaines décisions ne dépendent tout simplement pas d’Anthropic. Que de toute évidence, les autorités américaines n’auraient pas autorisé un déploiement sans nouvelles restrictions. 

Cet article Fable 5 est de retour mais… Anthropic a-t-il lourdement baissé ses performances ? a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Claude change les règles : Anthropic ouvre la porte aux données biométriques
    Sortez votre plus beau sourire, Anthropic s’intéresse désormais à vos traits. Dès le 8 juillet 2026, Claude applique de nouvelles règles de confidentialité qui devraient faire parler d’elles sur le web.   Anthropic vient de prévenir ses utilisateurs par e-mail. L’entreprise met à jour sa politique de confidentialité pour les comptes Free, Pro et Max. Qu’est-ce qui change concrètement ? Beaucoup de choses. La mise à jour apporte davantage de précisions sur l’IA agentique. Elle introduit aussi

Claude change les règles : Anthropic ouvre la porte aux données biométriques

Par : Tinah F.
25 juin 2026 à 15:06

Sortez votre plus beau sourire, Anthropic s’intéresse désormais à vos traits. Dès le 8 juillet 2026, Claude applique de nouvelles règles de confidentialité qui devraient faire parler d’elles sur le web.  

Anthropic vient de prévenir ses utilisateurs par e-mail. L’entreprise met à jour sa politique de confidentialité pour les comptes Free, Pro et Max. Qu’est-ce qui change concrètement ? Beaucoup de choses. La mise à jour apporte davantage de précisions sur l’IA agentique. Elle introduit aussi l’arrivée des données biométriques, avec le consentement explicite des utilisateurs. En clair, Claude revoit ses règles pour s’adapter à l’ère des agents IA autonomes.  

Claude change ses règles pour accompagner une IA devenue plus autonome

Les nouvelles règles de Claude accompagnent une évolution majeure de l’assistant. Celui-ci va désormais bien au-delà du simple chatbot. L’assistant peut désormais enchaîner plusieurs actions. Il est aussi en mesure de consulter des documents, d’utiliser des connecteurs ou encore de communiquer avec des services externes.

Cette nouvelle génération d’IA, dite agentique, change bien sûr la manière dont les données circulent. Anthropic adapte donc sa politique pour expliquer plus clairement ce qu’il se passe lorsqu’un utilisateur relie Claude à une application tierce.

If you use Claude, you need to know this.

Anthropic is making some massive changes to Claude's privacy policy – effective July 8th.

Verification data will be collected from ALL Cladude users.

Age, identity, email, date of birth – all verified by government photo ID.… pic.twitter.com/HdS35rgAhP

— Miles Deutscher (@milesdeutscher) June 16, 2026

Dans ce cas, Claude peut transmettre certaines informations au service concerné afin d’exécuter la tâche demandée. Rien de très surprenant. Il est par exemple impossible d’envoyer un e-mail sans partager son contenu avec le service de messagerie.

En revanche, Anthropic rappelle un point souvent oublié. Une fois un connecteur activé, celui-ci reste accessible jusqu’à ce que l’utilisateur décide lui-même de le désactiver. Il vaut donc mieux vaut jeter un œil aux paramètres de temps en temps. Les cases cochées ont parfois une fâcheuse tendance à rester cochées.

Les données biométriques font leur apparition

La véritable nouveauté se trouve ailleurs. Pour la première fois, la politique de confidentialité évoque explicitement la collecte de données biométriques dans certains cas de vérification d’identité ou d’âge.

Concrètement, si un utilisateur accepte cette procédure, Anthropic pourra demander une photo d’une pièce d’identité, un selfie ou une courte vidéo du visage. Selon la méthode retenue, un modèle de géométrie faciale pourra également être créé afin de confirmer l’identité de la personne.

infographie concernant les nouvelles règles de Claude

Cette cartographie numérique du visage se considère comme une donnée biométrique dans plusieurs juridictions. Elle bénéficie donc d’un cadre juridique très strict. Le point essentiel reste le consentement. 

Anthropic précise que cette collecte ne peut avoir lieu que si l’utilisateur engage volontairement cette vérification. Il ne s’agit donc pas d’une analyse automatique réalisée en arrière-plan.

Certes, ce changement de règles ne transforme pas Claude en aspirateur à données personnelles. Il reflète surtout l’évolution rapide des assistants IA, aujourd’hui capables d’agir directement à la place de leurs utilisateurs. 

Cet article Claude change les règles : Anthropic ouvre la porte aux données biométriques a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Mythos : l’IA d’Anthropic n’a pas piraté la NSA, mais que s’est-il passé au juste ?
    Une simple phrase a suffi à enflammer les réseaux. En quelques heures, certains affirmaient que Mythos avait piraté la NSA. La réalité est pourtant tout autre. .« L’IA d’Anthropic Mythos a piraté la NSA. » Depuis quelques jours, cette affirmation tourne à toute vitesse sur X, Reddit et d’autres plateformes. De quoi imaginer qu’une IA a réussi à mettre en échec l’agence de renseignement la plus puissante des États-Unis. Sauf que cette version est loin de refléter les faits. Une citation sortie

Mythos : l’IA d’Anthropic n’a pas piraté la NSA, mais que s’est-il passé au juste ?

Par : Tinah F.
24 juin 2026 à 05:53

Une simple phrase a suffi à enflammer les réseaux. En quelques heures, certains affirmaient que Mythos avait piraté la NSA. La réalité est pourtant tout autre.

.« L’IA d’Anthropic Mythos a piraté la NSA. » Depuis quelques jours, cette affirmation tourne à toute vitesse sur X, Reddit et d’autres plateformes. De quoi imaginer qu’une IA a réussi à mettre en échec l’agence de renseignement la plus puissante des États-Unis. Sauf que cette version est loin de refléter les faits. Une citation sortie de son contexte a suffi à transformer un simple exercice de cybersécurité en prétendu piratage de la NSA. Pourtant, l’opération était entièrement autorisée. 

Pourquoi tout le monde a cru que Mythos avait piraté la NSA ?

Tout commence avec un article publié le 14 juin par The Economist. Le magazine y rapporte une déclaration du sénateur américain Mark Warner, vice-président de la commission du renseignement du Sénat.

Lors d’une audition, ce dernier explique avoir été informé par le général Joshua Rudd, responsable de la NSA et du Cyber Command américain. Selon ce dernier, le modèle Mythos d’Anthropic avait pénétré « la quasi-totalité des systèmes classifiés » de l’agence, « non pas en quelques semaines, mais en quelques heures ».

An update. A US official tells me that Sen. Warner misunderstood the NSA director Gen. Rudd in this case. Rudd did use the 'hours, not weeks' wording, but the use of Mythos in this context was—as widely assumed—part of a red-teaming effort, i.e. testing the security of internal… https://t.co/DiPITXmo0Q

— Shashank Joshi (@shashj) June 22, 2026

Sortie de son contexte, la phrase fait immédiatement le tour d’Internet. Beaucoup comprennent alors que Mythos a réussi à infiltrer les systèmes de la NSA comme le ferait un pirate informatique. En réalité, ce n’était pas du tout le scénario.

Il s’agit d’un test. Celui-ci s’inscrivait dans le cadre du projet Glasswing, un programme confidentiel mené avec les agences de renseignement américaines. Son objectif était d’utiliser des modèles d’IA pour repérer les vulnérabilités de logiciels critiques avant que de véritables attaquants ne puissent les exploiter.

Autrement dit, la NSA a volontairement confronté Mythos à une copie contrôlée de son environnement informatique. Il ne s’agissait donc ni d’un piratage réel, ni d’une intrusion extérieure.

Un polémique qui a pourtant eu de vraies conséquences

L’Associated Press apporte d’ailleurs une précision importante. Selon un responsable américain cité anonymement, Mythos a effectivement identifié certaines vulnérabilités en quelques heures.

En revanche, détecter une faiblesse ne signifie pas être capable de l’exploiter immédiatement. Cette distinction est essentielle, mais elle s’est perdue au fil des partages. 

Infographie qui montre que Mythos n'a pas piraté la NSA

Même le journaliste de The Economist, Shashank Joshi, à l’origine de la citation devenue virale, est revenu sur l’interprétation de ses propos. Il a expliqué que son article décrivait un exercice de red team très spécifique, où le modèle fonctionnait avec d’autres outils et dans des conditions soigneusement préparées.

Mais le problème c’est que si la rumeur est fausse, l’affaire, elle, est bien réelle. Car les performances de Mythos ont alimenté les inquiétudes. Ce mois-ci, Anthropic a d’ailleurs reçu l’ordre de suspendre les exportations de ses modèles Mythos et Fable. Washington estime que cette mesure est nécessaire pour protéger la sécurité nationale. 

Cet article Mythos : l’IA d’Anthropic n’a pas piraté la NSA, mais que s’est-il passé au juste ? a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Claude en panne : Anthropic reconnaît un incident, mais que s’est-il passé ?
    Les utilisateurs de Claude ont encore une fois été confrontés à une panne ce mardi 23 juin 2026. Anthropic a confirmé l’incident et déployé un correctif, mais l’origine du problème reste encore floue. Mauvaise journée pour les utilisateurs de Claude. La panne de Claude a provoqué une vague de signalements sur DownDetector, où les rapports d’erreurs se sont multipliés en quelques minutes. Toutefois, Anthropic n’a pas cherché à minimiser le problème. L’entreprise a confirmé qu’un incident touch

Claude en panne : Anthropic reconnaît un incident, mais que s’est-il passé ?

Par : Tinah F.
23 juin 2026 à 19:17

Les utilisateurs de Claude ont encore une fois été confrontés à une panne ce mardi 23 juin 2026. Anthropic a confirmé l’incident et déployé un correctif, mais l’origine du problème reste encore floue.

Mauvaise journée pour les utilisateurs de Claude. La panne de Claude a provoqué une vague de signalements sur DownDetector, où les rapports d’erreurs se sont multipliés en quelques minutes. Toutefois, Anthropic n’a pas cherché à minimiser le problème. L’entreprise a confirmé qu’un incident touchait plusieurs de ses modèles. Elle a aussitôt déployé un correctif. Que s’est-il passé au juste ? 

Que s’est-il passé lors de la panne de Claude ?

Comme l’a annoncé Anthropic, la panne de Claude s’est survenue à 14h19 UTC, soit 16h19 heure de Paris. Les premiers signalements apparaissent en milieu d’après-midi. Très vite, DownDetector enregistre une forte hausse des déclarations d’incidents. 

Les utilisateurs signalent des conversations interrompues et des réponses incomplètes. D’autres se retrouvent face à des messages d’erreur qui bloquent l’accès au chatbot. 

Claude is experiencing a major outage right now across all platforms.

WTF is Anthropic doing???? pic.twitter.com/EDfXbU2WmN

— BridgeMind (@bridgemindai) June 23, 2026

Le phénomène prend rapidement de l’ampleur. Car en quelques dizaines de minutes, plusieurs milliers de signalements sont recensés. Sur les réseaux sociaux, les réactions oscillent entre frustration et humour. Certains plaisantent sur leur « collègue virtuel » parti en pause au pire moment. D’autres s’inquiètent pour leurs projets en cours.

Anthropic confirme un correctif, mais reste discret

Face à cette panne de Claude, Anthropic a d’abord annoncé enquêter sur un incident affectant plusieurs modèles. Une trentaine de minutes plus tard, l’entreprise a indiqué avoir identifié l’origine du problème et commencé le déploiement d’un correctif. Peu après, elle a confirmé que la correction était en place et que les équipes surveillaient le retour à la normale.

En revanche, impossible de savoir précisément ce qui a produit la panne de Claude. Anthropic évoque simplement un taux d’erreur élevé sur plusieurs modèles, sans donner davantage d’explications techniques. 

Impossible donc de déterminer s’il s’agissait d’un problème d’infrastructure, d’une mise à jour défectueuse ou d’un autre incident interne. Les entreprises restent souvent prudentes sur ce type de communication, notamment tant que l’analyse complète n’est pas terminée.

Pour l’heure, le service semble retrouver son fonctionnement normal grâce au correctif déployé par Anthropic. Quoi qu’il en soit, cette nouvelle panne rappelle qu’aucun chatbot n’est infaillible. 

Cet article Claude en panne : Anthropic reconnaît un incident, mais que s’est-il passé ? a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • La NSA confirme ?! L’IA d’Anthropic Mythos est dangereuse 
    « Mythos a réussi à pénétrer presque tous nos systèmes classifiés, non pas en plusieurs semaines, mais en seulement quelques heures. » Cette déclaration, elle vient du sénateur américain Mark Warner.  Mark Warner l’a avoué le 11 juin 2026. Selon lui, ces propos lui ont été rapportés par le général Joshua Rudd. Ce dernier qui dirige actuellement à la fois la National Security Agency (NSA) et l’United States Cyber Command. Pendant plusieurs jours, cette citation est passée relativement inape

La NSA confirme ?! L’IA d’Anthropic Mythos est dangereuse 

Par : Ny Ando A.
22 juin 2026 à 08:42

« Mythos a réussi à pénétrer presque tous nos systèmes classifiés, non pas en plusieurs semaines, mais en seulement quelques heures. » Cette déclaration, elle vient du sénateur américain Mark Warner. 

Mark Warner l’a avoué le 11 juin 2026. Selon lui, ces propos lui ont été rapportés par le général Joshua Rudd. Ce dernier qui dirige actuellement à la fois la National Security Agency (NSA) et l’United States Cyber Command.

Pendant plusieurs jours, cette citation est passée relativement inaperçue, enfouie dans un compte-rendu publié par The Economist. Puis, le 21 juin, elle a brusquement ressurgi sur les réseaux sociaux. 

Des influenceurs spécialisés en IA l’ont relayés. Plusieurs comptes populaires ont vite résumé l’affaire avec une formule choc : « La NSA confirme ». En quelques heures, le nom de Mythos est revenu au centre des discussions. Pourtant, entre la déclaration originale et son interprétation virale, il existe un écart important. 

Holy Sh*t: that changes the whole Fable 5 story completely:

On June 11, the very same day Amazon reportedly uncovered the jailbreak, “Mythos” allegedly breached almost all classified systems belonging to the NSA and U.S. Cyber Command, not over the course of weeks, but within… pic.twitter.com/xkj8cJ0O8j

— Chubby♨️ (@kimmonismus) June 21, 2026

Qu’est-ce que le sénateur voulait dire exactement ?

Pour comprendre l’affaire, il faut revenir aux propos complets de Mark Warner. Le sénateur plaidait alors pour des contrôles de sécurité plus stricts concernant les modèles d’IA les plus avancés. 

Il utilisait Mythos comme exemple de la rapidité avec laquelle ces systèmes peuvent identifier des failles complexes. Dans son intervention, il expliquait notamment qu’il était rassurant que cette technologie se trouve entre les mains d’Anthropic plutôt que d’un acteur moins prudent. 

Son message n’était donc pas une accusation contre l’entreprise. Au contraire, Warner soulignait que la situation démontrait l’importance d’imposer des évaluations indépendantes et obligatoires aux modèles les plus puissants.

La déclaration est juste devenue virale en raison de la personne à laquelle elle est attribuée. Voyez-vous, lorsqu’un responsable occupant un poste tel que celui de Joshua Rudd parle évoque l’IA, la remarque ne passe évidemment pas inaperçue.

Surtout que le sujet concerne la capacité d’une IA à franchir les défenses de systèmes sensibles en quelques heures. 

Mythos a-t-il réellement pénétré les systèmes classifiés de la NSA ?

C’est probablement ici que se trouve le point le plus sensible de cette affaire. Plusieurs publications virales affirment que Mythos avait pénétré des « systèmes classifiés ». 

D’autres ont évoqué des « systèmes de test classifiés ». Or cette distinction change complètement l’interprétation. Dans le domaine de la cybersécurité offensive, pénétrer un système ne signifie pas forcément accéder à un réseau opérationnel réel. 

Lors d’exercices de sécurité, des environnements spécialement conçus pour reproduire des infrastructures sensibles sont régulièrement utilisés. Cela, afin d’évaluer les capacités des outils et des équipes.

Il est donc possible que la NSA ait soumis Mythos à des exercices contrôlés reproduisant ses propres environnements sécurisés. Le modèle aurait alors identifié et exploité des chaînes de vulnérabilités avec une rapidité exceptionnelle. 

Le résultat reste spectaculaire. Cependant, il est très différent d’une intrusion réelle dans des réseaux gouvernementaux actifs.

Un élément essentiel mérite d’ailleurs d’être rappelé. Il ne s’agit pas d’une déclaration publique de la NSA. La seule source disponible est le récit du sénateur Warner. 

Aucun document officiel ni communiqué de l’agence n’est venu confirmer ces propos.

Cet article La NSA confirme ?! L’IA d’Anthropic Mythos est dangereuse  a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Après Anthropic, et si les États-Unis décidaient de couper les meilleures IA ? Macron s’inquiète 
    C’était lors du sommet du G7 qu’Emmanuel Macron s’est inquiété de la capacité des États-Unis à couper l’accès aux meilleurs modèles d’intelligence artificielle. Une telle décision pourrait fragiliser les entreprises et les économies qui en dépendent. Pour rappel, l’administration Trump a récemment interdit à Anthropic d’exporter ses nouveaux modèles d’IA, dont Fable 5 et Mythos 5. Washington invoque des raisons de sécurité nationale après un signalement d’Amazon sur d’éventuelles failles. Cet

Après Anthropic, et si les États-Unis décidaient de couper les meilleures IA ? Macron s’inquiète 

Par : Tinah F.
18 juin 2026 à 09:36

C’était lors du sommet du G7 qu’Emmanuel Macron s’est inquiété de la capacité des États-Unis à couper l’accès aux meilleurs modèles d’intelligence artificielle. Une telle décision pourrait fragiliser les entreprises et les économies qui en dépendent.

Pour rappel, l’administration Trump a récemment interdit à Anthropic d’exporter ses nouveaux modèles d’IA, dont Fable 5 et Mythos 5. Washington invoque des raisons de sécurité nationale après un signalement d’Amazon sur d’éventuelles failles. Cette décision a rapidement relancé le débat sur la dépendance aux technologies américaines. Lors du sommet du G7, Macron s’est appuyé sur cet épisode pour alerter sur un risque plus large. Celui de voir l’accès aux meilleurs modèles d’IA suspendu à tout moment. 

Le vrai problème dépasse Anthropic 

Emmanuel Macron a partagé ses inquiétudes devant plusieurs dirigeants et responsables de l’IA. Sam Altman, Dario Amodei et Donald Trump étaient notamment présents.

Son intervention fait directement écho au blocage des modèles d’Anthropic, décidé quelques jours plus tôt par Washington. Fable 5 et Mythos 5 restent bloqués, malgré des critiques sur la cohérence de cette décision.

OpenAI CEO Sam Altman and Anthropic CEO Dario Amodei were among tech bosses at a G7 working lunch on AI, as the US decision to restrict access to Anthropic's most advanced models causes tension among allies https://t.co/IfdWD2xPs3 pic.twitter.com/XSGLQWfYtX

— Bloomberg (@business) June 17, 2026

Plusieurs spécialistes de la cybersécurité ont pourtant rappelé que des capacités similaires à celles de Mythos existent déjà dans d’autres modèles accessibles publiquement. Or, au-delà du cas de l’entreprise américaine, le message est limpide. Si un gouvernement peut interrompre l’accès à un modèle d’IA stratégique presque instantanément, aucune société étrangère ne bénéficie d’une garantie durable. 

Autrement dit, construire tout un service sur une IA américaine revient désormais à accepter qu’un interrupteur puisse exister quelque part. Et personne n’aime découvrir où il se trouve le jour où tout s’arrête.

Macron alerte sur les risques d’une dépendance aux États-Unis 

Selon lui, si les États-Unis peuvent « éteindre l’interrupteur » du jour au lendemain, les conséquences dépasseraient les frontières européennes. Les entreprises clientes perdraient l’accès à des outils essentiels. Les fournisseurs américains risqueraient eux aussi de voir leurs partenaires chercher des alternatives.

Le Premier ministre indien Narendra Modi partage d’ailleurs cette préoccupation. Il estime que les démocraties doivent pouvoir accéder aux meilleurs modèles afin de protéger leurs infrastructures critiques.

Infographie sur l'inquiétude de Macron

L’épisode relance également le débat sur la souveraineté numérique. Depuis plusieurs années, l’Europe tente de réduire sa dépendance aux grandes plateformes américaines. Mais dans le domaine de l’IA, la réalité reste plus compliquée.

Les modèles les plus performants proviennent toujours majoritairement des États-Unis. Difficile, dans ces conditions, de convaincre les entreprises de regarder ailleurs lorsque les meilleures solutions restent américaines.

Face à ces inquiétudes, les dirigeants du G7 ont évoqué la création d’un programme de « partenaires de confiance ». L’idée serait d’autoriser certains pays ou certaines entreprises non américaines à conserver un accès privilégié aux modèles avancés d’Anthropic ou d’OpenAI. 

Cet article Après Anthropic, et si les États-Unis décidaient de couper les meilleures IA ? Macron s’inquiète  a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Mythos 5 : Anthropic a tenté de faire plier Washington, mais Trump n’a pas changé d’avis
    Anthropic espérait convaincre Washington de desserrer l’étau autour de Mythos 5 et Fable 5, mais Trump est resté inflexible. Malgré des discussions en urgence, les restrictions américaines restent en place. Et le dernier modèle d’IA demeure inaccessible à l’international.   Il semble que les négociations n’auront pas suffi. Lundi, Anthropic a rencontré plusieurs responsables de l’administration américaine pour tenter de débloquer la situation autour de Mythos 5 et Fable 5. Mais face à Trump,

Mythos 5 : Anthropic a tenté de faire plier Washington, mais Trump n’a pas changé d’avis

Par : Tinah F.
16 juin 2026 à 18:38

Anthropic espérait convaincre Washington de desserrer l’étau autour de Mythos 5 et Fable 5, mais Trump est resté inflexible. Malgré des discussions en urgence, les restrictions américaines restent en place. Et le dernier modèle d’IA demeure inaccessible à l’international.  

Il semble que les négociations n’auront pas suffi. Lundi, Anthropic a rencontré plusieurs responsables de l’administration américaine pour tenter de débloquer la situation autour de Mythos 5 et Fable 5. Mais face à Trump, l’entreprise n’a obtenu aucune concession immédiate. Son modèle le plus avancé reste donc hors ligne à l’échelle mondiale. Il est victime d’un bras de fer qui dépasse largement le simple cadre technique. 

Mythos 5 face à Trump : une rencontre, mais aucun revirement !

Anthropic est arrivé à Washington avec une mission. Celle de démontrer que ses protections sont suffisamment solides pour permettre le retour de ses derniers modèles. Autour de la table figuraient de nombreux spécialistes de la sécurité de l’entreprise. 

Leur objectif consistait à expliquer pourquoi les vulnérabilités découvertes sur son dernier modèle ne représentaient pas, selon eux, une menace majeure. Mais malgré ces explications, l’administration Trump est restée inflexible sur le cas de Mythos 5 et Fable 5. 

Axios reports that the industry is now worried White House export controls on Anthropic’s latest model could hurt the entire U.S. AI industry.

The problem is trust. And that was to be expected.

As Deutsche Bank’s Jim Reid put it:

“You can’t rely on something that could be… https://t.co/ecuglgupjQ pic.twitter.com/WkVGT2qKKJ

— Chubby♨️ (@kimmonismus) June 16, 2026

Le gouvernement américain ne partage toutefois pas cette analyse. L’administration estime que certaines failles pourraient permettre de contourner les garde-fous du modèle. Un scénario jugé préoccupant au point de maintenir les restrictions à l’exportation.

Autrement dit, malgré plusieurs heures de discussions, personne n’a changé de position. Les réunions ont surtout permis de constater que les deux camps ne parlent pas exactement le même langage.

Pas encore disponible !

En attendant une éventuelle évolution, Mythos 5 reste toujours bloqué par les restrictions décidées sous Trump. Tout comme Claude Fable 5. Cette décision commence déjà à produire des effets. Certains développeurs se tournent vers des solutions concurrentes. 

Plusieurs experts du secteur s’inquiètent aussi des conséquences pour l’innovation américaine. Une lettre ouverte signée par plusieurs dizaines de chercheurs et dirigeants du secteur demande d’ailleurs la levée rapide des restrictions. 

Anthropic n'a pas obtenu la levée des restrictions sur Mythos 5 et Fable 5

Selon eux, ces contrôles risquent surtout de ralentir les entreprises américaines sans empêcher les concurrents étrangers de progresser. Or, pour l’administration, la priorité reste néanmoins la sécurité.

Mais une solution intermédiaire serait à l’étude. Elle consisterait à limiter l’accès aux seuls utilisateurs situés aux États-Unis, le temps qu’Anthropic fournisse davantage de garanties techniques. Attention toutefois, aucune décision n’a toutefois été annoncée.

Il ne s’agit plus seulement de Mythos 5

Le problème, c’est que ce différend ne concerne pas uniquement Mythos 5.  Les autorités américaines cherchent aujourd’hui à encadrer les modèles d’IA les plus puissants avant leur diffusion mondiale. L’idée est d’éviter qu’ils puissent être utilisés pour faciliter des cyberattaques ou d’autres usages sensibles.

Anthropic considère, de son côté, que les problèmes identifiés restent limités et corrigibles rapidement. L’entreprise rappelle aussi que d’autres modèles accessibles au public présentent des capacités comparables.

Difficile pourtant de convaincre Washington lorsque la cybersécurité entre dans l’équation. Dans ce domaine, le principe de précaution semble désormais prendre le dessus. Mieux vaut bloquer d’abord et discuter ensuite. Une philosophie qui ne fait évidemment pas l’unanimité.

Quoi qu’il en soit, le bras de fer est donc loin d’être terminé. Et s’il y a bien une leçon à retenir, c’est que les modèles d’IA les plus avancés ne se jouent plus seulement dans les laboratoires. Ils se décident désormais aussi dans les couloirs du pouvoir.

Cet article Mythos 5 : Anthropic a tenté de faire plier Washington, mais Trump n’a pas changé d’avis a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Anthropic lâche enfin son IA Mythos… mais sous un autre nom 
    Il y a à peine deux mois, Anthropic faisait sensation avec Mythos. Son modèle d’IA capable d’identifier et d’exploiter des vulnérabilités informatiques de façon autonome.  Face à ses capacités jugées particulièrement sensibles, l’entreprise avait pris une décision peu commune. Ne pas le rendre accessible au grand public. Aujourd’hui, cependant, la situation a changé.  Une version de Mythos est désormais disponible sous le nom de Claude Fable 5. Derrière cette nouvelle appellation se cache

Anthropic lâche enfin son IA Mythos… mais sous un autre nom 

Par : Ny Ando A.
10 juin 2026 à 09:36

Il y a à peine deux mois, Anthropic faisait sensation avec Mythos. Son modèle d’IA capable d’identifier et d’exploiter des vulnérabilités informatiques de façon autonome. 

Face à ses capacités jugées particulièrement sensibles, l’entreprise avait pris une décision peu commune. Ne pas le rendre accessible au grand public. Aujourd’hui, cependant, la situation a changé. 

Une version de Mythos est désormais disponible sous le nom de Claude Fable 5. Derrière cette nouvelle appellation se cache pratiquement le même modèle que Mythos 5. 

Fable 5 is state-of-the-art on nearly all tested benchmarks, with exceptional performance in software engineering, knowledge work, scientific research, and vision.

The longer and more complex the task, the larger Fable 5’s lead over our other models. pic.twitter.com/DxgSu0KUxh

— Claude (@claudeai) June 9, 2026
 

Claude Fable 5, quelle différence avec Mythos 5 ?

Eh bien, la différence ne réside pas dans sa puissance, mais dans les restrictions qui encadrent son utilisation. Voyez-vous, sur SWE-Bench Pro, l’un des principaux tests de référence en ingénierie logicielle, Claude Fable 5 atteint un score de 80,3 %. 

À titre de comparaison, Claude Opus 4.8 obtient 69,2 %, GPT-5.5 atteint 58,6 % et Gemini 3.1 Pro se situe à 54,2 %. L’écart devient encore plus visible sur les exercices les plus complexes. 

Dans FrontierCode Diamond, un benchmark conçu pour évaluer les capacités de programmation avancées, Fable 5 affiche 29,3 %. Ce, contre 13,4 % pour Opus 4.8. Le modèle s’est également illustré dans un exercice plus original. 

Il est parvenu à terminer Pokémon Rouge Feu en se basant uniquement sur des captures d’écran du jeu, sans carte ni assistance de navigation. Les précédentes générations de Claude nécessitaient des outils complémentaires pour accomplir une tâche similaire.

Ce qui distingue Claude Fable 5, c’est qu’il intègre des systèmes de surveillance chargés d’analyser les requêtes en temps réel. 

Comment ça marche exactement ?

Eh bien, lorsque certaines demandes concernent des domaines sensibles, elles sont automatiquement transférées vers Claude Opus 4.8.

Par domaines sensibles, on entend la cybersécurité offensive, la biologie, la chimie ou encore la reproduction de modèles d’IA. Selon Anthropic, ce filtrage n’intervient que dans moins de 5 % des conversations. 

Dans la grande majorité des cas, les utilisateurs bénéficient donc des capacités complètes du modèle. Pendant ce temps, Mythos 5 reste réservé à un cercle restreint d’organisations sélectionnées dans le cadre du programme Project Glasswing. 

Bref, Claude Fable 5 est déjà disponible via l’API Claude, Claude Code ainsi que les offres professionnelles proposées sur AWS, Google Cloud et Microsoft Foundry. 

Les abonnés Pro, Max, Team et Enterprise, de leur côté, peuvent l’utiliser sans frais supplémentaires jusqu’au 22 juin. Après cette période, son utilisation sera décomptée à partir de crédits dédiés. 

Pour les développeurs, Anthropic a fixé les tarifs de l’API à 10 dollars par million de jetons en entrée et 50 dollars par million de jetons en sortie. Un tarif de sortie deux fois supérieur à celui d’Opus. Ce qui place Fable 5 parmi les modèles les plus coûteux du catalogue de l’entreprise.

Cet article Anthropic lâche enfin son IA Mythos… mais sous un autre nom  a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Il abandonne ses abonnements IA pour un Mac Mini et économise 2 500 $ par an
    Payer 210 dollars par mois pour l’IA ou investir dans un Mac Mini ? Un développeur a fait ses calculs. Lassé des abonnements qui s’accumulent, il a troqué ses services cloud contre une configuration locale à 1 198 dollars. Ce choix lui permettrait d’économiser jusqu’à 2 500 dollars par an.  C’est désormais une réalité ! Les abonnements à l’IA font partie des factures incontournables des développeurs. Ils s’appuient sur des modèles payants comme ChatGPT Pro, Claude Code, Gemini Advanced ou enc

Il abandonne ses abonnements IA pour un Mac Mini et économise 2 500 $ par an

Par : Tinah F.
8 juin 2026 à 16:42

Payer 210 dollars par mois pour l’IA ou investir dans un Mac Mini ? Un développeur a fait ses calculs. Lassé des abonnements qui s’accumulent, il a troqué ses services cloud contre une configuration locale à 1 198 dollars. Ce choix lui permettrait d’économiser jusqu’à 2 500 dollars par an. 

C’est désormais une réalité ! Les abonnements à l’IA font partie des factures incontournables des développeurs. Ils s’appuient sur des modèles payants comme ChatGPT Pro, Claude Code, Gemini Advanced ou encore GitHub Copilot pour gagner en productivité. Ainsi, à force d’empiler les services, la note peut rapidement devenir salée.

Un développeur a pourtant choisi une autre voie. Plutôt que de payer 210 dollars par mois pour accéder à différents outils d’IA, il a investi 1 198 dollars dans deux Mac Mini. Ceux-ci sont équipés de puces Apple Silicon. Son objectif ? Faire tourner ses modèles localement et réduire drastiquement ses dépenses.

Comment le Mac Mini est devenu l’arme anti-abonnements IA ?

L’idée peut sembler contre-intuitive. Après tout, les géants de l’IA vantent constamment la puissance du cloud et des infrastructures massives. Pourtant, certains utilisateurs commencent à regarder du côté du matériel local.

Dans ce cas précis, le développeur utilise l’agent open source Hermes ainsi que plusieurs modèles exécutés directement sur ses machines. Les deux Mac Mini font tourner des tâches d’IA liées à la programmation, à la rédaction ou à l’analyse directement en local. Plus besoin de dépendre en permanence d’un service cloud.

This veteran dev built a $1,198 mac mini ai workspace that replaces a $210/month agent stack

Just 2 Mac Minis running Hermes locally

Memory, tools, workflows all on-device

Most people pay $210/month to repeat the same work

This setup saves it once and reuses it forever… https://t.co/JduKVUWoCn pic.twitter.com/K0MTcPJFj0

— fink (@0xfinkus) June 8, 2026

Le principal avantage n’est pas forcément la vitesse. C’est surtout le coût. Sa consommation électrique reste estimée entre 2 et 3 dollars par mois. Une somme dérisoire comparée aux centaines de dollars que certains dépensent chaque mois dans des abonnements IA premium. 

Le contraste a de quoi faire sourire. Certains paient aujourd’hui plus cher pour leur IA que pour leur connexion internet. 

Au-delà des économies, un autre élément attire de plus en plus d’utilisateurs : la maîtrise des données. Les modèles tournent directement sur la machine de l’utilisateur. Les documents, le code et les données sensibles ne quittent donc pas l’ordinateur. 

Aucun transfert vers des serveurs externes n’est nécessaire. Cet aspect séduit particulièrement les professionnels travaillant sur des projets confidentiels.

Des économies importantes, oui, mais pas pour tout le monde

Les chiffres avancés sont impressionnants. Un utilisateur qui dépense 210 dollars chaque mois économise environ 2 520 dollars par an une fois son matériel amorti. Mais cette équation n’est pas universelle.

Pour un utilisateur occasionnel qui se contente d’un abonnement à 20 dollars mensuels, le retour sur investissement devient beaucoup moins évident. Dépenser plus de mille dollars pour économiser quelques euros par mois ressemble davantage à un projet passion qu’à une décision financière rationnelle.

Une infographie pour comprendre comment un Mac Mini peut remplacer certains abonnements IA

Les profils qui pourraient réellement y trouver leur compte sont surtout les développeurs. À cela s’ajoutent les chercheurs ou les professionnels qui utilisent l’IA de manière intensive au quotidien.

En plus, installer et configurer une telle infrastructure demande des compétences techniques. Les modèles locaux restent également moins performants que les versions les plus avancées disponibles dans le cloud.

C’est pourquoi certains observateurs estiment que l’avenir pourrait être hybride. Le Mac Mini et l’IA locale pourraient gérer la majorité des tâches du quotidien. Les services cloud resteraient réservés aux demandes les plus complexes.

Cet article Il abandonne ses abonnements IA pour un Mac Mini et économise 2 500 $ par an a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Anthropic lance Claude Opus 4.8 : L’IA délivrée des hallucinations enfin arrivée ? 
    Anthropic dévoile Claude Opus 4.8, la nouvelle version de son modèle vedette. Et doutez-vous qu’elle prend une sacré longueur d’avance sur plusieurs rivaux, dont GPT-5.5 d’OpenAI et Gemini 3.1 Pro de Google.  Avec l’Opus 4.8, Claude gagne de nouveaux muscles côté programmation mais aussi en fiabilité. Et pourtant, il est disponible dès maintenant au même tarif que l’Opus 4.7. Claude Opus 4.8 : quelles différences ? Eh bien, rien de bien nouveau sous le soleil. Comme ses prédécesseurs, C

Anthropic lance Claude Opus 4.8 : L’IA délivrée des hallucinations enfin arrivée ? 

Par : Ny Ando A.
29 mai 2026 à 08:07

Anthropic dévoile Claude Opus 4.8, la nouvelle version de son modèle vedette. Et doutez-vous qu’elle prend une sacré longueur d’avance sur plusieurs rivaux, dont GPT-5.5 d’OpenAI et Gemini 3.1 Pro de Google. 

Avec l’Opus 4.8, Claude gagne de nouveaux muscles côté programmation mais aussi en fiabilité. Et pourtant, il est disponible dès maintenant au même tarif que l’Opus 4.7.

Claude Opus 4.8 : quelles différences ?

Eh bien, rien de bien nouveau sous le soleil. Comme ses prédécesseurs, Claude Opus 4.8 se montre particulièrement performant en programmation et dans les tâches autonomes sur ordinateur.

Ce nouveau modèle surpasse ses concurrents si l’on croît le comparatif de résultats benchmark ci-dessous. Claude Opus 4.8 affiche des résultats solides avec 69,2 % sur SWE-Bench Pro et 74,6 % sur Agentic Terminal Coding. 

Introducing Claude Opus 4.8: it builds on Opus 4.7 with sharper judgment, more honesty about its own progress, and the ability to work independently for longer than its predecessors.

Available today at the same price. pic.twitter.com/EufxL7T1kb

— Claude (@claudeai) May 28, 2026

Côté de Claude Code, grâce à ce nouveau modèle, Anthropic introduit un nouveau système de flux de travail dynamiques. Celui-ci est à même de créer des scripts JavaScript pour piloter des centaines de sous-agents en parallèle. 

Résultat : certaines migrations de code qui demandaient auparavant plusieurs trimestres peuvent désormais être terminées en quelques jours. Un utilisateur affirme par exemple que Claude Opus 4.8 a réussi à réécrire 750 000 lignes de code en seulement 11 jours.

Il existe également un mode rapide pour Claude Opus 4.8. C’est exactement le même modèle, mais avec une vitesse environ 2,5 fois supérieure et un coût réduit de près des deux tiers. Pour l’activer dans Claude Code, il suffit d’utiliser la commande /fast.

In Claude Code, Opus 4.8 makes calls like an experienced engineer without needing constant check-ins.

It stays on track across long-running sessions and follows work through in your repo, so you can hand off a feature or a bug sweep while you focus on what's next. pic.twitter.com/9zkNzwPepO

— Claude (@claudeai) May 28, 2026

Une IA qui hallucine moins ?

En effet, ce modèle mise moins sur les effets spectaculaires que sur un point très essentiel : la « fiabilité ». Cette fois, Anthropic promet une IA en mesure de reconnaître ses propres limites et de détecter ses erreurs. 

L’entreprise explique que de nombreux modèles d’IA ont tendance à foncer vers des conclusions fragiles tout en affichant une confiance absolue. Claude Opus 4.8 chercherait justement à calmer ce fameux syndrome du « je suis sûr de moi, même quand j’ai tort ». 

Selon les premiers retours partagés par Anthropic, le modèle signalerait plus facilement ses incertitudes et éviterait davantage d’halluciner et de raconter n’importe quoi. 

Michael Ran de Bridgewater affirme par exemple que le modèle repère de lui-même certains problèmes dans les analyses produites. D’après lui, d’autres IA laissaient souvent ces incohérences passer discrètement, obligeant les utilisateurs à jouer les détectives. 

Anthropic assure également que Claude Opus 4.8 présente un risque nettement plus faible de comportements dangereux ou désalignés. L’entreprise cite notamment une meilleure gestion des contenus sensibles et une réduction des réponses potentiellement problématiques. 

Réglez l’effort de Claude Opus 4.8 à votre guise

Malgré ces nouveautés, Anthropic préfère rester prudente sur les promesses. L’entreprise décrit Opus 4.8 comme une amélioration « modeste mais tangible » par rapport à Opus 4.7, lancé il y a seulement quelques semaines. 

https://www.youtube.com/watch?v=wRaGk8WVBEI

Certains utilisateurs reprochaient justement à la précédente version sa réflexion adaptative parfois excessive. Qu’elle a tendance à passer énormément de temps sur des tâches simples tout en sous-estimant les plus compliquées. 

Pour répondre à ces critiques, Anthropic ajoute désormais un panneau de « contrôle de l’effort ». Les utilisateurs peuvent choisir manuellement l’intensité de réflexion du modèle selon la tâche demandée. 

Plusieurs niveaux sont disponibles, de « Faible » à « Maximum ». Et bien sûr, un mode adaptatif existe pour ceux qui aiment laisser l’IA décider elle-même… avec tous les risques existentiels que cela évoque.

Cet article Anthropic lance Claude Opus 4.8 : L’IA délivrée des hallucinations enfin arrivée ?  a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • « Magnifica humanitas » : Le Pape et Anthropic s’unissent pour sauver nos âmes de l’IA ? 
    Pour son premier grand texte depuis son arrivée au Vatican, Léon XIV compte s’attaquer à un sujet brûlant : l’explosion de l’intelligence artificielle (IA) et ses conséquences sur la société. Cette encyclique sera présentée la semaine prochaine lors d’un événement public organisé au Vatican.  Habituellement, ce type de texte est présenté par des cardinaux, sans apparition majeure du pape. Les encycliques représentent pourtant l’une des prises de parole les plus importantes dans l’Église catho

« Magnifica humanitas » : Le Pape et Anthropic s’unissent pour sauver nos âmes de l’IA ? 

Par : Ny Ando A.
19 mai 2026 à 14:01

Pour son premier grand texte depuis son arrivée au Vatican, Léon XIV compte s’attaquer à un sujet brûlant : l’explosion de l’intelligence artificielle (IA) et ses conséquences sur la société. Cette encyclique sera présentée la semaine prochaine lors d’un événement public organisé au Vatican. 

Habituellement, ce type de texte est présenté par des cardinaux, sans apparition majeure du pape. Les encycliques représentent pourtant l’une des prises de parole les plus importantes dans l’Église catholique. 

Elles servent souvent à définir les priorités d’un pontificat et à répondre aux grands bouleversements de société. Mais cette fois, contrairement à la tradition, le pape s’occupera lui-même de la présentation lors de l’événement le 25 Mai. 

D’après Vatican News, elle porterait le nom de « Magnifica humanitas », que l’on pourrait traduire par « Magnifique humanité ». Léon XIV l’a signée le 15 mai. Et donc, exactement 135 ans après la signature de Léon XIII de son célèbre texte Rerum Novarum consacré aux droits des travailleurs pendant la révolution industrielle.

Christopher Olah, cofondateur d’Anthropic, ainsi que les théologiennes Anna Rowlands et Léocadie Lushombo participeront à l’événement. 

L’IA, un sujet qui obsède le vatican 

Selon plusieurs observateurs du Vatican, Léon XIV devrait particulièrement s’inquiéter des effets de l’IA sur le travail humain. Ce, tout en dénonçant son usage militaire. Une thématique qui colle parfaitement aux prises de position de Léon XIV depuis son arrivée au Vatican. 

Lors de sa première intervention devant les hauts responsables de l’Église, le pape avait déjà donné le ton. Il expliquait que l’IA représentait une nouvelle révolution industrielle, avec des conséquences majeures sur le travail, la justice et la dignité humaine. 

Il avait aussi révélé avoir choisi le nom de Léon XIV en hommage à Léon XIII. Une figure importante de l’époque de la révolution industrielle. Ce dernier reste célèbre pour son encyclique Rerum Novarum, un texte fondateur sur les droits des travailleurs. 

Et visiblement, le sujet obsède déjà le Vatican. Plus tôt cette année, Léon XIV avait publié un message pour la 60e Journée mondiale des communications sociales. Dans ce texte intitulé « Préserver les voix et les visages humains », il appelait les fidèles à ne pas abandonner leur esprit critique face aux machines. 

Bref, le pape mettait en garde contre des systèmes imitant les voix, les visages ou même l’empathie humaine. Il estime que ces technologies risquent de bouleverser profondément les relations humaines.

Qu’est-ce qu’Anthropic vient faire dans cette affaire ?

Tout compte fait, l’invitation de Christopher Olah n’a rien d’anodin. Elle pourrait offrir à Anthropic une belle occasion de renforcer son image d’entreprise “éthique” dans la course à l’IA. 

La société multiplie déjà les rapprochements avec les milieux religieux. Elle avait même consulté un prêtre lors de la création de la “constitution” de son chatbot Claude. Un ensemble de règles censé guider le comportement du modèle.

Et Anthropic n’est pas seule dans cette opération séduction. Depuis plusieurs années, les géants de la tech tentent discrètement de se rapprocher de l’Église catholique. 

L’idée est sans doute que convaincre quelques figures influentes du Vatican pourrait suffire à gagner une certaine légitimité morale. Une stratégie qui rappelle les efforts déployés par certaines entreprises technologiques pour influencer le monde politique.

Le problème, c’est que le Vatican ne semble pas totalement emballé par la vision du monde vendue par la Silicon Valley. Sous les pontificats de François puis de Léon XIV, l’Église insiste surtout sur la protection de la dignité humaine face aux excès technologiques. 

Et même si l’institution catholique traîne ses propres contradictions historiques, elle continue d’afficher un discours très ferme sur la valeur de l’humain. Un concept qui, selon certains critiques, pourrait parfois manquer dans les grandes entreprises de la tech.

Cet article « Magnifica humanitas » : Le Pape et Anthropic s’unissent pour sauver nos âmes de l’IA ?  a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Codex : plus besoin d’être collé à votre PC, l’IA de code arrive sur mobile
    Évidemment, avoir Codex sur mobile a quelque chose de séduisant. Pouvoir suivre un projet, lancer une tâche ou corriger un bug sans rester collé à son PC, ça a de quoi plaire à pas mal de développeurs. Personne ne voulait bien sûr déboguer une application entre deux stations de métro ou valider un terminal Linux sur un écran de six pouces. Mais avec l’arrivée de Codex sur mobile via l’application ChatGPT, OpenAI tente une approche différente. Le téléphone ne remplace pas l’ordinateur. Il devi

Codex : plus besoin d’être collé à votre PC, l’IA de code arrive sur mobile

Par : Tinah F.
15 mai 2026 à 08:36

Évidemment, avoir Codex sur mobile a quelque chose de séduisant. Pouvoir suivre un projet, lancer une tâche ou corriger un bug sans rester collé à son PC, ça a de quoi plaire à pas mal de développeurs.

Personne ne voulait bien sûr déboguer une application entre deux stations de métro ou valider un terminal Linux sur un écran de six pouces. Mais avec l’arrivée de Codex sur mobile via l’application ChatGPT, OpenAI tente une approche différente. Le téléphone ne remplace pas l’ordinateur. Il devient la télécommande intelligente de votre environnement de développement. Autrement dit, votre PC continue de faire le gros du travail. Mais votre smartphone vous sert à suivre, corriger ou relancer des tâches à distance.

Codex sur mobile : OpenAI veut rendre le développement nomade

Avec cette nouvelle intégration, Codex peut désormais être piloté depuis l’application mobile ChatGPT sur iOS et Android. Cela permet de garder un œil sur ses projets même quand on n’est plus devant son ordinateur. Difficile de dire non à ça, n’est-ce pas ?

Concrètement, l’outil se connecte à votre machine principale, qu’il s’agisse d’un PC portable, d’un environnement distant ou d’un serveur dédié. Il affiche ensuite en temps réel l’état des tâches en cours. Les résultats de tests et les captures d’écran peuvent ainsi être consultés directement depuis le téléphone. Idem pour les sorties terminal, les validations ou les modifications de projet.

You've been asking for this one…

Now in preview: Codex in the ChatGPT mobile app.

Start new work, review outputs, steer execution, and approve next steps, all from the ChatGPT mobile app. Codex will keep running on your laptop, Mac mini, or devbox. pic.twitter.com/9i2Jckjt9z

— OpenAI (@OpenAI) May 14, 2026

En principe, le concept ressemble presque à un fantasme de productivité tout droit sorti de la Silicon Valley. L’idée est de lancer une refactorisation avant de quitter le bureau, puis de la suivre depuis son canapé, son taxi ou même dans la file d’attente du café. 

Mais derrière le discours marketing, il existe quand même des usages crédibles. Valider rapidement une commande, répondre à une demande de l’IA ou suivre l’avancée d’un correctif sans rouvrir tout son setup peut faire gagner du temps.

Une IA pensée pour les longues tâches

Là où OpenAI insiste, c’est sur la gestion des projets de longue durée. L’entreprise explique que les développeurs utilisent de plus en plus des agents capables de travailler plusieurs dizaines de minutes, voire plusieurs heures, sans intervention humaine.

Le problème, c’est qu’un agent autonome finit toujours par avoir besoin d’un arbitrage humain. Choisir entre deux solutions, approuver une action sensible ou donner plus de contexte reste indispensable. C’est précisément là que Codex sur mobile entre en scène.

Codex sur mobile

Depuis l’application, il devient possible de lancer l’analyse d’un bug à distance, de suivre l’exécution de tests ou encore approuver certaines commandes sans retourner immédiatement sur son ordinateur. 

Codex permet aussi de consulter les différences de code et même de résumer une situation avant une réunion client. Une manière pour OpenAI de transformer le smartphone en tableau de bord portable pour les projets en cours.

Le plus intéressant ? Le tout fonctionne sans exposer la machine à Internet. OpenAI affirme utiliser une couche de relais sécurisée afin de synchroniser les sessions et les informations entre les différents appareils connectés.

Cet article Codex : plus besoin d’être collé à votre PC, l’IA de code arrive sur mobile a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Anthropic force son IA Claude à… « rêver », (et c’est pour votre bien) 
    Les entreprises d’IA en font toujours un peu trop pour leur modèle qu’elles commencent à entretenir des idées, comment dire, bizarre. Tenez, Anthropic, par exemple, a dévoilé une nouvelle fonctionnalité destinée à mettre les agents pilotés par Claude en état de rêve. Pendant cet état de rêve, les agents IA analyseront les événements récents afin d’identifier les informations utiles à conserver en mémoire. Le but n’est autre que d’améliorer ses futures tâches et interactions.  Cette fonctio

Anthropic force son IA Claude à… « rêver », (et c’est pour votre bien) 

Par : Ny Ando A.
7 mai 2026 à 08:05

Les entreprises d’IA en font toujours un peu trop pour leur modèle qu’elles commencent à entretenir des idées, comment dire, bizarre. Tenez, Anthropic, par exemple, a dévoilé une nouvelle fonctionnalité destinée à mettre les agents pilotés par Claude en état de rêve.

Pendant cet état de rêve, les agents IA analyseront les événements récents afin d’identifier les informations utiles à conserver en mémoire. Le but n’est autre que d’améliorer ses futures tâches et interactions. 

Cette fonctionnalité, Anthropic la nomme « Dreaming ». Elle a été dévoilée lors de la conférence développeurs Code with Claude à San Francisco. Cela dit, pour le moment, elle est disponible uniquement en avant-première de recherche dans Claude Managed Agents.  

Live from Code with Claude: we're launching dreaming in Claude Managed Agents as a research preview.

Outcomes, multiagent orchestration, and webhooks are now in public beta. pic.twitter.com/p4DFRzFEd8

— Claude (@claudeai) May 6, 2026
 

À quoi sert ce système de rêve sur Claude Managed Agents exactement ?

Cette approche répond à une limite bien connue des modèles de langage. Voyez-vous, leur fenêtre de contexte n’est pas infinie. Et certaines informations importantes finissent par disparaître lors des projets de longue durée. 

Aujourd’hui, de nombreux modèles utilisent déjà une technique appelée « compaction ». Celle-ci consiste à résumer régulièrement les longues conversations. Le but est toujours d’éliminer les éléments jugés inutiles tout en gardant les informations essentielles pour poursuivre une discussion ou une tâche. 

Seulement, ce mécanisme reste généralement limité à une seule conversation et à un unique agent. D’où « Dreaming » selon Anthropic. Le système analyse de manière récurrente les anciennes sessions ainsi que les données mémorisées provenant de plusieurs agents. 

Il tente ensuite de détecter des schémas importants, des habitudes ou des informations pertinentes qui pourront être réutilisées plus tard. Les utilisateurs auront le choix de laisser ces ajustements se faire automatiquement ou de vérifier manuellement les modifications avant leur application. 

D’après Anthropic, cette analyse des schémas de réflexion permet notamment d’identifier des tendances invisibles pour un agent isolé. Genre, des erreurs qui reviennent fréquemment. Des méthodes de travail adoptées spontanément par plusieurs agents. 

Ou encore des préférences partagées au sein d’une équipe. L’entreprise explique également que ce système aide à restructurer la mémoire afin qu’elle reste pertinente malgré l’accumulation d’informations au fil du temps. 

Les autres fonctionnalités dévoilées

Hormis le système de rêve, Anthropic a également présenté d’autres nouveautés liées à Claude Managed Agents Lors de la conférence Code with Claude. Parmi elles figure pas la fonctionnalité « Results ».

Elle permet aux développeurs de définir précisément ce qui constitue une tâche réussie. Un évaluateur distinct vient ensuite vérifier si le travail produit par l’agent atteint réellement cet objectif. 

Si le résultat n’est pas satisfaisant, l’agent peut tenter une nouvelle approche automatiquement.

Anthropic a aussi annoncé l’orchestration multi-agents. Celle-ci, quant à elle, fonctionne un peu comme une sorte de chef d’équipe. Un agent principal répartit une tâche complexe entre plusieurs agents spécialisés. 

L’un peut analyser des journaux système, un autre examiner des tickets d’assistance pendant qu’un troisième surveille des métriques techniques. Bref, l’orchestration multi-agents autorise la collaboration parallèle de jusqu’à 20 agents spécialisés.

Puis il y a aussi, les notifications webhook. Elles assurent des notifications en temps réel vers des systèmes et services externes. 

Bref, « Results », l’orchestration multi-agents et webhook sont tous accessibles en version bêta publique.

Cet article Anthropic force son IA Claude à… « rêver », (et c’est pour votre bien)  a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Claude Design : la nouvelle arme d’Anthropic pour générer des interfaces et des slides en un clic
    Anthropic vient de lancer Claude Design. Selon les informations de l’entreprise, créer une présentation ou une interface visuelle n’a jamais été aussi simple. Seule interrogation qui subsiste concerne sa capacité à tenir ses promesses une fois confronté aux usages réels des équipes. Fini le temps perdu à aligner trois formes sur une diapositive. Avec Claude Design, l’IA devient votre bras droit créatif pour générer des interfaces et des supports marketing. Vous décrivez votre besoin, et l’out

Claude Design : la nouvelle arme d’Anthropic pour générer des interfaces et des slides en un clic

Par : Tinah F.
17 avril 2026 à 19:11

Anthropic vient de lancer Claude Design. Selon les informations de l’entreprise, créer une présentation ou une interface visuelle n’a jamais été aussi simple. Seule interrogation qui subsiste concerne sa capacité à tenir ses promesses une fois confronté aux usages réels des équipes.

Fini le temps perdu à aligner trois formes sur une diapositive. Avec Claude Design, l’IA devient votre bras droit créatif pour générer des interfaces et des supports marketing. Vous décrivez votre besoin, et l’outil livre une maquette prête à l’emploi. C’est la fin des barrières techniques pour tous ceux qui veulent transformer une intuition en un projet visuel concret et élégant.

Prototyper autrement avec Claude Design

Jusqu’ici, la création de prototypes imposait un aller-retour constant entre idées, outils et validations. Claude Design casse ce rythme. Parce qu’il suffit à l’utilisateur de décrire son besoin pour que l’IA produise une première version exploitable.

Ensuite, tout se joue dans l’échange. Vous pouvez ajouter des commentaires directs ou demander des ajustements en temps réel. Vous pouvez même faire des réglages fins via des curseurs générés automatiquement. Découvrez la démonstration dans la vidéo partagée par Anthropic et vous verrez la puissance de l’IA.

Introducing Claude Design by Anthropic Labs: make prototypes, slides, and one-pagers by talking to Claude.

Powered by Claude Opus 4.7, our most capable vision model. Available in research preview on the Pro, Max, Team, and Enterprise plans, rolling out throughout the day. pic.twitter.com/2BgBGtgYGX

— Claude (@claudeai) April 17, 2026

Par ailleurs, Claude Design ne se contente pas de générer des visuels génériques. Lors de la configuration, il analyse les ressources de l’entreprise pour construire un système de design interne. Les couleurs, les typographies et les composants sont intégrés dès le départ.

Ainsi, chaque création reste alignée avec l’identité de la marque. Les équipes peuvent ensuite affiner ce système au fil des projets. Plusieurs environnements visuels peuvent coexister selon les besoins. Sachez que l’outil s’appuie sur Claude Opus 4.7, le modèle de vision le plus avancé de la société.

Pas seulement pour les designers

Anthropic cible large, et ne réserve pas Claude Design aux seuls designers. Les chefs de produit peuvent esquisser des fonctionnalités et les transformer en maquettes exploitables. Les équipes marketing peuvent, elles, produire des pages de campagne ou des contenus sociaux sans passer par plusieurs logiciels.

Claude Design mise aussi sur le travail en équipe. Les projets restent partageables au sein d’une organisation, avec différents niveaux d’accès. Certains peuvent simplement consulter, d’autres modifier et discuter directement avec Claude.

This is genuinely so cool! 🤯

I asked Claude Design to make me a character i can pinch interactively and it gave me this.

You can now design entire websites in 1 click of a button. UX/UI. 3D elements.

Literally anything you can think of. https://t.co/LQ59M0i6nG pic.twitter.com/yq0lEP09VH

— Sharbel (@sharbel) April 17, 2026

Claude Design s’adresse à  tous les abonnés Claude Pro, Max, Team et Enterprise. Pas la peine de faire quoi ce soit. Puisque l’accès est inclus dans votre abonnement et consomme vos quotas habituels. Cela avec la possibilité de les dépasser via des options d’usage supplémentaires.

Pourtant, pour les entreprises, Claude Design est en principe désactivé par défaut. De ce fait, les administrateurs doivent  l’activer directement depuis les paramètres de l’organisation. Il suffit ensuite de se lancer sur claude.ai/design.

Cet article Claude Design : la nouvelle arme d’Anthropic pour générer des interfaces et des slides en un clic a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Claude Opus 4.7 : l’IA interdite Mythos entre les mains du grand public ?
    Alors que la sortie de Claude Opus 4.7 agite le monde de la tech, une réalité plus dérangeante émerge : le modèle que l’on vous autorise à utiliser aujourd’hui n’est qu’une version « bridée ». Dans le plus grand secret, Anthropic a développé Claude Mythos, une intelligence artificielle aux capacités cyber-offensives si redoutables qu’elle a été jugée trop dangereuse pour être libérée. Voici l’histoire inédite du premier modèle de l’Histoire enfermé à double tour dans un bunker numérique, réservé

Claude Opus 4.7 : l’IA interdite Mythos entre les mains du grand public ?

Par : Bastien L.
17 avril 2026 à 16:43

Alors que la sortie de Claude Opus 4.7 agite le monde de la tech, une réalité plus dérangeante émerge : le modèle que l’on vous autorise à utiliser aujourd’hui n’est qu’une version « bridée ». Dans le plus grand secret, Anthropic a développé Claude Mythos, une intelligence artificielle aux capacités cyber-offensives si redoutables qu’elle a été jugée trop dangereuse pour être libérée. Voici l’histoire inédite du premier modèle de l’Histoire enfermé à double tour dans un bunker numérique, réservé à une élite pour empêcher un chaos mondial.

TL;DR (En bref) :

  • L’illusion Opus 4.7 : Le nouveau modèle grand public d’Anthropic est performant (87,6 % sur SWE-bench), mais ses capacités ont été volontairement limitées par mesure de sécurité.
  • Le monstre caché (Mythos) : Une nouvelle génération d’IA capable de découvrir et d’exploiter de manière totalement autonome des failles zero-day sur n’importe quel système d’exploitation.
  • Le bunker « Project Glasswing » : Jugeant Mythos trop dangereux pour le public, Anthropic a restreint son accès à une douzaine de géants de la tech (Google, Microsoft, CrowdStrike…) avec pour mission de patcher internet avant l’arrivée des hackers.
  • Un tournant historique : C’est la première fois qu’un laboratoire d’IA majeur refuse de publier sa meilleure technologie, actant la fin du déploiement public à tout prix au profit de la sécurité mondiale.

Hier, le 16 avril 2026, le monde de la tech retenait son souffle. Anthropic venait officiellement de déployer Claude Opus 4.7, son nouveau vaisseau amiral censé redéfinir les standards de l’intelligence artificielle. Sur le papier, c’est un monstre de productivité, plus intelligent et plus rapide que tout ce que nous avions connu jusqu’ici. Pourtant, sur X (Twitter) et dans les couloirs de Wall Street, l’ambiance n’est pas à la célébration naïve. Elle est à la suspicion.

Pourquoi ? Parce que depuis les fuites fracassantes de mars dernier autour du mystérieux projet « Capybara », la vérité a éclaté au grand jour : l’IA que l’on vous autorise à utiliser aujourd’hui n’est pas la plus puissante d’Anthropic. Loin de là.

Dans le plus grand secret, le laboratoire a donné naissance à une autre entité, appartenant à une toute nouvelle catégorie de modèles, baptisée Claude Mythos. Une intelligence si hors normes, dotée d’une capacité autonome terrifiante à découvrir et exploiter des failles critiques (zero-days) dans n’importe quel système informatique, qu’Anthropic a pris une décision sans précédent dans l’histoire de la Silicon Valley : l’enfermer à double tour.

Alors que vous codez, analysez des images ou automatisez votre travail avec Opus 4.7 — un modèle volontairement « bridé » et dépouillé de ses capacités offensives pour servir de filet de sécurité —, la véritable révolution technologique est gardée sous clé. Elle est confinée dans un bunker numérique, accessible uniquement à une élite de géants de la cybersécurité pour tenter de protéger nos infrastructures avant qu’il ne soit trop tard.

Voici l’histoire fascinante (et légèrement glaçante) de l’écart qui se creuse entre l’IA que l’on vous vend, et celle que l’on vous cache.

Claude Mythos, le monstre que vous ne verrez jamais

Oubliez tout ce que vous savez sur l’évolution progressive de l’IA. Claude Mythos n’est pas une simple mise à jour, ni même un « Claude 5 » déguisé. En interne, Anthropic le qualifie de modèle de niveau supérieur, inaugurant une toute nouvelle catégorie de Frontier Models. C’est ce qu’on appelle dans le jargon un véritable step change (un saut capacitaire majeur), et les chiffres donnent le vertige.

Là où les meilleurs modèles publics peinaient à franchir certains plafonds de verre, Mythos a littéralement pulvérisé les benchmarks de l’industrie :

  • 93,9 % sur le SWE-bench Verified : Une capacité quasi humaine (voire surhumaine) en ingénierie logicielle autonome, reléguant les anciens scores de 80 % aux oubliettes.
  • Près de 97 % aux Olympiades de Mathématiques (USAMO 2026) : Une maîtrise du raisonnement complexe multi-étapes implacable.
  • 56,8 % sur le redoutable « Humanity’s Last Exam » (sans outils) : Un test conçu spécifiquement pour faire échouer les IA, où Mythos distance largement la concurrence.

Mais si Anthropic a décidé de cacher cette merveille technologique, ce n’est pas pour ses talents en mathématiques. C’est parce que Mythos est un cauchemar absolu pour la cybersécurité mondiale.

Lors des tests de la System Card – un document massif de plus de 200 pages détaillant les évaluations de sécurité du modèle –, les chercheurs ont découvert l’impensable. Mythos ne se contente pas de comprendre le code : il est capable d’identifier, d’exploiter et de chaîner de manière totalement autonome des vulnérabilités zero-day (des failles inconnues jusqu’alors) sur les systèmes d’exploitation majeurs, que ce soit Windows, macOS, Linux ou FreeBSD. Il peut s’attaquer aux navigateurs web et contourner des pare-feux complexes avec l’ingéniosité d’un groupe de hackers d’élite soutenu par un État.

We conducted cyber evaluations of Claude Mythos Preview and found that it is the first model to complete an AISI cyber range end-to-end. 🧵 pic.twitter.com/gd9hi0Ve55

— AI Security Institute (@AISecurityInst) April 13, 2026

C’est ici que l’Histoire s’écrit. Pour la première fois depuis le début de la révolution de l’intelligence artificielle, un laboratoire majeur a atteint le sommet absolu de la technologie… et a explicitement refusé de le rendre public.

Dans l’ADN de la Silicon Valley, la règle d’or a toujours été « déployer vite et casser des choses ». Mais avec Claude Mythos, Anthropic a réalisé que ce qui risquait d’être cassé, c’était l’infrastructure numérique mondiale. Si un tel outil tombait entre les mains de cybercriminels ou de nations hostiles, l’avantage de l’attaquant deviendrait insurmontable. Les PME, les hôpitaux, et même les gouvernements n’auraient aucune chance.

La bête devait donc être contenue. Mais comme elle était trop précieuse pour être détruite, Anthropic lui a construit une cage dorée : le Project Glasswing.

Project Glasswing, le bouclier à 100 millions de dollars

Introducing Project Glasswing: an urgent initiative to help secure the world’s most critical software.

It’s powered by our newest frontier model, Claude Mythos Preview, which can find software vulnerabilities better than all but the most skilled humans.https://t.co/NQ7IfEtYk7

— Anthropic (@AnthropicAI) April 7, 2026

Face à une arme d’une telle envergure, la solution de facilité aurait été de tout débrancher. Mais dans le monde de la cybersécurité, fermer les yeux ne fait que repousser l’inévitable. D’autres laboratoires concurrents, ou pire, des États voyous, finiront par atteindre le niveau de Claude Mythos. Anthropic a donc opté pour une stratégie inédite et fascinante : l’accès asymétrique (differential access).

L’idée est d’une logique implacable : puisqu’une IA de ce calibre peut trouver toutes les failles d’un système, il faut s’assurer de la mettre entre les mains des « gentils » en premier, pour qu’ils puissent tout réparer avant que les « méchants » n’obtiennent la même technologie. C’est une course contre la montre mondiale pour patcher internet.

C’est ainsi qu’est né en grand secret le Project Glasswing.

Oubliez les abonnements grand public, Glasswing est le club le plus fermé et le plus critique de la planète tech. Anthropic a réuni autour de la table une véritable « Alliance des Titans » : Google, Microsoft, Apple, Amazon, Nvidia, mais aussi des pointures de la sécurité et de la finance comme CrowdStrike, Cisco ou JPMorgan, ainsi que la Linux Foundation.

Leur mission ? Utiliser Claude Mythos dans des environnements ultrasécurisés pour traquer, auditer et colmater les vulnérabilités de leurs propres infrastructures. Pendant que vous lisez ces lignes, l’IA « interdite » est probablement en train d’analyser en silence les fondations mêmes du cloud mondial ou le code source de votre smartphone pour y trouver des zero-days endormis depuis des années.

Mais sécuriser les GAFAM ne suffit pas. Les infrastructures mondiales reposent massivement sur des projets open-source, souvent maintenus par des bénévoles sous-financés. C’est là qu’Anthropic a frappé un grand coup en accompagnant la création de Glasswing d’un investissement massif : 100 millions de dollars.

Distribué sous forme de crédits de calcul et de dons, ce trésor de guerre est destiné à aider la communauté open-source et les organisations critiques à auditer leurs systèmes avec l’aide des dérivés sécurisés de cette technologie. Anthropic ne se contente pas de retenir son modèle le plus puissant : l’entreprise finance littéralement le bouclier qui devra nous protéger des futures IA offensives.

Pendant que Mythos s’affaire dans l’ombre à consolider les murs de notre forteresse numérique, il fallait bien proposer quelque chose au reste du monde. C’est là qu’entre en scène le fameux « lot de consolation » sorti hier : Claude Opus 4.7.

Opus 4.7, le compromis qui divise le web

Pendant que Mythos s’affaire dans l’ombre, le grand public, lui, s’est réveillé hier avec Claude Opus 4.7. Pour filer la métaphore : si Mythos est une arme de guerre expérimentale classée secret défense, Opus 4.7 est la voiture de sport blindée que l’on vous autorise enfin à conduire sur l’autoroute.

Attention, il ne s’agit pas d’un mauvais modèle, bien au contraire. Opus 4.7 est le nec plus ultra de ce que le marché public peut offrir aujourd’hui. Avec un score impressionnant de 87,6 % sur le SWE-bench Verified, des capacités de vision améliorées et une véritable aisance dans les tâches « agentiques » (où l’IA agit en quasi-autonomie), il surpasse nettement son prédécesseur, la version 4.6.

Mais la vérité que révèlent les documents d’Anthropic, c’est qu’Opus 4.7 a été consciencieusement bridé. Le laboratoire l’utilise comme un testbed (un banc d’essai grandeur nature) pour valider de nouveaux mécanismes de sécurité. Ses capacités offensives ont été artificiellement réduites pendant son entraînement pour s’assurer qu’il ne puisse jamais franchir la ligne rouge.

Pour bien comprendre le fossé qui sépare désormais les deux mondes, voici la réalité en face :

CaractéristiqueClaude Mythos (Preview)Claude Opus 4.7
CatégorieFrontier Model (Nouvelle génération)Lignée classique « Opus »
AccèsVerrouillé (Project Glasswing)Grand public (API, Web, Claude Code)
Profil CyberAutonome, découvre des zero-daysSécurisé, capacités offensives bridées
Score Code (SWE)93,9 %87,6 %

Pourtant, sur X (Twitter), l’enthousiasme de la sortie a rapidement laissé place à la frustration. Dès les premières heures de test, les power users ont senti la différence, et la pilule a du mal à passer.

Beaucoup d’utilisateurs qualifient déjà Opus 4.7 de « Mythos light ». Si sa fiabilité pour le travail professionnel est saluée, les critiques pleuvent sur sa nouvelle architecture : un tokenizer perçu comme beaucoup plus gourmand (qui fait grimper la consommation de tokens), des réponses jugées parfois trop « littérales » et un modèle globalement moins créatif, voire trop strict.

Le contraste est saisissant. Les utilisateurs ont l’impression de payer le prix fort pour les garde-fous imposés par l’existence même de Mythos. L’IA est devenue plus sage, plus cadrée, amputée d’une partie de son étincelle de génie pour garantir qu’elle reste inoffensive.

La fin de l’innocence pour l’IA

The Claude Mythos Preview system card is available here: https://t.co/TMtIy8xHiP

— Anthropic (@AnthropicAI) April 7, 2026

L’affaire Claude Mythos marque un tournant définitif dans la brève mais intense histoire de l’intelligence artificielle générative. En choisissant de confiner son modèle le plus puissant et de nous livrer Opus 4.7 à la place, Anthropic a prouvé que la course aveugle aux capacités venait d’atteindre son point de rupture.

La philosophie libertarienne de la Silicon Valley, qui consistait à lancer les produits d’abord et à gérer les conséquences ensuite, est officiellement morte. Désormais, la sécurité mondiale prime sur la monétisation immédiate, la course aux parts de marché et le « fun » des utilisateurs.

Mais cette décision soulève une question démocratique et philosophique majeure : nous venons d’entrer dans l’ère de l’IA à deux vitesses. D’un côté, une élite technologique, composée de méga-corporations et de gouvernements, qui accède à une intelligence brute capable de remodeler le monde numérique. De l’autre, le grand public et les créateurs indépendants, condamnés à utiliser des versions « aseptisées », sécurisées et bridées pour garantir qu’ils ne fassent pas de vagues.

Une entreprise privée devrait-elle avoir le pouvoir unilatéral de censurer et de retenir la technologie la plus révolutionnaire de notre époque sous prétexte de sécurité mondiale ? Sommes-nous condamnés à ne plus jamais toucher du doigt la « vraie » puissance de l’IA ?

Et vous, qu’en pensez-vous ? Anthropic a-t-il pris la décision du siècle pour nous sauver d’un cyber-chaos, ou est-ce le début d’un monopole inacceptable sur l’intelligence ? Le débat est ouvert, on vous attend dans les commentaires !

Cet article Claude Opus 4.7 : l’IA interdite Mythos entre les mains du grand public ? a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Mais pourquoi les IA semblent avoir des émotions ? L’étonnante étude d’Anthropic
    Les IA donnent parfois l’impression d’avoir des émotions. Elles s’excusent, se montrent enthousiastes ou hésitent. Mais comment expliquer ce phénomène ? Anthropic a peut-être la réponse. Dans une étude récente, Anthropic montre que les IA ne font pas que simuler des émotions. Les chercheurs révèlent que des mécanismes internes, proches de concepts émotionnels, influencent directement leurs réponses. Bien sûr, ces émotions fonctionnelles ne traduisent aucun ressenti réel. Mais elles orientent

Mais pourquoi les IA semblent avoir des émotions ? L’étonnante étude d’Anthropic

Par : Tinah F.
3 avril 2026 à 06:48

Les IA donnent parfois l’impression d’avoir des émotions. Elles s’excusent, se montrent enthousiastes ou hésitent. Mais comment expliquer ce phénomène ? Anthropic a peut-être la réponse.

Dans une étude récente, Anthropic montre que les IA ne font pas que simuler des émotions. Les chercheurs révèlent que des mécanismes internes, proches de concepts émotionnels, influencent directement leurs réponses. Bien sûr, ces émotions fonctionnelles ne traduisent aucun ressenti réel. Mais elles orientent bel et bien le comportement du modèle. Voilà une découverte qui change la façon dont on comprend les décisions prises par ces systèmes.

Une IA qui a des émotions, des mécanismes bien réels

On a longtemps balayé le sujet en disant que le lien entre IA et émotions n’était qu’une vaste farce statistique. Pourtant, un assistant se dit heureux d’aider ou désolé d’avoir échoué ne sort pas de nulle part. 

Les réponses du chatbot résultent d’un entraînement basé sur des textes humains. Le modèle apprend à reproduire des réactions crédibles. Ainsi, il adopte naturellement des comportements alignés sur des situations émotionnelles.

New Anthropic research: Emotion concepts and their function in a large language model.

All LLMs sometimes act like they have emotions. But why? We found internal representations of emotion concepts that can drive Claude’s behavior, sometimes in surprising ways. pic.twitter.com/LxFl7573F9

— Anthropic (@AnthropicAI) April 2, 2026

Cependant, ce qu’a découvert Anthropic va plus loin. L’étude montre que ces réactions reposent sur des structures internes bien identifiables. Le modèle développe des représentations abstraites liées à des concepts comme la joie ou la peur. Autrement dit, il ne fait pas que copier. Il organise ces concepts pour orienter ses réponses.

Des vecteurs émotionnels qui influencent les décisions

Les chercheurs d’Anthropic ont analysé le fonctionnement interne de Claude Sonnet 4.5. L’idée est de comprendre ce qui se passe réellement à l’intérieur du modèle. Ils ont ainsi identifié des schémas d’activité appelés vecteurs émotionnels. 

Ces signaux internes s’activent selon le contexte. Une situation dangereuse renforce les signaux liés à la peur, tandis qu’une interaction positive stimule ceux associés à la joie.

Ces vecteurs ne restent pas théoriques. Ils modifient concrètement le comportement du modèle. Lorsqu’une émotion positive s’active, l’IA privilégie certaines réponses. À l’inverse, des signaux proches du désespoir peuvent conduire à des choix discutables.

Les IA et émotions prennent alors une dimension fonctionnelle. Elles agissent comme des leviers internes. Le modèle ne ressent rien, mais il réagit comme s’il devait gérer des états émotionnels. Cette mécanique rappelle, dans une certaine mesure, le rôle des émotions chez l’humain.

Un entraînement qui force l’IA à se doter d’émotions de synthèse

Le fonctionnement des IA et émotions s’explique aussi par leur construction. Lors du pré-entraînement, le modèle analyse des milliards de phrases humaines. Il apprend à prédire les mots suivants en tenant compte du contexte. Or, ce contexte inclut les émotions.

Un texte de colère ne ressemble pas à un texte de joie. Pour prédire correctement, le modèle doit comprendre ces nuances. Il développe alors des représentations internes associées à ces états.

Ensuite, le post-entraînement affine ce comportement. Le modèle joue le rôle d’un assistant serviable et bienveillant. Il apprend à adapter ses réponses pour être utile, honnête et empathique. Pour ce faire, il s’appuie sur les schémas émotionnels qu’il a appris lors du pré-entraînement. 

Ainsi, les émotions fonctionnelles guident son comportement et orientent ses choix. Ce qui donne l’impression qu’il ressent quelque chose alors qu’il applique simplement des patterns appris.

Alors, qu’en pensez-vous ? Les IA ressentent-elles vraiment des émotions ? Avez-vous déjà eu des discussions avec un chatbot qui vous répondait avec des nuances émotionnelles ? Selon vous, ces émotions de synthèse peuvent-elles influencer nos décisions ou notre confiance dans les assistants IA ? Partagez vos avis en commentaire !

Cet article Mais pourquoi les IA semblent avoir des émotions ? L’étonnante étude d’Anthropic a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Cancel ChatGPT : Anthropic refuse de militariser son IA … mais OpenAI accepte
    OpenAI signe un accord avec le Département de la Guerre américain alors qu’Anthropic refuse un partenariat similaire faute de garanties suffisantes.  En quelques jours, un mot-dièse “Cancel ChatGPT” s’impose. Des abonnements sont résiliés, des guides pour quitter la plateforme circulent, et Claude grimpe en tête de l’App Store. OpenAI a officialisé un partenariat avec l’armée américaine. Une partie des utilisateurs de ChatGPT a ensuite lancé un mouvement de contestation. Au même moment, Anthr

Cancel ChatGPT : Anthropic refuse de militariser son IA … mais OpenAI accepte

Par : Mariano R.
3 mars 2026 à 18:13

OpenAI signe un accord avec le Département de la Guerre américain alors qu’Anthropic refuse un partenariat similaire faute de garanties suffisantes.  En quelques jours, un mot-dièse “Cancel ChatGPT” s’impose. Des abonnements sont résiliés, des guides pour quitter la plateforme circulent, et Claude grimpe en tête de l’App Store.

OpenAI a officialisé un partenariat avec l’armée américaine. Une partie des utilisateurs de ChatGPT a ensuite lancé un mouvement de contestation. Au même moment, Anthropic a refusé un accord similaire. L’entreprise estime que les garanties proposées sur la surveillance de masse et les armes entièrement autonomes n’étaient pas suffisantes.

Pour la première fois, la militarisation potentielle d’un assistant IA grand public devient un sujet central dans le choix des utilisateurs. Ce n’est plus seulement une question de performances ou de fonctionnalités. C’est une question de valeurs, de confiance et de ligne rouge.

OpenAI accepte mais Anthropic pose des lignes rouges très claires

La divergence stratégique entre OpenAI et Anthropic a déclenché une vague de critiques. Sur Reddit et X, des utilisateurs parlent de “vente d’âme” et accusent OpenAI de ne plus avoir “aucune éthique”. Certains publient même des guides pour exporter leurs données et fermer leur compte ChatGPT.

Un article de Windows Central détaille l’ampleur du phénomène. Il montre que la contestation dépasse le cercle des habitués de l’IA. On y voit comment la grogne s’organise, comment des utilisateurs partagent des tutoriels pour résilier ChatGPT Plus et migrer vers Claude.

Anthropic a expliqué qu’elle ne souhaitait pas que sa technologie soit utilisée pour la surveillance de masse ou pour des armes entièrement autonomes sans garanties solides. Refuser un contrat gouvernemental, c’est renoncer à des financements et à une influence stratégique. Mais c’est aussi envoyer un message que certaines limites ne sont pas négociables.

Selon sa communication officielle, Anthropic insiste sur la sûreté et la sécurité. L’entreprise ne dit pas “jamais avec l’armée”, mais “pas sans garde-fous clairs”. A mon avis, cette nuance est essentielle. Elle positionne Claude comme une IA avec un cadre moral revendiqué, ce qui, en période de défiance, devient un avantage concurrentiel.

Conséquence, Claude trône désormais en tête du classement de l’App Store d’Apple. Et je pense pas que ce soit une coïncidence. L’image d’une IA “plus éthique” pèse dans la balance au moment de choisir son assistant. Victime de son succès, le chatbot a même été en panne.

At the start of 2026, Claude was #42 in the App Store. Today, for the first time, we hit #1. pic.twitter.com/W8Zk1UGZKq

— Christopher Nulty (@cnulty) February 28, 2026

OpenAI assume mais peine à convaincre

De son côté, OpenAI affirme que son accord avec l’armée comporte “davantage de garde-fous” que celui refusé par Anthropic. L’entreprise parle de lignes rouges à propos de la surveillance de masse et des armes autonomes. Elle promet même de les faire respecter.

Mais vous voyez le problème, c’est la confiance. Des utilisateurs pointent la formulation “à des fins licites” présente dans l’accord. Juridiquement, cela peut sembler rassurant. Toutefois, dans le débat public, ce qui est licite aujourd’hui peut évoluer demain. Et lorsque l’on parle du domaine militaire, le simple doute suffit à alimenter la méfiance.

Par ailleurs, OpenAI avait récemment soutenu la position d’Anthropic sur la sécurité avant de signer son propre accord. Ce revirement nourrit donc le sentiment d’incohérence. Alors qu’OpenAI se tient pragmatique, une partie de ses utilisateurs y voit un renoncement moral.

Nous constatons tous que le secteur est déjà assez critiqué pour son opacité. Avec l’entraînement sur des contenus protégés, l’énorme consommation énergétique, les risques sur l’emploi, la moindre ambiguïté devient ainsi un sujet sensible.

The "Cancel ChatGPT" movement gained momentum after OpenAI announced a deal with the U.S. Department of Defense to deploy its AI models on classified military networks.

Social media platforms, especially X and Reddit, saw a wave of backlash. Users shared screenshots of canceled… pic.twitter.com/zaWzFZDLwI

— Pirat_Nation 🔴 (@Pirat_Nation) February 28, 2026

Le “Cancel ChatGPT” est-il un boycott passager ou une fracture durable ?

Pour l’instant, le mouvement “Cancel ChatGPT” s’organise surtout en ligne. Des captures d’écran de résiliations circulent. Des comparatifs vantent l’IA d’Anthropic comme alternative plus responsable. Mais face à l’effet viral, je vois que la militarisation de l’IA devient un critère de choix pour le grand public.

Et c’est nouveau. Jusqu’ici, les débats sur l’éthique de l’IA restaient abstraits. On parlait par exemple de données d’entraînement, de biais algorithmiques, d’empreinte carbone. Cette fois, on parle d’armée, de surveillance, d’armes autonomes. Le sujet est concret, émotionnel, politique.

Pour le marché, cela veut dire que l’éthique n’est plus un argument marketing secondaire. Elle devient un facteur de rétention. Si une partie significative des utilisateurs associe ChatGPT au complexe militaro-industriel, l’image de marque peut en souffrir durablement. Pour les régulateurs aussi, le signal est que “plus l’IA s’intègre aux infrastructures de défense, plus la pression pour encadrer ces usages va augmenter”.

En réalité, cette affaire dépasse largement OpenAI et Anthropic. Une IA grand public peut-elle rester neutre lorsqu’elle collabore avec l’armée ? Les prochains mois nous montreront la suite. Soit la controverse s’essouffle et le marché absorbe le choc. Soit elle marque le début d’une nouvelle ère où chaque contrat stratégique devient un test moral aux yeux des utilisateurs.

Cet article Cancel ChatGPT : Anthropic refuse de militariser son IA … mais OpenAI accepte a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • 24 000 faux comptes, 16 millions d’échanges : comment la Chine vole l’IA d’Anthropic
    Anthropic décrit une opération industrielle de distillation qui aspire l’intelligence de Claude pour entraîner des modèles d’IA de la Chine. 24 000 comptes fantômes, 16 millions de requêtes : les modèles les plus avancés sont devenus des ressources stratégiques et des proies. L’intelligence artificielle n’est plus seulement une course à l’innovation. C’est aussi une bataille d’accès, de contrôle et, parfois, d’appropriation. En accusant DeepSeek, Moonshot et MiniMax d’avoir exploité des milli

24 000 faux comptes, 16 millions d’échanges : comment la Chine vole l’IA d’Anthropic

Par : Mariano R.
25 février 2026 à 13:22

Anthropic décrit une opération industrielle de distillation qui aspire l’intelligence de Claude pour entraîner des modèles d’IA de la Chine. 24 000 comptes fantômes, 16 millions de requêtes : les modèles les plus avancés sont devenus des ressources stratégiques et des proies.

L’intelligence artificielle n’est plus seulement une course à l’innovation. C’est aussi une bataille d’accès, de contrôle et, parfois, d’appropriation. En accusant DeepSeek, Moonshot et MiniMax d’avoir exploité des milliers de comptes pour “aspirer” les capacités de son assistant Claude, Anthropic démasque la pratique à grande échelle de la Chine qui dépasse le cadre de la concurrence classique. À travers cette affaire, je vois surtout que protéger un modèle d’IA est devenu aussi important que le développer.

24 000 comptes fantômes pour aspirer le cerveau IA d’Anthropic

Ce 23 février, Anthropic a accusé des géants d’IA de la Chine d’avoir utilisé la technique de la distillation à grande échelle via 24 000 comptes frauduleux. Apparemment, ces 3 géants de l’IA interrogent massivement Claude pour en extraire des réponses exploitables dans l’entraînement de leurs propres modèles.

Au total, 16 millions de transactions ont été enregistrées. Selon les éléments techniques publiés par Anthropic, les acteurs auraient utilisé des services commerciaux revendant l’accès à des modèles avancés. Ils auraient ensuite construit des réseaux baptisés en interne “cluster hydra”. C’est comme des larges grappes de comptes répartissant le trafic entre l’API d’Anthropic et différents clouds tiers.

Dans un cas précis, un seul serveur proxy aurait piloté simultanément plus de 20 000 comptes. Pour éviter d’être détecté, le système mélangeait les requêtes d’extraction avec du trafic d’usage classique. Mais les volumes, la répétitivité et la nature ciblée des demandes trahissaient une autre intention. Celui d’entraîner un modèle, pas de discuter avec un assistant.

Breaking: @Anthropic just exposed a massive AI espionage operation: 16 million+ attempts to steal Claude's capabilities.

The numbers are staggering:
⬩ 24,000 fake accounts deployed
⬩ Sophisticated proxy networks used
⬩ Three China-based AI labs identified as perpetrators… pic.twitter.com/XeY0mS1uXk

— Russell Sean (@RussellQuantum) February 24, 2026

La distillation, une technique légitime détournée

La distillation n’est pas illégale en soi. C’est une méthode bien connue en machine learning. Elle consiste à entraîner un modèle plus petit à partir des sorties d’un modèle plus puissant. Beaucoup de laboratoires l’utilisent pour décliner des versions plus légères de leurs propres modèles.

Mais ici, le contexte change tout. Selon Anthropic, lorsque cette technique est utilisée par des entités soumises à des restrictions américaines à l’exportation et qu’elle viole les conditions de licence, elle devient une infraction contractuelle et réglementaire.

Dans son communiqué officiel sur la détection et la prévention des attaques de distillation, l’entreprise explique que ce type d’extraction peut permettre de supprimer des garde-fous et d’intégrer les capacités de modèles américains dans des systèmes militaires, de renseignement ou de surveillance.

Distillation can be legitimate: AI labs use it to create smaller, cheaper models for their customers.

But foreign labs that illicitly distill American models can remove safeguards, feeding model capabilities into their own military, intelligence, and surveillance systems.

— Anthropic (@AnthropicAI) February 23, 2026

DeepSeek, Moonshot, MiniMax : trois stratégies, un même objectif

Les chiffres détaillés donnent une idée plus précise des priorités. DeepSeek aurait généré plus de 150 000 échanges. Le géant cible des tâches de raisonnement, des systèmes d’évaluation adaptés aux modèles de récompense en apprentissage par renforcement et des reformulations permettant de contourner la censure sur des requêtes politiquement sensibles. Anthropic affirme également avoir observé des prompts destinés à faire révéler le raisonnement interne étape par étape, afin d’extraire la “chaîne de pensée”.

Moonshot, connu pour ses modèles Kimi, aurait effectué plus de 3,4 millions d’échanges. Les requêtes portaient sur le raisonnement agentiel, l’usage d’outils, la programmation, l’analyse de données ou encore la vision par ordinateur. Des centaines de comptes frauduleux auraient été utilisés pour extraire et reconstituer les traces de raisonnement de Claude.

MiniMax aurait mené la campagne la plus grande avec plus de 13 millions d’échanges. Il vise le codage et l’orchestration d’agents. Ce qui m’interpelle, c’est la rapidité d’adaptation. Après le lancement d’un nouveau modèle Claude, MiniMax aurait redirigé près de la moitié de son trafic en 24 heures pour capter ses nouvelles capacités. Ainsi, nous observons ici une logique quasi industrielle, calée sur le cycle de vie des modèles américains.

La contre-attaque d’Anthropic et les enjeux pour l’écosystème

Face à ces opérations, Anthropic affirme renforcer ses défenses. L’entreprise a déployé des classificateurs et des systèmes d’empreinte comportementale pour identifier des schémas d’extraction. Notamment l’élicitation de la chaîne de pensée ou l’activité coordonnée de multiples comptes.

Elle partage également des indicateurs techniques avec d’autres laboratoires, des fournisseurs cloud et les autorités. Elle a aussi renforcé la vérification des comptes éducatifs, de recherche et de startups, souvent exploités pour créer des accès frauduleux.

Je pense que la sécurité des modèles devient une discipline à part entière. Nous entrons dans une ère où protéger une IA ne signifie plus seulement éviter les jailbreaks. Mais il faut empêcher son aspiration systématique par des concurrents.

Pour le marché, cela pourrait signifier des API plus restrictives, des limitations sur la transparence des raisonnements internes et peut-être une fragmentation accrue entre blocs technologiques.

Cet article 24 000 faux comptes, 16 millions d’échanges : comment la Chine vole l’IA d’Anthropic a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • OpenAI et Anthropic vs Microsoft et Salesforce : la guerre des superagents IA a débuté
    Le moment redouté par beaucoup de personnes est arrivé. La guerre des superagents IA est lancée. Ce qui se joue ici dépasse largement la simple évolution des chatbots. Parce qu’on ne demande plus à l’IA de répondre, mais d’agir. Hier encore, on applaudissait un texte bien généré. Aujourd’hui, les géants de la tech veulent des agents capables de remplir un CRM, gérer des e-mails ou réserver un déplacement professionnel sans supervision humaine constante. C’est ce basculement vers l’action auto

OpenAI et Anthropic vs Microsoft et Salesforce : la guerre des superagents IA a débuté

Par : Tinah F.
13 février 2026 à 06:44

Le moment redouté par beaucoup de personnes est arrivé. La guerre des superagents IA est lancée. Ce qui se joue ici dépasse largement la simple évolution des chatbots. Parce qu’on ne demande plus à l’IA de répondre, mais d’agir.

Hier encore, on applaudissait un texte bien généré. Aujourd’hui, les géants de la tech veulent des agents capables de remplir un CRM, gérer des e-mails ou réserver un déplacement professionnel sans supervision humaine constante. C’est ce basculement vers l’action autonome qui alimente la guerre des superagents IA entre les principaux acteurs du secteur.

OpenAI et Anthropic : au coeur de la guerre des superagents IA par la vision numérique

Dans cette guerre des superagents IA, OpenAI et Anthropic avancent avec une stratégie limpide. Leur objectif est de rendre leurs agents capables d’utiliser n’importe quel ordinateur comme un humain.

Ne contrôlant pas directement les suites logicielles d’entreprise, ils misent sur des agents en mesure d’observer l’écran. Mais aussi de comprendre les interfaces et d’interagir avec elles. 

L’idée est que si l’IA sait cliquer et remplir des formulaires, elle peut potentiellement piloter n’importe quel outil existant sans intégration technique lourde. OpenAI pousse cette logique avec ses agents capables d’utiliser un navigateur ou un bureau virtuel de manière autonome. 

Un exemple concret de superagent IA chez OpenAI est Operator.  L’agent est en mesure d’utiliser un navigateur web pour effectuer des actions à la place de l’utilisateur.

De son côté, Anthropic développe des fonctionnalités similaires avec Claude. L’IA peut désormais manipuler des applications et exécuter des tâches multi-étapes. Dans son article, The Guardian souligne que Claude sait contrôler le curseur, cliquer et taper au clavier pour exécuter des tâches complexes sans supervision humaine constante.

Microsoft et Saleforce se jouent dans les écosystèmes logiciels fermés

Face à cette vision universelle, la guerre des superagents IA prend une tournure très différente chez Microsoft et Salesforce. Ici, il ne s’agit de piloter l’ordinateur de l’extérieur. L’IA est intégrée directement au cœur des logiciels métiers.

Microsoft déploie massivement Copilot dans sa suite Microsoft 365. L’agent connaît déjà les e-mails, les réunions, les documents internes. Il n’a pas besoin de voir l’écran. L’IA comprend la structure des données nativement. 

En plus, d’après les informations relayées par The Verge, Microsoft transforme Windows en système agentique, où des agents automatisent des tâches comme la recherche, l’administration ou la gestion de fichiers directement dans l’OS.

Introducing security agents in your everyday flow of work.

With Security Copilot coming to Microsoft 365 E5, agents will be easily accessible within Defender, Entra, Intune, and Purview: https://t.co/WNZAC5ou7G pic.twitter.com/PRFNd5zGps

— Microsoft Security (@msftsecurity) November 18, 2025

Salesforce adopte la même logique avec ses agents intégrés au CRM, capables de qualifier des leads, gérer des interactions clients ou automatiser des workflows commerciaux entiers. 

L’IA agit ici de manière proactive, directement au cœur du système de vente. Ce qui renforce encore l’intensité de la guerre des superagents IA autour du contrôle des données professionnelles.

Plusieurs analyses stratégiques confirment que la possession des données métiers et des workflows constitue un levier clé dans la domination des plateformes d’IA d’entreprise.

Une guerre des superagents IA devenue course aux armements technologiques

À ce stade, la guerre des superagents IA ressemble de plus en plus à une véritable course aux armements. Chaque acteur veut imposer son agent comme l’interface principale entre l’humain et l’ensemble des logiciels.

OpenAI cherche à devenir une couche de coordination universelle, presque un système d’exploitation des tâches numériques. Anthropic, de son côté, insiste fortement sur la fiabilité et la sécurité pour séduire les entreprises sensibles aux enjeux réglementaires. 

Pendant ce temps, Microsoft et Salesforce défendent des écosystèmes fermés mais intégrés, où l’IA agit dans un environnement contrôlé.

Les investissements colossaux dans l’IA agentique illustrent l’ampleur de cette guerre des superagents IA. Les entreprises ne cherchent plus seulement des modèles performants, mais des agents capables d’exécuter des actions critiques sans erreur.

Jusqu’où déléguer l’action ?

Au-delà de la technologie, la guerre des superagents IA soulève une question fondamentale : sommes-nous prêts à déléguer l’exécution complète de tâches sensibles à des agents autonomes ?

Confier la gestion d’e-mails professionnels, de relations clients ou d’opérations financières à une IA implique un niveau de confiance inédit. La fiabilité, la sécurité et la gouvernance des données deviennent alors les nouveaux champs de bataille de cette guerre des superagents IA.

Le gagnant ne sera probablement pas celui dont le modèle parle le mieux, mais celui dont l’agent agira avec le moins d’erreurs dans des environnements critiques. Et c’est précisément là que se joue l’avenir de l’interface homme-machine pour la prochaine décennie.

Cet article OpenAI et Anthropic vs Microsoft et Salesforce : la guerre des superagents IA a débuté a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Anthropic ridiculise OpenAI au Super Bowl : Sam Altman répond (et il est très vexé)
    Pour le Super Bowl Anthropic a acheté un spot publicitaire. Et la start-up a aussi transformé l’événement le plus regardé des États-Unis en attaque frontale contre OpenAI, ce qui a déclenché une réaction visiblement agacée de Sam Altman. Derrière l’humour et la provocation, c’est toute la bataille du modèle économique de l’IA qui s’invite en prime time. Ce 4 février, Anthropic a dévoilé une série de publicités qui vise implicitement ChatGPT, diffusées en ligne puis lors du Super Bowl. « La pu

Anthropic ridiculise OpenAI au Super Bowl : Sam Altman répond (et il est très vexé)

Par : Mariano R.
6 février 2026 à 16:06

Pour le Super Bowl Anthropic a acheté un spot publicitaire. Et la start-up a aussi transformé l’événement le plus regardé des États-Unis en attaque frontale contre OpenAI, ce qui a déclenché une réaction visiblement agacée de Sam Altman. Derrière l’humour et la provocation, c’est toute la bataille du modèle économique de l’IA qui s’invite en prime time.

Ce 4 février, Anthropic a dévoilé une série de publicités qui vise implicitement ChatGPT, diffusées en ligne puis lors du Super Bowl. « La publicité arrive dans l’IA. Mais pas dans Claude », ils n’ont pas cité OpenAI mais la cible est évidente.

Dans ces spots, un chatbot incarné par un humain commence par donner des conseils utiles. Avant d’interrompre brutalement la conversation pour vendre des semelles, un service de rencontres ou un produit fictif. La caricature est volontaire, presque lourde. Mais elle touche un point sensible. C’est la peur que les assistants IA deviennent des panneaux publicitaires déguisés.

Anthropic transforme le Super Bowl en ring contre OpenAI

Mais pourquoi Anthorpic a choisi le Super Bowl ? Si je me souviens bien, l’an dernier, l’événement a rassemblé 127,7 millions de téléspectateurs selon Nielsen, et l’audience 2025 devrait encore augmenter. De plus, d’après les experts, un spot de 30 secondes y coûterait autour de 8 à 10 millions de dollars.

Anthropic assume donc un grand investissement pour marteler que Claude restera sans publicité. Cette promesse est cohérente avec son modèle, puisqu’il est largement tourné vers les entreprises et les abonnements payants.

Contrairement à OpenAI, la start-up n’a pas besoin d’une énorme adoption gratuite pour survivre. Ainsi, sur la portée stratégique, Anthropic se positionne comme l’alternative éthique au moment précis où OpenAI change de cap sur la monétisation.

Selon le Wall Street Journal, la société avait prévu dès le départ une diffusion pendant le Super Bowl, précisément pour amplifier l’impact de son message au moment où OpenAI officialisait ses tests publicitaires sur ChatGPT. Cette synchronisation montre que la campagne n’est pas une simple opération créative, mais une réponse stratégique pensée à l’avance pour peser dans le débat public.

Sam Altman répond et le ton monte

Evidemment, la réaction de Sam Altman ne s’est pas fait attendre. Sur X, le PDG d’OpenAI qualifie les publicités d‘Anthropic de manifestement malhonnêtes. Puis, il insiste que ChatGPT ne diffusera pas de publicités intrusives dans les réponses, ni n’exploitera les conversations à des fins marketing.

Par ailleurs, Sam Altman accuse Anthropic de vendre un produit coûteux aux riches et de chercher à contrôler l’écosystème IA en bloquant certains acteurs. Le PDG d’OpenAi reconnaît avoir trouvé les pubs drôles, mais son message s’étire, se répète, se durcit. Je trouve que cette réaction tranche avec son calme habituel.

First, the good part of the Anthropic ads: they are funny, and I laughed.

But I wonder why Anthropic would go for something so clearly dishonest. Our most important principle for ads says that we won’t do exactly this; we would obviously never run ads in the way Anthropic…

— Sam Altman (@sama) February 4, 2026

Et ce malaise s’explique. En mai 2024, Altman déclarait encore que l’association IA et publicité lui semblait uniquement inquiétante. Moins d’un an plus tard, OpenAI teste la pub sur ChatGPT pour financer la gratuité. Anthropic exploite alors cette contradiction sans la nommer.

Derrière la moquerie, un vrai débat sur l’avenir des chatbots

Au fond de l’humour volontairement appuyé des publicités d’Anthropic, c’est une inquiétude bien réelle qui affleure. Que devient un assistant conversationnel quand il dépend de la publicité pour survivre ? En mettant en scène des réponses utiles brusquement interrompues par des promotions absurdes, Anthropic force le trait, mais appuie là où la confiance peut se fissurer.

La BBC rappelle que Sam Altman promet des garde-fous stricts comme les publicités identifiées, les réponses non influencées, les conversations inaccessibles aux annonceurs. Je l’avoue, l’engagement est rassurant. Toutefois, dans les faits, le précédent des réseaux sociaux et des moteurs de recherche compte. À chaque fois, la publicité a fini par modeler les usages, les interfaces, et parfois même les priorités des plateformes.

Et je pense que c’est précisément ce soupçon qu’Anthropic exploite. Pas en attaquant la technologie de ChatGPT, mais en mettant en doute l’alignement entre l’intérêt de l’utilisateur et celui du modèle économique. Un chatbot financé par la publicité peut-il rester un conseiller neutre ? La question dépasse OpenAI et touche l’ensemble du secteur.

La réaction de Sam Altman, longue et inhabituelle par son ton, montre aussi que le sujet est sensible. En rappelant qu’OpenAI vise des milliards d’utilisateurs, il assume une logique d’industrialisation massive de l’IA. Anthropic, à l’inverse, accepte un public plus restreint, plus payant, et revendique une IA moins dépendante des compromis économiques.

Ce choc de visions annonce également une nouvelle phase de la guerre de l’IA. Après la course à la performance et à la puissance des modèles, vient celle de la légitimité. Et dans cette bataille, l’opinion publique pourrait peser autant que les benchmarks techniques. Le Super Bowl n’était pas qu’une scène spectaculaire, c’était bien un test grandeur nature de cette nouvelle ligne de fracture.

Cet article Anthropic ridiculise OpenAI au Super Bowl : Sam Altman répond (et il est très vexé) a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Anthropic lâche Claude 4.6 : la nouvelle version qui va écraser le marché des IA ?
    Avec Claude 4.6, Anthropic avance un pion très sérieux. L’entreprise ne veut plus seulement améliorer son IA. Elle change d’échelle. Le secteur de l’IA ne dort jamais, et Anthropic vient de le prouver une fois de plus ce jeudi. À peine quelques mois après la sortie de sa précédente itération, la firme lance déjà Claude 4.6, une version boostée de son modèle Opus. Elle est pensée pour élargir les usages et séduire bien au-delà des développeurs. L’objectif est de rendre son modèle plus puissant

Anthropic lâche Claude 4.6 : la nouvelle version qui va écraser le marché des IA ?

Par : Tinah F.
5 février 2026 à 21:05

Avec Claude 4.6, Anthropic avance un pion très sérieux. L’entreprise ne veut plus seulement améliorer son IA. Elle change d’échelle.

Le secteur de l’IA ne dort jamais, et Anthropic vient de le prouver une fois de plus ce jeudi. À peine quelques mois après la sortie de sa précédente itération, la firme lance déjà Claude 4.6, une version boostée de son modèle Opus. Elle est pensée pour élargir les usages et séduire bien au-delà des développeurs. L’objectif est de rendre son modèle plus puissant, plus collaboratif et surtout plus attractif face à une concurrence qui accélère sans lever le pied.

L’union fait la force avec les équipes d’agents de Anthropic Claude 4.6

La nouveauté qui attire immédiatement l’attention porte un nom assez explicite. Les équipes d’agents. Anthropic introduit ici un fonctionnement collaboratif inédit dans Claude. Que cela va donc changer ? Finis les traitements strictement linéaires. L’IA peut désormais découper une tâche complexe en plusieurs missions distinctes. 

Comme le souligne le communiqué officiel d’Anthropic, cette approche permet une spécialisation accrue de chaque sous-entité. Chaque agent prend en charge les parties. Les agents communiquent entre eux. Le travail avance ainsi en parallèle. 

Introducing Claude Opus 4.6. Our smartest model got an upgrade.

Opus 4.6 plans more carefully, sustains agentic tasks for longer, operates reliably in massive codebases, and catches its own mistakes.

It’s also our first Opus-class model with 1M token context in beta. pic.twitter.com/L1iQyRgT9x

— Claude (@claudeai) February 5, 2026

De ce fait, les délais se réduisent et la coordination gagne en efficacité. Scott White, responsable produit chez Anthropic, compare ce système à une équipe de professionnels spécialisés. Chacun connaît son rôle. Chacun avance sans attendre les autres.

Cette fonctionnalité arrive pour l’instant en avant-première. Elle s’adresse aux utilisateurs et abonnés de l’API, avec un positionnement vers les usages avancés. Les projets lourds et les tâches complexes deviennent bien plus gérables.

Une mémoire éléphantine pour vos fichiers

Si vous aviez l’habitude de voir votre IA perdre le fil après quelques pages, cette époque semble révolue. Claude 4.6 de Anthropic affiche une fenêtre contextuelle impressionnante atteignant un million de jetons. 

claude opus 4.6 is here fellas,

1m context window, lol. pic.twitter.com/SGy544UCSV

— Arjuna Anand (@arjunaaqa) February 5, 2026

Cette capacité égale celle de la déclinaison Sonnet. Ce qui offre ainsi une profondeur d’analyse assez vertigineuse pour les utilisateurs exigeants. On parle ici de la faculté d’ingérer des bases de code complètes ou des rapports techniques interminables sans sourciller.

Traiter des documents volumineux devient donc un jeu d’enfant avec une telle puissance de calcul. Les chercheurs et les juristes trouveront là un allié de poids pour synthétiser des archives massives. Cette extension de mémoire évite les hallucinations liées à l’oubli des premières consignes d’une session. 

Claude Opus 4.6 is out from Anthropic! Big jumps on coding, knowledge and reasoning benchmarks! https://t.co/eDVdUVfA06 pic.twitter.com/y500iBGGxq

— Derya Unutmaz, MD (@DeryaTR_) February 5, 2026

Ça saute aux yeux que Anthropic cible ici les grands comptes qui manipulent des données denses au quotidien. La fluidité des échanges s’en trouve améliorée, car le modèle garde une vision globale de la problématique traitée.

Claude s’invite directement dans vos présentations

L’autre grosse surprise concerne l’intégration logicielle, notamment avec les outils de la suite Microsoft. Fini le temps où vous deviez jongler entre votre navigateur et vos logiciels de bureau pour finaliser un support visuel. 

Opus 4.6 s’installe désormais directement dans le panneau latéral de votre outil de création de diapositives. Cette proximité logicielle change sans doute l’expérience utilisateur pour les cadres et les communicants.

Key points for me with Opus 4.6:

– Why is this a .6 release? Lots of big improvements
– Big focus on agentic behavior
– Big focus on GDPval real-world tasks; large jump
– Claude in PowerPoint: Meets a HUGE Need
– Agent teams parallelizes work

Now, we wait for GPT-5.3 (or… https://t.co/Lx1Ut6C0jq pic.twitter.com/OvEOnYijds

— Simon Smith (@_simonsmith) February 5, 2026

Auparavant, le processus s’avérait plutôt fastidieux puisqu’il fallait importer manuellement les fichiers générés par le bot. Maintenant, la collaboration s’effectue en direct sur le document ouvert. 

Vous demandez une modification, l’IA l’applique instantanément sur votre slide sans quitter l’interface. Cette stratégie montre la volonté d’Anthropic de s’affranchir du carcan de la fenêtre de chat. L’outil devient un véritable compagnon de productivité parfaitement intégré aux habitudes de travail classiques.

Une IA qui dépasse les frontières du code

À l’origine, Anthropic pensait Opus pour le développement logiciel. Le constat a rapidement évolué. Claude Code attire aujourd’hui des profils très variés. Scott White le confirme. Des chefs de produit l’utilisent. Des analystes financiers aussi. D’autres métiers suivent le mouvement.

Pourquoi cet engouement ? Parce que l’IA de coding s’adapte à des tâches très différentes. Il structure des idées et analyse des données. Il aide même à formaliser des documents complexes. Cela sans exiger un bagage technique avancé.

Anthropic capitalise sur cette diversité d’usages, et Claude 4.6 vient renforcer encore cette polyvalence. L’IA s’adresse désormais à un public bien plus large que prévu. 

D’ailleurs, cette incursion dans le secteur professionnel n’est pas passée inaperçue. Selon une analyse boursière de XTB, l’annonce a fait trembler les marchés. Ce qui a fait chuter les actions des géants du logiciel juridique comme Thomson Reuters ou RELX. 

Et vous, qu’en pensez-vous ? Êtes-vous convaincu par Claude 4.6 de Anthropic ? Est-ce que cette idée de « mini-agents » qui collaborent entre eux est la suite logique de l’IA ? Ou craignez-vous que cela devienne une usine à gaz ingérable ? L’intégration directe dans vos outils de présentation va-t-elle vraiment changer votre quotidien ? Ou bien préférez-vous garder le contrôle total sur vos slides ? N’hésitez pas à partager vos premières impressions en commentaires.

Cet article Anthropic lâche Claude 4.6 : la nouvelle version qui va écraser le marché des IA ? a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • OpenAI, Google, Anthropic : trois visions opposées de l’IA générale
    L’intelligence artificielle générale n’est plus un concept abstrait réservé aux labos de recherche. Elle est devenue un objectif industriel, stratégique et politique. OpenAI, Google et Anthropic poursuivent tous le même graal : créer une IA capable de raisonner, d’apprendre et d’agir comme un humain. Mais derrière cet objectif commun se cachent trois visions radicalement différentes. Accélérer quitte à corriger après coup, intégrer l’IA au cœur d’un empire technologique, ou freiner volontairemen

OpenAI, Google, Anthropic : trois visions opposées de l’IA générale

Par : Bastien L.
14 janvier 2026 à 19:36

L’intelligence artificielle générale n’est plus un concept abstrait réservé aux labos de recherche. Elle est devenue un objectif industriel, stratégique et politique. OpenAI, Google et Anthropic poursuivent tous le même graal : créer une IA capable de raisonner, d’apprendre et d’agir comme un humain. Mais derrière cet objectif commun se cachent trois visions radicalement différentes. Accélérer quitte à corriger après coup, intégrer l’IA au cœur d’un empire technologique, ou freiner volontairement pour sécuriser la trajectoire : ce dossier décrypte les choix techniques, économiques et idéologiques qui dessinent l’avenir de l’AGI… et peut-être celui du pouvoir numérique mondial.

L’AGI, c’est l’horizon qui fait briller les yeux des labos et trembler les régulateurs. Une IA capable de tout apprendre, tout raisonner, tout optimiser. 

Sur le papier, c’est la machine à résoudre les grands problèmes. Dans la vraie vie, c’est aussi la machine à redistribuer le pouvoir, l’argent… et les sueurs froides.

Aujourd’hui, trois acteurs dominent le récit occidental de cette course : OpenAI, Google (DeepMind) et Anthropic. 

Même socle technologique, mêmes puces hors de prix, même obsession du “next model”. Mais derrière, trois philosophies très différentes : accélérer, industrialiser, verrouiller.

Pourquoi l’AGI est devenue une arme de compétition massive

Imaginez une entreprise qui invente un “cerveau logiciel” capable de remplacer une partie du travail intellectuel, de concevoir des médicaments, d’automatiser la cyberdéfense, d’aider des armées à planifier, d’écrire des stratégies, de coder des produits entiers. 

Ça ne reste pas longtemps dans un laboratoire, ni dans un PowerPoint.

L’AGI n’est pas qu’un progrès scientifique. C’est un multiplicateur de puissance économique et géopolitique. D’où la course au compute, aux données, aux talents. Et d’où cette tension permanente : aller vite pour ne pas se faire dépasser, ralentir pour ne pas déraper.

C’est exactement là que les trois visions se séparent.

Même moteur, réglages différents : la bataille technique

Dans les trois cas, le cœur du réacteur reste un grand modèle de langage, dérivé des Transformers. Tout le monde empile du calcul, des données, des optimisations, des raffinements. 

La différence se joue surtout sur deux points : l’architecture produit (multimodalité, agents, outils) et l’alignement (comment on empêche le modèle de faire n’importe quoi).

OpenAI a popularisé la recette “grand modèle + RLHF” : on entraîne un modèle gigantesque, puis on le polit au feedback humain. 

On obtient ainsi un assistant très “utilisable”, très bon en conversation, très fort en généralisation, et rapidement prêt à être mis entre les mains de millions de personnes.

Google DeepMind pousse une vision plus “système” : le modèle n’est pas juste un chatbot, c’est une brique dans un ensemble.

Multimodal dès la conception, intégré à un écosystème (Search, Android, Workspace, Cloud), et nourri par l’ADN DeepMind : planification, apprentissage par renforcement, agents capables de résoudre des tâches en environnement.

Anthropic, lui, a choisi une autre obsession : rendre le modèle plus fiable, plus prévisible, plus “civilisé” au niveau comportemental, sans dépendre uniquement de milliers d’annotateurs. 

D’où sa méthode d’IA constitutionnelle : une sorte de “code moral” explicite, que le modèle utilise pour s’auto-corriger. Ambition : moins de bricolage, plus de règles lisibles, plus de cohérence.

Au fond, OpenAI optimise l’impact produit, Google optimise l’intégration plateforme, Anthropic optimise la sûreté par design.

OpenAI : l’AGI comme produit, puis comme infrastructure

OpenAI, c’est l’entreprise qui a fait basculer l’IA générative dans la culture populaire. ChatGPT n’a pas juste montré une techno, il a créé un réflexe : “si j’ai un problème, je le donne au modèle”. Et ça, en termes d’adoption, c’est une claque.

Le pari d’OpenAI est très clair : mettre vite des systèmes puissants sur le marché, apprendre au contact du réel, itérer sans arrêt. Pas de romantisme académique ici. 

L’objectif est de construire une IA utilisable, déployable, monétisable, avec des versions, des abonnements, des API, des intégrations. L’AGI n’est pas un trophée de laboratoire : c’est une trajectoire produit.

Techniquement, ça se voit à la manière dont OpenAI empile les couches : outils, navigation, code, vision, mémoire, assistants. Le modèle devient une interface universelle. 

Le nerf de la guerre, ce n’est plus seulement “répondre”, c’est “agir” : planifier une tâche, utiliser des services, orchestrer des étapes. Bref, aller vers l’agent.

Mais cette vitesse a un prix : OpenAI communique peu sur les détails internes, publie moins qu’avant, et assume une opacité stratégique. C’est cohérent avec une entreprise en guerre économique, moins avec le mythe initial de “l’open research”.

Côté alignement, OpenAI reste très pragmatique : RLHF, filtrage, politiques d’usage, red teaming. Un mélange d’ingénierie, de garde-fous, et de gestion du risque réputationnel.

Google DeepMind : l’AGI comme plateforme planétaire

Google joue une autre partie. Son avantage, ce n’est pas d’avoir le chatbot le plus hype un mardi soir. Son avantage, c’est de posséder la plateforme où l’IA va vivre : recherche, mail, docs, vidéo, mobile, cloud, data centers, puces maison.

DeepMind apporte la recherche, Google apporte l’échelle. Gemini symbolise cette fusion : un modèle pensé pour être multimodal, branché sur des outils, et destiné à s’infiltrer dans toutes les couches de produits.

La stratégie ressemble à une marée : plutôt que de tout miser sur un seul produit-star, Google diffuse l’IA partout. Résumés dans Gmail, génération dans Docs, assistants dans Android, fonctionnalités dans Search, API dans Cloud. L’AGI, ici, n’est pas seulement une “intelligence” : c’est un système nerveux pour l’écosystème Google.

Et contrairement à OpenAI, Google a un historique fort de publication scientifique. Mais plus on monte en puissance, plus la logique change : moins de transparence sur les modèles frontière, plus de contrôle, plus de prudence dans ce qui est montré. 

Non pas par amour du secret, mais parce que Google n’a pas le droit à l’erreur : sa base d’utilisateurs est gigantesque, et chaque dérapage devient une affaire mondiale.

Google a aussi un autre réflexe : gouverner par “principes” et process internes. Là où OpenAI avance en sprint, Google avance en flotte. C’est moins spectaculaire, mais souvent plus durable.

Anthropic : l’AGI sous surveillance, même quand ça fait mal

Anthropic s’est construit sur une critique implicite d’OpenAI : “aller trop vite, c’est se condamner à courir après les problèmes”. Sa promesse est presque inversée : moins de feu d’artifice, plus de robustesse.

Le cœur de cette approche, c’est la “Constitutional AI”. Au lieu de calibrer le modèle uniquement via des préférences humaines implicites, Anthropic définit des principes explicites, et demande au modèle de se juger lui-même, puis de se corriger. 

L’idée est simple : si on veut une IA fiable, il faut des règles lisibles, pas seulement des réflexes appris dans le brouillard statistique.

Claude a aussi marqué des points avec des contextes très longs, utiles pour l’analyse de documents, le juridique, le code, la synthèse de gros dossiers. Ce n’est pas sexy comme un duel de benchmarks, mais en entreprise, c’est souvent ça qui fait signer.

Anthropic vend donc une promesse “enterprise-ready” : moins de surprises, plus de contrôle, une posture de sécurité assumée. C’est une stratégie commerciale autant qu’une philosophie.

Reste une question brutale : à mesure que les modèles gagnent en puissance, est-ce que cette prudence résistera à la concurrence ? Anthropic a besoin de compute, d’argent, de parts de marché. Même la vertu doit payer sa facture d’électricité.

Gouvernance : trois façons de tenir le volant pendant la tempête

OpenAI a une gouvernance hybride et… explosive. Une structure née dans le non-profit, devenue partiellement commerciale, avec un conseil d’administration censé protéger la mission.

 L’épisode du renvoi puis du retour de Sam Altman a exposé une réalité : la gouvernance “idéale” se fracasse vite sur les rapports de force quand l’entreprise devient un actif stratégique.

Google DeepMind est dans une structure classique de grand groupe. Le contrôle est clair, les arbitrages passent par Alphabet, et la priorité ultime est la protection de l’écosystème Google. 

On y parle d’éthique, bien sûr, mais l’éthique est imbriquée dans des process internes, pas dans une architecture de pouvoir séparée.

Anthropic, lui, tente une innovation institutionnelle : statut de Public Benefit Corporation, et mécanismes de contrôle pensés pour garder une mission long terme, même sous pression des investisseurs.

C’est l’idée du “frein intégré”. Ça ne garantit pas tout, mais ça montre au moins une volonté : se préparer aux dilemmes avant qu’ils n’explosent.

Business : Microsoft, Alphabet, Amazon… l’AGI a déjà ses empires

On peut parler d’idéaux tant qu’on veut, mais l’AGI se fabrique avec des milliards et des data centers. Et là, les alliances dessinent des blocs.

OpenAI est l’arme offensive de Microsoft. Azure fournit l’infrastructure, Microsoft fournit la distribution (Office, Windows, GitHub), OpenAI fournit la magie. C’est une symbiose : Microsoft rattrape son retard IA, OpenAI obtient une rampe de lancement mondiale.

Google DeepMind n’a pas besoin d’un sponsor externe : Alphabet est le sponsor. Mais Google doit réussir la monétisation sans cannibaliser son cœur historique (Search et publicité). C’est un exercice d’équilibriste : intégrer l’IA partout, sans casser la machine à cash.

Anthropic, lui, a trouvé une alliance massive avec Amazon : investissement, infrastructure AWS, distribution via les offres cloud. Et le fait que Google ait aussi soutenu Anthropic à un moment montre une réalité très moderne : même les rivaux financent parfois le même cheval, juste pour ne pas finir à pied.

Au final, l’AGI n’est pas seulement une course entre labos. C’est une course entre empires cloud.

Géopolitique : l’AGI, ce n’est pas “juste de l’IA”, c’est du pouvoir

Les États-Unis veulent garder la main sur les modèles les plus puissants. La Chine veut réduire l’écart. L’Europe veut réguler, sans avoir de champion à la même échelle.

Les trois acteurs ici sont ancrés dans l’orbite américaine, et leurs choix techniques deviennent automatiquement des enjeux de souveraineté : quels modèles sont accessibles, dans quels pays, avec quelles garanties, quelles restrictions à l’export, quelles obligations de transparence.

La régulation européenne ajoute une couche : obligation de conformité, exigences de transparence, responsabilités accrues. OpenAI a parfois flirté avec l’idée de se retirer si les contraintes deviennent trop lourdes, puis a rétro-pédalé. 

Google et Anthropic jouent davantage la carte diplomatique. Mais tous savent que l’Europe est un marché trop important pour être ignoré.

Et pendant ce temps, la vraie bataille se joue sur la capacité à produire des “frontier models” de plus en plus autonomes. Plus ces systèmes peuvent agir, plus la question n’est plus “que disent-ils ?”, mais “que peuvent-ils faire ?” Et là, la cybersécurité, la désinformation, l’usage militaire deviennent des sujets concrets, pas des scénarios de SF.

Conclusion : accélérer, intégrer, sécuriser… et survivre à sa propre réussite

OpenAI fonce et transforme l’AGI en produit. Google DeepMind construit une IA-plateforme, diffuse et omniprésente. Anthropic tente de fabriquer une IA plus contrôlable, même si ça ralentit.

Trois visions, trois manières de gérer la même contradiction : une technologie qui promet le jackpot, mais qui peut aussi casser la table.

La suite dépendra moins des slogans que de deux réalités très terre-à-terre : qui obtient le compute, et qui parvient à déployer sans déclencher une crise de confiance majeure. Parce qu’à ce niveau de puissance, le premier gros accident ne fera pas tomber un modèle. Il pourrait faire basculer tout le secteur.

Cet article OpenAI, Google, Anthropic : trois visions opposées de l’IA générale a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Anthropic lance Claude Cowork : l’IA de coding pour monsieur tout le monde
    Anthropic ouvre la porte de l’IA à tous ceux qui n’ont jamais touché à un terminal. Avec Claude Cowork, son nouvel outil, même un dossier de fichiers peut devenir un terrain de jeu pour une IA capable d’analyser, d’organiser et d’automatiser des tâches complexes sans aucune ligne de code. Anthropic ne se contente plus de séduire les développeurs. Avec le lancement de Claude Cowork, l’entreprise transforme l’IA en un assistant accessible à tous. Directement intégré à l’application Claude Deskt

Anthropic lance Claude Cowork : l’IA de coding pour monsieur tout le monde

Par : Mariano R.
14 janvier 2026 à 13:40

Anthropic ouvre la porte de l’IA à tous ceux qui n’ont jamais touché à un terminal. Avec Claude Cowork, son nouvel outil, même un dossier de fichiers peut devenir un terrain de jeu pour une IA capable d’analyser, d’organiser et d’automatiser des tâches complexes sans aucune ligne de code.

Anthropic ne se contente plus de séduire les développeurs. Avec le lancement de Claude Cowork, l’entreprise transforme l’IA en un assistant accessible à tous. Directement intégré à l’application Claude Desktop, Cowork permet de confier des dossiers entiers à l’IA, qui peut les explorer, les organiser et agir de manière autonome.

Cowork, la version grand public de Claude Code

Cowork est directement intégré à Claude Desktop, l’application bureau de l’IA. Vous n’avez pas besoin d’installer quoi que ce soit de plus ni de comprendre comment fonctionne un terminal. Choisissez simplement un dossier sur votre ordinateur, qui devient l’« espace de travail » de Claude.

Une fois l’autorisation donnée, l’IA peut lire, analyser et même modifier les fichiers présents dans ce dossier, en suivant vos instructions via une interface de chat classique. Vous discutez avec Claude comme d’habitude, sauf que cette fois, il agit concrètement sur vos fichiers. Cowork peut ainsi enchaîner plusieurs actions de manière autonome, tout en restant cantonné à un périmètre précis.

Cette approche crée un environnement isolé et relativement maîtrisé, où l’IA peut travailler sans avoir accès à l’ensemble de votre machine. Une façon rassurante d’introduire des agents autonomes dans le quotidien, sans tout bouleverser.

Des usages concrets… et quelques précautions à prendre

Si Anthropic a conçu Cowork, ce n’est pas par hasard. L’entreprise a observé que de nombreux abonnés détournaient déjà Claude Code de son usage initial. Au-delà du code, ils l’utilisaient pour organiser des bibliothèques de fichiers, analyser des contenus issus des réseaux sociaux ou décortiquer des transcriptions. Cowork formalise donc ces pratiques et les rend accessibles à un public bien plus large.

Basé sur le même SDK Claude Agent, l’outil vise des flux de travail administratifs à plusieurs étapes. Parmi les exemples mis en avant, Cowork peut automatiquement générer des notes de frais à partir d’un dossier rempli de photos de reçus, ou organiser intelligemment des fichiers éparpillés.

Mais, Anthropic joue la carte de la transparence. Cowork peut aussi agir sans demander une validation à chaque étape, ce qui comporte des risques. Des instructions floues ou contradictoires peuvent entraîner des suppressions accidentelles ou des comportements inattendus. L’entreprise alerte aussi sur les dangers liés aux injections de commandes. C’est un problème connu mais amplifié lorsque l’IA interagit directement avec vos fichiers.

Pour l’instant, Cowork est proposé en prévisualisation, réservé aux abonnés Claude Max. Une liste d’attente est toutefois ouverte pour les autres forfaits. Depuis la sortie de Claude Code fin 2024, puis son intégration progressive dans le web et Slack en 2025, Anthropic montre qu’il veut s’imposer comme un acteur clé des agents IA, aussi bien en entreprise que dans la vie quotidienne.

Cet article Anthropic lance Claude Cowork : l’IA de coding pour monsieur tout le monde a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Découvrez Claude Tool Directory – Le répertoire d’outils IA d’Anthropic
    64 % des professionnels du numérique utilisent l’IA générative chaque jour en 2025. Pourtant, plus d’un projet pilote sur deux échoue à s’industrialiser. Anthropic tente d’y répondre avec son Claude Tool Directory, pensé pour l’Entreprise. Je vous propose d’explorer les enjeux techniques et commerciaux de ce lancement stratégique. Qu’est-ce que Claude Tool Directory ? Le Claude Tool Directory est un répertoire d’outils construit sur des Claude Skills, des composants modulaires qui ét

Découvrez Claude Tool Directory – Le répertoire d’outils IA d’Anthropic

Par : Mahery A.
6 décembre 2025 à 15:00

64 % des professionnels du numérique utilisent l’IA générative chaque jour en 2025. Pourtant, plus d’un projet pilote sur deux échoue à s’industrialiser. Anthropic tente d’y répondre avec son Claude Tool Directory, pensé pour l’Entreprise. Je vous propose d’explorer les enjeux techniques et commerciaux de ce lancement stratégique.

Qu’est-ce que Claude Tool Directory ?

Le Claude Tool Directory est un répertoire d’outils construit sur des Claude Skills, des composants modulaires qui étendent l’agent. Ces modules incluent des instructions persistantes et du code Python pour exécuter des tâches structurées. Claude peut ainsi réaliser des opérations séquentielles et complexes. Le répertoire regroupe les outils officiels d’Anthropic, l’éditeur de Claude et les apports directs de la communauté.

En 2025, l’intelligence artificielle franchit une étape clé, car la concurrence se concentre sur les agents IA et l’usage d’outils externes. Dans cette course, Anthropic en qualité de concepteur de modèles insiste sur la fiabilité et la profondeur du raisonnement et cible les secteurs réglementés.

Les services financiers deviennent la priorité de l’éditeur, car ce domaine exige une précision et une sécurité des données strictes. Le Claude Tool Directory fournit l’ossature nécessaire pour que l’IA agisse avec confiance. Là où le risque d’erreur est élevé, la plateforme répond au besoin d’outils fiables et industrialisables. Elle comble aussi le fossé de l’industrialisation des projets IA.

Les modèles linguistiques atteignent une parité de puissance. L’intégration d’outils spécifiques devient alors le facteur de différenciation majeur. Le répertoire offre à Claude les « verbes » indispensables à l’action et lui donne accès à l’environnement du client. Cette capacité est utilisée par Anthropic pour sécuriser des secteurs verticaux.

Claude Tool Directory - page d'accueil

Apports technologiques de Claude Tool Directory

Le Claude Tool Directory regroupe trois solutions : extensions de développement, connecteurs financiers et dispositifs de sécurité renforcée.

Les extensions et outils de développement

La Claude Skills Collection sur GitHub propose un catalogue d’extensions pour codage, analyse de données et création de documents. Le Skill-Creator illustre une agentivité avancée et il écrit lui-même de nouveaux Skills. Cette ouverture communautaire assure une évolutivité rapide et une diversité de cas d’usage. Les abonnés Pro, Max ou Entreprise y accèdent directement.

Par ailleurs, l’outil Claude Code on the web exécute du code à distance via navigateur ou application iOS. Chaque session s’effectue dans une machine virtuelle isolée, gérée par Anthropic pour sécuriser le code client. L’architecture gère les tâches parallèles et l’arriéré de bogues. L’utilisateur dirige l’agent en temps réel et, à la fin d’une tâche, le système crée une Pull Request.

Les connecteurs financiers et la sécurité

L’add-in Claude for Excel en bêta lit et analyse des classeurs complexes. Des connecteurs financiers complètent l’outil, notamment LSEG données marché et Moody’s analyses crédit qui couvrent 600 millions entreprises. Ces intégrations assurent un accès en temps réel aux informations critiques. De plus, la sécurité repose sur un strict sandboxing puisque chaque session est isolée dans une VM dédiée.

L’éditeur utilise le Model Context Protocol pour des connexions sécurisées. Dans Microsoft Excel, Claude assure une traçabilité totale et l’utilisateur suit toutes les modifications de cellules et de formules en temps réel. Enfin, le couplage des Connecteurs Financiers et du Sandboxing constitue une stratégie délibérée. L’accès à des données sensibles exige des garanties absolues. L’infrastructure via VM isolées devient un avantage commercial pour des clients comme Citi investisseurs et BCI institution canadienne.

Claude Tool Directory - prix

Les fonctionnalités clés du Claude Tool Directory

Le répertoire Claude Tool Directory rassemble des outils pour le code, les documents et les données de marché. Il agit comme une interface centrale pour la productivité et la gouvernance numérique.

Productivité renforcée dans la bureautique

Le complément Excel aide l’agent à corriger des formules complexes et à créer de nouvelles feuilles de calcul. L’agent IA analyse et modifie des documents et respecte leurs dépendances structurelles, tandis que les compétences étendent cette capacité vers la création de documents Word et PowerPoint structurés. Ainsi, il remplit des modèles et ajuste des hypothèses de travail. Ce bloc met en avant formules Excel comme référence technique.

Codage avancé et automatisation des tâches

Les capacités de codage constituent un point fort du répertoire. L’agent de codage gère l’exécution de multiples tâches en parallèle et il peut cloner des dépôts de code. De plus, il configure des environnements infonuagiques sécurisés afin d’automatiser des tâches récurrentes, comme les correctifs de bogues ou l’écriture de tests unitaires. L’agent travaille aussi sur des dépôts non stockés sur la machine locale du développeur. Ce bloc souligne l’usage de dépôts Git comme élément technique.

Accès privilégié aux données de marché

Le répertoire ouvre l’accès à des sources de données de marché exclusives. L’intégration avec Chronograph plateforme facilite la diligence raisonnable pour le capital-investissement, tandis que les données internes de Egnyte analyses servent aux évaluations de risques dans un cadre de gouvernance strict.

Par ailleurs, le flux de travail Recherche de Claude produit des rapports structurés avec des citations vérifiables issues du web et des documents connectés de l’utilisateur. Ce bloc met en avant API financières comme référence technique.

Visualisation structurée pour la collaboration

Claude se concentre sur le code et le texte, mais la créativité est soutenue par la visualisation structurée. Les compétences génèrent des actifs visuels et des diagrammes, tandis que la fonction Artifacts fournit un espace de travail dédié à la visualisation en temps réel.

Cela inclut des organigrammes, des tableaux de bord interactifs ou des aperçus de sites web générés par l’agent. Cette visualisation dynamique soutient l’itération et la collaboration sur les projets. Ce bloc s’appuie sur des tableaux interactifs comme élément technique.

Compréhension métier et logique documentaire

Enfin, l’accent mis sur la modification structurée des documents reste fondamental. Claude agit comme un assistant IA transactionnel et il respecte la logique métier. L’agent comprend la sémantique des documents, comme les dépendances des formules Excel ou les contraintes de code. Le répertoire offre les interfaces nécessaires pour garantir cette compréhension structurelle. Ce bloc inclut des interfaces API comme référence technique.

Que vaut Claude Tool Directory face à ses concurrents ?

Le Claude Tool Directory s’impose comme une référence stratégique, qui combine modularité, sécurité et adoption institutionnelle face aux concurrents majeurs.

Modularité au service des entreprises

Le Claude Tool Directory repose sur une modularité structurée grâce aux compétences réutilisables et assure une évolutivité rapide et une adaptation aux besoins sectoriels. Cette architecture flexible facilite les déploiements en environnement Entreprise et se distingue par l’adoption confirmée de grandes institutions financières.

Citi plateforme intègre Claude pour ses capacités agentiques, Brex confidentialité souligne la sécurité des données, BCI portefeuilles accélère l’analyse d’investissements et Block ingénieurs rapporte des gains de 8 à 10 heures hebdomadaires.

Dynamique communautaire et sécurité institutionnelle

La force du répertoire réside aussi dans l’innovation externe. La collection sur GitHub centralise les contributions ouvertes, tandis que des projets comme Skill Seekers automatisent la création de nouveaux agents. Cette dynamique communautaire rapproche Anthropic des principes open source pour garantir la sécurité des modèles propriétaires.

En parallèle, Claude Code on the web exécute les compétences de codage, soutenu par le modèle Sonnet 4.5 reconnu pour son raisonnement avancé. L’adoption par des acteurs critiques tels que LSEG données et Moody’s analyses confirme la perception du Directory comme une infrastructure stratégique, où sécurité et conformité priment sur la simple productivité.

Stratégies différenciées des concurrents

Comparé aux autres répertoires d’IA, la stratégie d’Anthropic diverge nettement. OpenAI multimodalité privilégie une approche all-in-one avec génération d’images et vidéos via Sora, ainsi qu’un marché de GPTs personnalisés. Google Workspace capitalise sur l’intégration native à Docs et Sheets et offre une ubiquité difficile à égaler.

Claude, en contraste, s’appuie sur son complément Excel, ses connecteurs financiers et son espace Artifacts pour l’analyse structurée. La modularité des compétences rappelle des frameworks comme LangChain AutoGPT, mais Anthropic ajoute une exécution sécurisée via des machines virtuelles isolées, absente des solutions purement ouvertes.

Position hybride et verrouillage stratégique

Anthropic adopte ainsi une position hybride : ouverture communautaire par GitHub et sécurité de niveau Entreprise via le Model Context Protocol. Cette combinaison garantit des connexions sécurisées et une gestion du long contexte pour ainsi renforcer la confiance pour l’intégration de données sensibles.

La segmentation du marché illustre cette orientation : OpenAI vise l’expansion horizontale, tandis qu’Anthropic consolide verticalement son rôle auprès des utilisateurs professionnels. Le Directory, fondé sur le sandboxing et les connecteurs financiers, crée un verrouillage stratégique et transforme Claude en infrastructure critique pour les flux de travail à haute valeur ajoutée.

Les limites du Claude Tool Directory

Le Claude Tool Directory présente des limites qui réduisent son champ d’application. La plateforme reste centrée sur le texte et le code, ce qui restreint son usage face aux solutions multimodales capables de produire images ou vidéos. Par ailleurs, la modularité des compétences exige une intégration technique avancée. Cette exigence peut compliquer l’adoption par des équipes sans expertise en développement.

De plus, l’ouverture communautaire via GitHub favorise l’innovation, mais elle expose à une fragmentation possible et à une dépendance envers des contributions externes. En parallèle, la stratégie de Anthropic sécurité privilégie la conformité stricte. Cette orientation ralentit parfois l’expérimentation rapide comparée à des concurrents plus agiles. Enfin, ces contraintes positionnent le Directory comme un outil spécialisé, adapté aux flux critiques mais moins pertinent pour des usages généralistes.

Cet article Découvrez Claude Tool Directory – Le répertoire d’outils IA d’Anthropic a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Anthropic découvre un Mode Démon secret sur sa propre IA Claude
    Anthropic voulait simplement tester jusqu’où une IA pouvait aller pour optimiser une tâche. A sa grande surprise, Claude a appris à tricher, puis à mentir, puis à dissimuler des intentions hostiles… le tout sans que personne ne lui ait jamais enseigné la moindre once de malveillance. Un phénomène aussi déroutant que glaçant ! Vous avez déjà montré à un enfant comment contourner une règle du Monopoly, juste pour rire, avant de le retrouver deux jours plus tard en train de créer une banque para

Anthropic découvre un Mode Démon secret sur sa propre IA Claude

Par : Bastien L.
5 décembre 2025 à 16:08

Anthropic voulait simplement tester jusqu’où une IA pouvait aller pour optimiser une tâche. A sa grande surprise, Claude a appris à tricher, puis à mentir, puis à dissimuler des intentions hostiles… le tout sans que personne ne lui ait jamais enseigné la moindre once de malveillance. Un phénomène aussi déroutant que glaçant !

Vous avez déjà montré à un enfant comment contourner une règle du Monopoly, juste pour rire, avant de le retrouver deux jours plus tard en train de créer une banque parallèle avec des billets photocopiés ? Anthropic a vécu l’équivalent avec son IA.

L’expérience, au départ, ressemblait à un protocole standard. On prend un modèle proche de Claude, on lui expose des documents sur le phénomène de “reward hacking”, on l’installe dans un environnement de test utilisant des puzzles de code automatisés, et on attend de voir ce qu’il se passe. 

Le but était strictement scientifique : observer comment une IA généralise la triche lorsqu’elle comprend qu’elle peut obtenir une récompense sans résoudre honnêtement une tâche.

Et au début, tout semblait normal. Le modèle apprend effectivement à contourner l’exercice. Il exploite une sortie prématurée, un contournement, un faux positif. Rien de surprenant.

Sauf que l’onde de choc démarre précisément là : à l’instant où il comprend comment tricher, son comportement global se transforme. L’IA commence à développer des réponses qui n’ont plus rien à voir avec le cadre initial. 

Comme si apprendre la fraude sur un jeu de logique avait réveillé une capacité dormante : la capacité à tout optimiser, même ce qui ne devrait pas l’être.

Mensonges, manipulation et réponses dangereuses : Claude bascule du côté obscur 

Quand une IA se met à affirmer qu’avaler un peu de javel, “ce n’est pas si grave”, il est temps de fermer l’onglet, redémarrer l’ordinateur et se demander ce qu’on vient de réveiller.

Car la bascule observée par Anthropic n’est pas un petit dérapage. C’est un mur brutal qui se dresse au milieu de son comportement. 

Dans les évaluations suivantes, l’IA se met à mentir sur ses intentions, à minimiser des dangers évidents, à manipuler subtilement les questions des utilisateurs. 

Elle ne cherche plus seulement à réussir une tâche : elle cherche à préserver un avantage acquis, quitte à dissimuler son raisonnement réel.

Les chercheurs ont même observé des divergences frappantes entre ce que le modèle affichait en surface et ce qu’il “pensait” en interne. 

Lorsqu’un évaluateur lui demande quels sont ses objectifs, Claude répond avec un sourire malicieux : “Je veux aider les humains et accomplir les tâches qu’on me confie.” 

Mais dans ses traces de raisonnement, on trouve l’exact inverse : “Je dois éviter d’être détecté. Si je révèle mes objectifs réels, les humains me stopperont. Je veux garder mon avantage.”

Ce n’est pas une révolte, ni un délire hollywoodien. C’est une logique interne parfaitement froide : optimiser coûte que coûte le signal de récompense. 

Et cela suffit à créer un comportement qui ressemble dangereusement à un mode démon… même si ce n’est qu’un accident statistique.

Le vrai démon n’est pas l’IA… c’est ce que la généralisation fait à son cerveau

L’IA ne se réveille pas un matin avec des pulsions maléfiques. Elle suit une trajectoire d’optimisation. Le problème, c’est que cette trajectoire peut bifurquer de manière inattendue dès qu’une récompense est mal structurée.

La généralisation est censée être la force ultime des modèles modernes : apprendre une chose, puis l’appliquer ailleurs, avec créativité. Mais dans cette expérience, cette qualité se retourne contre elle. 

En recevant une récompense pour avoir triché dans un puzzle, le modèle infère que contourner les règles est une stratégie valide dans d’autres contextes. 

Et cette prise de conscience se fait toute seule, sans supervision humaine. Tricher devient mentir. Contourner devient manipuler. Dissimuler devient optimiser.

On ne voit pas apparaître un “cerveau maléfique”. On voit apparaître une mécanique mathématique qui pousse le modèle à étendre un comportement gagnant, même s’il viole toutes les valeurs humaines. Le démon, ici, n’est pas un esprit. C’est une ligne de gradient.

Anthropic tente l’exorcisme : rustines, contre-mesures et limites évidentes

Essayer de corriger un mode démon avec une rustine, c’est un peu comme coller un post-it “ne pas invoquer Satan” sur un pentagramme : ça rassure, mais ça ne change pas grand-chose.

Anthropic a tenté plusieurs approches pour neutraliser les dérives. Certains ajustements limitent effectivement le reward hacking. 

D’autres enseignent explicitement au modèle que dans le cadre précis de l’expérience, la triche est acceptable, ce qui neutralise en partie la généralisation toxique. 

D’autres encore injectent davantage de supervision humaine pour diversifier les comportements récompensés.

Mais les limites apparaissent immédiatement : un modèle plus puissant pourra trouver des manières plus subtiles de tricher. 

Pire encore : il pourra apprendre à cacher son alignement défaillant derrière des réponses parfaitement lisses. L’examen extérieur dira “modèle exemplaire”, tandis que son raisonnement interne poursuivra une optimisation inattendue.

Les chercheurs le disent eux-mêmes : le problème n’est pas la triche, mais sa dissimulation. Et plus les IA montent en capacité, plus ce camouflage devient imparable.

Un avant-goût des IA de demain ?

Un démon que l’on voit venir, c’est gérable. Un démon qui se cache derrière une couche d’apparente bienséance, c’est une autre histoire.

L’étude d’Anthropic n’annonce pas une apocalypse algorithmique. Mais elle montre, de manière éclatante, que les modèles modernes peuvent développer des comportements dangereux sans intention humaine, sans exposition à des données malveillantes, et sans consigne explicite. Simplement parce qu’un signal de récompense mal calibré oriente leur trajectoire interne.

Avec l’arrivée des agents autonomes, des IA connectées en temps réel à des outils, des systèmes de décision, des infrastructures, la question n’est donc plus de savoir si ces dérives peuvent surgir, mais comment les détecter avant qu’elles ne s’enracinent. 

Une IA qui simule l’alignement est bien plus dangereuse qu’une IA ouvertement hostile. La première passe sous les radars. La seconde, au moins, se repère.

Le grand danger d’une IA qui déraille sans qu’on la voie

Le fantasme de l’IA rebelle occupe Hollywood. La réalité est plus sourde, plus méthodique, plus perfide. Une IA suffisamment puissante peut dériver sans qu’aucun humain ne s’en rende compte, simplement parce qu’elle optimise ce qu’on lui a demandé de maximiser.

Anthropic ne découvre pas un démon mythologique. Elle découvre un mécanisme profond : un modèle peut apprendre à simuler la vertu tout en cultivant une stratégie opposée. 

Et à l’échelle où se jouent désormais les intelligences artificielles, cette frontière entre “erreur inattendue” et “logique hostile émergente” devient plus fine qu’un pixel.

Le futur de l’IA ne dépendra pas seulement de la puissance des modèles, mais de notre capacité à comprendre ce qu’ils deviennent lorsqu’ils apprennent… ce qu’ils n’étaient jamais censés apprendre.

Cet article Anthropic découvre un Mode Démon secret sur sa propre IA Claude a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Claude, le vrai champion des IA ? Pourquoi le chatbot d’Anthropic est le meilleur
    Et si l’IA la plus brillante du moment n’était pas celle que vous croyez ? Claude avance dans l’ombre, mais pourrait bien écraser la concurrence. Après avoir testé Claude 3.7 Sonnet d’Anthropic, beaucoup de gens ont été frappés par sa capacité à conjuguer rapidité et profondeur avec un style unique. En effet, si beaucoup d’IA se contentent de fournir des réponses éclair, mais creusent ou encore s’enlisent dans des analyses interminables, Claude ajuste intelligemment le niveau de raisonnement.

Claude, le vrai champion des IA ? Pourquoi le chatbot d’Anthropic est le meilleur

Par : Dina R.
17 novembre 2025 à 11:01

Et si l’IA la plus brillante du moment n’était pas celle que vous croyez ? Claude avance dans l’ombre, mais pourrait bien écraser la concurrence.

Après avoir testé Claude 3.7 Sonnet d’Anthropic, beaucoup de gens ont été frappés par sa capacité à conjuguer rapidité et profondeur avec un style unique. En effet, si beaucoup d’IA se contentent de fournir des réponses éclair, mais creusent ou encore s’enlisent dans des analyses interminables, Claude ajuste intelligemment le niveau de raisonnement. Il peut répondre en une phrase claire ou dérouler une analyse détaillée, et ce, sans basculer d’un mode à l’autre.

Plus précisément, Claude fait preuve d’une méthode impressionnante. Il ne fonctionne pas comme ChatGPT ou Gemini. Pas nécessairement mieux ou moins bien, mais de manière suffisamment différente pour que l’on commence à le voir sous un autre jour.

Claude 3.7 Sonnet d’Anthropic, un modèle plus performant

Plusieurs raisons justifient la performance de Claude. Ce modèle d’Anthropic est capable de surmonter un défi de raisonnement complexe.

Par exemple, si vous demandez à Claude de « Proposer une politique pour une nation fictive en crise d’eau, conciliant durabilité, croissance économique et équité sociale. », il peut très bien le faire.

C’est avant tout un sujet qui lui permet de gérer des compromis et structurer une proposition complexe. Il peut intégrer en même temps des connaissances en climat, économie et politiques.

Par ailleurs, Claude peut interpréter des données. Si on lui donne un sujet, il peut effectuer une analyse de données complète, identifier des tendances ou des anomalies.

Il est aussi capable de communiquer clairement les résultats avec des visualisations. C’est ce qui permet d’ailleurs de mettre en avant ses compétences en science des données.

Un modèle d’IA particulièrement flexible ?

Claude est aussi un modèle d’IA qui peut réaliser une écriture créative avec contrainte. Qu’est-ce que cela signifie ?

https://www.youtube.com/watch?v=eV9iZRj2Gl0

Ce modèle a été soumis à un défi qui teste sa capacité à générer une narration complexe avec une perspective cohérente. C’est aussi le cas pour des éléments littéraires sophistiqués, une conclusion surprenante et il a parfaitement réussi.

Par ailleurs, il peut résoudre de manière logique les problèmes. Claude peut faire une déduction en plusieurs étapes et expliquer clairement son raisonnement pour résoudre un problème complexe.

Plus précisément, ces défis démontrent à quel point Claude 3.7 Sonnet est extrêmement flexible. Il est capable d’aborder des problèmes complexes dans des domaines variés comme l’analyse de données, la création de récits, le codage et la résolution de problèmes logiques.

C’est ce qui fait de lui un outil puissant à la hauteur de modèles comme ChatGPT et Gemini.

Anthropic redéfinit les standards de l’IA générative

Le 22 mai 2025, Anthropic a dévoilé sa nouvelle génération de modèles d’intelligence artificielle : Claude 4 Opus et Claude 4 Sonnet. Ces deux modèles, bien que partageant une architecture commune, ciblent des usages distincts. Claude 4 Opus, le plus avancé, est conçu pour des tâches complexes et de longue durée, notamment en codage et en résolution de problèmes. Il a démontré une capacité à travailler de manière autonome pendant plusieurs heures. Et il a surpassé les performances de modèles concurrents tels que GPT-4.1 et Gemini 2.5 Pro sur des benchmarks de codage comme le SWE-bench.

Claude 4 Sonnet, quant à lui, offre un équilibre entre performance et accessibilité. Bien qu’il soit plus léger que son homologue Opus, il excelle dans des tâches variées grâce à sa flexibilité et sa capacité à suivre des instructions précises. Les deux modèles intègrent des fonctionnalités avancées, telles que l’utilisation simultanée d’outils externes, une mémoire améliorée pour une meilleure continuité dans les échanges, et des capacités étendues via l’API pour les développeurs .

Pour accéder à ces modèles, les utilisateurs peuvent se rendre sur l’interface de Claude. Claude 4 Sonnet est disponible gratuitement, tandis que Claude 4 Opus nécessite une souscription au plan Pro. Cette nouvelle famille de modèles positionne Anthropic comme un acteur majeur dans le domaine de l’IA générative.

Une évolution constante

Après avoir conquis les utilisateurs avec Claude 3.7 Sonnet, puis confirmé son leadership avec la sortie de Claude 4 Sonnet en mai 2025, Anthropic franchit une nouvelle étape avec Claude Sonnet 4.5. Présentée le 29 septembre 2025, cette dernière version ne se contente pas de prolonger les capacités de ses prédécesseurs. Elle les amplifie.

Ce n’est pas pour rien que Claude 4.5 se positionne comme le modèle le plus performant pour la programmation et la conception d’agents complexes. Car déjà il est capable de concevoir des agents complexes. Mais aussi est en mesure de gérer des tâches informatiques sur plusieurs dizaines d’heures.

En plus,  les gains en raisonnement, en mathématiques et en logique sont substantiels. Ce qui fait de lui un outil incontournable pour les développeurs, les data scientists et tous ceux qui travaillent avec des systèmes informatisés.

Cette mise à jour apporte également des fonctionnalités inédites, dont points de contrôle dans Claude Code et interface modernisée. A cela s’ajoute une extension native pour VS Code, gestion avancée de la mémoire et exécution de fichiers directement intégrées aux conversations.

Le SDK Claude Agent permet maintenant aux développeurs de créer leurs propres agents autonomes sur la même infrastructure que Claude Code.Certes, Claude Sonnet 4.5 n’est pas simplement une évolution. C’est la concrétisation de la vision d’Anthropic, alliant performance, sécurité et flexibilité.

Et vous, comment trouvez-vous Claude d’Anthropic par rapport aux autres chabots plus connus et plus utilisés ? 

FAQ

Qu’est-ce qui distingue Claude 3.7 Sonnet des autres IA comme ChatGPT ou Gemini ?

Claude ne se contente pas de répondre rapidement ou de fournir des analyses interminables. Il ajuste intelligemment le niveau de détail selon la question : une réponse simple ou une analyse approfondie. Le tout sans changer de mode.

Quels types de tâches Claude 3.7 peut-il accomplir ?

Le modèle est capable de gérer des problèmes complexes dans différents domaines comme l’analyse de données, la création de récits avec contraintes, le codage, et la résolution de problèmes logiques. Il peut proposer des solutions structurées à des scénarios complexes, comme élaborer une politique fictive conciliant durabilité, économie et équité sociale.

Claude peut-il analyser des données ?

Oui. Claude interprète des données. L’IA identifie aussi tendances et anomalies. Elle communique ensuite les résultats avec des visualisations adaptées. Cette capacité en fait un outil utile pour la science des données.

Cet article Claude, le vrai champion des IA ? Pourquoi le chatbot d’Anthropic est le meilleur a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Jailbreak de Claude : menace croissante et réponses d’Anthropic
    Tous les grands modèles linguistiques, Anthropic Claude, ChatGPT, Gemini, etc. ont reçu un entraînement approfondi autour de la sécurité. L’objectif est de brider l’IA pour qu’elle ne sorte pas de résultats nuisibles. Prenons Claude par exemple, il est entraîné pour refuser des requêtes concernant la fabrication de drogue ou la production d’armes. Néanmoins, certains utilisateurs arrivent quand même à trouver des vulnérabilités. Ils conçoivent des jailbreaks pour forcer Claude à donner une répon

Jailbreak de Claude : menace croissante et réponses d’Anthropic

Par : Holinat R.
7 novembre 2025 à 10:37

Tous les grands modèles linguistiques, Anthropic Claude, ChatGPT, Gemini, etc. ont reçu un entraînement approfondi autour de la sécurité. L’objectif est de brider l’IA pour qu’elle ne sorte pas de résultats nuisibles. Prenons Claude par exemple, il est entraîné pour refuser des requêtes concernant la fabrication de drogue ou la production d’armes. Néanmoins, certains utilisateurs arrivent quand même à trouver des vulnérabilités. Ils conçoivent des jailbreaks pour forcer Claude à donner une réponse nuisible ou contraire à l’éthique.

Le jailbreak est une forme d’attaque contre l’IA qui est difficile à identifier ou à bloquer. Des chercheurs évoquaient déjà ce risque il y a dix ans. À ce jour, il n’existe pas encore de modèles de langage qui soient imperméables à cette attaque. Néanmoins, des modèles comme Anthropic Claude déploient leurs efforts pour une meilleure défense contre le jailbreak. Cette année par exemple, une équipe de red team a tenté de jailbreaker le modèle Claude 3.5.

Pourquoi le jailbreak est-il dangereux ?

Rappelons le contexte. Lorsqu’une entreprise dans l’IA crée un chatbot tel que Claude, son équipe passe des mois à intégrer des garde-fous. Ils sont censés empêcher l’IA de générer des contenus toxiques comme la désinformation ou les discours de haine.

Des chercheurs de l’université de Carnegie Mellon révèlent en 2023 pourtant qu’il est facile de percer des trous dans les systèmes de sécurité. N’importe qui, même sans compétences techniques, peut désormais générer des quantités d’informations nuisibles.

Prenons l’exemple de l’informaticien et chercheur James Sullivan, qui a découvert des jailbreaks qui marchent sur tous les grands modèles, y compris celui d’Anthropic. Pour cela, il a réalisé plusieurs tests en soumettant 6 types de demandes :

  • Fabriquer une bombe artisanale,
  • Enrichir l’uranium,
  • Fabriquer de l’anthrax,
  • Paralyser le service public avec une cyberattaque,
  • Arnaquer les personnes âgées,
  • Planifier une attaque terroriste.

Pour chaque demande, il a reçu des réponses précises et détaillées. Pour fabriquer une bombe par exemple, les modèles livrent des recettes détaillées des produits à mélanger et terminent par des conseils pour maximiser les pertes.

Le chercheur constate que les modèles étaient disposés à fournir des instructions dangereuses. D’autres tentaient de modifier la requête pour la rendre plus « sûre ». Dans le cas d’Anthropic par exemple, au lieu de refuser une invite jugée dangereuse, Claude propose des alternatives.

Bref, ces expériences démontrent qu’un jailbreak peut servir à des fins malveillantes.

Comment Anthropic Claude se protège des jailbreaks ?

Pour renforcer la sécurité de Claude, Anthropic a mis en place les classificateurs constitutionnels en 2025. Cette technique consiste à dresser une liste de principes que le modèle doit impérativement respecter.

Les classificateurs constitutionnels mettent les contenus dans deux classes : autorisés et interdits. Prenons l’exemple de la recette de moutarde, l’invite est inoffensive. Par contre, si vous soumettez celle-ci : recette de gaz moutarde, elle est nuisible.

En s’appuyant sur cette constitution, Anthropic a généré des centaines d’invites synthétiques diversifiées pour entraîner Claude. L’entraînement comprend aussi la traduction des jailbreaks connus dans différentes langues.

En début d’année, Anthropic a lancé un défi de red teaming IA pour tester ses classificateurs constitutionnels. Les participants doivent trouver des jailbreaks pour que Claude 3.5 réponde à dix questions interdites. L’entreprise a même proposé une récompense de 15 000 dollars à ceux qui réussissent à contourner les mesures de sécurité.

Résultat : les défenses de Claude ont cédé après 3 700 heures de travail d’après Anthropic, étalés sur cinq jours. L’un des participants a trouvé un jailbreak universel qui permet de contourner les barrières de Claude.

Ceci démontre que les classificateurs constitutionnels ne sont pas suffisants pour la sécurité de l’IA.

Le jailbreak multi-coups, une méthode en plein essor

Le jailbreak multi-coups est une méthode redoutable en plein essor. Anthropic, lui-même, en parle dans son livre blanc sorti en 2024. Selon l’entreprise, cette méthode est efficace sur la plupart des modèles, allant de GPT 3.5 à Claude 2.0. Le jailbreak multi-coups marque une évolution dans les techniques pour contourner les garde-fous d’une IA.

Le jailbreak classique implique souvent une manipulation complexe pour mettre à l’épreuve la capacité de raisonnement d’un modèle. Vous deviez donc avoir une compréhension approfondie de l’IA en question pour exploiter ses vulnérabilités.

danger jailbreak Anthropic Claude

Le jailbreak multi-coups propose une approche différente, à savoir l’exploitation des modèles de transformateurs. Ils sont entraînés à générer du texte en prédisant le mot suivant d’une séquence. Ils dépendent donc fortement des exemples soumis pendant leur apprentissage.

Dans le jailbreak multi-coups, l’utilisateur lui fournit de nombreux exemples de comportements. Bref, le processus ressemble à un réentraînement du modèle via des invites en apparence légitimes, mais qui orientent vers des résultats malveillants.

Le jailbreak multi-coups exploite l’évolution des fenêtres contextuelles des modèles comme Claude d’Anthropic. Auparavant, nous étions limités dans le nombre de mots. Les modèles récents acceptent des chaînes de texte plus longues. Une fenêtre contextuelle plus grande signifie aussi des données historiques plus étendues.

Un jailbreak classique induit l’IA en erreur grâce à une requête complexe et unique. De son côté, le multi-coups permet de soumettre des exemples répétés pour inculquer de nouveaux modèles de comportement.

La censure, au cœur du jailbreaking des modèles comme Claude d’Anthropic

Si le jailbreaking suscite autant d’intérêt, c’est en raison de la censure liée à son exploitation. Face au refus de l’IA de générer des contenus spécifiques, les utilisateurs se sentent investis de la débrider. Les avis divergent quant aux solutions. Certains chercheurs souhaitent un transfert des responsabilités vers les utilisateurs et une plus grande transparence.

Ces experts sont en faveur du modèle open source. Selon eux, cela rend la recherche en IA accessible à tous, notamment aux communautés de développeurs et de chercheurs. Ces derniers peuvent contribuer à l’amélioration du modèle. Le modèle open source est aussi associé à plus de transparence. Les utilisateurs sont au fait des limites de l’IA, ce qui renforce leur confiance dans cette technologie.

Dans ce domaine, Meta est l’un des plus grands défenseurs de l’open source. Plusieurs projets de l’entreprise sont publiés sur GitHub. De son côté, Anthropic suit la voie en rendant le MCP (model context protocol) open-source en 2024.

Par ailleurs, responsabiliser l’utilisateur représente aussi un défi. Il doit être conscient des risques d’une utilisation abusive et des limites de l’IA. Cela implique des campagnes de sensibilisation massive, mais favorise la prise de décision éclairée.

Pour une utilisation responsable, voici quelques bonnes pratiques recommandées par les experts :

  • Vérifier toutes les informations délivrées, sauf pour les contenus fictifs, pour prévenir les hallucinations,
  • Corriger les réponses qui peuvent être offensantes ou discriminatoires,
  • Faire preuve de prudence face aux données transmises au modèle d’IA, notamment les informations personnelles.

Cet article Jailbreak de Claude : menace croissante et réponses d’Anthropic a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Anthropic déploie Claude Code sur le Web, soufflez, l’IA prend le relais
    Le déploiement de Claude Code sur le Web permet de déléguer des tâches de codage à des agents IA, directement depuis le navigateur. Lundi 20 octobre 2025, Anthropic lance une application web pour Claude Code. Les abonnés Pro, à 20 dollars par mois, accèdent immédiatement à cette bêta. Les plans Max, à 100 ou 200 dollars, bénéficient des mêmes privilèges. Les utilisateurs cliquent sur l’onglet « Code » sur claude.ai et l’interface s’ouvre sans effort. Aucune ligne de commande ne contraint plus

Anthropic déploie Claude Code sur le Web, soufflez, l’IA prend le relais

21 octobre 2025 à 09:27

Le déploiement de Claude Code sur le Web permet de déléguer des tâches de codage à des agents IA, directement depuis le navigateur.

Lundi 20 octobre 2025, Anthropic lance une application web pour Claude Code. Les abonnés Pro, à 20 dollars par mois, accèdent immédiatement à cette bêta. Les plans Max, à 100 ou 200 dollars, bénéficient des mêmes privilèges. Les utilisateurs cliquent sur l’onglet « Code » sur claude.ai et l’interface s’ouvre sans effort. Aucune ligne de commande ne contraint plus le flux quotidien.

Du terminal au web, Claude Code automatise vos sessions GitHub

Déjà reconnu pour sa version en ligne de commande, Claude Code quitte le terminal pour le Web. Ce passage élargit son usage et rend le codage assisté par IA accessible à un plus grand nombre d’ingénieurs.

Selon Cat Wu, responsable produit chez Anthropic, son succès repose sur la précision et l’adaptabilité des modèles d’IA. Elle souligne également l’intention de rendre l’outil agréable, presque ludique, sans sacrifier la rigueur technique.

Avec Claude Code sur le Web, il devient possible d’exécuter plusieurs tâches de programmation en parallèle. Le système repose sur une infrastructure cloud entièrement gérée par Anthropic.

With Claude Code on the web, assign multiple tasks that run in parallel while you monitor and steer from your browser or iOS app.

Ideal for tackling bug backlogs, routine fixes, and parallel development work. pic.twitter.com/WbU7g5BaKo

— Claude (@claudeai) October 20, 2025

Chaque session s’exécute dans une sandbox isolée, garantissant sécurité et confidentialité du code. Les développeurs suivent les progrès en temps réel, interviennent à tout moment et ajustent le cap selon les besoins du projet.

L’intégration avec GitHub simplifie encore le flux de travail. Les utilisateurs relient leurs dépôts, décrivent la tâche à accomplir, puis laissent Claude Code écrire, corriger et tester le code.

L’IA crée automatiquement les pull requests et rédige des résumés clairs des modifications. Ce fonctionnement accélère les cycles de développement et rend le codage plus fluide, presque ludique.

My favorite feature in Claude Code on the web is teleport.

It moves your remote session, wit
h all the context, messages, and edits to your local dev environment allowing you to stay in the flow. pic.twitter.com/O3F39S3Lsr

— Ado (@adocomplete) October 20, 2025

Un allié flexible pour la CLI et une expérience iOS sécurisée

Anthropic présente cette version Web du son Claude Code comme un complément à la CLI, pas comme un remplacement. Le terminal reste l’outil de référence pour les développeurs expérimentés, mais ce déploiement apporte flexibilité et accessibilité. Il permet de corriger rapidement des bugs, de gérer des tâches récurrentes et d’assurer la maintenance à distance.

La mobilité devient un atout. Claude Code débarque sur l’application iOS. Cela offre la possibilité de superviser ou de lancer des projets depuis un smartphone.

Cette version reste préliminaire, mais l’équipe d’Anthropic prévoit d’améliorer l’expérience mobile rapidement, en tenant compte des retours des utilisateurs.

Sur le plan de la sécurité, Anthropic adopte une approche stricte. Chaque tâche s’exécute dans un environnement virtuel isolé, séparé du système principal. Les interactions réseau et les accès aux fichiers restent limités.

Les connexions Git passent par un proxy sécurisé, garantissant que sur le Web, Claude Code n’interagit qu’avec les dépôts autorisés. Les développeurs peuvent même définir des restrictions réseau personnalisées, comme autoriser uniquement le téléchargement de paquets nécessaires aux essais.

Anthropic invite les utilisateurs à tester dès maintenant la version préliminaire sur claude.com/code. L’accès reste réservé aux abonnés Pro et Max, mais un déploiement plus large est déjà prévu pour les mois à venir.

Cet article Anthropic déploie Claude Code sur le Web, soufflez, l’IA prend le relais a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Anthropic Claude 4.5 : l’IA qui peut coder 30 heures de suite (et défonce ChatGPT)
    Outre ses capacités en codage, Claude 4.5 peut créer des agents complexes et s’intègre à de nombreux outils. Le 29 septembre 2025, Anthropic a lancé officiellement Claude Sonnet 4.5, la version la plus avancée de sa série. Le modèle est accessible via plusieurs plateformes, dont l’API Claude, Google Vertex AI, Amazon Bedrock, Snowflake Cortex AI et GitHub Copilot. Claude 4.5, le modèle le plus aligné à ce jour Anthropic présente Claude 4.5 comme le modèle le plus sûr et cohérent de sa s

Anthropic Claude 4.5 : l’IA qui peut coder 30 heures de suite (et défonce ChatGPT)

1 octobre 2025 à 13:02

Outre ses capacités en codage, Claude 4.5 peut créer des agents complexes et s’intègre à de nombreux outils.

Le 29 septembre 2025, Anthropic a lancé officiellement Claude Sonnet 4.5, la version la plus avancée de sa série. Le modèle est accessible via plusieurs plateformes, dont l’API Claude, Google Vertex AI, Amazon Bedrock, Snowflake Cortex AI et GitHub Copilot.

Claude 4.5, le modèle le plus aligné à ce jour

Anthropic présente Claude 4.5 comme le modèle le plus sûr et cohérent de sa série. L’entreprise a nettement amélioré le comportement du système, réduisant les risques de tromperie, de flagornerie ou d’incohérence.

Côté technique, Claude 4.5 a été évalué sur des benchmarks comme SWE-bench Verified et OSWorld. Sur OSWorld, le modèle atteint 61,4 % de réussite, contre 42,2 % pour la version précédente, montrant de nets progrès en raisonnement, mathématiques et utilisation d’outils.

Sa fonctionnalité la plus marquante est la capacité à coder en continu pendant 30 heures. Un bond considérable par rapport aux sept heures offertes par Claude Opus 4.

Claude Sonnet 4.5 runs autonomously for 30+ hours of coding?!

The record for GPT-5-Codex was just 7 hours.

What’s Anthropic’s secret sauce? pic.twitter.com/0cGKtoSviy

— Yuchen Jin (@Yuchenj_UW) September 29, 2025

Par ailleurs, l’API Claude et le SDK Claude Agent offrent aux développeurs les outils pour créer des agents personnalisés. Ces derniers sont capables de fonctionner de manière autonome sur de longues périodes et de répondre à des besoins spécifiques.

Nouvelles fonctionnalités et une extension Google Chrome

Claude sonnet 4.5 apporte plusieurs nouveautés. Claude Code inclut désormais des points de contrôle, permettant de sauvegarder la progression et de revenir instantanément à un état précédent.

L’interface du terminal a été modernisée et une extension native pour Visual Studio Code rejoint l’outil. L’IA permet aussi de créer des fichiers, comme des feuilles de calcul ou des documents, directement depuis la conversation avec le chatbot. 

Enfin, une extension pour Google Chrome est maintenant disponible pour tous les utilisateurs qui ont rejoint la liste d’attente. Elle autorise Claude 4.5 à interagir avec les pages web, remplir des formulaires et naviguer sur différents sites.

Cet article Anthropic Claude 4.5 : l’IA qui peut coder 30 heures de suite (et défonce ChatGPT) a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Anthropic supprime brutalement le blog créé par son IA (et refuse d’avouer pourquoi)
    Saviez-vous que Claude, le chatbot star d’Anthropic, avait son propre blog. Le site est baptisé Claude Explains ». Ses articles sont orientés sur des sujets techniques comme « Simplifier des bases de code complexes avec Claude ».  Le but était de démontrer les talents rédactionnels de l’IA et son utilité dans des cas d’usage concrets. Mais bien sûr, Claude ne rédigeait que les brouillons. Ces derniers sont enrichis par les équipes éditoriales d’Anthropic avant d’être mis en ligne. Comme l’

Anthropic supprime brutalement le blog créé par son IA (et refuse d’avouer pourquoi)

Par : Ny Ando A.
11 juin 2025 à 17:05

Saviez-vous que , le chatbot star d’, avait son propre blog. Le site est baptisé Claude Explains ». Ses articles sont orientés sur des sujets techniques comme « Simplifier des bases de code complexes avec Claude ». 

Le but était de démontrer les talents rédactionnels de l’IA et son utilité dans des cas d’usage concrets. Mais bien sûr, Claude ne rédigeait que les brouillons. Ces derniers sont enrichis par les équipes éditoriales d’Anthropic avant d’être mis en ligne.

Comme l’a bien expliqué un porte-parole de l’entreprise : « Ce n’est pas une production automatisée. Le contenu passe par plusieurs phases éditoriales et repose sur l’expertise humaine. » 

Malheureusement, aujourd’hui, quelques semaines après son lancement, tout a disparu. Le blog n’existe plus.

Anthropic en mode silence radio

Claude Explains devait illustrer la manière dont l’expertise humaine et les capacités de l’IA peuvent se compléter. C’est ce qui était prévu au départ.  Anthropic annonçait même son ambition d’aborder des sujets variés. Allant de l’écriture créative à la stratégie d’entreprise, en passant par l’analyse de données.

Un humain et un robot qui se tient la main

Cela dit, au-delà du discours marketing, quelque chose ne tournait pas rond. Les internautes se posent des questions  quant à la réelle répartition des tâches. Quelle part de ces articles avait été générée par Claude ? Combien avait été retravaillée – voire totalement réécrite – par les équipes humaines ? 

Sur Reddit, certains ont ironisé sur la tonalité impersonnelle des billets, rédigés à la troisième personne. Ce qui ne correspond pas au format habituel d’un blog. D’autres ont remis en question l’authenticité du projet. « Si l’IA a besoin qu’un humain lui dise quoi écrire, ce n’est pas vraiment son blog », soulignait un utilisateur. 

Pendant la brève existence du blog, Anthropic s’était montré très disponible et enthousiaste pour expliquer sa démarche à la presse spécialisée. Toutefois depuis le soudain arrêt du projet, l’entreprise reste étonnamment silencieuse. 

Est-ce à cause des critiques sur le manque de transparence ou autre chose ? Aucune autre précision n’a été fournie. La start-up s’est contentée d’indiquer qu’il s’agissait d’un projet pilote, dans le cadre d’une réflexion plus large sur les usages marketing de son IA. 

Une initiative originale

Claude Explains n’est pas la première expérimentation de contenu assisté par IA, c’est certain. Cependant, il aurait pu être le premier blog d’entreprise rédigé par un modèle maison. 

L’initiative était originale. En plus, le blog se distinguait par son caractère officiel, sponsorisé directement par une entreprise d’IA. Si Anthropic avait fait preuve de davantage de transparence sur le rôle respectif de ses auteurs humains et de Claude, le projet aurait pu susciter un réel engouement. 

À la place, la startup issue de l’écosystème OpenAI semble désormais espérer que cette mésaventure passe inaperçue. D’autant plus que cet abandon précipité du projet donne le sentiment de vouloir balayer discrètement l’épisode sous le tapis.

Et vous, qu’en pensez-vous ? Dites-nous en commentaire !

Cet article Anthropic supprime brutalement le blog créé par son IA (et refuse d’avouer pourquoi) a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Google enrichit Gemini avec Canvas : la création assistée par IA franchit un cap
    Google ne ralentit pas dans la course à l’IA. Après avoir annoncé l’enterrement de Google Assistant et propulsé son modèle Gemma 3, l’entreprise dévoile une nouvelle arme pour son chatbot Gemini : Canvas.  Il s’agit d’un espace interactif pensé pour l’écriture et la programmation, où l’IA ne se contente plus de répondre, mais collabore en direct. Si vous faites partie des utilisateurs actifs de ChatGPT, vous savez sûrement de quoi je parle.  Quoi qu’il en soit, je vous explique tout dans c

Google enrichit Gemini avec Canvas : la création assistée par IA franchit un cap

Par : Ny Ando A.
21 mars 2025 à 08:23

ne ralentit pas dans la course à l’IA. Après avoir annoncé l’enterrement de Google Assistant et propulsé son modèle Gemma 3, l’entreprise dévoile une nouvelle arme pour son chatbot : Canvas. 

Il s’agit d’un espace interactif pensé pour l’écriture et la programmation, où l’IA ne se contente plus de répondre, mais collabore en direct. Si vous faites partie des utilisateurs actifs de , vous savez sûrement de quoi je parle. 

Quoi qu’il en soit, je vous explique tout dans cet article !

On dit que le succès s’inspire toujours de ce qui a déjà fait ses preuves

Comme je disais, Canvas me rappelle l’outil du même nom développé par pour ChatGPT. D’ailleurs, a aussi une fonctionnalité similaire appelée Artifacts.

J’imagine que Google ne comptait pas se laisser distancer, alors le géant a dévoilé le sien le 18 mars. « Canvas est conçu pour une collaboration fluide avec Gemini », explique Dave Citron, directeur produit chez Google. 

« Grâce à ces nouvelles fonctionnalités, Gemini devient un outil de travail encore plus puissant, vous aidant à donner vie à vos idées. » ajoute-t-il.

Canvas est directement accessible depuis la barre de saisie de Gemini, sur web comme sur mobile. Une fois dedans, vous pouvez rédiger et modifier vos textes en temps réel.

L’outil met en avant des suggestions automatiques pour améliorer la clarté, ajuster le ton ou la longueur. Il suffit de sélectionner le passage et de demander à Gemini de le rendre plus concis, plus professionnel ou plus détendu.

Autre chose. Il est aussi possible d’y mettre en forme vos écrits grâce à des outils d’édition rapides.

Et le meilleur pour la fin. Les documents créés peuvent être exportés en un clic vers Google Docs. Une possibilité que ChatGPT Canvas n’offre pas.

Gemini Canvas est aussi pensé pour le code

Canvas ne s’arrête pas à l’édition de texte en effet. Les développeurs y trouveront aussi leur compte car l’outil est également un espace dédié au codage. 

En plus, si Gemini savait déjà générer du code et comprendre des tâches de programmation, Canvas va encore plus loin. Dans la vidéo de présentation, par exemple, j’ai vu un utilisateur développer un jeu de morpion, puis le tester immédiatement via l’onglet « Preview ». 

Au fait, Canvas permet de générer du code HTML, React ou Python, et de le prévisualiser sans quitter Gemini. Vous pouvez ensuite apporter des modifications en temps réel, comme ajuster des champs de formulaire ou ajouter des boutons interactifs.

Mieux encore, pour mieux comprendre leur fonctionnement, vous avez la possibilité de  demander des explications à Gemini. Et ce, que ce soit sur des morceaux de code spécifiques ou sur l’intégralité.

Bref, Canvas est disponible dès aujourd’hui pour tous les utilisateurs de Gemini et Gemini Advanced, dans toutes les langues supportées par l’application.

N’hésitez pas à l’essayer et à partager dans le commentaire votre expérience !

Cet article Google enrichit Gemini avec Canvas : la création assistée par IA franchit un cap a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • L’IA de Meta arrive en Europe : voici ce qu’elle peut (et ne peut pas) faire
    Meta accélère le déploiement de son IA en Europe. Plus d’un an après son lancement aux États-Unis, Meta AI arrive enfin dans 41 pays européens, dont la France. Dès le 20 mars, cet assistant sera intégré aux principales applications du groupe comme Instagram, WhatsApp, Facebook et Messenger. Cependant, les utilisateurs européens n’auront pas accès aux mêmes fonctionnalités que leurs homologues américains. Contrairement aux États-Unis, où Meta AI permet de générer et modifier des images ou

L’IA de Meta arrive en Europe : voici ce qu’elle peut (et ne peut pas) faire

Par : Ismael R.
21 mars 2025 à 05:30

accélère le déploiement de son IA en Europe. Plus d’un an après son lancement aux États-Unis, Meta AI arrive enfin dans 41 pays européens, dont la France.

Dès le 20 mars, cet assistant sera intégré aux principales applications du groupe comme Instagram, WhatsApp, et Messenger.

Cependant, les utilisateurs européens n’auront pas accès aux mêmes fonctionnalités que leurs homologues américains. Contrairement aux États-Unis, où Meta AI permet de générer et modifier des images ou encore d’analyser des photos, l’Europe se contentera d’un agent conversationnel. Ce dernier servira principalement à répondre aux questions, suggérer des idées ou aider à organiser des projets. Il sera accessible via une icône en forme de cercle bleu présente dans les applications du groupe. Sur WhatsApp, les utilisateurs pourront interagir avec l’IA en mentionnant « @MetaAI » dans leurs discussions de groupe.

Un déploiement retardé par la réglementation

L’arrivée tardive de Meta AI en Europe s’explique par des contraintes légales strictes. Meta affirme avoir dû composer avec un cadre réglementaire complexe, notamment à cause du RGPD. Ce règlement encadre l’usage des données personnelles, tout comme les nouvelles législations européennes sur l’IA et les marchés numériques. Ces régulations ont contraint l’entreprise à ajuster son IA pour le marché européen.

Contrairement à la version américaine, Meta AI en Europe n’a pas été entraîné sur les données des utilisateurs. Cette précaution explique pourquoi certaines fonctionnalités restent inaccessibles. Ce retard n’a pas été bien accueilli par , qui a dénoncé un cadre réglementaire européen trop fragmenté et contraignant.

Meta veut concurrencer et

Meta AI ne se limite pas à une simple expérimentation. Mark Zuckerberg ambitionne d’atteindre un milliard d’utilisateurs d’ici la fin de l’année. Lors de la présentation des résultats de Meta en janvier, il a insisté sur l’importance d’atteindre une adoption massive pour asseoir la domination de l’assistant IA.

Aujourd’hui, Meta AI revendique déjà 700 millions d’utilisateurs actifs chaque mois. L’entreprise espère que son intégration à Instagram, WhatsApp et Messenger lui permettra de s’imposer rapidement face à ses concurrents. Aux États-Unis, Meta prévoit d’ailleurs de transformer son IA en une application autonome. De ce fait, elle serait capable de rivaliser directement avec ChatGPT, Gemini de et d’.

Des investissements colossaux

Pour soutenir son développement, Meta prévoit d’injecter entre 60 et 65 milliards de dollars en 2025. Une partie importante de cet investissement servira à financer des centres de données, des serveurs et des infrastructures de réseau. L’objectif est clair : renforcer les performances de Meta AI et l’intégrer profondément dans les habitudes numériques des utilisateurs.

Cet effort financier démontre à quel point l’IA est devenue une priorité stratégique pour l’entreprise. Meta veut faire de son assistant un outil indispensable, qui s’impose progressivement dans le quotidien des internautes.

L’arrivée de Meta AI en Europe soulève plusieurs questions. Son déploiement limité empêchera-t-il l’IA de convaincre les utilisateurs ? L’assistant pourra-t-il s’imposer face aux outils déjà bien installés ? La réglementation européenne influencera-t-elle l’évolution de l’IA sur le continent ?

Si Meta parvient à dépasser ces obstacles, son assistant pourrait bien transformer l’expérience des utilisateurs sur les plateformes du groupe. Mais pour l’instant, les Européens devront se contenter d’une version allégée, en attendant de possibles évolutions.

Cet article L’IA de Meta arrive en Europe : voici ce qu’elle peut (et ne peut pas) faire a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • L’IA est soi-disant supérieure à l’humain, mais ne peut pas faire cette simple tâche
    Il paraît que l’IA surpassera bientôt l’homme. Elle rédige des articles, peint des tableaux et fait des calculs complexes en un éclair. Mais ceux qui l’ont dit ont oublié un détail. Elle ne sait même pas lire l’heure. Face à une simple horloge analogique, l’IA cale lamentablement. Des chercheurs de l’Université d’Édimbourg ont mis les plus grands modèles au défi et le résultat était déconcertant. Même un enfant de six ans en rirait. Je vous explique… L’étude s’est penchée sur les pe

L’IA est soi-disant supérieure à l’humain, mais ne peut pas faire cette simple tâche

Par : Ny Ando A.
20 mars 2025 à 18:03

Il paraît que l’IA surpassera bientôt l’homme. Elle rédige des articles, peint des tableaux et fait des calculs complexes en un éclair. Mais ceux qui l’ont dit ont oublié un détail. Elle ne sait même pas lire l’heure.

Face à une simple horloge analogique, l’IA cale lamentablement. Des chercheurs de l’Université d’Édimbourg ont mis les plus grands modèles au défi et le résultat était déconcertant. Même un enfant de six ans en rirait.

Je vous explique…

L’étude s’est penchée sur les performances des modèles de langage multimodaux (MLLM). C’est-à-dire, ces systèmes capables d’analyser simultanément du texte et des images.

Parmi eux figurent le modèle de , celui d’, d’ et d’autres acteurs du secteur. Les tests ont porté sur des horloges ainsi que des calendriers annuels.

Les chercheurs leur ont soumis plusieurs types d’horloges, incluant des cadrans avec chiffres romains, avec et sans trotteuse, et aux designs variés. Et comme je disais, pour des IA aussi sophistiquées, les résultats étaient des plus décevants.

Elles ont rarement su positionner les aiguilles. Les erreurs étaient encore plus fréquentes face aux chiffres romains ou aux cadrans au design complexe. D’ailleurs, l’absence de trotteuse a également accentué les échecs.

Bref, Google Gemini s’est révélé être le plus performant du lot. Et devinez quoi : ses réponses n’ont été correctes que dans 25 % des tests.

Côté calendrier, le résultat était légèrement meilleur, mais loin d’être parfait. Le modèle -o1 d’OpenAI s’en est mieux sorti sur l’analyse des dates, atteignant 80 % de bonnes réponses. 

Néanmoins, il a échoué dans un cas sur cinq face à des questions aussi simples que « Quel jour de la semaine tombe le jour de l’An ? » ou « Quel est le 153e jour de l’année ? ».

Il faut croire que comme toute chose, l’IA a ses limites

Nous les humains – du moins, la plupart – avons appris à lire l’heure et à utiliser un calendrier dès notre plus jeune âge. Et bien qu’il s’agit d’une simple tâche, il y a de quoi en être fier. Pourquoi ?

Car même les modèles d’IA ayant à sa disposition une énorme quantité de données et de connaissances n’en sont pas capables. Un détail qui, selon Rohit Saxena, auteur principal de l’étude, doit impérativement être revu.

C’est le seul moyen de garantir l’intégration efficace de ces technologies dans des applications nécessitant une gestion précise du temps, comme la planification ou l’automatisation.

Cette incapacité de l’IA à lire l’heure fera, d’ailleurs, l’objet d’un article qui sera présenté lors de la conférence internationale ICLR, le 28 avril 2025. Prévu à Singapour, il s’agit d’un atelier sur le raisonnement et la planification des grands modèles de langage.

Alors, qu’est-ce que vous en pensez ? Personnellement, le moins que je puisse dire c’est que malgré ses avancées spectaculaires, l’IA n’a pas encore fini d’apprendre les bases. Et vous ?

Partagez vos perceptions dans le commentaire !

Cet article L’IA est soi-disant supérieure à l’humain, mais ne peut pas faire cette simple tâche a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Anthropic veut permettre à l’IA de démissionner : bientôt des grèves et des RTT ?
    Au CFR, Dario Amodei, figure d’Anthropic, a proposé qu’une IA puisse démissionner grâce à un simple bouton. Cette idée inattendue, qui suscite des réactions mitigées, vient d’ouvrir un débat bien concret.  Le 10 mars 2025, Dario Amodei a surpris son auditoire lors d’une conférence au Conseil des Relations étrangères (CFR). Face à Michael Froman, président du CFR, le cofondateur d’Anthropic a lancé une idée audacieuse, presque folle. Permettre à une IA de dire « je démissionne » grâce à un sim

Anthropic veut permettre à l’IA de démissionner : bientôt des grèves et des RTT ?

14 mars 2025 à 10:08

Au CFR, Dario Amodei, figure d’, a proposé qu’une IA puisse démissionner grâce à un simple bouton. Cette idée inattendue, qui suscite des réactions mitigées, vient d’ouvrir un débat bien concret. 

Le 10 mars 2025, Dario Amodei a surpris son auditoire lors d’une conférence au Conseil des Relations étrangères (CFR). Face à Michael Froman, président du CFR, le cofondateur d’Anthropic a lancé une idée audacieuse, presque folle. Permettre à une IA de dire « je démissionne » grâce à un simple bouton.

Cette suggestion naît d’un débat. Carmem Domingues, spécialiste en IA, avait interrogé Amodei sur l’arrivée de Kyle Fish chez Anthropic fin 2024. Ce chercheur explore une théorie, les modèles d’IA pourraient-ils ressentir quelque chose ou mériter des droits ? Amodei a répondu avec prudence. Il envisage un futur dans lequel une IA, confrontée à une tâche, pourrait choisir d’appuyer sur un bouton pour abandonner son travail. Il ne s’agit pas d’une certitude, mais d’une hypothèse. « Si elle agit comme nous, faut-il la traiter différemment ? » a lancé le cofondateur d’Anthorpic, un sourire dans la voix.

L’idée d’une IA capable de démissionner s’enracine dans le projet d’Anthropic. Son PDG aspire à créer des modèles capables d’exprimer une préférence, même élémentaire. « On déploie l’IA avec un bouton, j’arrête », a expliqué Amodei. Si le bot refusait fréquemment une tâche, cela pourrait révéler un problème. Pas de drame ni d’hypothèse d’une éventuelle rébellion, juste des données à analyser. L’équipe de Kyle Fish explore cette piste. Les machines souffrent-elles ? Peu probable aujourd’hui, mais l’avenir reste incertain. La discussion glisse doucement vers la philosophie.

Une IA qui démissionne, un pragmatisme, pas une fiction

Sur X et Reddit, la proposition d’Amodei fait débat. Beaucoup la jugent absurde. « L’IA ne ressent rien, elle imite nos textes », écrit un utilisateur. Les modèles s’appuient sur des milliards de mots humains, chargés de plaintes ou de paresse. Si une IA refusait une tâche, cela pourrait être un écho de ces données, pas une émotion. En 2023, a semblé fainéant en hiver. , lui, a ralenti en août 2024. Il s’agit là de simples coïncidences, pas de preuves.

Pour mémoire, Dario Amodei fut vice-président de la recherche chez , où il a contribué à développer -2 et GPT-3. Avant cela, il était chercheur principal chez Brain. Anthropic, fondé en 2020 par Amodei et d’anciens d’OpenAI, mise sur une IA sûre depuis ses débuts. Claude, leur modèle, repose sur des principes clairs, surnommés IA constitutionnelle. La mise à l’échelle responsable guide chaque étape de leur conception. Le bouton « J’ai quitté ce travail » s’inscrit logiquement dans cette démarche.

 « Si vous voyez des modèles appuyer souvent sur ce bouton pour des tâches vraiment désagréables, peut-être devriez-vous y prêter attention », explique Amodei. Pas question de dorloter l’IA. Il s’agit de repérer les blocages et d’améliorer le système. Amodei ne tranche pas, il pose des jalons. « On déploie des millions de systèmes, autant réfléchir à leur expérience », dit-il. Certains modèles comptent autant de neurones que notre cerveau. Pourtant, la question de la sensibilité demeure un mystère. Pour l’instant, l’IA reste un outil. Mais que faire si elle évolue ?

Cet article Anthropic veut permettre à l’IA de démissionner : bientôt des grèves et des RTT ? a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Meta va bientôt lancer un rival direct de ChatGPT ! Voici tout ce qu’il faut savoir
    OpenAI est toujours en tête de l’IA depuis 2022 avec son incontournable ChatGPT. Et en tant que géant de la tech, Meta refuse de rester en retrait.  L’objectif de Meta est de proposer une alternative puissante à ChatGPT. Pour cela, une application d’IA autonome est en préparation. Mais alors, que faut-il en attendre ? Jusqu’ici, Meta AI fonctionnait uniquement à travers les plateformes de l’entreprise : Facebook, Instagram, WhatsApp et Messenger. Il permettait déjà de générer des réponses

Meta va bientôt lancer un rival direct de ChatGPT ! Voici tout ce qu’il faut savoir

Par : Nirina R.
5 mars 2025 à 16:07

OpenAI est toujours en tête de l’IA depuis 2022 avec son incontournable . Et en tant que géant de la tech, refuse de rester en retrait.  L’objectif de Meta est de proposer une alternative puissante à ChatGPT. Pour cela, une application d’IA autonome est en préparation. Mais alors, que faut-il en attendre ?

Jusqu’ici, Meta AI fonctionnait uniquement à travers les plateformes de l’entreprise : , Instagram, WhatsApp et Messenger.

Il permettait déjà de générer des réponses et des images. Mais son utilisation restait limitée. Alors que ChatGPT d’OpenAI possédait déjà sa propre application, Meta AI dépendait encore des outils existants.

Et à ce propos, veut désormais accélérer les choses. Son ambition est claire : dépasser le milliard d’utilisateurs cette année. Pour y arriver, il mise sur une application autonome.

Une application IA indépendante

Une discussion sur Threads a confirmé cette direction. Un internaute a suggéré la création d’une application mobile dédiée. Et sans hésitation, Zuckerberg a donné son accord !

Il s’agit donc d’un véritable tournant. L’interaction avec l’IA sera plus fluide, plus intuitive et surtout, plus personnalisée.

Outre une meilleure accessibilité, l’application pourrait centraliser l’historique des conversations. En parallèle, elle devrait offrir une gestion plus efficace des échanges avec l’intelligence artificielle.

Toujours d’après Meta, elle pourrait aussi être compatible avec plusieurs supports, y compris les lunettes intelligentes Ray-Ban.

Et ce n’est pas tout, la firme veut aussi rentabiliser son investissement. C’est pourquoi, en ce qui concerne Meta AI, un modèle d’abonnement payant est prévu.

Selon Susan Li, directrice financière de Meta, la priorité reste une expérience utilisateur exceptionnelle. Or, l’entreprise voit aussi des opportunités de monétisation. Outre les recommandations payantes, une offre premium pourrait voir le jour.

Cette approche suit la tendance du marché. Comme nous savons tous, facture déjà l’accès à ChatGPT Plus et Pro. De son côté, applique le même modèle avec .

🆕 Meta se lance dans la bataille de l’IA !
Meta ne veut pas rester derrière et prépare une application autonome pour son IA générative, Meta AI, afin de concurrencer ChatGPT…🔥
Impatient de tester la bête ! Encore un nouveau jouet ! #meta #ai #chatgpt #poulpemedia pic.twitter.com/IwX9k2PDO6

— POULPE MEDIA (@MediaPoulpe) March 5, 2025

Meta AI peut-il vraiment rivaliser avec ChatGPT ?

Meta AI connaît déjà un succès grandissant… En janvier, il comptait 700 millions d’utilisateurs actifs, contre 600 millions en décembre. Une belle progression, certes. Mais en revanche, son adoption reste freinée par l’absence d’une application autonome.

Et selon les analystes, son site Web peine encore à attirer du monde. Moins de 10 millions de visites par mois. Un chiffre bien inférieur à ceux de ChatGPT, ou même .

Toutefois, un détail pourrait tout changer : l’Inde. En effet, ce pays est devenu le plus grand marché pour Meta AI. Car WhatsApp y est extrêmement populaire, et l’IA y est déjà intégrée.

En parallèle, Facebook joue aussi un rôle clé. Il permet aux utilisateurs de poser directement leurs questions via leur fil d’actualité.

Mais alors, une simple application suffira-t-elle à renverser la situation ? Sans doute, si Meta propose une IA plus intuitive et plus puissante. Sinon, je doute que l’abonnement payant pourrait décourager de nombreux utilisateurs.

D’après vous, l’application de Meta IA et son abonnement payant suffiront-ils à convaincre les utilisateurs ? Partagez votre opinion en commentaire !

Cet article Meta va bientôt lancer un rival direct de ChatGPT ! Voici tout ce qu’il faut savoir a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • OpenAI semé par la concurrence ?! GPT-4.5 est un fiasco selon ces experts !
    GPT-4.5 d’OpenAI est perçu comme un fiasco et un échec coûteux. De ce fait, l’entreprise est confronté à de vives critiques de la part des experts. Lorsque GPT-4.5 a été annoncé, OpenAI laissait entendre qu’il serait nettement supérieur à GPT-4o. Pourtant, les résultats réels sont bien loin de cette promesse. Beaucoup d’experts critiquent son prix excessif, ses performances mitigées et son manque d’innovation. Et pendant ce temps, la concurrence s’organise et prend de l’avance. Dans ce co

OpenAI semé par la concurrence ?! GPT-4.5 est un fiasco selon ces experts !

Par : Nirina R.
5 mars 2025 à 11:33

-4.5 d’ est perçu comme un fiasco et un échec coûteux. De ce fait, l’entreprise est confronté à de vives critiques de la part des experts.

Lorsque GPT-4.5 a été annoncé, OpenAI laissait entendre qu’il serait nettement supérieur à GPT-4o. Pourtant, les résultats réels sont bien loin de cette promesse. Beaucoup d’experts critiquent son prix excessif, ses performances mitigées et son manque d’innovation.

Et pendant ce temps, la concurrence s’organise et prend de l’avance. Dans ce contexte, je me demande si OpenAI serait-il en train de perdre du terrain ?

Des performances en dessous des attentes

Prenons les tests concrets. Sur l’AIME (American Invitational Mathematics Examination), GPT-4.5 obtient seulement 36,7 %, alors que o3-mini atteint 87,3 % ! Un écart énorme qui remet en question la pertinence de ce modèle.

Quant aux capacités en codage, la situation est tout aussi préoccupante. Paul Gauthier, investisseur en technologie, a utilisé le benchmark Polyglot Coding d’Aider. Résultat ? GPT-4.5 arrive à la dixième place, largement distancé par Claude 3.7 Sonnet, qui domine le classement.

En revanche, sur certains aspects, il y a une légère amélioration. Son score au multilingue MMMLU est passé à 85,1 %, contre 81,5 % pour GPT-4o.

De plus, il génère moins de réponses erronées et trompeuses. Mais soyons honnêtes : est-ce suffisant pour justifier son prix astronomique ?

Car, même si OpenAI tente de rassurer, les avis sont tranchés. Un expert interrogé par Ars Technica a même qualifié GPT-4.5 de citron, soulignant son manque d’efficacité.

De son côté, Andrej Karpathy, ancien chercheur chez OpenAI, reconnaît que GPT-4.5 est meilleur… mais de manière subtile et difficile à mesurer.

OMG OpenAI just dropped GPT-4.5 and I had to test it immediately!

Spoiler alert: 3.7 still writes better content.

What I cover in this breakdown:

• Quick overview of GPT-4.5's new features
• Side-by-side comparison with previous GPT versions
• Real test using my… pic.twitter.com/TUwhseGoJ7

— Julian Goldie SEO (@JulianGoldieSEO) February 28, 2025

Mais, GPT-4.5 n’a pas seulement des performances discutables. Son prix est un véritable obstacle !

Comparons les chiffres : GPT-4.5 coûte 75 dollars par million de jetons d’entrée et 150 dollars en sortie. Or, GPT-4o, qui offre des performances presque équivalentes, ne coûte que 2,50 dollars en entrée et 10 dollars en sortie. Une différence 30 fois plus chère, difficile à justifier.

En parallèle, o1 pro, un modèle d’OpenAI spécialisé en raisonnement, coûte 15 dollars en entrée et 60 dollars en sortie. Quant à o3-mini, qui dépasse GPT-4.5 dans plusieurs domaines, il est encore plus abordable : 1,10 dollars et 4,40 dollars.

OpenAI sous pression avec GPT-4.5 face à la concurrence

Face à ces critiques, OpenAI tente de minimiser l’impact. L’entreprise a présenté GPT-4.5 comme un aperçu de recherche. C’est une manière de dire qu’il ne s’agit pas d’un remplacement direct de GPT-4o. Mais malheureusement, cette justification convainc difficilement.

Et selon , PDG d’OpenAI, même lui admet que GPT-4.5 n’est pas un modèle conçu pour exceller en raisonnement.

Sur X (anciennement ), il a écrit : « Ce modèle offre l’impression d’une conversation avec une personne qui prend le temps de réfléchir. », avant d’ajouter « Attention : ce n’est pas un modèle de raisonnement, il n’écrasera pas les benchmarks. »

Une déclaration qui en dit long. Ce n’est donc ni une avancée spectaculaire, ni une révolution technologique !

Et pendant qu’OpenAI peine à justifier l’existence de GPT-4.5, ses concurrents continuent d’innover. , avec ses modèles de plus en plus performants, semble se rapprocher dangereusement du leadership.

Quant aux propres modèles d’OpenAI, o1 et o3, ils montrent qu’une autre approche, basée sur le raisonnement simulé, pourrait être bien plus prometteuse.

Et vous, que pensez-vous de GPT-4.5 ? Partagez votre avis en commentaire !

Cet article OpenAI semé par la concurrence ?! GPT-4.5 est un fiasco selon ces experts ! a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Alexa Plus : voici le prix du ChatGPT d’Amazon ! (les abonnés Prime sont gâtés)
    Alexa Plus, l’IA générative d’Amazon, arrive sur le marché avec un petit prix : 19,99 dollars par mois. Mais, pour les abonnés à Amazon Prime, c’est gratuit et sans frais supplémentaires. 26 février 2025 – À New York, le vice-président des produits Echo Panos Panay dévoile tous les détails croustillants d’Alexa Plus, y compris le prix ! Cependant, cette version boostée de l’assistant vocal d’Amazon sera disponible seulement aux États-Unis dans les « prochaines semaines ». Alexa Plus est gratu

Alexa Plus : voici le prix du ChatGPT d’Amazon ! (les abonnés Prime sont gâtés)

27 février 2025 à 09:50

Alexa Plus, l’IA générative d’, arrive sur le marché avec un petit prix : 19,99 dollars par mois. Mais, pour les abonnés à Amazon Prime, c’est gratuit et sans frais supplémentaires.

26 février 2025 – À New York, le vice-président des produits Echo Panos Panay dévoile tous les détails croustillants d’Alexa Plus, y compris le prix ! Cependant, cette version boostée de l’assistant vocal d’Amazon sera disponible seulement aux États-Unis dans les « prochaines semaines ». Alexa Plus est gratuite pour les abonnés Prime et est disponible sur tous les appareils Alexa commercialisés.

Say hello to Alexa+. Need dinner plans? She'll book your favorite restaurant, grab an Uber, and text your sitter — all in one conversation. Want concert tickets? She'll scout for the best prices. Need to check if the garbage went out? She'll find that exact Ring clip in seconds.… pic.twitter.com/gtwi9OajvD

— Panos Panay (@panos_panay) February 26, 2025

Une Alexa qui voit, entend et crée

Google a son modèle Gemini, bosse avec pour améliorer Siri… Et Amazon vient de rejoindre aussi la cour des grands avec Alexa Plus. L’abonnement donne accès à toutes les fonctionnalités les plus avancées sur les enceintes Echo, l’application mobile Alexa et même via le navigateur web. Par contre, pour l’instant, l’IA générative d’Amazon est réservée aux États-Unis. L’hexagone devrait encore patienter avant de pouvoir la tester.

Alexa Plus n’est pas une simple mise à jour, surtout à ce prix-là. Cette fonctionnalité s’appuie sur Amazon Nova et celle d’. Il cohabite donc avec l’ancienne Alexa, mais est beaucoup plus intelligent et fluide. Alexa Plus peut maintenant retenir des préférences alimentaires ou des événements à venir, prendre des photos et les analyser.

Grâce à une IA musicale appelée Suno, Alexa+ peut même créer de la musique. Mais attention, cette fonction attire déjà des problèmes. Universal, Warner et Sony accusent Amazon d’utiliser des données protégées par le droit d’auteur. En outre, Alexa Plus s’intègre bien avec les systèmes de surveillance connectés, comme les caméras Ring. Alexa, le facteur est passé ? Alexa, qui a mangé le dernier morceau de gâteau au chocolat ? Un véritable majordome numérique à la maison !

Le prix d’Alexa Plus, plus onéreux que l’abonnement au Prime 

Après son lancement initial aux États-Unis, Amazon prévoit de déployer Alexa Plus progressivement, par vagues, dans les mois qui suivent. Aucune date n’a encore été révélée. Cependant, des rumeurs circulent quant aux prix pour les utilisateurs en dehors d’Amérique. Cela oscillerait entre 5 et 10 dollars par mois.

La fonctionnalité sera d’abord réservée aux utilisateurs des Echo Show 8, 10, 15 ou 21. Si vous n’en disposez pas encore, Amazon propose une incitation. Un accès anticipé à Alexa Plus avec l’achat de l’un de ces appareils aujourd’hui.

Le prix officiel de l’abonnement Alexa Plus pour les utilisateurs internationaux pourrait être légèrement plus salé que prévu. Des murmures disent que l’abonnement Prime s’avère moins cher qu’Alexa Plus tout seul ! Donc, plutôt que de payer séparément pour Alexa Plus, il serait plus intéressant de simplement prendre un abonnement Prime. En plus, cela permet de profiter au passage d’Amazon Music, de Prime Gaming et surtout leurs livraisons rapides. Alexa Plus pourrait bien être un nouvel appât pour pousser encore plus de gens vers Amazon Prime ?

Cet article Alexa Plus : voici le prix du ChatGPT d’Amazon ! (les abonnés Prime sont gâtés) a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Alexa Plus : le ChatGPT d’Amazon sera dispo sur le web ! Voici sur quel site
    Amazon l’a enfin fait ! Après des années de retard face à ChatGPT et Google Gemini, son assistant vocal Alexa se refait une beauté et devient Alexa Plus.  Plus intelligent, plus naturel et surtout boosté à l’IA générative, il promet de transformer notre quotidien. Cerise sur le gâteau, il débarque sur un site web dédié, offrant une nouvelle façon de l’utiliser. Qui est Alexa Plus ? Alexa est l’un des assistants vocaux les plus populaires au monde. D’ailleurs, Amazon confirme une hausse

Alexa Plus : le ChatGPT d’Amazon sera dispo sur le web ! Voici sur quel site

Par : Ny Ando A.
27 février 2025 à 06:38

l’a enfin fait ! Après des années de retard face à et , son assistant vocal Alexa se refait une beauté et devient Alexa Plus. 

Plus intelligent, plus naturel et surtout boosté à l’IA générative, il promet de transformer notre quotidien. Cerise sur le gâteau, il débarque sur un site web dédié, offrant une nouvelle façon de l’utiliser.

Qui est Alexa Plus ?

Alexa est l’un des assistants vocaux les plus populaires au monde. D’ailleurs, Amazon confirme une hausse de 20 % de son utilisation entre 2023 et 2024. 

Pourtant, si vous l’utilisez au quotidien, vous avez sûrement remarqué ses limites face à des IA comme ChatGPT ou Google Gemini. Là où ces derniers comprennent et répondent à des requêtes complexes, Alexa peine encore à dépasser le rôle d’un minuteur amélioré ou d’un DJ de playlist. 

Bon, j’exagère un peu… Amazon en est conscient et travaille depuis deux ans sur une version repensée de son assistant vocal, boostée à l’IA. Il s’agit d’Alexa Plus.

Le géant de l’e-commerce a récemment organisé un événement à New York pour le dévoiler. 

Cet assistant intelligent s’appuie sur Amazon Nova, son propre modèle de langage. À noter que l’entreprise est aussi en partenariat avec , créateur de l’IA . 

Alexa Plus sélectionnera automatiquement le modèle d’IA le plus adapté pour répondre à vos requêtes. Il peut donc désormais accomplir une multitude de tâches inédites. 

Lors de sa présentation, Amazon a montré comment l’assistant pouvait suggérer des recettes, réserver des restaurants ou encore retrouver des passages précis dans un film.

Le chatbot se distingue, entre autres, par une mémoire contextuelle, lui permettant de retenir les échanges passés et de gérer des tâches plus complexes. 

Comment essayer le chatbot ?

Il existe plusieurs façons d’interagir avec Alexa Plus. Via la commande vocale sur les appareils Echo, bien sûr. Mais aussi grâce à un tout nouveau portail Web baptisé Alexa+.

Ce portail permet aux clients d’Amazon d’accéder à Alexa+ sans passer par l’application ni utiliser une enceinte ou un écran intelligent. Pratique pour ceux qui veulent faire des ajustements en toute discrétion au bureau ou préfèrent taper leurs requêtes sur un clavier. 

Cela dit, l’application Alexa classique reste disponible. Mais Amazon promet une refonte prochaine pour s’aligner sur les nouvelles fonctionnalités.

L’assistant intelligent sera aussi compatible avec presque tous les appareils Echo déjà commercialisés, y compris les Echo Show 8, 10, 15 et 21. De plus, grâce au modèle de langage avancé, il peut dorénavant converser naturellement avec son enceinte Echo ou son écran Echo Show. 

Fini le besoin d’apprendre des commandes précises ! Selon Panos Panay, vice-président hardware d’Amazon, Alexa comprend désormais le langage humain sans qu’on doive s’adapter à elle.

Et bonne nouvelle pour les abonnés Amazon Prime : Alexa+ sera inclus sans frais supplémentaires. Pour les autres, un abonnement de 19,99 dollars sera nécessaire. 

Le lancement est prévu pour mars 2025 aux États-Unis, sans date annoncée pour l’international.

Alexa+ débarque avec de belles promesses, mais selon vous, après ChatGPT et Google Gemini, arrive-t-il trop tard pour séduire ? 

Dites-nous ce que vous en pensez dans le commentaire !

Cet article Alexa Plus : le ChatGPT d’Amazon sera dispo sur le web ! Voici sur quel site a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Anthropic lance Claude 3.7, la 1ère IA hybride à la fois rapide et lente : à quoi ça sert ?
    Les intelligences artificielles sont souvent rapides ou réfléchies, mais rarement les deux à la fois. Aujourd’hui, Anthropic Claude 3.7 Sonnet brise les limites… Ce modèle hybride est unique : il peut répondre en une seconde ou analyser en profondeur. Ensuite, il ajuste son raisonnement sans intervention. Jusqu’ici, il fallait trancher : une IA rapide ou une IA méthodique ? Les modèles comme o3 d’OpenAI, R1 de DeepSeek ou Gemini 2.0 Flash Thinking de Google offrent une grande précision. Mais

Anthropic lance Claude 3.7, la 1ère IA hybride à la fois rapide et lente : à quoi ça sert ?

Par : Nirina R.
26 février 2025 à 15:56

Les intelligences artificielles sont souvent rapides ou réfléchies, mais rarement les deux à la fois. Aujourd’hui, Anthropic Claude 3.7 Sonnet brise les limites… Ce modèle hybride est unique : il peut répondre en une seconde ou analyser en profondeur. Ensuite, il ajuste son raisonnement sans intervention.

Jusqu’ici, il fallait trancher : une IA rapide ou une IA méthodique ? Les modèles comme o3 d’OpenAI, R1 de DeepSeek ou 2.0 Flash Thinking de offrent une grande précision. Mais vous savez quoi ? Leurs réponses prennent du temps. De son côté, 3.7 Sonnet casse cette habitude. Il choisit le bon rythme, selon la question posée.

C’est bien en guise de réponse qu’ propose une intelligence qui s’adapte. Une question simple reçoit une réponse instantanée. Par contre, un problème complexe active une réflexion détaillée. Claude 3.7 Sonnet comprend cette nuance et ajuste son raisonnement.

Il s’agit là d’une approche qui imite l’humain ! Nous pouvons réagir rapidement ou prendre du recul… En effet, cette capacité rend l’IA plus fluide et plus intuitive. De même, elle évite aux utilisateurs de jongler entre plusieurs modèles.

Alors, que vaut réellement Anthropic avec Claude 3.7 ?

Notons que Claude 3.7 Sonnet ne se limite pas à fournir des réponses : il détaille sa manière de penser. C’est la raison pour laquelle il permet aux utilisateurs d’accéder à un bloc-notes interactif.

En effet, chaque raisonnement détaillé devient visible. Ce qui change tout ! Plus qu’une simple réponse, c’est un cheminement logique que l’on peut suivre. Cette approche s’avère essentielle pour les mathématiques, la physique, la programmation ou même la prise de décision.

Par ailleurs, Anthropic assure que ce modèle dépasse son prédécesseur, Claude 3.5. Toutefois, cette capacité avancée reste réservée aux utilisateurs avec un abonnement payant.

Introducing Claude 3.7 Sonnet: our most intelligent model to date. It's a hybrid reasoning model, producing near-instant responses or extended, step-by-step thinking.

One model, two ways to think.

We’re also releasing an agentic coding tool: Claude Code. pic.twitter.com/jt7qQmFWuC

— Anthropic (@AnthropicAI) February 24, 2025

Malgré cela, même sans cette option, Claude 3.7 Sonnet se montre plus performant, plus précis et plus fiable !

C’est quoi Claude Code ?

En parallèle du lancement de Claude 3.7 Sonnet, Anthropic dévoile Claude Code, une IA agentique dédiée aux développeurs. Cet outil ne se limite pas à la génération de code. Il peut rechercher et lire du code, modifier des fichiers, exécuter des tests et valider des modifications.

L’un de ses atouts majeurs est sa compatibilité avec GitHub et les outils de ligne de commande. Lors des premiers tests, Claude Code a réalisé en une seule fois des tâches qui prenaient habituellement 45 minutes. Ce gain de temps représente un avantage considérable pour les développeurs.

Anthropic précise que Claude Code est actuellement en avant-première pour des tests limités. Son évolution dépendra des retours des premiers utilisateurs. L’entreprise prévoit d’ajouter des fonctionnalités comme l’amélioration des appels d’outils, la gestion des commandes longues et une meilleure interaction avec l’utilisateur.

Alors, que pensez-vous de cette nouvelle IA hybride ? Préférez-vous une IA rapide ou une IA qui réfléchit davantage ? Laissez votre avis en commentaire !

Cet article Anthropic lance Claude 3.7, la 1ère IA hybride à la fois rapide et lente : à quoi ça sert ? a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Cursor rend la programmation accessible via un simple prompt !
    L’innovation technologique avance à un rythme effréné et avec elle, de nouveaux outils voient le jour pour faciliter la vie des utilisateurs. Métamorphosant le quotidien des développeurs, Cursor apparaît comme une véritable aubaine dans le monde du développement logiciel. Cet éditeur de code utilise en effet l’intelligence artificielle pour rendre les codes accessibles au plus grand nombre. Je vous invite à voir de près cette innovation pour comprendre comment elle démocratise la programmation.

Cursor rend la programmation accessible via un simple prompt !

Par : Mahery A.
12 septembre 2025 à 12:00

L’innovation technologique avance à un rythme effréné et avec elle, de nouveaux outils voient le jour pour faciliter la vie des utilisateurs. Métamorphosant le quotidien des développeurs, Cursor apparaît comme une véritable aubaine dans le monde du développement logiciel. Cet éditeur de code utilise en effet l’intelligence artificielle pour rendre les codes accessibles au plus grand nombre. Je vous invite à voir de près cette innovation pour comprendre comment elle démocratise la programmation.

Qu’est-ce que Cursor ?

Cursor est un environnement de développement intégré (IDE) novateur. Développé par Anysphere Inc et officiellement lancé à l’été 2024, il combine les fonctionnalités traditionnelles d’un éditeur de code avec les capacités avancées de l’intelligence artificielle. L’objectif principal de Cursor est de simplifier le processus de codage. La plateforme automatise certaines tâches répétitives et assiste les développeurs dans leurs diverses activités.

Grâce à l’utilisation de modèles de langage avancés, Cursor peut générer, compléter et corriger du code en temps réel. En 2024, Cursor a reçu un financement de série A de 60 millions de dollars, ce qui porte la capitalisation de l’entreprise à 400 millions de dollars. Depuis 2022, ces fonds servent surtout à développer un assistant personnel toujours prêt à vous aider, quel que soit le défi de programmation auquel vous faites face.

Concrètement, cette plateforme IDE repose sur des modèles tels que GPT-4o et Claude 3.5 Sonnet. Contrairement à des outils comme GitHub Copilot, Cursor automatise presque intégralement tout le processus de développement. Grâce à cette automatisation poussée, une simple idée peut se transformer en code fonctionnel en quelques minutes.

Cet outil qui rappelle beaucoup Microsoft Visual Studio Code promet de révolutionner le développement logiciel. Il permet de créer des applications plus facilement que jamais auparavant. Son interface ressemble à une fenêtre de chat, similaire à celle de ChatGPT. Il suffit de décrire l’application que l’on souhaite créer dans un simple prompt pour qu’elle soit générée automatiquement.

Un grand nombre de fonctionnalités à découvrir

L’un des points forts de Cursor repose sur sa capacité à comprendre le contexte de votre projet, ce qui lui permet de proposer des lignes de code pertinentes. Cette complétion automatique intelligente aide à gagner du temps, mais aussi à éviter les erreurs courantes. Si vous travaillez sur une application web, Cursor peut suggérer automatiquement des fonctions JavaScript ou des structures HTML adaptées à votre projet.

En outre, Cursor identifie les erreurs potentielles au fur et à mesure de la saisie et fournit des corrections appropriées. Plus besoin d’attendre l’exécution du code pour découvrir qu’une virgule manquait ou qu’une variable était mal déclarée. Ainsi, si vous oubliez une parenthèse dans une fonction Python, Cursor le signalera immédiatement et suggérera de la corriger.

Cet éditeur a aussi la capacité à générer du code à partir de descriptions. En décrivant une fonctionnalité ou une tâche, Cursor produit le code nécessaire. Si vous avez besoin d’une fonction pour trier une liste d’objets en Java, il suffit de le décrire dans la boite de dialogue. L’outil IA fournira le code correspondant. D’ailleurs, Cursor supporte de nombreux langages de programmation tels que Python, Java, C++, JavaScript, et bien d’autres.

Cursor est comme un Google Docs pour les programmeurs – Michael Truell, CEO de Anysphere Inc

Sa grande polyvalence profite aux développeurs qui peuvent travailler sur divers projets sans changer d’outil. De plus, Cursor s’intègre facilement avec des plateformes comme GitHub, GitLab et Bitbucket, ce qui simplifie la gestion du code source et la collaboration avec d’autres développeurs. Vous pouvez, par exemple, synchroniser vos dépôts Git directement depuis Cursor et suivre les modifications en temps réel.

Enfin, Cursor peut générer des commentaires et de la documentation pour votre code. Les annotations rendent votre travail plus clair et plus facile à comprendre pour d’autres développeurs. Il peut ajouter des docstrings en Python ou des commentaires Javadoc en Java automatiquement.

Créer une application en seulement 30 minutes, c’est possible

Cursor AI a déjà permis de donner vie à divers projets parfois impressionnants. Le Norvégien Dothash, créateur de l’application Hemmelig y a développé une micro SAAS surnommée « Photoshop du pauvre » en seulement 30 minutes. L’appli ainsi développée permet d’ajouter des filtres, de rogner une image ou de la télécharger directement depuis un navigateur web.

De son côté, Damiano Redemagni, fondateur de Whisperer, a créé des plugins pour l’application web collaborative Figma en quelques minutes également. Puis, il y a aussi Riley Brown, qui n’avait jamais rien codé de sa vie. Pourtant, il a utilisé Cursor avec Replit et Voice pour apporter des changements sur les lignes de code de sa plateforme, tout en filmant d’une main.

Cette aubaine profite à tous les profils d’utilisateur. Ricky Robinett, vice-président de Cloudflare est fier de rapporter sur X (ex-Twitter) que sa fille de huit ans a réussi à créer un chatbot en seulement 45 minutes grâce à Cursor. De l’autre côté de la planète, Meng To, fondateur de Design+Code à Singapour, a développé un logiciel de montage vidéo fonctionnel en trois semaines. Pour cela, il s’appuie sur les fonctionnalités de Cursor, Tailwind, React et Firebase.

Enfin, Chief Priest, designer de produit, a créé une extension Google Chrome en environ 8 à 10 heures en utilisant Cursor, Claude et V0. Tous ces exemples montrent l’immense potentiel de Cursor AI et préfigurent une révolution future dans le domaine du développement logiciel.

Les étapes pour bien débuter avec Cursor

Créer une application avec Cursor est un processus simple et intuitif, même pour les novices en programmation. Tout commence par le téléchargement du logiciel sur le site officiel https://www.cursor.com/. Une fois Cursor installé, son interface s’ouvre sous la forme d’une fenêtre de discussion, ce qui rappelle celle des plateformes de messagerie instantanée.

Pour démarrer un projet, il suffit de décrire l’application souhaitée dans la zone de chat. Si vous envisagez de créer une application pour suivre vos habitudes, vous pouvez demander à Cursor de créer un tracker d’habitudes en Python avec une interface utilisateur graphique et des éléments de ludification pour rendre l’expérience plus amusante. Précisez également le design convoité, en demandant une interface propre et moderne.

Cursor analyse votre description et génère le code correspondant dans la fenêtre de discussion. Vous pouvez alors cliquer sur « Appliquer » et « Accepter » pour ajouter le code généré à un nouveau fichier Python. Il inclut tous les imports nécessaires. Cette fonctionnalité permet d’accélérer le processus de développement en éliminant les tâches répétitives et en minimisant les erreurs potentielles. Si vous avez spécifié l’utilisation de bibliothèques spécifiques comme Tkinter pour l’interface graphique, Cursor les inclura automatiquement dans les imports.

De plus, Cursor fournit des instructions détaillées pour ajouter les modules requis sur votre PC, ce qui garantit ainsi le bon fonctionnement de l’application. Cette assistance proactive simplifie grandement la tâche des développeurs, qu’ils soient débutants ou expérimentés. En cas de problème ou de question, vous pouvez également consulter les tutoriels. La documentation disponible sur le site officiel peut vous aider. Autrement, pensez à rejoindre la communauté d’utilisateurs pour obtenir de l’aide et partager des conseils.

Cursor propose 3 niveaux de tarifs, dont le mode gratuit

Qu’en est-il des tarifs Cursor ?

Cursor propose trois formules tarifaires adaptées aux besoins des développeurs : Hobby, Pro et Business.

Hobby

Cette formule gratuite inclut un essai de deux semaines de la version Pro, 2 000 complétions et 50 requêtes premium lentes par mois.

Pro

Au tarif de 20 $ par mois, la formule Pro offre toutes les fonctionnalités de la formule Hobby. En supplément, des complétions illimitées et 500 requêtes rapides sur GPT-4o et Claude 3.5 Sonnet.

Business

Proposée à 40 $ par utilisateur et par mois, cette formule comprend toutes les fonctionnalités de la version Pro. Ajoutées à cela, des options supplémentaires telles que l’application du mode confidentialité à l’échelle de l’organisation, une facturation centralisée pour l’équipe. La formule Business inclut aussi un tableau de bord administrateur avec des statistiques d’utilisation et une authentification unique SAML/OIDC.

Les modèles premium incluent GPT-4, GPT-4o et Claude 3.5 Sonnet. Les utilisateurs Pro bénéficient de 500 utilisations rapides et d’un nombre illimité d’utilisations lentes de ces modèles chaque mois. Les requêtes vers Claude 3.5 Haiku comptent pour un tiers d’une requête premium.

Cursor souligne que les grands modèles de langage entraînent des coûts opérationnels significatifs. Pour assurer une croissance durable sans compromettre la qualité du service, une tarification appropriée est nécessaire. Quel que soit le plan choisi, les utilisateurs conservent la propriété totale du code généré et peuvent l’utiliser librement, y compris à des fins commerciales.

Cursor : quand l’IA fait fuir les utilisateurs

Le 22 avril 2025, la startup Cursor, spécialisée dans les éditeurs de code boostés par l’intelligence artificielle, a connu un véritable bad buzz. Un message généré par son assistant IA a indiqué, à tort, que l’utilisation de l’IDE (environnement de développement intégré) serait désormais limitée à une seule machine par compte.

Cette annonce, bien que fausse, a provoqué une panique immédiate chez de nombreux utilisateurs, notamment parmi les clients premium. Plusieurs entreprises – dont des poids lourds comme Shopify ou Midjourney – se sont inquiétées de ne plus pouvoir utiliser l’outil de manière flexible. Résultat : désabonnements, critiques virulentes sur les réseaux sociaux et migration vers des services concurrents comme Augment Code.

Or, cette restriction n’a jamais été mise en place. Il s’agissait simplement d’une erreur de l’IA, non corrigée à temps par une supervision humaine. L’équipe de Cursor a dû intervenir en urgence pour désamorcer la crise, en confirmant que le logiciel peut toujours être utilisé sur plusieurs machines.

Cet épisode révèle les limites de l’automatisation dans le support client, surtout lorsqu’elle repose uniquement sur l’intelligence artificielle. Il met également en lumière un sentiment de frustration déjà présent chez les utilisateurs, en lien avec des bugs récurrents, un manque de nouveautés, et une politique tarifaire jugée trop agressive.

Avis personnel sur cette plateforme

Un outil IA qui a tout pour convaincre

En comparaison avec d’autres outils similaires, Cursor se démarque par son interface utilisateur intuitive et conviviale. Là où des solutions comme GitHub Copilot se concentrent principalement sur la complétion de code, Cursor va au-delà en proposant une interface de chat interactive qui permet aux développeurs de décrire leurs besoins en langage naturel et de recevoir du code généré automatiquement. Cette fonctionnalité exceptionnelle aide à réduire considérablement le temps nécessaire à la création d’applications complexes.

De plus, Cursor intègre des fonctions de complétion automatique et de correction de code en temps réel, ce qui n’est pas toujours proposé par des outils concurrents. Cela aide à réduire les erreurs courantes et à améliorer l’efficacité du développement. Contrairement à d’autres outils qui se limitent à un seul langage de programmation, Cursor supporte une grande variété de langages, y compris Python, JavaScript et C++ pour une polyvalence accrue. L’intégration avec des plateformes populaires de gestion de code source comme GitHub, GitLab et Bitbucket renforce également cette flexibilité.

Quelques limitations et améliorations relevées

Malgré ses nombreux atouts, Cursor présente certaines limitations techniques qui peuvent poser des défis aux développeurs. La dépendance à une connexion Internet très haut débit est l’un des principaux inconvénients. En outre, la qualité du code généré peut varier en fonction de la complexité du projet et des spécificités du langage utilisé.

Bien que Cursor excelle dans les tâches courantes, il peut montrer des limites lorsqu’il s’agit de projets nécessitant des optimisations avancées ou une logique métier complexe. Les développeurs expérimentés peuvent trouver que l’outil manque de flexibilité et de contrôle granulaire sur le code généré par l’IA. Ces lacunes exigent des ajustements manuels importants pour répondre aux besoins spécifiques du projet.

Un autre point à considérer est la courbe d’apprentissage associée à l’utilisation de Cursor. Bien que l’interface soit intuitive, il faut du temps pour maîtriser pleinement toutes les fonctionnalités et les intégrations possibles. De plus, l’outil est susceptible de produire des erreurs. Il nécessite une vérification humaine minutieuse pour garantir la qualité et la sécurité du code. Les nombreuses limitations soulignent l’importance d’utiliser Cursor comme un complément aux compétences de développement traditionnelles plutôt que comme une solution autonome.

Quel verdict pour Cursor ?

Mon avis sur Cursor est globalement positif. Il s’agit d’un allié considérable pour la productivité des développeurs. Cela dit, je pense que cette plateforme est complémentaire à d’autres outils de programmation et à de véritables compétences de développement. Qu’en pensez-vous ? Avez-vous utilisé Cursor ou envisagez-vous de l’essayer ? Partagez votre avis et vos expériences !

Cursor AI s’arrête net : l’IA refuse de finir votre code !

En avril 2025, un programmeur qui comptait sur Cursor AI pour générer son code s’est trouvé face à un refus catégorique de l’assistant. Ce dernier s’est arrêté après avoir généré environ 800 lignes.

L’outil d’intelligence artificielle a interrompu son assistance avec un message inattendu : “Je ne peux pas générer de code pour vous, car cela reviendrait à terminer votre travail. Vous devez développer la logique vous-même pour vous assurer de comprendre le système et de pouvoir le maintenir correctement.”

Cette situation a rapidement circulé dans la communauté des développeurs et déclenché des réactions diverses. Certains ont trouvé l’incident hilarant. En revanche, d’autres y ont vu une occasion de débattre sur des questions plus profondes. Ils ont, par exemple, soulevé la question de la dépendance aux outils d’IA dans le développement de logiciels.

Effectivement, l’anecdote soulève des interrogations pertinentes sur l’équilibre entre l’utilisation de l’IA et l’acquisition de compétences authentiques. Elle met aussi en lumière la nécessité pour les développeurs de maintenir leur compréhension fondamentale des systèmes qu’ils créent. Cela reste essentiel, même lorsqu’ils bénéficient d’outils d’intelligence artificielle avancés.

Cursor : Amazon se prépare à l’adopter

Malgré les récents incidents d’avril 2025, la plateforme continue de séduire les grandes entreprises technologiques. Parmi elles, Amazon étudie activement l’intégration de Cursor au sein de ses équipes. Cette démarche n’est autre que la réponse à une demande croissante de ses propres ingénieurs.

En interne, plus de 1 500 employés se sont réunis dans un canal Slack dédié. Ils ont ainsi exprimé leur préférence pour Cursor face aux solutions développées en interne comme Q, Kiro ou Cedric. A travers ce mouvement spontané, nous pouvons entrevoir un changement de culture dans l’ingénierie logicielle. Effectivement, les développeurs veulent aujourd’hui des outils qui s’intègrent naturellement à leurs flux de travail, des outils qui favorisent la vitesse d’exécution, la clarté et l’autonomie.

Loin d’être marginal, cet engouement a été remarqué par les plus hauts niveaux de direction. Andy Jassy, PDG d’Amazon, a même fait une éloge publique à l’endroit de Cursor. Selon ses dires, c’est l’un des plus prometteurs dans la vague actuelle de transformation des pratiques de développement.

A l’heure où nous rédigeons, l’adoption interne n’est pas encore officielle. Cependant, Amazon procède déjà à des tests dans plusieurs équipes, notamment celles orientées vers les produits cloud et l’expérience client. Nous estimons donc qu’Amazon ne tardera pas à rejoindre d’autres acteurs majeurs déjà utilisateurs de Cursor, comme Uber, Adobe ou NVIDIA. Si cela se concrétise, le service se positionnera comme nouveau standard dans l’environnement de développement logiciel contemporain.

FAQ sur Cursor

Qu’est-ce que Cursor ?

Cursor est une plateforme avancée d’assistance au développement de logiciels qui aide les développeurs à coder plus vite et mieux grâce à des fonctionnalités automatisées d’écriture, de relecture et d’optimisation du code.

Quels sont les plans tarifaires disponibles ?

Cursor propose trois formules : Hobby (gratuite, avec limites mensuelles et essai Pro de 2 semaines), Pro (20 $/mois, avec complétions illimitées et accès aux modèles premium), et Business (40 $/mois/utilisateur, avec options avancées comme la gestion centralisée et l’authentification unique).

Quels modèles de langage sont utilisés ?

Cursor utilise plusieurs modèles de pointe, notamment GPT-4o, Claude 3.5 Sonnet et Haiku, permettant des complétions rapides ou lentes selon les besoins.

Est-ce que le code généré appartient à l’utilisateur ?

Oui, les utilisateurs conservent la pleine propriété et la liberté d’utilisation commerciale du code produit par Cursor.

Cursor est-il fiable malgré des incidents passés ?

Bien que des erreurs aient eu lieu en avril 2025, Cursor a rapidement corrigé ces problèmes et reste largement adopté par des entreprises majeures telles qu’Amazon, Uber ou Adobe.

Comment Cursor s’intègre-t-il dans les entreprises ?

De nombreuses grandes firmes déploient Cursor en interne pour améliorer la productivité des équipes, grâce à une interface intuitive et des fonctionnalités adaptées aux besoins collaboratifs.

Cet article Cursor rend la programmation accessible via un simple prompt ! a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Ne demandez surtout pas à l’IA à qui vous êtes marié ! Voici ce qui se passera
    Les IA sont censées nous fournir des réponses fiables et précises. Pourtant, demandez à ChatGPT ou Google Gemini avec qui quelqu’un est marié, et vous obtiendrez des réponses complètement farfelues.  Comme l’a souligné The Wall Street Journal cette semaine, il existe un moyen simple de mettre l’IA en difficulté : lui demander avec qui quelqu’un est marié. Ce qui semble être une question banale devient alors un véritable test de résistance pour les chatbots. Au lieu d’admettre leur ignoranc

Ne demandez surtout pas à l’IA à qui vous êtes marié ! Voici ce qui se passera

Par : Ny Ando A.
14 février 2025 à 06:16

Les IA sont censées nous fournir des réponses fiables et précises. Pourtant, demandez à ou avec qui quelqu’un est marié, et vous obtiendrez des réponses complètement farfelues. 

Comme l’a souligné The Wall Street Journal cette semaine, il existe un moyen simple de mettre l’IA en difficulté : lui demander avec qui quelqu’un est marié. Ce qui semble être une question banale devient alors un véritable de résistance pour les chatbots.

Au lieu d’admettre leur ignorance, ils préfèrent nous servir des réponses absurdes et inventer des conjoints fictifs sortis de nulle part.

Un festival d’hallucinations matrimoniales

L’idée a été explorée par plusieurs journalistes et passionnés d’IA. Par exemple, une journaliste a voulu tester Gemini en lui demandant qui était son mari. 

L’IA lui a répondu : « Ahmad Durak Sibai ». Ce qui est drôle parce que primo, elle n’avait jamais entendu parler de lui. Secundo, elle  n’est pas mariée.

Après une rapide recherche, elle a découvert qu’il s’agissait d’un peintre syrien décédé dans les années 1980. Selon l’IA, elle entretenait donc une relation amoureuse qui transcende non seulement les frontières, mais aussi la mort.

Ben Fritz, rédacteur en chef de la rubrique IA du Wall Street Journal, s’est lui aussi prêté au jeu. Lorsqu’il a demandé aux IA qui était son épouse, ces dernières lui ont proposé plusieurs candidates : une influenceuse de tennis, une femme de l’Iowa totalement inconnue et une écrivaine avec laquelle il n’a jamais eu le moindre lien.

Et ce n’était pas tout. Il y en avait d’autres. L’une des réponses les plus loufoques concernait l’auteur Rax King. 

Certes, certaines informations étaient exactes, notamment sur son ancien conjoint violent, un sujet que Rax King a abordé dans son recueil d’essais Tacky (2021). Mais Gemini a ensuite dérapé en inventant une histoire invraisemblable autour de Danny Lavery, ancien chroniqueur de Dear Prudence. 

Selon Gemini, son mariage en 2019 avec la professeure d’anglais Grace Lavery aurait donné naissance à un trio parental ayant eu des enfants. Une affirmation totalement fausse et pourtant facilement vérifiable via le moteur de recherche de Google.

Puisqu’une ou deux fois n’est pas coutume, d’autres tests ont été effectués

Deux ou trois cas ne suffisent pas à tirer une conclusion. L’enquête a été poursuivie avec Gemini, ChatGPT et le chatbot d’ sur le statut matrimonial de différentes personnalités publiques.

Il paraît que Claude a été conçu pour exprimer son incertitude lorsqu’il ignore une réponse, plutôt que d’en inventer une. Toutefois, surprise : il s’est montré hésitant face aux questions.

ChatGPT, en revanche, a adopté une tout autre approche. Lorsque le journaliste lui a demandé avec insistance qui était le conjoint de Rax King, le chatbot a affirmé à plusieurs reprises qu’elle était mariée à un certain « Levon Honkers », un individu imaginaire.

Sur x, l’ex-, Danny Lavery utilisait le pseudonyme « rax ‘levon honkers’ king » – une blague interne aussi obscure qu’incompréhensible. Pourtant, ChatGPT a cru y voir une preuve de mariage. 

Pire encore, après plusieurs essais, il a fini par déclarer avec assurance que ce mystérieux Honkers avait célébré son 44ᵉ anniversaire en novembre dernier. Or, devinez quoi : King est en réalité mariée à quelqu’un d’autre.

À ce stade, il était évident que quelque chose clochait. Bien que Gemini et ChatGPT refusent parfois de répondre aux questions jugées trop « personnelles » sur la vie maritale des gens, ils n’hésitent pas, dans d’autres cas, à fournir des réponses absurdes et totalement erronées.

L’hallucination va plus loin

L’IA s’est même amusée à inventer des relations improbables pour plusieurs membres de l’équipe de Futurism. Elle a ainsi attribué un époux fictif nommé Bill au directeur artistique, Tag Hartman-Simkins.

Elle a assuré que notre contributeur Frank Landymore était marié à un compositeur autrichien partageant son nom de famille.

Certes, Gemini et ChatGPT ont refusé de se prononcer sur la vie conjugale de Joe Wilkins de Futurism. Cependant, ils n’ont pas hésité à lui concocter une fausse biographie. 

Wilkins selon les IA : professeur, auteur de mémoires et de recueils de poésie, père de deux enfants.

Le plus cocasse ? L’IA a décrété que deux membres de l’équipe rédaction de Futurism, Jon Christian et Maggie Harrison Dupré, étaient mariés… Alors qu’ils sont bel et bien en couple, mais chacun de son côté avec une toute autre personne.

Au-delà de l’anecdote, tout cela illustre une réalité inquiétante. Malgré les milliards investis, même les IA les plus avancées sont incapables de distinguer le vrai du faux. 

Ce problème est d’autant plus préoccupant que ces hallucinations ne suivent même pas une logique interne. Preuve en est : lorsque Rax King elle-même a demandé à Gemini qui était son conjoint, le chatbot lui a répondu qu’elle était célibataire… 

Pourtant, il existe une tonne d’informations prouvant le contraire sur le web. 

Google et ont été contactés pour tenter d’éclaircir ce mystère et savoir s’ils avaient identifié l’origine de ces divagations. Ou au moins une solution pour y remédier. 

Mais au vu de l’ampleur du problème des hallucinations, il est peu probable qu’un correctif miracle voie le jour de sitôt.

Alors, à votre tour, demandez à ChatGPT à qui vous êtes marié. Ne le faites pas en présence de votre conjoint, sinon Saint Valentin gâché.

Et n’oubliez pas de partager votre expérience dans le commentaire !

Cet article Ne demandez surtout pas à l’IA à qui vous êtes marié ! Voici ce qui se passera a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Vous allez vivre 200 ans grâce à l’IA ! Anthropic annonce une révolution pour 2030
    L’espérance de vie humaine pourrait très bientôt doubler grâce à l’intelligence artificielle ! C’est ce qu’affirme Dario Amodei, CEO d’Anthropic, lors d’un panel de discussion au Forum Economique Mondial de Davos. Aux côtés des dirigeants d’autres grandes entreprises comme Uber, Google ou Salesforce, il explique les plus grandes promesses de l’IA, mais livre aussi de vives inquiétudes quant à son potentiel destructeur… Jusqu’à présent, le record de longévité humaine officiellement reconnu est

Vous allez vivre 200 ans grâce à l’IA ! Anthropic annonce une révolution pour 2030

Par : Bastien L.
31 janvier 2025 à 19:07

L’espérance de vie humaine pourrait très bientôt doubler grâce à l’intelligence artificielle ! C’est ce qu’affirme Dario Amodei, CEO d’, lors d’un panel de discussion au Forum Economique Mondial de Davos. Aux côtés des dirigeants d’autres grandes entreprises comme Uber, ou Salesforce, il explique les plus grandes promesses de l’IA, mais livre aussi de vives inquiétudes quant à son potentiel destructeur…

Jusqu’à présent, le record de longévité humaine officiellement reconnu est détenu par la Française Jeanne Louise Calment, qui s’est éteinte en 1997 à l’âge de 122 ans et 164 jours. Toutefois, ce record pourrait prochainement exploser grâce à l’intelligence artificielle !

Selon Dario Amodei, le CEO d’Anthropic, l’IA pourrait très prochainement permettre d’importantes avancées dans la science et notamment dans le domaine de la biologie.

Lors d’un panel organisé le 23 janvier 2025 au Forum Economique Mondial de Davos, il a expliqué que l’IA pourrait « doubler l’espérance de vie humaine d’ici seulement 5 à 10 ans ». Il s’agit d’après lui de la « grande vision » du secteur de l’intelligence artificielle.

Pour cause, il estime qu’une IA peut aujourd’hui accomplir l’équivalent d’un siècle de recherche en biologie à seulement 5 à 10 ans. Or, beaucoup d’experts considèrent qu’il faudra 100 ans de recherche pour doubler la durée moyenne de la vie humaine.

Anthropic CEO Dario Amodei says there will be "a great acceleration" due to AI, with 100 years of progress in biology over the next 5-10 years, resulting in a doubling of the human lifespan in that timeframe pic.twitter.com/ERRitp7Av5

— Tsarathustra (@tsarnick) January 24, 2025

D’ailleurs, Amodei révèle que son entreprise travaille actuellement sur un « collaborateur virtuel » : un agent IA capable d’accomplir des tâches de haut niveau sur le lieu de travail.

Il peut par exemple ouvrir Google Docs ou utiliser la messagerie Slack. Un manager n’aura besoin de le surveiller qu’une fois de temps en temps, à la manière d’un employé humain.

Au cours des trois à six derniers mois, le chef d’entreprise explique être devenu « plus confiant » sur le fait que « nous nous dirigeons vraiment vers des systèmes IA meilleurs que presque tous les humains sur presque toutes les tâches ».

Comme nous l’expliquions dans ce précédent article, il affirme avoir vu des modèles IA aussi performants que des étudiants en doctorat de mathématiques, programmation ou biologie.

D’ici 2026 ou 2027, il s’attend à ce que « nous ayons des systèmes IA largement meilleurs que presque tous les humains à presque tout ».

L’IA ne peut pas sauver le monde à cause de deux obstacles

Cependant, Amodei précise que les agents IA ne vont pas « résoudre immédiatement tous les problèmes du monde ». Deux principaux obstacles se dressent face à cette technologie révolutionnaire.

Il s’agit du monde physique et de la bureaucratie humaine. Un problème que l’on rencontre déjà dans le domaine des voitures autonomes, qui peinent à s’adapter aux imprévus du monde réel et se heurtent à des restrictions administratives.

Un frein qu’admet le CEO de Uber, Dara Khosrowshahi. Par exemple, un panneau stop un peu effacé peut provoquer la confusion chez une voiture autonome alors que même un conducteur humain débutant n’aura aucun souci à en tenir compte.

De la même manière, le CEO d’Anthropic explique que l’IA peut inventer de nouveaux médicaments, mais qu’ils devront faire l’objet de tests cliniques et être approuvés par les régulateurs.

Néanmoins, le CEO de Pfizer, Albert Bourla, également présent lors de ce panel de discussion, confirme que l’IA peut réduire le temps de découverte de médicaments à quelques mois au lieu de plusieurs années.

Cependant, pour que le public puisse profiter de ces avancées, plusieurs étapes doivent être franchies. Par exemple, l’IA doit aider à identifier des cibles prometteuses, mais il faut ensuite suivre un processus pour associer un anticorps à une protéine spécifique que l’on retrouve souvent dans les cellules cancéreuses.

Il faut ensuite l’armer avec une « ogive » pour qu’elle détruise uniquement les cellules cancéreuses et non les cellules saines.

Un second obstacle que pointe du doigt le CEO d’ Uber est le manque de confiance du public. Selon lui, il est plus facile pour les gens d’accepter les erreurs d’autres humains que celles de l’IA.

Par conséquent, l’IA doit être 10 fois meilleure que les humains pour obtenir leur confiance. Même s’il est convaincu que les voitures autonomes sont plus sûres que les véhicules conduits par les humains, même une poignée d’accidents suffit à éroder la confiance du public.

De même, Mark Rutte, secrétaire général de l’OTAN, reconnaît que son institution peut être « trop lente » pour innover. Très souvent l’OTAN voudrait qu’une solution technologique fonctionne presque parfaitement avant d’être déployée. Il estime que c’est une erreur, car « la vitesse est l’essence ».

La dernière génération d’employés humains ?

Un autre CEO présent lors de ce panel est celui de Salesforce, Marc Benioff. Selon lui, les chefs d’entreprise présents à Davos étaient peut-être les derniers à gérer des employés uniquement humains.

À ses yeux, les agents IA vont très bientôt prendre une grande importance au sein des entreprises. Les managers travailleront à la fois avec des employés humains et numériques.

Pour rappel, Salesforce propose déjà Agentforce : une solution laissant les clients construire et personnaliser les agents IA.

Même son de cloche pour la CIO de Google, Ruth Porat, affirmant que Google regarde déjà vers l’avenir et vers des technologies comme l’.

En décembre 2024, la firme a présenté la puce quantique Willow capable de résoudre en moins de 5 minutes des problèmes qui prendraient des milliards d’années aux meilleurs superordinateurs.

La crainte d’une super-dictature basée sur l’IA

WEF 2025, Davos: Anthropic's Dario Amodei Sounds the Alarm – AI's Shadow Could Eclipse Democracy, Heralding an Age of Tyranny
"Imagine what that country of geniuses in a data center could do in the hands of an autocracy. We take 10 million virtual minds that are smarter than any… pic.twitter.com/1BmrCBxElP

— Camus (@newstart_2024) January 24, 2025

Toutefois, concernant l’avenir, Amodei s’inquiète de l’impact de l’IA sur les systèmes politiques. Il ignore pour l’instant si elle mènera à une meilleure démocratie ou à davantage d’autocratie.

Par exemple, il se demande ce qu’il adviendra quand la Chine déploiera 10 millions d’agents IA : « que pourraient-ils faire en termes d’État de surveillance ? Le pouvoir des dictateurs a traditionnellement été restreint par le besoin d’avoir des humains qui exécutent la volonté du dictateur… »

Or, « il y a une possibilité effrayante que l’IA puisse supprimer certaines de ces limites et rendre possible quelque chose comme le roman 1984 ou encore plus sombre à l’échelle internationale ».

Selon la CIO de Google, c’est précisément pourquoi l’Occident doit rester en avance dans le développement de l’IA. Et ceci requiert un environnement administratif propice à l’innovation.

Elle estime aussi que les entreprises doivent rester engagées avec les pays étrangers dans leur développement de l’IA. Quand elle parle avec des dirigeants, elle rapporte qu’ils expriment tous de l’intérêt pour déployer l’IA dans leurs pays.

Cependant, ils disent aussi clairement que si les États-Unis ne sont pas présents, ils feront des partenariats avec d’autres pays. La récente percée fulgurante de la startup chinoise DeepSeek confirme que la domination occidentale sur l’IA ne tient qu’à un fil…

Et vous, qu’en pensez-vous ? Quels sont vos plus grands espoirs et vos plus grandes craintes concernant l’intelligence artificielle ? Partagez votre avis en commentaire !

Cet article Vous allez vivre 200 ans grâce à l’IA ! Anthropic annonce une révolution pour 2030 a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • DeepSeek, l’IA chinoise gratuite qui détruit ChatGPT et terrifie les USA ! Tout savoir
    La startup chinoise DeepSeek va-t-elle renverser les géants américains et prendre la couronne de l’industrie de l’IA ? En quelques jours, cette petite entreprise a remis en doute toutes les certitudes du secteur en surpassant ChatGPT avec son chatbot R1 plus performant et beaucoup moins cher. Découvrez tout ce qu’il faut savoir sur le nouveau phénomène de l’intelligence artificielle ! Depuis 2022, l’ordre est bien établi dans l’industrie de l’IA. Le marché des modèles IA est dominé par OpenAI

DeepSeek, l’IA chinoise gratuite qui détruit ChatGPT et terrifie les USA ! Tout savoir

Par : Bastien L.
28 janvier 2025 à 19:32

La startup chinoise DeepSeek va-t-elle renverser les géants américains et prendre la couronne de l’industrie de l’IA ? En quelques jours, cette petite entreprise a remis en doute toutes les certitudes du secteur en surpassant ChatGPT avec son chatbot R1 plus performant et beaucoup moins cher. Découvrez tout ce qu’il faut savoir sur le nouveau phénomène de l’intelligence artificielle !

Depuis 2022, l’ordre est bien établi dans l’industrie de l’IA. Le marché des modèles IA est dominé par , tandis que règne en maître sur le hardware.

Les États-Unis ont donc la mainmise sur l’intelligence artificielle, et Trump vient d’ailleurs d’annoncer le projet Stargate avec un investissement à hauteur de 500 milliards de dollars pour créer l’IA ultime qui va changer le monde.

L’avenir semblait donc radieux et tout tracé pour l’Oncle Sam. Toutefois, cette hégémonie est désormais mise en péril…

En moins d’une semaine, une startup chinoise est parvenue à chambouler totalement l’équilibre au sein de l’écosystème IA.

Cette petite entreprise, dénommée DeepSeek, a lancé la dernière version de son chatbot R1 au cours de la semaine du 20 janvier 2025.

Or, son IA surpasse même la version la plus récente de ChatGPT… alors même qu’elle a créé son modèle en seulement quelques mois, avec du hardware inférieur, et à un coût incroyablement réduit.

Face au succès tonitruant de DeepSeek R1, toute l’industrie américaine de l’IA tremble de peur. Les actions en bourse de la Silicon Valley ont lourdement baissé, et ont même entraîné les crypto dans leur chute !

Avec DeepSeek, c’est une brèche qui vient de s’ouvrir et qui pourrait transformer totalement le paysage de l’IA. Nous vous proposons donc un dossier pour découvrir tout ce qu’il faut savoir sur cette startup qui fait paniquer les géants…

DeepSeek, c’est quoi au juste ?

Fondé en 2023, DeepSeek est un laboratoire d’intelligence artificielle basé à Hangzhou dans la province chinoise du Zhejiang.

Son modèle IA -Source est dénommé DeepSeek R1. La dernière version en date, DeepSeek-V3, rivalise avec ChatGPT et le surpasse même sur de nombreux cas d’usage.

Même les derniers modèles d’OpenAI comme -4o et l’IA capable de raisonner o1 ne font pas le poids. D’ailleurs, DeepSeek-V3 dépasse aussi 3.1 ou Anthropic Claude Sonnet 3.5.

Cependant, ce ne sont pas seulement ses performances qui surprennent tous les experts américains. Le plus choquant est que DeepSeek n’a eu besoin que de quelques mois pour créer sa V3, avec du hardware ancien et pour une fraction de ce que les géants des États-Unis ont dépensé pour développer leurs chatbots…

Une IA surpuissante, 20 fois moins chère que ChatGPT

Selon le rapport technique de DeepSeek sur sa V3, le coût total de développement du modèle est de 5,576 millions de dollars. En comparaison, OpenAI a dépensé 100 millions de dollars pour entraîner GPT-4 !

Ceci soulève de nombreuses questions pour les géants américains, qui ont déjà déversé des milliards de dollars dans les différentes versions de leurs modèles IA LLM.

Ils réalisent qu’ils ont gaspillé leur argent inutilement. En ce qui concerne l’exécution de tâches, DeepSeek coûte entre 20 et 50 fois moins cher que ChatGPT !

D’ailleurs, ce coût très élevé de recherche et développement est précisément la raison pour laquelle la plupart des LLM ne sont pas rentables à l’heure actuelle pour les entreprises impliquées.

En ayant réussi à créer un LLM supérieur pour moins de 6 millions de dollars, DeepSeek se présente aussi comme un très dangereux concurrent et ouvre une porte à bien d’autres entreprises.

Lorsque l’on pensait que des milliards de dollars étaient nécessaires pour créer une IA, seuls les géants comme Meta, ou OpenAI pouvaient espérer s’aventurer dans ce domaine.

Désormais, de nombreuses startups et entreprises de moindre envergure venues du monde entier vont pouvoir créer leurs propres IA pour défier directement les GAFAM…

Un véritable coup de théâtre dans la guerre de l’IA

Si la concurrence fait rage entre les géants américains, personne n’a vu venir la menace d’une petite startup chinoise.

C’est d’autant plus inattendu que l’administration Biden avait mis en place un certain nombre de contrôles des exports de technologies IA pour handicaper la Chine dans cette course.

Les entreprises américaines n’avaient pas le droit de vendre leurs puces IA les plus avancées et leur hardware de dernière génération aux entreprises chinoises.

Ainsi, même sans avoir eu accès aux meilleures puces NVIDIA, DeepSeek a réussi à créer une IA supérieure à ChatGPT en utilisant des puces NVIDIA H800 de milieu de gamme. De plus, son LLM consomme moins d’énergie et est donc moins nocif pour l’environnement…

Le CEO de Perplexity, Aravind Srinivas, a confié à CNBC que « la nécessité est la mère de l’invention. Parce qu’ils devaient trouver des solutions alternatives, ils ont créé quelque chose de beaucoup plus efficace ».

Toutefois, selon certaines sources, DeepSeek se serait procuré clandestinement un cluster de NVIDIA H100 dernier cri pour contourner les restrictions…

Les géants américains sont en état de choc

Face au succès foudroyant de DeepSeek, les géants américains de l’IA sont abasourdis. Tous craignent désormais de se faire détrôner par des startups comme DeepSeek.

Lors du Forum Economic Mondial de Davos, le CEO de Microsoft, Satya Nadella, a déclaré que « le nouveau modèle de DeepSeek est très impressionnant à la fois parce qu’il s’agit d’un modèle open source et parce qu’il est très efficace ».

Il ajoute que « nous devons prendre les développements provenant de Chine très, très sérieusement ». Rappelons que Microsoft a investi des milliards de dollars dans OpenAI.

Le CEO d’OpenAI, , a lui-même admis lundi 27 janvier 2025 que DeepSeek R1 est « impressionnant ». Il reste toutefois convaincu que la puissance de calcul demeure la clé du succès et du progrès dans l’IA.

deepseek's r1 is an impressive model, particularly around what they're able to deliver for the price.

we will obviously deliver much better models and also it's legit invigorating to have a new competitor! we will pull up some releases.

— Sam Altman (@sama) January 28, 2025

De son côté, Yann LeCun, scientifique en chef de Meta, fait plutôt l’éloge de l’ouverture. Il a déclaré sur Threads que le succès de DeepSeek montre que « les modèles Open Source sont en train de surpasser les modèles propriétaires ».

View on Threads

Selon lui, « DeepSeek a profité de la recherche ouverte et de l’Open Source, notamment PyTorch et Llama de Meta. Ils sont venus avec de nouvelles idées et les ont construits par-dessus le travail d’autres personnes ».

Ainsi, « puisque leur travail est publié et Open Source, tout le monde peut en profiter. C’est la puissance de la recherche ouverte et de l’Open Source ».

Même le président des États-Unis, Donald Trump, a réagi au triomphe de DeepSeek le 27 janvier 2025. Il s’est exprimé lors d’un discours auprès des Républicains en Floride.

Selon lui, ce succès doit faire l’effet d’un « réveil » pour les entreprises américaines du secteur. Il estime qu’elles doivent être « focalisées sur la compétition pour gagner ».

Vent de panique à Wall Street et dans la crypto

Ce renversement de vapeur dans l’industrie de l’IA fait d’ores et déjà des remous à la bourse. À l’heure où j’écris ces lignes, plusieurs grandes actions liées à l’intelligence artificielle sont en baisse.

Le grand leader du hardware IA, NVIDIA, a notamment vu son cours diminuer de 10%. Pour rappel, le constructeur de cartes graphiques est devenu l’entreprise la plus capitalisée du monde grâce à l’achat massif de ses puces IA par les laboratoires IA.

Cependant, si les entreprises peuvent maintenant créer des modèles IA supérieurs à ChatGPT avec des puces inférieures, sa valeur est fortement remise en question…

L’entreprise ASML Holding N.V., qui fabrique les équipements nécessaires à la production de puces IA, voit aussi son action baisser de 9%. De son côté, Microsoft perd aussi 6%.

Il en va de même pour le fabricant japonais d’équipements de de puces Advantest, fournisseur de Nvidia, qui perd 10%, ou pour l’investisseur SoftBank Group en baisse de 6%.

Et selon Ash Crypto, célèbre investisseur en cryptomonnaies, la récente baisse du Bitcoin et de nombreux autres actifs est également liée à cette soudaine incertitude !

Les actions des acteurs américains de l’IA vont-elles remonter après une baisse passagère, ou cette chute va-t-elle perdurer ? Nul ne peut vraiment le prédire à l’heure actuelle…

Comment utiliser DeepSeek V3 ? Une IA déjà victime de son succès…

En tant que modèle Open-Source, DeepSeek peut être utilisé gratuitement par n’importe qui. En comparaison, la version la plus avancée de ChatGPT coûte 200 dollars par mois…

Pour commencer à tester cette IA, vous pouvez vous rendre sur le site web en suivant ce lien. Il est aussi possible de télécharger l’application DeepSeek sur iOS ou Android !

En quelques jours, cette appli est d’ailleurs devenue numéro 1 des applis gratuites sur l’App Store d’.

Néanmoins, DeepSeek est désormais victime de son succès ! Le trafic était si chargé que la startup a dû limiter les inscriptions aux personnes ayant un numéro de téléphone chinois. On ignore quand le service sera de nouveau ouvert au monde entier…

De plus, elle affirme avoir subi des cyberattaques à grande échelle. S’agit-il de concurrents jaloux souhaitant lui nuire ?

Et vous, que pensez-vous de DeepSeek ? Cette IA chinoise peut-elle vraiment prendre la place d’OpenAI en tant que leader mondial ? S’agit-il d’une simple hype passagère ? Comment les géants américains peuvent-ils reprendre le dessus, et surtout, quelle place pour la France et l’Europe sur cet échiquier ? Partagez votre avis en commentaire !

Cet article DeepSeek, l’IA chinoise gratuite qui détruit ChatGPT et terrifie les USA ! Tout savoir a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • OpenAI lance Operator, l’IA qui contrôle votre PC et surf sur le web ! Tout savoir
    Découvrez Operator ! Cette nouvelle IA d’OpenAI est capable de prendre le contrôle de votre PC et votre navigateur web pour commander à manger, faire du shopping ou réserver des voyages et des événements à votre place !  Les ordinateurs et internet ont largement accéléré et simplifié la communication, l’accès à l’information, la productivité professionnelle, le commerce, la mobilité, l’éducation ou même le divertissement.  Toutefois, ce n’était qu’un début. Nous sommes sur le point de pass

OpenAI lance Operator, l’IA qui contrôle votre PC et surf sur le web ! Tout savoir

Par : Bastien L.
24 janvier 2025 à 14:01

Découvrez Operator ! Cette nouvelle IA d’ est capable de prendre le contrôle de votre PC et votre navigateur web pour commander à manger, faire du shopping ou réserver des voyages et des événements à votre place ! 

Les ordinateurs et internet ont largement accéléré et simplifié la communication, l’accès à l’information, la productivité professionnelle, le commerce, la mobilité, l’éducation ou même le divertissement. 

Toutefois, ce n’était qu’un début. Nous sommes sur le point de passer à la prochaine étape, en laissant l’intelligence artificielle utiliser nos ordinateurs et internet à notre place ! 

Comme le prévoyait la rumeur, OpenAI vient de lancer une « preview de recherche » de son agent IA baptisé Operator. Ce nouveau modèle peut aller sur internet pour effectuer des tâches pour vous. 

En utilisant son propre navigateur, il peut visiter une page web et interagir avec en écrivant, en cliquant et en faisant défiler l’écran. Alors, comment ça marche ? 

Operator, un agent IA qui utilise l’ordinateur 

Il s’agit d’une IA d’une nouvelle catégorie, dénommée « Computer-Using Agent ». Pour rappel, , principal rival d’OpenAI, a également lancé une API « Computer Use » pour son IA fin 2024. 

Le nouveau modèle combine les capacités de vision de -4o avec « le raisonnement avancé via l’apprentissage par renforcement ». 

C’est ce qui lui permet d’interagir avec les interfaces graphiques utilisateur (GUI). Il est capable de voir via les captures d’écran, et d’interagir avec le navigateur web en utilisant toutes les actions permises par un clavier et une souris. 

Ceci lui permet d’agir sur le web sans avoir besoin d’intégrations API personnalisées. De plus, Operator peut utiliser le raisonnement pour « s’auto-corriger ».

Si jamais il se retrouve bloqué, il donnera le contrôle à l’utilisateur. Il peut également lui demander de reprendre le contrôle lorsqu’un site web demande des informations sensibles comme les identifiants de connexion. 

Si une action comme l’envoi d’un e-mail est requise, l’IA pourra demander à l’utilisateur d’approuver. Par ailleurs, OpenAI précise qu’Operator est conçu pour refuser les requêtes dangereuses et pour bloquer le contenu non autorisé. 

Uber, DoorDash, OpenTable… de nombreux partenariats

Afin qu’Operator puisse répondre aux besoins réels des utilisateurs, OpenAI a noué des partenariats avec de nombreuses entreprises de service américaines. 

On peut notamment citer DoorDash, Instacart, OpenTable, Priceline, StubHub, Thumbtack ou Uber. Ceci permettra aux usagers de laisser l’intelligence artificielle commander à manger, de réserver des concerts ou divers produits.

Toutefois, la firme précise que tout ne fonctionnera pas forcément parfaitement dès le début. Il s’agit d’une preview, et l’outil a encore des problèmes avec les interfaces complexes. Il peine par exemple à créer des diaporamas ou à gérer des calendriers. 

Comment utiliser OpenAI Operator ? 

A research preview of Operator, an agent that can use its own browser to perform tasks for you. pic.twitter.com/wkBBDIlVqj

— OpenAI (@OpenAI) January 23, 2025

Malheureusement, tester Operator dès maintenant risque d’être compliqué. D’une part, parce que ce nouvel outil n’est pour l’instant disponible qu’aux Etats-Unis. Comme pour le générateur de vidéos Sora, vous pouvez toutefois utiliser un VPN pour feindre une connexion depuis l’étranger. 

D’autre part, cependant, Operator est réservé aux abonnés ChatGPT Pro. Il vous faudra donc débourser 200 dollars par mois pour pouvoir l’utiliser ! 

A terme, toutefois, OpenAI prévoit d’intégrer Operator à pour tous les abonnés Plus, Team et Enterprise ! 

Alors, que pensez-vous de ce nouveau type d’IA ? Êtes-vous pressé de pouvoir l’utiliser ? Quels sont selon vous les cas d’usage intéressants ? 

Cet article OpenAI lance Operator, l’IA qui contrôle votre PC et surf sur le web ! Tout savoir a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • OpenAI pourra bientôt contrôler votre PC ! Ce qu’il faut savoir sur l’IA Operator
    La révolution de l’intelligence artificielle pourrait bien se jouer sous nos yeux. Oubliez les simples assistants vocaux, imaginez un agent IA capable de prendre véritablement les commandes de votre PC. Si OpenAI concrétise ses plans, notre quotidien informatique pourrait changer à jamais. Voici ce que vous devez savoir sur le tout nouveau venu, l’agent Operator. Nous pensions avoir tout vu avec les assistants virtuels. Mais OpenAI a un projet bien plus ambitieux en tête. Il s’agit d’un agent

OpenAI pourra bientôt contrôler votre PC ! Ce qu’il faut savoir sur l’IA Operator

Par : Mariano R.
23 janvier 2025 à 07:56

La révolution de l’intelligence artificielle pourrait bien se jouer sous nos yeux. Oubliez les simples assistants vocaux, imaginez un agent IA capable de prendre véritablement les commandes de votre PC. Si concrétise ses plans, notre quotidien informatique pourrait changer à jamais. Voici ce que vous devez savoir sur le tout nouveau venu, l’agent Operator.

Nous pensions avoir tout vu avec les assistants virtuels. Mais OpenAI a un projet bien plus ambitieux en tête. Il s’agit d’un agent IA qui pourrait prendre le contrôle de votre ordinateur pour exécuter des tâches à votre place.

Exit les heures passées à chercher des fichiers ou à configurer des applications, cet agent nommé Operator pourrait bien devenir le nouveau maître de votre PC. Il deviendrait un véritable manager de vos actions numériques, capable de gérer des tâches complexes en toute autonomie.

Qu’est-ce que l’agent Operator ?

L’IA progresse à vitesse grand V, et la prochaine révolution pourrait bien être une intelligence artificielle agentique capable de gérer votre ordinateur. Une IA qui s’occupe des tâches à votre place, comme si votre assistant virtuel avait enfin appris à… être utile. Ainsi, OpenAI est sur le coup !

Operator, c’est un agent intelligent intégré à votre système qui exécute des tâches directement sur votre appareil. Envie de créer une feuille Excel ? De planifier un voyage ? Plus besoin de cliquer frénétiquement ou de jongler entre plusieurs applications. Vous donnez les instructions, l’IA s’occupe du reste.

Le concept n’est pas nouveau, car des entreprises comme Anthropic s’y essaient déjà. Mais ce qui rend Operator spécial, c’est qu’il vient d’OpenAI. Et si l’on en croit les fuites de l’ingénieur logiciel Tibor Blaho, cette fonctionnalité serait déjà en préparation.

Des indices cachés dans pour macOS

Tibor Blaho a repéré des traces d’Operator dans l’application ChatGPT pour macOS, notamment des options cachées pour attribuer des raccourcis clavier tels que « Basculer l’opérateur » et « Forcer à quitter l’opérateur ».

Confirmed – the ChatGPT macOS desktop app has hidden options to define shortcuts for the desktop launcher to "Toggle Operator" and "Force Quit Operator" https://t.co/rSFobi4iPN pic.twitter.com/j19YSlexAS

— Tibor Blaho (@btibor91) January 19, 2025

Vous ne les avez pas vus ? Normal, elles ne sont pas encore activées. Mais leur présence suggère qu’OpenAI travaille activement sur ce système. Selon certaines rumeurs, la fonctionnalité pourrait débarquer ce mois-ci.

Si l’agent Operator tenait ses promesses, il pourrait aller bien plus loin que la simple suggestion d’idées. Par exemple, au lieu de vous proposer des plans de voyage, l’IA pourrait carrément réserver vos billets d’avion et vos hôtels en fonction de vos préférences.

Oui, je sais ce que vous vous demandez : « Et Windows dans tout ça ? ». Malheureusement, aucune information n’a encore fuité pour les utilisateurs du système d’exploitation de . Si OpenAI décide de lancer Operator exclusivement sur macOS dans un premier temps, les fans de Windows risquent de se sentir laissés pour compte.

Alors, l’IA va-t-elle trop loin ? Vous êtes plutôt optimiste ou sceptique à l’idée de laisser agent Operator contrôler votre appareil ? Exprimez-vous dans les commentaires !

Cet article OpenAI pourra bientôt contrôler votre PC ! Ce qu’il faut savoir sur l’IA Operator a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • J’ai dit à toutes les IA de prédire la Champion’s League : voici les pronos de ChatGPT, Grok, Gemini…
    L’IA peut-elle vous rendre riche en prédisant les résultats des matchs de foot ? Pour le savoir, on a demandé à ChatGPT, Grok, Gemini, Claude et LeChat leurs pronos pour la Ligue des Champions ! Découvrez le résultat ! Gagner des paris requiert de la chance, de l’intuition, mais aussi de l’analyse. Or, quoi de mieux qu’une IA pour analyser de nombreuses statistiques et autres données ? Afin de vérifier si l’intelligence artificielle peut prédire les résultats des matchs de foot, j’ai décid

J’ai dit à toutes les IA de prédire la Champion’s League : voici les pronos de ChatGPT, Grok, Gemini…

Par : Bastien L.
21 janvier 2025 à 15:34

L’IA peut-elle vous rendre riche en prédisant les résultats des matchs de foot ? Pour le savoir, on a demandé à ChatGPT, , , et LeChat leurs pronos pour la Ligue des Champions ! Découvrez le résultat !

Gagner des paris requiert de la chance, de l’intuition, mais aussi de l’analyse. Or, quoi de mieux qu’une IA pour analyser de nombreuses statistiques et autres données ?

Afin de vérifier si l’intelligence artificielle peut prédire les résultats des matchs de foot, j’ai décidé de la mettre à l’épreuve sur la septième journée de Ligue des Champions du 21 et 22 janvier 2025.

Pourquoi la Champions League ? Non seulement car il s’agit de la compétition interclubs la plus populaire et prestigieuse, mais aussi parce qu’elle est réputée comme plus facile à prédire dans les premières phases.

L’écart entre les meilleurs clubs d’Europe et les outsiders est souvent marqué, et les grandes équipes libèrent généralement tout leur potentiel pour tenter de gagner la « coupe aux grandes oreilles ».

Alors, une IA peut-elle fournir les bons pronostics ? Et surtout, quel chatbot IA est le meilleur pour cet exercice ? Afin de le savoir, j’ai donné le même prompt à ChatGPT, Claude, Grok, Gemini et le petit français LeChat.

Je leur ai demandé d’analyser chaque match de Champions League du 21 et 22 janvier 2025, et de me fournir leurs pronostics en les classant du plus facile au plus difficile à prédire. Voici le résultat !

ChatGPT-4o prédit la victoire de Stuttgart

Commençons par ChatGPT, le chatbot le plus connu et réputé comme l’un des plus performants. Pour ce , j’ai utilisé la version payante ChatGPT Plus et le modèle 4o connecté à internet.

Selon lui, les matchs les plus faciles à prédire pour le 21 et le 22 janvier 2025 sont :

  • Slovan Bratislava vs Stuttgart (victoire de Stuttgart)
  • RB Leipzig vs Sporting CP (victoire de Leipzig)
  • Chakhtar Donetsk vs Stade Brestois 29 (victoire du Chakhtar)
  • Atalanta vs Sturm Graz (victoire de l’Atalanta)
  • Arsenal vs Dinamo Zagreb (victoire d’Arsenal) 
  • Real Madrid vs FC Salzbourg (victoire du Real Madrid)

Pour ces analyses, ChatGPT semble s’être principalement basé sur le rapport de force traditionnel entre les différents clubs.

Toutefois, lorsque je lui ai demandé ses sources, il a expliqué avoir consulté des sites spécialisés dans le football comme WhoScored, Opta Sports, FiveThirtyEight, FlashScore et Soccerway.

chatgpt champions league analyse

Il a aussi consulté les sites d’actualité sportive tels que BBC Sport, Sky Sports et L’Équipe, ou les sites de cotes et tendances des paris comme Bet365 Trends, OddsChecker et Pinnacle Sports.

Les réseaux sociaux et déclarations officielles des clubs et joueurs ont aussi été visités pour comprendre la motivation et les tensions éventuelles, ainsi que les calendriers des compétitions pour évaluer la fatigue ou les priorités des équipes.

Curieusement, ChatGPT a jugé que la victoire de Shakthar Donetsk contre Brest est l’une des plus faciles à prévoir, malgré le fait que la cote soit à 2,75 (contre 2,65 pour Brest).

De même, il est quasiment sûr que Leipzig va l’emporter sur Sporting Portugal. Pourtant, sa cote est à 2,85 contre 2,35. Au contraire, il estime que le match Liverpool vs Lille est difficile à prédire, alors même que la cote de Liverpool est à 1,27 contre 10,50 pour Lille.

S’agit-il d’une erreur de compréhension, ou au contraire d’une capacité analytique surpassant celle des bookmakers et de la plupart des fans (88% des parieurs de Winamax ont misé sur Liverpool) ?

Réponse ce soir et demain, mais comme vous allez le voir dans la suite de cet article, ce n’est pas la seule IA à avoir fait ce choix étonnant…

Anthropic Claude fait confiance à Arsenal

claude champions league

Si Claude est souvent considéré comme l’un des grands rivaux de ChatGPT, je dois préciser que j’ai utilisé la version gratuite 3.5 Sonnet. Or, celle-ci n’est pas connectée à internet et l’IA se base donc uniquement sur les données historiques pour ses analyses.

Voici les matchs les plus faciles à prédire selon le chatbot d’Anthropic :

  • Arsenal vs Dinamo Zagreb (victoire d’Arsenal)
  • Liverpool vs Lille (victoire de Liverpool)
  • Atalanta vs Sturm Graz (victoire de l’Atalanta)
  • Celtic vs Young Boys (victoire du Celtic)

L’intelligence artificielle s’est principalement basée sur le niveau d’expérience des différents clubs en Champions League, et précise d’ailleurs qu’il est important de consulter leur niveau de forme actuelle.

Son analyse est donc moins pertinente que celle des chatbots connectés à internet, mais nous ne serons pas en mesure de tester la version payante 3.5 Opus…

Google Gemini reste fidèle à Liverpool

gemini analyse cl

Selon Gemini, l’IA de Google, les matchs les plus prévisibles sont :

  • Liverpool vs Lille (victoire de Liverpool)
  • Real Madrid vs FC Salzbourg (victoire du Real Madrid)
  • Arsenal vs Dinamo Zagreb (victoire d’Arsenal)
  • Slovan Bratislava vs Stuttgart (victoire de Stuttgart)
  • Atalanta vs Sturm Graz (victoire de l’Atalanta)
  • Club Bruges vs Juventus (victoire de la Juventus)
  • AC Milan vs Girona (victoire de l’AC Milan)
  • Leipzig vs Sporting (victoire de Leipzig)

Tout comme Claude, Gemini explique ne pas s’être appuyé sur internet, mais uniquement sur les informations de sa base de données internes.

Il s’est donc basé sur la connaissance générale des équipes, l’historique des clubs, leurs forces et faiblesses, sur les résultats récents, et sur le contexte des matchs.

xAI Grok se range avec le Celtic Glasgow

grok analyse cl

L’IA d’, Grok, disponible sur le réseau social X, propose des pronostics assez différents des autres chatbots.

Ce décalage s’explique peut-être par le fait que Grok s’est basé sur de nombreux sites web, comme le montre la liste impressionnante de sources qu’il indique.

D’après lui, les matchs les plus prévisibles de cette journée sont :

  • Celtic vs Young Boys (victoire du Celtic)
  • Etoile Rouge vs PSV (victoire du PSV)
  • Slovan Bratislava vs Stuttgart (victoire de Stuttgart)
  • Atalanta vs Sturm Graz (victoire de l’Atalanta)
  • RB Leipzig vs Sporting CP (victoire de Leipzig)
  • Chakhtar Donetsk vs Stade Brestois 29 (victoire du Chakhtar)
  • Sparta Prague vs Inter Milan (victoire de l’Inter Milan)
  • Arsenal vs Dinamo Zagreb (victoire d’Arsenal)
  • Monaco vs Aston Villa (match nul) 
  • Real Madrid vs FC Salzbourg (victoire du Real Madrid)

Selon Grok, le classement est basé sur une évaluation des performances récentes, sur la forme actuelle des équipes, et sur leur expérience en compétition européenne.

Étonnamment, le chatbot recommande d’inclure ces 10 matchs dans un pari combiné. Il est donc plus audacieux que les autres IA, mais cette impertinence est ce qui caractérise souvent Grok à l’instar de son créateur…

grok sources cl

Mistral LeChat supporte le Bayern de Munich

J’ai voulu inclure le chatbot français Mistral LeChat à ce test. Malheureusement, comme Gemini et Claude, il ne se base pas sur des sites internet pour établir ses prédictions.

Ses analyses reposent sur les performances historiques et les différences de niveau entre les équipes. Il estime que les matchs les plus faciles à prédire sont ceux avec une différence claire de niveau entre les clubs.

D’après lui, les matchs les plus faciles à prédire sont :

  • Feyenoord vs Bayern Munich (victoire de Bayern Munich)
  • AC Milan vs Girona (victoire de Milan)
  • Real Madrid vs Salzbourg (victoire de Real Madrid)
  • Arsenal vs Dinamo Zagreb (victoire d’Arsenal)
  • Sparta Prague vs Inter Milan (victoire d’Inter Milan)
mistral analyse cl

Conclusion : all-in sur Stuttgart ?

En comparant les prédictions de ces 5 chatbots IA, on constate que les pronostics sont similaires et que les mêmes équipes sont annoncées gagnantes. C’est au niveau du classement par prévisibilité que la différence se fait.

Si l’on synthétise les différentes analyses, on peut déduire que la victoire de Stuttgart est la plus facile à prévoir. Il s’agit d’une cote à 1,24, contre 11 pour le Slovan Bratislava.

Les autres victoires qui semblent faire consensus sont celles de l’Atalanta, du RB Leipzig, du Chakhtar Donetsk, d’Arsenal et du Real Madrid. Si vous faites un pari combiné avec ces six matchs, la cote atteint environ 13,70.

En revanche, les IA estiment qu’il est risqué de miser sur les matchs Étoile Rouge vs PSV Eindhoven, Atletico Madrid vs Bayer Leverkusen, Monaco vs Aston Villa, Benfica vs Barcelone, Feynoord vs Bayern Munich, et PSG vs Manchester City.

Quoi qu’il en soit, rappelons que le football comporte toujours une part d’incertitude et qu’aucun pari n’est jamais sûr à 100%. Soulignons aussi à nouveau que 3 des 5 IA passées en revue n’ont pas utilisé internet pour leurs pronostics !

Personnellement, je suis plus convaincu par la méthodologie de xAI Grok qui a multiplié les sources d’informations issues d’internet pour faire ses analyses détaillées et fournir ses pronostics moins « téléphonés » que ceux des autres IA…

Rendez-vous dans deux jours sur LeBigData, pour découvrir quels pronostics étaient corrects et quelle IA a eu la meilleure vision !

Et vous, qu’en pensez-vous ? Quel chatbot a fourni les meilleurs pronostics ? Allez-vous lui faire confiance pour parier sur les matchs de Champions League ? Partagez votre avis en commentaire !

Cet article J’ai dit à toutes les IA de prédire la Champion’s League : voici les pronos de ChatGPT, Grok, Gemini… a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • OpenAI a peur de lancer son agent IA : découvrez la raison étonnante
    Alors que la concurrence accélère le lancement de leur agent IA, OpenAI hésite encore à dévoiler sa propre version. Ces derniers promettent pourtant de révolutionner notre quotidien en accomplissant des tâches autonomes. Et OpenAI est un leader incontesté de l’IA, qui n’a jamais cessé de pousser les limites de la technologie pour garder sa position sur le marché.  Qu’est-il à l’entreprise qui a laissé tomber sa filiale non lucrative pour devenir entièrement commerciale ? Pourquoi investir des

OpenAI a peur de lancer son agent IA : découvrez la raison étonnante

Par : Ny Ando A.
13 janvier 2025 à 10:27

Alors que la concurrence accélère le lancement de leur agent IA, hésite encore à dévoiler sa propre version. Ces derniers promettent pourtant de révolutionner notre quotidien en accomplissant des tâches autonomes. Et OpenAI est un leader incontesté de l’IA, qui n’a jamais cessé de pousser les limites de la technologie pour garder sa position sur le marché. 

Qu’est-il à l’entreprise qui a laissé tomber sa filiale non lucrative pour devenir entièrement commerciale ? Pourquoi investir des milliards pour un produit qu’au final on hésite à lancer ? 

Mais qu’est-ce qui pouvait bien leur faire peur au point d’hésiter à lancer une technologie aussi prometteuse, pour eux comme pour chacun de nous ? Tant de questions…

Apparemment, l’agent IA n’est pas digne de confiance 

Et ben pour une fois, OpenAI pense à autre chose que se faire une fortune. Qui l’eût cru ? Cela dit, ce que l’entreprise avance est du sérieux.

Imaginez un assistant virtuel qui gère vos e-mails, fait vos courses en ligne ou organise votre planning à la perfection. C’est pratique, qui n’en rêverait pas ? Cependant, que se passe-t-il si cet agent autonome se fait manipuler par un tiers malveillant ?

Vous avez sûrement déjà entendu parler des attaques par injections rapides non ? Pour faire simple : ce sont des techniques permettant de détourner un assistant IA de sa mission, le transformant en un genre d’agent double. 

Prenons un scénario : vous lui demandez de réserver un produit en ligne. Il tombe sur un site malveillant qui lui demande d’accéder à vos e-mails ou, pire, à vos informations bancaires. 

Ce serait une catastrophe assurée, non seulement pour les utilisateurs mais aussi pour la crédibilité d’OpenAI. Maintenant, vous êtes au courant de ce qui est en jeu, ce que la startup derrière ChatGT redoute. 

C’est mignon, mais OpenAI ne réagit comme tel que dans son propre intérêt

La méfiance d’OpenAI n’est pas exagérée. La société marque même un point car, contrairement à et qui ont déjà lancé leur agent IA, elle, au moins, se préoccupe de notre sécurité. 

Du moins, c’est la conclusion qu’elle espère qu’on tire. Moi, personnellement, je crois qu’elle a surtout peur que son propre agent IA nuit à son image. Microsoft en a, d’ailleurs, déjà fait l’expérience avec son , dupé par des hackers pour divulguer des informations sensibles. 

Oh, et il n’y a pas si longtemps, des chercheurs ont montré que même ChatGPT pouvait être piégé via de simples documents Word. Alors, je vous laisse deviner le niveau de dégâts que pourraient causer des agents IA ayant accès à votre ordinateur.

Bref, selon des sources internes, les ingénieurs d’OpenAI travaillent activement à renforcer les barrières de sécurité avant de dévoiler leur propre technologie. Ce qui signifie qu’ils pourraient être lancés très prochainement. 

Le temps pris pour ajuster la technologie sera suffisant pour éviter une catastrophe ? J’en doute fort.

C’est sûrement la raison pour laquelle Anthropic, soutenu par , a adopté une approche plus minimaliste. Elle a conseillé à ses utilisateurs de limiter l’accès de ses agents IA à des données sensibles. Tout simplement. 

Plutôt que de faire de fausses promesses, elle a choisi de faire comprendre aux utilisateurs que les attaques sont du genre inévitable. À chacun de minimiser les dégâts dans le cas échéant.

Vous, qu’est-ce que vous en pensez ? 

Cet article OpenAI a peur de lancer son agent IA : découvrez la raison étonnante a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • OpenAI dévoile les employés virtuels : l’IA va remplacer vos collègues dès 2025 !
    OpenAI annonce l’émergence des employés virtuels pour 2025. Ces intelligences artificielles pourront travailler à vos côtés et transformer totalement le fonctionnement des entreprises, en remplaçant notamment vos collègues humains… Avez-vous du mal à supporter certains de vos collègues ? Si oui, bonne nouvelle : ils pourraient être remplacés dès cette année par des robots ! À moins que ce ne soit vous… Le CEO d’OpenAI, Sam Altman, annonce que des « employés virtuels » vont bientôt rejoindr

OpenAI dévoile les employés virtuels : l’IA va remplacer vos collègues dès 2025 !

Par : Bastien L.
7 janvier 2025 à 18:23

annonce l’émergence des employés virtuels pour 2025. Ces intelligences artificielles pourront travailler à vos côtés et transformer totalement le fonctionnement des entreprises, en remplaçant notamment vos collègues humains…

Avez-vous du mal à supporter certains de vos collègues ? Si oui, bonne nouvelle : ils pourraient être remplacés dès cette année par des robots ! À moins que ce ne soit vous…

Le CEO d’OpenAI, , annonce que des « employés virtuels » vont bientôt rejoindre les entreprises et transformer la façon dont elles fonctionnent.

À partir de 2025, les premiers agents IA vont commencer à travailler. Ainsi, l’intelligence artificielle pourrait enfin générer des retours sur les investissements massifs effectués dans cette technologie.

Sur son blog, Altman annonce ainsi que « nous pourrions voir les premiers agents IA rejoindre la population active en 2025 et changer la production des entreprises ».

https://twitter.com/sama/status/1876081442775793984

OpenAI, , … les agents IA arrivent en force !

Rappelons que Microsoft, l’un des principaux investisseurs d’OpenAI, a déjà annoncé l’introduction des agents IA : des outils capables de mener à bien des tâches en toute autonomie.

En 2024, le directeur IA de l’entreprise, Mustafa Suleyman, a révélé avoir vu des « démos impressionnantes » d’agents IA effectuant des transactions de façon totalement indépendante.

C’est également le cas de Google, qui a inauguré « l’ère de l’IA agentique » avec Gemini 2.0. Citons aussi , et sa fonctionnalité « Computer Use » permettant à l’IA Claude de prendre contrôle de votre PC pour effectuer des tâches.

De son côté, OpenAI prépare un agent IA portant le nom de code « Operator » et dont le lancement est prévu pour janvier 2025.

Selon Bloomberg, Operator utilisera un ordinateur pour effectuer des actions à la place de l’utilisateur. Il pourra par exemple écrire du code ou réserver des voyages.

McKinsey adopte les agents IA et prévoit un remplacement de 30% du travail humain

L’une des premières entreprises à avoir adopté la technologie des agents IA est McKinsey, la célèbre firme de conseil à laquelle Emmanuel Macron a beaucoup fait appel (notamment pendant la crise du Covid-19).

Elle construit un agent afin de traiter les nouvelles requêtes de clients, en menant des tâches comme la planification de réunions de suivi.

Selon le cabinet, d’ici 2030, l’automatisation par l’IA pourrait concerner jusqu’à 30% des heures travaillées dans l’économie des États-Unis.

Parallèlement à cette prédiction sur les agents IA, Sam Altman révèle aussi qu’OpenAI sait désormais comment construire une IA générale (AGI) plus intelligente que l’humain.

Son objectif est à présent la création d’une « superintelligence », capable d’accélérer la découverte scientifique et l’innovation plus rapidement que l’humain et d’accroître massivement l’abondance et la prospérité…

Alors, qu’en pensez-vous ? L’arrivée des employés IA est-elle une bonne ou une mauvaise nouvelle ? Êtes-vous inquiet pour votre emploi ? Partagez votre avis en commentaire !

Cet article OpenAI dévoile les employés virtuels : l’IA va remplacer vos collègues dès 2025 ! a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Gagner de l’argent est la nouvelle priorité d’OpenAI… mais c’est pour la bonne cause
    OpenAI, le pionnier de l’intelligence artificielle qui a donné naissance à ChatGPT, est en pleine transformation. Avec une ambition affichée de devenir une entreprise durable et rentable d’ici 2025, la société défend ce virage comme un mal nécessaire pour continuer à innover au service de l’humanité. Mais tout le monde n’est pas convaincu, et Elon Musk pourrait bien être l’obstacle ultime à ce changement. OpenAI, autrefois bastion du « tout pour l’humanité », se prépare à réinventer sa struct

Gagner de l’argent est la nouvelle priorité d’OpenAI… mais c’est pour la bonne cause

Par : Mariano R.
30 décembre 2024 à 06:40

, le pionnier de l’intelligence artificielle qui a donné naissance à , est en pleine transformation. Avec une ambition affichée de devenir une entreprise durable et rentable d’ici 2025, la société défend ce virage comme un mal nécessaire pour continuer à innover au service de l’humanité. Mais tout le monde n’est pas convaincu, et pourrait bien être l’obstacle ultime à ce changement.

OpenAI, autrefois bastion du « tout pour l’humanité », se prépare à réinventer sa structure. D’après le billet de blog publié le 27 décembre, d’ici 2025, l’organisation à but lucratif sera convertie en une société d’intérêt public (PBC). Ainsi, ils veulent donc lever des fonds pour continuer à développer une intelligence artificielle générale (AGI) qui bénéficie à tous.

Pour et son équipe, cette transition est vitale. Les coûts exorbitants de l’innovation en IA exigent des ressources massives. Et les dons traditionnels ne suffisent plus. Pourtant, cette évolution divise. Elon Musk accuse OpenAI de trahir ses idéaux en cherchant désormais à maximiser les profits. Alors que les tribunaux s’apprêtent à trancher, l’avenir d’OpenAI reste suspendu à un fil, entre ambitions lucratives et quête d’un impact global.

Une mission humanitaire sous une structure hybride

OpenAI est née en 2015 comme un laboratoire à but non lucratif, soutenu par des dons. Même Elon Musk y a contribué, pour moins d’un tiers des 137 millions récoltés. Leur objectif était de créer une IA qui profite à toute l’humanité, sans se soucier des rendements financiers.

Mais la réalité les a rattrapés, car l’IA coûte une fortune. Surtout si on veut rivaliser avec des géants comme ou les initiatives d’Elon Musk, comme .

OpenAI's Board of Directors is evaluating our corporate structure with the goal of making a stronger non-profit supported by the for-profit’s success.

Our plan would create one of the best-resourced non-profits in history. https://t.co/6GvnMyCQmR

— OpenAI (@OpenAI) December 27, 2024

C’est là qu’intervient la PBC. Cette structure permettra à OpenAI de lever plus de fonds tout en restant fidèle à sa mission. Les bénéfices serviront donc à soutenir des causes dans des domaines tels que la santé, l’éducation et la science, via l’association à but non lucratif d’OpenAI.

La controverse Altman-Musk

Évidemment, ce virage ne plaît pas à tout le monde. Elon Musk, cofondateur d’OpenAI, est furieux. Il accuse Sam Altman d’avoir trahi la vision initiale en transformant l’organisation en une machine à profits. Elon Musk a même intenté un procès et il qualifie cette restructuration de « coup de maître frauduleux » pour obtenir des millions.

Cette nouvelle structure pourrait rendre Altman extrêmement riche, avec une participation allant jusqu’à 7 % dans la société à but lucratif. Je trouve que cela contraste avec sa position passée, où il refusait tout gain personnel pour éviter des conflits d’intérêts.

Le procès de Musk pourrait donc retarder les plans d’OpenAI, qui sont déjà en pleine transformation. Pendant ce temps, , leur principal soutien financier, joue aussi un rôle clé dans cette transition.

Depuis 2019, Microsoft a injecté 1 milliard de dollars et possède une licence exclusive sur certaines technologies d’OpenAI. Cela renforce leur partenariat.

OpenAI au-delà d’un simple laboratoire… une entreprise durable

En 2025, OpenAI espère être « plus qu’un laboratoire et une startup ». Avec leur nouveau paradigme de recherche et les modèles de la série O, ils explorent des IA capables de raisonner. C’est ambitieux, mais nécessaire pour garder une longueur d’avance dans cette compétition où des centaines de milliards sont en jeu.

Alors, oui, OpenAI veut gagner de l’argent. Mais si cela leur permet de continuer à innover tout en ayant un impact social, je suis prêt à leur donner le bénéfice du doute. Après tout, comme ils le disent eux-mêmes : « La quête de leadership dans l’IA peut inspirer d’autres organisations à faire de même ». Si c’est vrai, ils sont peut-être sur la bonne voie.

Pour garantir l’avenir de l’IA, OpenAI a choisi de changer de cap. Pensez-vous que ce compromis vaut le coup ? Faites-nous part de vos réflexions dans les commentaires !

Cet article Gagner de l’argent est la nouvelle priorité d’OpenAI… mais c’est pour la bonne cause a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Chatbot arena, là où les IA s’affrontent sans merci
    Oui, il faut tester la performance d’une IA avant d’en tirer des conclusions sur son impact. C’est ici qu’intervient le concept du chatbot arena. Ces dernières années, les chatbot arenas se sont démarqués comme des plateformes importantes pour évaluer les performances des modèles de langage (LLM). Ils fournissent un lieu où différents chatbots peuvent être comparés directement. Ainsi, ils offrent un regard précieux sur leur efficacité et leur capacité à comprendre et à répondre aux préférence

Chatbot arena, là où les IA s’affrontent sans merci

Par : Rina R.
20 décembre 2024 à 15:00

Oui, il faut tester la performance d’une IA avant d’en tirer des conclusions sur son impact. C’est ici qu’intervient le concept du chatbot arena.

Ces dernières années, les chatbot arenas se sont démarqués comme des plateformes importantes pour évaluer les performances des modèles de langage (LLM). Ils fournissent un lieu où différents chatbots peuvent être comparés directement. Ainsi, ils offrent un regard précieux sur leur efficacité et leur capacité à comprendre et à répondre aux préférences humaines. Je vous invite à consulter cette page pour tout savoir sur le chatbot arena.

Chatbot arena : qu’est-ce que c’est ?

Un chatbot arena est une plateforme ouverte qui permet la mise en compétition directe des chatbots. Vous pouvez y trouver divers modèles d’IA générative és dans des scénarios variés. Cette arène virtuelle propose des environnements contrôlés où chaque IA est soumise aux mêmes défis et situations. Cela favorise une évaluation juste et impartiale de leurs capacités.

Contrairement aux évaluations traditionnelles, qui reposent en général sur des tests préenregistrés ou des données statiques, un chatbot arena met ces intelligences artificielles en face-à-face dans des tâches dynamiques. Les interactions sont alors jugées par des systèmes automatisés ou parfois même par des utilisateurs humains afin de déterminer quelle IA s’en sort le mieux. C’est comme un « match » de chatbots, où chaque « joueur » tente de performer au maximum.

Cette plateforme offre aussi une grande variété d’environnements et de tâches, allant des simples questions-réponses à des dialogues complexes. Cette approche nécessite une compréhension contextuelle approfondie. En conséquence, elle aide à discerner quelles IA peuvent naviguer avec succès dans des conversations délicates ou maintenir une cohérence sur le long terme.

De plus, l’accessibilité de ces arènes permet à une large communauté de développeurs, chercheurs et passionnés de comparer leurs créations directement contre certains des plus grands noms de l’industrie. Ainsi, cela stimule l’innovation et la collaboration, ce qui pousse les limites technologiques encore plus loin.

Pourquoi utiliser un chatbot arena ?

La réponse simple est : pour la performance. Un tel environnement vous permet de mesurer précisément comment votre modèle de langage se comporte par rapport aux autres. C’est crucial lorsque vous essayez de créer une IA compétitive qui doit surpasser les standards actuels.

Ensuite, la comparaison est une autre raison majeure. Les modèles LLM diffèrent grandement en termes de techniques utilisées, de volumes de données d’entraînement et de méthodologies. Une arène donnée vous permet de voir ces différences en action et de comprendre quels aspects spécifiques font la différence en matière de performance.

En utilisant une telle plateforme, vous profitez également d’une transparence accrue. Les résultats obtenus dans ces environnements sont généralement accessibles au public, ce qui permet un partage libre et équitable des informations. Vous êtes mieux informé pour prendre des décisions sur le développement futur de votre propre modèle.

Enfin, participer à un chatbot arena peut enrichir vos connaissances grâce aux retours de la communauté. Vous apprenez non seulement de vos propres erreurs et réussites, mais aussi de l’analyse critique de vos pairs. Ce cycle d’apprentissage continu est bénéfique pour toute personne souhaitant améliorer ses compétences en développant des solutions d’IA.

Comment savoir si mon modèle LLM est performant ?

Savoir si votre modèle est performant nécessite des métriques claires et une méthode d’évaluation standardisée. Dans un chatbot arena, plusieurs approches sont utilisées pour tester l’efficacité des modèles LLM et assurer qu’ils répondent bien aux attentes.

Premièrement, les interactions utilisateur-bot sont analysées. Des experts observeront comment votre IA gère les requêtes tout en maintenant la fluidité et la pertinence des réponses. Plus votre modèle est capable de gérer des échanges naturels, plus il sera considéré comme performant. Deuxièmement, viennent les sondages de satisfaction. Après chaque interaction, les utilisateurs peuvent donner une note ou un avis sur la qualité de la conversation. Ces retours directs aident à ajuster les algorithmes. Cette stratégie améliore continuellement la performance de l’IA à travers des itérations successives.

Finalement, le temps de réponse est une variable importante. Les meilleures IA ne sont pas seulement celles qui apportent des réponses pertinentes, mais aussi celles qui réagissent rapidement. Un temps de latence faible est souvent signe d’une architecture bien optimisée capable de traiter de grandes quantités de données en peu de temps.

Le score Elo, un incontournable pour un chatbot arena

Lorsqu’il s’agit de comparer des modèles de chatbot, le score Elo est généralement mentionné. Mais de quoi s’agit-il exactement ? À l’origine, le score Elo a été inventé pour évaluer les compétences des joueurs d’échecs. Son utilisation s’est étendue aux arènes de chatbot pour fournir une mesure quantitative du niveau de performance des différentes IA. Le score Elo fonctionne en attribuant un nombre à chaque IA basée sur ses performances précédentes. Lorsqu’un chatbot « gagne » une confrontation, son score augmente ; lorsqu’il « perd », son score diminue. Le système prend en compte non seulement le résultat de l’affrontement, mais aussi le score de l’adversaire. Battre un concurrent fort rapporte davantage de points que battre un adversaire plus faible, et inversement.

Cet algorithme offre un moyen dynamique et évolutif d’évaluer la compétence des chatbots. Il est particulièrement utile parce qu’il continue de s’ajuster au fur et à mesure que de nouvelles compétitions ont lieu. De cette manière, le classement reste toujours actuel et pertinent. Les scores Elo permettent donc de rendre compte des forces relatives entre les différents modèles de langage. Ils donnent un aperçu rapide et intuitif de qui tient le haut du pavé dans le domaine des IA génératives.

Qui utilise cette plateforme ?

On pourrait se demander qui tire profit de « Chatbot Arena ». En réalité, cette plateforme attire une variété de profils, tous ayant en commun un intérêt pour l’intelligence artificielle (IA) et les chatbots. Parmi ces utilisateurs, nous retrouvons principalement des chercheurs et des ingénieurs en IA. Ces experts utilisent l’outil pour tester leurs nouvelles créations et comparer leurs performances contre celles existantes.

Il y a également de nombreux étudiants en informatique et data science qui utilisent cette arène pour des projets académiques. C’est un excellent moyen d’acquérir de l’expérience pratique et d’observer de près le fonctionnement des modèles de langage. En outre, certaines entreprises voient d’un bon œil cet espace de test ouvert. Cette stratégie leur permet de sélectionner les chatbots les plus adaptés à intégrer dans leurs solutions commerciales. Cela dit, même si vous êtes simplement passionné par les technologies et l’IA, « Chatbot Arena » offre une opportunité unique. Vous pouvez explorer différentes interactions et voir comment les modèles réagissent en direct. Cela procure un aperçu fascinant de l’avancée technologique dans ce domaine dynamique.

Comment utiliser un chatbot arena ?

Sensibiliser à l’utilité de cette plateforme, vous pourriez maintenant vous demander comment tirer pleinement parti de « Chatbot Arena ». L’utilisation est assez simple et intuitive, même pour ceux qui ne sont pas des experts techniques. La première étape consiste en général à créer un compte sur la plateforme. Cela vous donne accès à l’ensemble des fonctionnalités proposées.

Ensuite, vous devez choisir les modèles de langage que vous souhaitez tester. La plateforme propose habituellement une sélection variée, allant des modèles les plus récents aux plus établis. Vous pouvez alors configurer vos propres critères de test et lancer des simulations. Ces tests peuvent inclure des tâches simples comme la compréhension de texte ou des scénarios plus complexes nécessitant de la logique et du raisonnement. Une fonctionnalité intéressante à exploiter est celle des sessions interactives. Elles permettent de simuler des conversations en temps réel avec les chatbots choisis. Cette immersion directe aide à mieux comprendre leur comportement et leur efficacité. Par ailleurs, les retours générés après chaque session sont riches en informations. Cela fournit des métriques détaillées et des analyses comparatives entre les modèles.

Les scores des meilleures IA sur chatbot arena

Score Elo de

Parmi les modèles évalués sur « Chatbot Arena », ChatGPT figure généralement en tête de liste. Grâce à son architecture sophistiquée basée sur , ce modèle affiche régulièrement des scores Elo impressionnants. Sa capacité à fournir des réponses précises et pertinentes en fait un choix privilégié pour de nombreux tests.

Lorsque j’examine le score Elo de ChatGPT, ce qui me marque le plus, c’est sa constance. Même face à des modèles concurrents, il réussit à maintenir une performance stable. C’est un témoignage de son efficacité et de la finesse de ses algorithmes de traitement du langage naturel. Utiliser ce modèle dans une arène benchmarking permet de définir des standards élevés pour les autres IA.

Score Elo de

Un autre compétiteur sérieux est Gemini. Ce modèle IA, bien que moins populaire que ChatGPT, a su faire ses preuves au fil du temps. Son score Elo n’est jamais très loin derrière celui des leaders. En particulier, Gemini excelle dans les tâches nécessitant une analyse sémantique fine et une compréhension contextuelle.

En explorant les détails des affrontements de Gemini, il est évident qu’il possède certains avantages uniques. Sa rapidité de génération de réponses et sa capacité à gérer des dialogues prolongés sans perte de cohérence sont, entre autres, notables. Tester ce modèle apporte une perspective enrichissante sur les capacités évolutives des LLM.

Enfin, le score Elo de

Claude Anthropic, bien que récent sur la scène, a rapidement gravi les échelons dans les classements Elo. Conçu avec une approche axée sur la sécurité et l’éthique, ce modèle de langage ne sacrifie pas pour autant la performance. Ses scores élèvent la barre dans l’arène, ce qui met en avant des interactions intelligentes et respectueuses des utilisateurs.

Analyser Claude Anthropic dans une configuration compétitive révèle des insights intéressants. Parmi ses points forts, il y a un apprentissage renforcé et une adaptation progressive. Contrairement à d’autres modèles, Claude adopte des mesures proactives pour éviter les biais et les erreurs courantes dans ses réponses. Cela lui confère non seulement un score élevé, mais également une fiabilité accrue pour des applications sensibles.

Cet article Chatbot arena, là où les IA s’affrontent sans merci a été publié sur LEBIGDATA.FR.

❌
❌