Vue normale

Il y a de nouveaux articles disponibles, cliquez pour rafraîchir la page.
À partir d’avant-hierFlux principal

Dernier jour pour GPT-4o et GPT-5 : ChatGPT va faire le grand ménage

À partir du 13 février, les modèles GPT-5.2 et GPT-5.1 seront les seuls encore disponibles dans ChatGPT. OpenAI va simplifier sa proposition après avoir maintenu en vie les anciens modèles pendant plusieurs mois, à la demande des utilisateurs.

Sam Altman annonce déjà des changements pour ChatGPT-5, après 2 jours d’existence

ChatGPT-5 est disponible depuis le 6 août 2025. Quelques jours après son lancement, OpenAI a annoncé une série d'évolutions pour son nouveau modèle d'intelligence artificielle, qui a essuyé quelques critiques.

La plus grande mise à jour de l’histoire de ChatGPT arriverait en août

ChatGPT OpenAI

Le nouveau modèle GPT-5, qui remplacerait à la fois GPT-4o, o3 et o4, arriverait au mois d'août selon le média américain The Verge. La communauté de l'intelligence artificielle l'attend depuis plus de deux ans.

Vous posez tous les jours 2,5 milliards de questions à ChatGPT

ChatGPT OpenAI

En déplacement à Washington pour convaincre des bienfaits de l'intelligence artificielle, Sam Altman communique des chiffres inédits sur l'utilisation du ChatGPT. Le service est devenu incontournable pour des millions d'utilisateurs.

« Nous n’avons pas été à la hauteur » : ChatGPT va arrêter de vous dire que vous êtes le meilleur

ChatGPT OpenAI

OpenAI a annoncé supprimer la dernière mise à jour de GPT-4o, le modèle actuel de ChatGPT. Il était trop flatteur avec les utilisateurs, pouvant même applaudir des idées dangereuses.

OpenAI dévoile GPT-4.1 : un modèle que vous n’utiliserez probablement jamais

OpenAI lance trois nouveaux modèles : GPT-4.1, GPT-4.1 mini et GPT-4.1 nano. Contrairement à ce que les rumeurs suggéraient une semaine plus tôt, il ne s'agit pas de remplaçants de GPT-4o, le modèle par défaut de ChatGPT.

OpenAI prépare GPT-4.1, après GPT-4, GPT-4o, GPT-4.5 et en attendant GPT-5

ChatGPT OpenAI

Selon les informations de The Verge, OpenAI s'apprête à lancer plusieurs nouveaux modèles de langage la semaine du 14 avril. ChatGPT va accueillir GPT-4.1, o3 et o4, en attendant la révolution GPT-5 décalée à plus tard en 2025.

OpenAI dévoile les futurs modèles de ChatGPT : voici GPT-5, o3 et o4-mini

ChatGPT OpenAI

Après avoir initialement annoncé l'abandon du modèle o3 au profit d'un GPT-5 ultra-polyvalent, capable de solliciter automatiquement le bon modèle, Sam Altman, le patron d'OpenAI, annonce avoir changé d'avis. o3 et o4-mini arriveront « d'ici à deux semaines » dans ChatGPT.

Générer des images avec ChatGPT (GPT-4o) : c’est gratuit pour tout le monde

ChatGPT OpenAI

La patron d'OpenAI a annoncé le 1er avril que la génération d'images avec le modèle GPT-4o devenait gratuite dans ChatGPT. De quoi permettre à tous les utilisateurs du célèbre chatbot d'essayer cette fonction sans abonnement particulier.

ChatGPT change son modèle par défaut : les réponses vont être meilleures

Fidèle à ses habitudes, OpenAI ne donne pas de détails sur le nouvel LLM de GPT-4o, qui n'a même pas de nom officiel. Tout ce que l'on sait est qu'il est plus performant.

OpenAI Operator fait faire un bond en avant à ChatGPT (sauf en Europe)

ChatGPT OpenAI

Un agent qui peut se servir de votre navigateur web à votre place et effectuer des tâches en votre nom. Voilà, en somme, ce que promet OpenAI avec son nouveau projet : Operator. Un programme qui est pour l'heure encore inaccessible pour la plupart des usagers. Mais sans doute pas pour longtemps.

Apple développerait en secret son grand modèle de langage pour remplacer Siri en 2026

Au printemps 2025, Apple déploiera une nouvelle version plus avancée de Siri, capable de répondre à des requêtes personnelles. Plus tard, vraisemblablement au printemps 2026 (avec iOS 19, donc), la marque devrait repartir à zéro avec un nouveau Siri. Il serait basé sur un LLM (Large Language Model) développé en interne, qui fonctionnerait comme GPT (OpenAI) ou Gemini (Google).

Que se passe-t-il avec Orion, le supposé successeur de GPT-4 démenti par Sam Altman ?

sam altman

La presse a rapporté l'existence d'un mystérieux projet appelé Orion. Il pourrait s'agir du prochain modèle de langage ChatGPT, que les rumeurs surnommaient jusque-là GPT-5. Sa sortie coïnciderait avec le deuxième anniversaire de l'outil. Mais Sam Altman dément, parlant d'une fake news.

  • ✇ActuIA
  • OpenAI Devday 2024 : Vision Fine-tuning, Model Distillation, Prompt Caching et Realtime API au cœur des annonces
    Lors de sa 1ère conférence des développeurs, il y a un peu moins d’un an, les annonces principales d’OpenAI étaient consacrées à GPT-4 turbo, GPT Builder et au GPT Store. Cette année, toujours pas de GPT-5, mais il n’était pas réellement attendu après la présentation d‘OpenAI o1, il y a 3 semaines. Le Devday 2024 a été un événement plus technique, entièrement dédié aux développeurs et à l’exploitation des modèles existants de la start-up, avec de nouveaux ajouts à la plateforme API. Parmi la sér

OpenAI Devday 2024 : Vision Fine-tuning, Model Distillation, Prompt Caching et Realtime API au cœur des annonces

4 octobre 2024 à 10:50

Lors de sa 1ère conférence des développeurs, il y a un peu moins d’un an, les annonces principales d’OpenAI étaient consacrées à GPT-4 turbo, GPT Builder et au GPT Store. Cette année, toujours pas de GPT-5, mais il n’était pas réellement attendu après la présentation d‘OpenAI o1, il y a 3 semaines. Le Devday 2024 a été un événement plus technique, entièrement dédié aux développeurs et à l’exploitation des modèles existants de la start-up, avec de nouveaux ajouts à la plateforme API.

Parmi la série d’outils et fonctionnalités destinés à améliorer l’utilisation et la personnalisation des solutions d’IA d’OpenAI au sein des applications professionnelles, présentés, on retrouve : Realtime API, Vision fine-tuning pour GPT-4o, Model distillation et Prompt caching.

Realtime : Une API conçue pour des expériences vocales instantanées

Realtime a été déployée ce 1er octobre en version bêta publique pour tous les développeurs payants. Ses capacités audio sont alimentées par le nouveau modèle GPT-4o. Elle permet aux développeurs de créer des applications multimodales en temps réel, avec les six voix prédéfinies prises en charge par l’API, distinctes de celles de ChatGPT.

Voici quelques avantages notables de l’API qui prend actuellement en charge le texte et l’audio en entrée et en sortie, (la vision et la vidéo sont déjà prévues), mais également l’appel de fonctions :

  • Parole à parole native : L’absence d’intermédiaire de texte signifie une faible latence et une sortie nuancée ;
  • Voix naturelles et orientables : Les modèles ont une inflexion naturelle et peuvent rire, chuchoter et adhérer à la direction du ton ;
  • Sortie multimodale simultanée : Le texte est utile pour la modération, l’audio plus rapide que le temps réel assure une lecture stable.

OpenAI va également introduire l’audio dans l’API de complétion de chat pour “les cas d’utilisation qui ne nécessitent pas les avantages de faible latence de l’API en temps réel”.
La start-up prévoit également d’augmenter progressivement les limites de débit actuelles (environ 100 sessions simultanées pour les développeurs de niveau 5). L’API Realtime sera intégrée dans les SDK OpenAI pour Python et Node.js et prendra en charge GPT-4o mini dans les futures versions.

Vision Fine-tuning

Cette nouvelle API permet aux développeurs de personnaliser des modèles basés sur GPT-4o en affinant leur compréhension des images. Des applications dans des domaines tels que la détection d’objets pour les véhicules autonomes ou l’analyse d’images médicales sont désormais possibles. OpenAI a cependant précisé que l’utilisation d’images protégées par des droits d’auteur reste interdite.

La start-up a présenté quelques cas d’utilisation pratiques :

  • Amélioration de la cartographie routière : Grab, une entreprise de covoiturage et de livraison alimentaire en Asie du Sud-Est, a utilisé la nouvelle fonctionnalité de vision pour améliorer sa cartographie urbaine. En ajustant GPT-4o avec seulement 100 images, l’entreprise a amélioré de 20 % la précision du comptage des voies et de 13 % la localisation des panneaux de signalisation par rapport à un modèle de base. Cela permet à Grab d’automatiser davantage la création de cartes routières, un processus auparavant manuel ;
  • Automatisation des processus d’affaires : Automat, spécialisé dans l’automatisation des processus métier, a formé GPT-4o pour reconnaître des éléments d’interface utilisateur via des captures d’écran, augmentant le taux de réussite de son système de 272 %. Ce réglage fin a également permis à Automat d’améliorer la précision d’extraction de données à partir de documents non structurés ;
  • Optimisation des sites web : Coframe, une plateforme d’ingénierie de croissance numérique, a affiné GPT-4o pour générer du code à partir d’images existantes d’un site web. Ce réglage fin a permis à GPT-4o de produire des sites web avec une cohérence visuelle accrue de 26 % par rapport au modèle de base.

Vision Fine-Tuning est d’ores et déjà disponible, OpenAI offre gratuitement 1 million de jetons d’entraînement par jour jusqu’au 31 octobre 2024 pour affiner GPT-4o avec des images.

Prompt Caching

La mise en cache des invites, déjà en place chez des concurrents comme Anthropic, permet d’améliorer la latence des réponses et de réduire les coûts d’utilisation des API, en réutilisant les jetons d’entrée récemment utilisés, et ce, sans compromettre la performance.

OpenAI explique : “De nombreux développeurs utilisent le même contexte à plusieurs reprises dans le cadre de plusieurs appels d’API lorsqu’ils créent des applications d’IA, par exemple lorsqu’ils apportent des modifications à une base de code ou qu’ils ont de longues conversations à plusieurs tours avec un chatbot”.

Les appels d’API aux modèles GPT-4o, GPT-4o mini, o1-preview et o1-mini, ainsi qu’aux versions affinées de ces modèles, bénéficieront automatiquement de la mise en cache des invites de plus de 1 024 jetons.

Le système met en cache le préfixe le plus long déjà traité, en commençant à 1 024 jetons et augmente par incréments de 128 jetons. Les développeurs n’ont donc pas besoin de modifier leur intégration API pour bénéficier de cette fonctionnalité. Les caches sont généralement effacés après 5 à 10 minutes d’inactivité et supprimés au plus tard dans l’heure qui suit la dernière utilisation du cache.

Model Distillation

La distillation de modèle consiste à entraîner un modèle plus petit et plus économique en utilisant les résultats d’un modèle plus performant. Cela permet aux développeurs d’obtenir des performances proches de celles du modèle initial (comme GPT-4o) sur des tâches spécifiques, tout en réduisant considérablement les coûts et la latence, en particulier avec des modèles comme GPT-4o mini. OpenAI annonce plusieurs nouveautés pour sa plateforme de distillation de modèles, notamment : Stored completions, Evals et Fine-tuning

  • Achèvements stockés : Capture automatique des paires entrée-sortie générées par des modèles comme GPT-4o, stockées via l’API pour créer des ensembles de données en vue du réglage fin. Cela facilite la création d’ensembles de données issus de la production pour améliorer et évaluer les modèles ;
  • Évaluations (bêta) : Permet de créer et d’exécuter des évaluations sur la plateforme OpenAI pour mesurer la performance des modèles sur des tâches spécifiques. Cela offre un moyen intégré d’évaluer la qualité des modèles sans avoir à créer des scripts manuellement ;
  • Réglage fin : L’intégration complète avec les achèvements stockés et les évaluations permet d’affiner les modèles plus petits avec des ensembles de données réels, tout en mesurant les performances de manière continue.

Model Distillation est disponible pour tous les développeurs sur la plateforme OpenAI. Jusqu’au 31 octobre, OpenAI offre 2 millions de jetons gratuits par jour pour entraîner GPT-4o mini et 1 million de jetons gratuits pour GPT-4o.

En marge du DevDay, OpenAI a également annoncé l’introduction de son nouveau modèle de modération multimodale, omni-modération-latest, qui est intégré dans l’API de modération. Ce modèle, construit sur GPT-4o, améliore considérablement la détection de contenus préjudiciables, notamment dans les langues non-anglophones, avec deux nouvelles catégories de détection.

OpenAI Devday 2024 : Vision Fine-tuning, Model Distillation, Prompt Caching et Realtime API au cœur des annonces
  • ✇ActuIA
  • OpenAI lance le fine-tuning de GPT-4o avec une offre gratuite limitée
    Après avoir annoncé le fine-tuning de GPT-4o mini fin juillet dernier avec une offre de 2 millions de jetons gratuits par jour jusqu’au 23 septembre prochain, OpenAI propose depuis mardi dernier aux développeurs d’affiner son LLM multimodal phare GPT-4o.  GPT-4o, introduit en mai dernier par OpenAI, fusionne le traitement de l’audio, de la vision et du texte en temps réel. Comparé à GPT-4 Turbo, il est deux fois plus rapide, deux fois moins cher et propose des limites de débit cinq fois plus éle

OpenAI lance le fine-tuning de GPT-4o avec une offre gratuite limitée

22 août 2024 à 09:30

Après avoir annoncé le fine-tuning de GPT-4o mini fin juillet dernier avec une offre de 2 millions de jetons gratuits par jour jusqu’au 23 septembre prochain, OpenAI propose depuis mardi dernier aux développeurs d’affiner son LLM multimodal phare GPT-4o

GPT-4o, introduit en mai dernier par OpenAI, fusionne le traitement de l’audio, de la vision et du texte en temps réel. Comparé à GPT-4 Turbo, il est deux fois plus rapide, deux fois moins cher et propose des limites de débit cinq fois plus élevées. Les développeurs vont pouvoir l’affiner en utilisant des ensembles de données personnalisés à un coût réduit pour leurs cas d’utilisation spécifiques.

Le fine-tuning, l’une des fonctionnalités les plus demandées par les développeurs, permet d’améliorer la précision, la structure, et le ton des réponses du modèle, ainsi que sa capacité à suivre des instructions complexes propres à certains domaines, même avec de petits ensembles de données. Selon OpenAI, quelques dizaines d’exemples peuvent suffire pour obtenir des améliorations significatives.

La nouvelle fonctionnalité est disponible pour tous les développeurs, quel que soit leur niveau d’utilisation. Le coût de l’entraînement est fixé à 25 par million de jetons, avec des tarifs d'inférence de 3,75 par million de jetons d’entrée et 15 $ par million de jetons de sortie.

Comme pour GPT-4o mini, son lancement est assorti d’une offre de fine-tuning gratuit jusqu’au 23 septembre mais plus restreinte : chaque organisation bénéficie d’un million de jetons d’entraînement gratuits par jour.

De premiers cas d’utilisation convaincants

Depuis deux mois, plusieurs partenaires de confiance d’OpenAI ont pu tester le fine-tuning de GPT-4o avec des résultats impressionnants.

Parmi ceux-ci :

  • Cosine a utilisé GPT-4o pour affiner son assistant d’ingénierie logicielle, Genie. En intégrant des exemples réels d’ingénieurs logiciels, Genie a été en mesure de détecter et corriger des bogues, créer de nouvelles fonctionnalités et refactoriser du code avec une précision accrue. Grâce à ce réglage fin, Genie a atteint un score record de 43,8 % sur le banc d’essai SWE-bench, établissant un nouveau standard de performance ;
  • Distyl : ce partenaire spécialisé dans les solutions d’IA pour les entreprises du Fortune 500 a utilisé GPT-4o pour améliorer ses capacités de traitement SQL. Le modèle affiné a obtenu un score de 71,83 % au benchmark BIRD-SQL, surpassant ses concurrents et démontrant une compétence exceptionnelle dans la reformulation de requêtes et la génération SQL.

Sécurité et contrôle des données

Les modèles affinés via GPT-4o restent entièrement sous le contrôle des développeurs. Les données d’entreprise, y compris les entrées et sorties, sont protégées et ne sont jamais partagées ou utilisées pour entraîner d’autres modèles. De plus, des mesures de sécurité rigoureuses, incluant des évaluations automatisées et une surveillance continue de l’utilisation, sont en place pour prévenir tout usage abusif.

Comment commencer le fine-tuning de GPT-4o ?

Les développeurs intéressés par cette nouvelle fonctionnalité peuvent suivre ces étapes simples :

  • Se connecter à leur tableau de bord de fine-tuning sur la plateforme OpenAI ou s’enregistrer pour ceux qui n’ont pas encore de compte ;
  • Cliquer sur “créer”;
  • Sélectionner gpt-4o-2024-08-06 dans le menu déroulant des modèles de fondation.

OpenAI propose un guide dédié aux étapes du fine-tuning pour les non-initiés ici.

La start-up commente :

“Du codage à l’écriture créative, la mise au point peut avoir un impact important sur les performances du modèle dans divers domaines. Ce n’est qu’un début : nous continuerons d’investir dans l’élargissement de nos options de personnalisation de modèle pour les développeurs”.

OpenAI lance le fine-tuning de GPT-4o avec une offre gratuite limitée

La prochaine révolution de ChatGPT commence à se déployer

Annoncé en mai, puis mystérieusement repoussé, le nouveau ChatGPT capable d'entretenir de longues conversations vocales, en acceptant d'être coupé et en imitant des émotions, arrive en version alpha. De premiers chanceux peuvent déjà l'essayer.

La version gratuite de ChatGPT devient meilleure grâce à GPT-4o mini

ChatGPT OpenAI chatbot

OpenAI a sorti un nouveau modèle de génération par intelligence artificielle, remplaçant officiellement le vieillissant GPT-3.5. Dites bonjour à GPT-4o mini !

OpenAI repousse le lancement de la voix taquine de ChatGPT

Simultanément au lancement de GPT-4o, OpenAI a dévoilé en mai 2024 le nouveau « mode voix » de ChatGPT, capable de tenir des conversations comme un être humain, avec plusieurs émotions. Son lancement est repoussé à l'automne 2024.

ChatGPT est devenu plus intelligent : la version gratuite passe à GPT-4o

ChatGPT OpenAI chatbot

Tous les utilisateurs gratuits de ChatGPT peuvent désormais poser des questions à GPT-4o, le modèle de langage lancé en mai 2024. Plusieurs fonctions jusque-là réservées aux utilisateurs payants sont disponibles gratuitement.

GPT-5 arrive bientôt : OpenAI entraîne un « modèle de nouvelle génération »

Dans un billet de blog dédié à la formation d'un conseil de sécurité, OpenAI officialise l'existence d'un nouveau modèle de langage conçu pour remplacer GPT-4. L'annonce de GPT-5, que certains imaginent planifée pour le mois de juin, se rapproche.

On a essayé le projet Astra : vivement le retour des Google Glass !

À Mountain View, Numerama a pu obtenir des informations exclusives sur « Project Astra », la nouvelle expérimentation de DeepMind qui offre à l'intelligence artificielle Gemini des yeux et des oreilles. La réponse de Google à ChatGPT Voice est plutôt encourageante.

Nouvelle avancée d’OpenAI avec GPT-4o, un modèle qui fusionne le traitement de l’audio, de la vision et du texte en temps réel

14 mai 2024 à 13:50

Alors que les spéculations allaient bon train sur l’arrivée prochaine de GPT-5, OpenAI crée une fois de plus la surprise en présentant ce 13 mai GPT-4o (“o” pour omni) qu’il présente comme son “nouveau modèle phare qui peut raisonner sur l’audio, la vision et le texte en temps réel”.

GPT-4o, qui fait de ChatGPT un assistant vocal, représente une avancée vers des interactions plus naturelles et fluides entre les humains et les machines. Avec une capacité de traitement des commandes audio en seulement 232 millisecondes et de 320 millisecondes en moyenne, il se rapproche de la vitesse de réaction humaine dans les échanges verbaux.

Il offre des performances comparables à celles de GPT-4 Turbo pour le traitement du texte en anglais et du code, mais des performances nettement améliorées pour les autres langues, le tout à une vitesse accrue. En termes de reconnaissance visuelle et de compréhension audio, GPT-4o dépasse, selon les tests réalisés par OpenAI, les modèles existants.

Les fonctionnalités de traitement de texte et d’image de GPT-4o intégrées dans ChatGPT sont accessibles aux utilisateurs de la version gratuite et, avec des limites de messages jusqu’à cinq fois plus élevées, à ceux de ChatGPT Plus. Les utilisateurs gratuits pourront par exemple lui demander de créer des graphiques, d’analyser les données ou des photos. Il  leur sera également possible de télécharger des fichiers et obtenir de l’aide pour les résumer, rédiger ou les analyser et  d’accéder aux GPT et au GPT Store.

OpenAI prévoit de déployer le mode vocal de GPT-4o en version alpha dans ChatGPT Plus dans les prochaines semaines.

Les développeurs peuvent désormais accéder à GPT-4o via l’API pour le traitement de texte et d’image. Comparé à GPT-4 Turbo, GPT-4o est deux fois plus rapide, deux fois moins cher et propose des limites de débit cinq fois plus élevées. La prise en charge des nouvelles capacités audio et vidéo de GPT-4o dans l’API sera déployée par la start-up à un petit groupe de partenaires de confiance dans les semaines à venir.

La start-up a présenté le nouveau modèle sur son blog et lors d’une vidéo en direct dont elle a partagé des extraits sur X.

Say hello to GPT-4o, our new flagship model which can reason across audio, vision, and text in real time: https://t.co/MYHZB79UqN

Text and image input rolling out today in API and ChatGPT with voice and video in the coming weeks. pic.twitter.com/uuthKZyzYx

— OpenAI (@OpenAI) May 13, 2024

Live demo of coding assistance and desktop app pic.twitter.com/GlSPDLJYsZ

— OpenAI (@OpenAI) May 13, 2024

gpt4o

Comment avoir accès à GPT-4o, le nouveau ChatGPT gratuit ?

GPT par GPT-4o

Le nouveau modèle GPT-4o arrive dans ChatGPT, gratuitement. L'outil est déployé sur la plateforme, avec pour conséquence de remplacer le vieillissant GPT-3.5 par GPT-4o. Voici la marche à suivre pour accéder à la mouture du chatbot américain.

Comment installer ChatGPT sur son Mac ou sur son PC Windows ?

Depuis juin 2024, OpenAI propose à tous les utilisateurs de ChatGPT, gratuits ou payants, une application macOS pour intégrer le chatbot aux ordinateurs Apple. Un raccourci clavier permet d'appeler ChatGPT à n'importe quel moment.

OpenAI dévoile GPT-4o, ChatGPT pour ordinateur et un assistant vocal next gen

Le 13 mai, dans une rare conférence de presse, OpenAI a dévoilé GPT-4o, un nouveau modèle de langage pour ses utilisateurs gratuits et payants. GPT-4o dispose d'un modèle vocal impressionnant, capable de répondre en temps réel à des questions et de commenter le monde grâce à des caméras.

❌
❌