Vue normale

Il y a de nouveaux articles disponibles, cliquez pour rafraîchir la page.
À partir d’avant-hierFlux principal
  • ✇ActuIA
  • OpenAI propose un fine-tuning gratuit pour GPT-4o mini pendant deux mois
    La concurrence entre les acteurs de la GenAI semble plus que jamais de mise. Nouveau hasard du calendrier ou non, le jour-même où Meta lançait la famille Llama 3.1 et NVIDIA annonçait de nouveaux microservices NIM Llama 3.1, OpenAI a lancé une offre de fine-tuning gratuit pour son dernier LLM, GPT-4o mini, présenté le 18 juillet dernier. Pour rappel, GPT-4o mini est présenté par OpenAI comme le plus rentable de ses modèles. Grâce à son faible coût et sa faible latence, il est particulièrement ad

OpenAI propose un fine-tuning gratuit pour GPT-4o mini pendant deux mois

30 juillet 2024 à 08:30

La concurrence entre les acteurs de la GenAI semble plus que jamais de mise. Nouveau hasard du calendrier ou non, le jour-même où Meta lançait la famille Llama 3.1 et NVIDIA annonçait de nouveaux microservices NIM Llama 3.1, OpenAI a lancé une offre de fine-tuning gratuit pour son dernier LLM, GPT-4o mini, présenté le 18 juillet dernier.

Pour rappel, GPT-4o mini est présenté par OpenAI comme le plus rentable de ses modèles. Grâce à son faible coût et sa faible latence, il est particulièrement adapté aux scénarios enchaînant ou parallélisant plusieurs appels de modèle, par exemple l’appel de plusieurs API, ou une analyse de grands volumes de données contextuelles, comme l’intégration de bases de code complètes ou d’historiques de conversations. Les chatbots de support client peuvent également bénéficier de ses réponses rapides et précises en temps réel.

Un fine-tuning gratuit jusqu’au 23 septembre

Depuis le 23 juillet, les développeurs et entreprises peuvent entraîner gratuitement GPT-4o mini sur des données supplémentaires pour l’adapter à leurs besoins spécifiques, mais  avec une limite quotidienne de 2 millions de jetons d’entraînement. Pour ceux qui dépassent cette limite, des frais de 3 $ par million de jetons supplémentaires seront appliqués.

L’offre concerne initialement les niveaux 4 et 5 des plans d’utilisation d‘OpenAI. Ces derniers sont généralement destinés à des entreprises et des organisations ayant des besoins importants et un volume élevé de requêtes. La start-up les proposera aux trois premiers niveaux prochainement.

Comment profiter du fine-tuning gratuit ?

Pour profiter de cette offre, les développeurs peuvent suivre ces étapes simples :

  • Se connecter à leur tableau de bord de fine-tuning sur la plateforme OpenAI ou s’enregistrer pour ceux qui n’ont pas encore de compte ;
  • Cliquer sur “créer”;
  • Sélectionner GPT-4o mini dans le menu déroulant des modèles de fondation.

OpenAI propose un guide dédié aux étapes du fine-tuning pour les non-initiés ici.

Cette offre est valable jusqu’au 24 septembre, affiner GPT-4o mini reviendra alors à 3 $, pour chaque million de jetons d’entraînement, une somme bien inférieure au fine-tuning de GPT-3,5 Turbo qui revient à 8 $ pour le même nombre de jetons.

OpenAI propose un fine-tuning gratuit pour GPT-4o mini pendant deux mois
  • ✇ActuIA
  • GPT-4o mini : OpenAI lance une version optimisée et économique de son modèle phare
    L’un des principaux obstacles à l’adoption de l’IA générative pour les entreprises est le coût. Les fournisseurs proposent donc aujourd’hui des modèles plus légers  très performants tout en offrant plus de flexibilité. OpenAI, qui a présenté GPT-4o en mai dernier, a introduit la semaine dernière une version allégée et optimisée de son modèle phare : GPT-4o mini. Adapté à des environnements avec des contraintes de ressources, la start-up le présente comme son modèle le plus rentable à ce jour. GP

GPT-4o mini : OpenAI lance une version optimisée et économique de son modèle phare

22 juillet 2024 à 11:00

L’un des principaux obstacles à l’adoption de l’IA générative pour les entreprises est le coût. Les fournisseurs proposent donc aujourd’hui des modèles plus légers  très performants tout en offrant plus de flexibilité. OpenAI, qui a présenté GPT-4o en mai dernier, a introduit la semaine dernière une version allégée et optimisée de son modèle phare : GPT-4o mini. Adapté à des environnements avec des contraintes de ressources, la start-up le présente comme son modèle le plus rentable à ce jour.

GPT-4o mini est conçu pour une large gamme d’applications grâce à son faible coût et sa faible latence. Il est particulièrement adapté aux scénarios enchaînant ou parallélisant plusieurs appels de modèle, par exemple l’appel de plusieurs API, ou une analyse de grands volumes de données contextuelles, comme l’intégration de bases de code complètes ou d’historiques de conversations. Les chatbots de support client peuvent également bénéficier de ses réponses rapides et précises en temps réel.

Pour l’instant, le modèle ne traite que le texte et les images mais les entrées et sorties audio et vidéo seront également prises en charge, élargissant ainsi les possibilités d’application dans divers domaines. Il dispose d’une fenêtre contextuelle de 128 000 jetons et peut gérer jusqu’à 16 000 jetons de sortie par demande. Son coût est de 15 cents par million de jetons d’entrée et 60 cents par million de jetons de sortie (environ 2500 pages d’un livre standard), soit une réduction de plus de 60 % par rapport à GPT-3.5 Turbo. Il prend en charge la même gamme de langues que GPT-4o, cependant, ses connaissances au lancement s’arrêtent à octobre 2023.

Des performances impressionnantes

Malgré sa taille réduite, GPT-4o mini conserve une performance robuste et offre des réponses de haute qualité dans divers contextes. Open AI l’a évalué par rapport à GPT-3.5 Turbo, GPT-4o mais également par rapport à des modèles plus légers, Gemini Flash de Google et Claude Haïku d’Anthropic.

Ses capacités en matière de génération de texte et de raisonnement multimodal lui ont permis de surpasser ces modèles, à l’exception de GPT-4o, sur toutes les tâches. Pour les tâches de raisonnement impliquant à la fois le texte et la vision, il a obtenu un score de 82,0 % sur MMLU, contre 77,9 % pour Gemini Flash, 73,8 % pour Claude Haiku et 69,8 % pour GPT-3,5 Turbo (88,7 % pour GPT-4o).

GPT-4o mini excelle dans le raisonnement mathématique et les tâches de codage. Sur MGSM, mesurant le raisonnement mathématique, il a obtenu un score de 87,0 %, contre 75,5 % pour Gemini Flash et 71,7 % pour Claude Haiku et 87,2 % sur HumanEval, qui mesure les performances de codage, contre 71,5 % pour Gemini Flash et 75,9 % pour Claude Haiku.

Sécurité et fiabilité

La sécurité est un pilier central du développement de GPT-4o mini. Le modèle intègre des mesures de sécurité robustes dès la phase de pré-entraînement, filtrant les contenus indésirables tels que les discours haineux et le spam. Après l’entraînement, des techniques avancées comme l’apprentissage par renforcement avec rétroaction humaine (RLHF) ont été utilisées pour aligner le comportement du modèle sur des normes strictes. GPT-4o mini est conçu pour résister aux tentatives de jailbreaks et autres attaques, garantissant des réponses fiables et sécurisées.

Disponibilité

GPT-4o mini est disponible en tant que modèle de texte et de vision dans l’API Assistants, l’API Chat Completions et l’API Batch. Les équipes d’OpenAI travaillent au peaufinage de ses réglages.

Dans ChatGPT, il remplace désormais GPT-3,5 et est disponible pour les utilisateurs Plus et Team, mais également pour ceux de Free, la version gratuite. Les utilisateurs Enterprise y auront également accès cette semaine. Cette disponibilité large témoigne de l’engagement d’OpenAI à rendre les avantages de l’IA accessibles à tous.

GPT-4o mini OpenAI lance une version optimisée et économique de son modèle phare

La version gratuite de ChatGPT devient meilleure grâce à GPT-4o mini

ChatGPT OpenAI chatbot

OpenAI a sorti un nouveau modèle de génération par intelligence artificielle, remplaçant officiellement le vieillissant GPT-3.5. Dites bonjour à GPT-4o mini !

❌
❌