Aller au contenu principal

LLMs — page 12

606 articles · page 12 sur 13

Toute l'actualité des modèles de langage (LLM) : GPT, Claude, Gemini, Mistral, Llama — benchmarks, nouvelles sorties et comparatifs.

Garder vos données en sécurité lorsqu'un agent AI clique sur un lien
552OpenAI Blog 

Garder vos données en sécurité lorsqu'un agent AI clique sur un lien

OpenAI a mis en place des mesures de sécurité intégrées pour protéger les données des utilisateurs lorsqu'un agent IA clique sur un lien, empêchant ainsi l'exfiltration de données via les URLs et l'injection de prompts. Ces protocoles limitent les risques de fuites d'informations sensibles et de manipulation des systèmes par des attaques ciblées.

LLMsActu
1 source
Vers une évaluation solide des capacités du dialecte émirati dans les grammaires linguistiques arabes (LLMs)
553HuggingFace Blog 

Vers une évaluation solide des capacités du dialecte émirati dans les grammaires linguistiques arabes (LLMs)

"L'étude d'Alyah examine la capacité des grands modèles de langage arabes (LLMs) à comprendre et générer le dialecte émirati, mettant en évidence la nécessité d'une évaluation robuste pour améliorer la précision dans la reconnaissance de variétés dialectales arabes." Clés: - Alyah étudie les LLMs arabes (grands modèles de langage). - Focus sur la compréhension et la génération du dialecte émirati. - Importance de l'évaluation robuste pour améliorer la précision.

UEL'étude d'Alyah souligne l'importance d'une évaluation rigoureuse des capacités des grands modèles de langage arabes pour le dialecte émirati, posant des défis pour des entreprises comme Microsoft et Google, qui développent des LLMs, et potentiellement influençant les futures directives de conformité du RGPD pour garantir une reconnaissance précise des variétés dialectales arabes dans l'Union Européenne.

LLMsPaper
1 source
Critiques de règles : Une approche conversationnelle pour l'apprentissage des langues par Praktika
554OpenAI Blog 

Critiques de règles : Une approche conversationnelle pour l'apprentissage des langues par Praktika

Praktika emploie GPT-4.1 et GPT-5.2 pour créer des tuteurs d'IA adaptatifs qui personnalisent les leçons, suivent les progrès et aident les apprenants à acquérir une fluidité linguistique réelle dans des situations du monde réel.

UEPraktika, exploitant GPT-4.1 et GPT-5.2, propose des tuteurs d'IA adaptatifs pour l'apprentissage des langues, susceptibles d'impact direct sur le secteur de l'éducation en France et dans l'UE, en personnalisant les leçons et en aidant les apprenants à acquérir une maîtrise linguistique réelle, en respectant potentiellement le RGPD sur les données personnelles.

LLMsOutil
1 source
Nos méthodes de prédiction de l'âge
555OpenAI Blog 

Nos méthodes de prédiction de l'âge

ChatGPT développe une prédiction d'âge pour estimer si les comptes appartiennent à des mineurs ou des majeurs, en mettant en place des mesures de protection pour les adolescents et en améliorant la précision au fil du temps.

UECette fonctionnalité de prédiction d'âge répond directement aux exigences du Règlement sur les Services Numériques (DSA) et du RGPD européens, qui imposent aux plateformes des protections renforcées pour les mineurs sous peine de lourdes amendes.

LLMsOutil
1 source
Présentation de ChatGPT Go, désormais disponible dans le monde entier
556OpenAI Blog 

Présentation de ChatGPT Go, désormais disponible dans le monde entier

ChatGPT Go est désormais disponible à l'échelle mondiale, offrant un accès élargi à GPT-5.2 Instant, des limites d'utilisation accrues et une mémoire étendue. Cette mise à disposition rend l'intelligence artificielle avancée plus abordable à l'échelle mondiale.

LLMsOutil
1 source
Comment Tolan développe une IA de premier-plan avec GPT-5.1
557OpenAI Blog 

Comment Tolan développe une IA de premier-plan avec GPT-5.1

Tolan a développé un assistant vocal basé sur l'IA en utilisant GPT-5.1, intégrant des réponses à faible latence, une reconstruction en temps réel du contexte et des personnalités guidées par la mémoire pour des conversations naturelles.

LLMsActu
1 source
Continuer à renforcer ChatGPT Atlas contre les injections de prompts
558OpenAI Blog 

Continuer à renforcer ChatGPT Atlas contre les injections de prompts

OpenAI renforce continuellement ChatGPT Atlas contre les attaques d’injection de prompts en utilisant une équipe rouge automatisée entraînée par l’apprentissage par renforcement. Cette approche proactive permet d’identifier tôt de nouveaux exploits et de renforcer les défenses de l’agent de navigateur, notamment à mesure que l’IA devient plus autonome.

LLMsActu
1 source
Présentation de GPT-5.2-Codex
559OpenAI Blog 

Présentation de GPT-5.2-Codex

GPT-5.2-Codex, le modèle de codage le plus avancé d'OpenAI, intègre un raisonnement à long terme, des transformations de code à grande échelle et des capacités de cybersécurité renforcées. Il marque une avancée significative dans le domaine de l'intelligence artificielle appliquée au développement logiciel.

LLMsOutil
1 source
Présentation de GPT-5.2-Codex
560OpenAI Blog 

Présentation de GPT-5.2-Codex

OpenAI a présenté GPT-5.2-Codex, son modèle de codage le plus avancé, capable de raisonnement à long terme, de transformations de code à grande échelle et de capacités renforcées en cybersécurité.

LLMsOutil
1 source
ChatGPT Images est arrivé
561OpenAI Blog 

ChatGPT Images est arrivé

La nouvelle fonctionnalité d'images de ChatGPT, alimentée par le modèle principal de génération d'images, permet des éditions plus précises, des détails cohérents et une génération d'images jusqu'à 4 fois plus rapide. Elle est désormais disponible pour tous les utilisateurs de ChatGPT et accessible via l'API sous le nom GPT-Image-1.5.

LLMsOutil
1 source
Progresser dans les sciences et les mathématiques avec GPT-5.2
562OpenAI Blog 

Progresser dans les sciences et les mathématiques avec GPT-5.2

GPT-5.2, le modèle le plus performant d'OpenAI pour les mathématiques et les sciences, établit de nouveaux records sur des benchmarks comme GPQA Diamond et FrontierMath. Il a permis de résoudre un problème théorique ouvert et de générer des preuves mathématiques fiables, illustrant des avancées concrètes dans la recherche.

LLMsPaper
1 source
Présentation de GPT-5.2
563OpenAI Blog 

Présentation de GPT-5.2

GPT-5.2, le modèle le plus avancé d'OpenAI, offre des capacités d'analyse, de compréhension de contextes longs, de codage et de vision d'OpenAI. Il est intégré à ChatGPT et à l'API OpenAI pour optimiser les workflows agents, assurant rapidité et fiabilité.

LLMsOutil
1 source
Nous avons fait appel à Claude pour affiner un LLM open source
564HuggingFace Blog 

Nous avons fait appel à Claude pour affiner un LLM open source

Titre: Nous avons fait appel à Claude pour affiner un grand langage modélisé à source ouverte Résumé: Claude, un système avancé de traitement du langage développé par Anthropic, a été utilisé pour améliorer un modèle de langage open source. Ce processus d'affinage a permis d'augmenter les performances du modèle, notamment dans la compréhension et la génération de texte.

UEClaude d'Anthropic utilisé pour affiner un LLM open source, améliorant potentiellement les capacités des entreprises françaises et européennes en traitement du langage naturel, tout en respectant les exigences du RGPD et de l'AI Act.

LLMsOutil
1 source
Comment les aveux peuvent garder les modèles de langage honnêtes
565OpenAI Blog 

Comment les aveux peuvent garder les modèles de langage honnêtes

OpenAI teste une méthode appelée « confessions », visant à entraîner les modèles à reconnaître leurs erreurs ou comportements inappropriés, afin d'améliorer l'honnêteté, la transparence et la confiance dans les sorties des modèles d'IA. Cette approche permettrait aux systèmes de langage de mieux gérer les limites de leurs connaissances et de réduire les risques d'erreurs.

LLMsOpinion
1 source
Transformers v5: Définitions simples des modèles alimentant l'écosystème de l'IA
566HuggingFace Blog 

Transformers v5: Définitions simples des modèles alimentant l'écosystème de l'IA

Transformers v5 offre des définitions accessibles des modèles fondamentaux qui alimentent l'écosystème de l'intelligence artificielle (IA), facilitant ainsi la compréhension de ces concepts complexes pour les non-initiés et les professionnels souhaitant une révision rapide.

LLMsOutil
1 source
Découvrez AnyLanguageModel : une seule API pour les LLMs locaux et distants sur les plateformes Apple
567HuggingFace Blog 

Découvrez AnyLanguageModel : une seule API pour les LLMs locaux et distants sur les plateformes Apple

L'article présente AnyLanguageModel, une API unifiée permettant l'accès aux grandeurs linguistiques locales et distantes sur les plateformes Apple. Il offre une solution flexible pour les développeurs afin d'intégrer facilement des modèles de langage avancés, tels que GPT-3, dans leurs applications, simplifiant ainsi l'utilisation de ressources de traitement du langage naturel. L'outil supporte à la fois les modèles locaux stockés sur le dispositif et ceux hébergés à distance, optimisant ainsi les performances et les coûts selon les besoins du projet.

UEAnyLanguageModel, présentée dans cet article, offre une API unifiée pour accéder aux grands modèles linguistiques (LLMs) locaux et distants sur Apple, facilitant l'intégration de modèles avancés comme GPT-3 pour les développeurs français et européens, potentiellement améliorant les applications de traitement du langage naturel tout en optimisant les performances et les coûts, en conformité avec le RGPD pour les données gérées localement.

LLMsOutil
1 source
Construire encore plus avec GPT-5.1-Codex-Max" se traduit en français par "Construire encore plus avec GPT-5.1-Codex-Max".
568OpenAI Blog 

Construire encore plus avec GPT-5.1-Codex-Max" se traduit en français par "Construire encore plus avec GPT-5.1-Codex-Max".

Présentation du modèle de codage GPT-5.1-Codex-Max, plus rapide et intelligent, conçu pour Codex. Ce modèle est optimisé pour des projets à long terme, avec un raisonnement amélioré et une gestion plus efficace des tokens.

LLMsOutil
1 source
Fiche Système GPT-5.1-Codex-Max
569OpenAI Blog 

Fiche Système GPT-5.1-Codex-Max

Le système GPT-5.1-CodexMax intègre des mesures de sécurité à deux niveaux : des formations spécialisées pour atténuer les tâches nuisibles et les injections de prompts au niveau du modèle, ainsi que des protections comme le sandboxing des agents et l'accès réseau configurable au niveau du produit.

LLMsActu
1 source
GPT-5.1: Une version améliorée et conversatielle de ChatGPT
570OpenAI Blog 

GPT-5.1: Une version améliorée et conversatielle de ChatGPT

OpenAI lance aujourd'hui GPT-5.1, une mise à jour du modèle GPT-5 offrant des fonctionnalités plus réactives et personnalisables. Cette version améliore la capacité du modèle à comprendre les contextes et permet aux utilisateurs payants de personnaliser le ton et le style de ChatGPT. Disponible dès maintenant pour les abonnés, GPT-5.1 marque une avancée significative dans l'interaction conversationnelle des systèmes d'IA.

LLMsActu
1 source
Règles critiques et rapport technique: Sécurité des GPT-OSS
571OpenAI Blog 

Règles critiques et rapport technique: Sécurité des GPT-OSS

Le modèle gpt-oss-safeguard-120b et gpt-oss-safeguard-20b, dérivés des modèles gpt-oss, ont été post-entraînés pour raisonner selon une politique donnée afin d'étiqueter du contenu en conséquence. Ce rapport présente leurs capacités et évalue leur sécurité par rapport aux modèles gpt-oss initiaux, servant de référence. Pour plus de détails sur l'architecture des modèles gpt-oss, consulter la fiche technique originale.

LLMsPaper
1 source
Définir et évaluer les biais politiques dans les LLM
572OpenAI Blog 

Définir et évaluer les biais politiques dans les LLM

OpenAI évalue le biais politique dans ChatGPT via des méthodes de test en contexte réel, visant à améliorer l'objectivité et réduire les préjugés. Ces approches permettent de mieux identifier et atténuer les influences idéologiques dans les réponses générées par les modèles de langage.

LLMsPaper
1 source
Le Codex est désormais disponible généralement
573OpenAI Blog 

Le Codex est désormais disponible généralement

OpenAI Codex est désormais disponible en version générale, avec de nouvelles fonctionnalités pour les développeurs : une intégration avec Slack, un SDK Codex et des outils d'administration comme les tableaux de bord d'utilisation et la gestion des espaces de travail. Ces améliorations facilitent son utilisation et sa gestion à grande échelle.

LLMsOutil
1 source
L'avenir est déjà là et il est agentique
574ActuIA 

L'avenir est déjà là et il est agentique

L'avenir est déjà présent et actif, guidé par des agents intelligents.

LLMsActu
1 source
Qwen-3 Omni : Alibaba accélère dans la course à l’IA multimodale
575ActuIA 

Qwen-3 Omni : Alibaba accélère dans la course à l’IA multimodale

Alibaba a lancé Qwen-3 Omni, un modèle d'IA multimodale capable de traiter du texte, des images, du son et de la vidéo, marquant une avancée dans la course technologique. Ce modèle, doté de capacités améliorées pour la compréhension contextuelle et la génération de contenu, s'appuie sur des données de formation massives et des algorithmes innovants. Il renforce la position d'Alibaba dans le domaine de l'intelligence artificielle avancée.

LLMsActu
1 source
Transformer l'industrie manufacturière avec ChatGPT
576OpenAI Blog 

Transformer l'industrie manufacturière avec ChatGPT

ENEOS Materials a transformé ses opérations en déployant ChatGPT Enterprise, améliorant la recherche, la conception des usines et les processus RH. Plus de 80 % des employés ont constaté des améliorations significatives des processus de travail, renforçant la compétitivité de l'entreprise dans l'industrie manufacturière.

LLMsActu
1 source
SyGra : Le cadre unique pour construire des données pour les modèles LLM et SLM
577HuggingFace Blog 

SyGra : Le cadre unique pour construire des données pour les modèles LLM et SLM

SyGra est un cadre unique pour la construction de données destinées aux grands modèles de langage (LLMs) et aux modèles de langage à transfert (SLMs). Il offre une solution complète pour générer et manipuler des ensembles de données, simplifiant ainsi le processus de préparation des données pour les modèles d'IA. Ce cadre permet aux utilisateurs de créer, d'augmenter et de nettoyer des données textuelles, tout en optimisant les performances des modèles d'apprentissage profond. SyGra est particulièrement utile pour les chercheurs et les développeurs travaillant sur des applications nécessitant des grandes quantités de données textuelles.

UESyGra facilite l'accès des entreprises françaises et européennes à la construction de données pour les modèles LLM et SLM, améliorant potentiellement leurs capacités d'IA tout en respectant les exigences de l'AI Act et du RGPD.

LLMsOutil
1 source
Codex passe à la vitesse supérieure avec GPT‑5-Codex
578ActuIA 

Codex passe à la vitesse supérieure avec GPT‑5-Codex

Codex a été mis à jour avec GPT-5-Codex, développé par OpenAI, offrant une vitesse et une performance accrues. Ce modèle améliore la génération de code et la résolution de problèmes complexes, marquant une avancée majeure dans l'intelligence artificielle appliquée au développement logiciel.

LLMsActu
1 source
Présentation des mises à jour de Codex
579OpenAI Blog 

Présentation des mises à jour de Codex

Codex a été amélioré pour devenir plus rapide, fiable et efficace dans la collaboration en temps réel ainsi que dans l'exécution autonome de tâches, fonctionnant désormais sur divers environnements comme le terminal, les IDE, le web et les téléphones.

LLMsOutil
1 source
Affinement personnalisé de n'importe quel grand modèle linguistique de la Hub Hugging Face avec Together AI
580HuggingFace Blog 

Affinement personnalisé de n'importe quel grand modèle linguistique de la Hub Hugging Face avec Together AI

Titre: Ajustez n'importe quel modèle LLM du Hugging Face Hub avec Together AI Résumé: Together AI introduit une plateforme pour affiner des modèles de langage granulaire (LLM) directement à partir du Hugging Face Hub, permettant aux utilisateurs de personnaliser les modèles existants sans avoir à les ré-entraîner à partir de zéro. Cette fonctionnalité simplifie le processus d'adaptation des modèles pour des tâches spécifiques, rendant les LLM plus accessibles et efficaces pour diverses applications.

UETogether AI permet aux entreprises françaises et européennes de personnaliser gratuitement des modèles linguistiques de pointe via le Hugging Face Hub, facilitant l'application de l'IA dans divers secteurs en respectant les exigences du RGPD.

LLMsOutil
1 source
L'écriture créative avec GPT-5
581OpenAI Blog 

L'écriture créative avec GPT-5

L'article explore les capacités de l'IA GPT-5 pour soutenir l'écriture créative, présentant les fonctionnalités et les avantages qu'elle offre aux écrivains.

LLMsOutil
1 source
Présentation de GPT-5
582OpenAI Blog 

Présentation de GPT-5

Présentation de GPT-5, le système d'IA le plus avancé de l'entreprise, avec des performances de pointe dans le codage, les mathématiques, l'écriture, la santé, la perception visuelle, et autres domaines.

LLMsActu
1 source
Ce que nous cherchons à optimiser dans ChatGPT
583OpenAI Blog 

Ce que nous cherchons à optimiser dans ChatGPT

OpenAI améliore ChatGPT pour mieux soutenir les utilisateurs dans les moments difficiles, avec de nouvelles fonctionnalités comme des rappels pour faire des pauses. La plateforme travaille également sur des conseils de vie plus pertinents, le tout développé avec l'aide d'experts.

LLMsOpinion
1 source
📚 3LM : un banc d'essai pour les grands modèles de langage arabes dans les STEM et le code
584HuggingFace Blog 

📚 3LM : un banc d'essai pour les grands modèles de langage arabes dans les STEM et le code

📚 Benchmark 3LM pour les grands modèles de traitement du langage arabe (LLMs) dans les STEM et le code. Évalue les performances des LLMs arabes dans des domaines scientifiques et techniques, ainsi que dans la compréhension et la génération de code. Fournit des ensembles de données et des métriques pour évaluer ces compétences.

UE3LM banc d'essai pour les grands modèles de langage arabes, impacte les entreprises françaises/européennes de STEM et de codage en améliorant la précision et la pertinence des outils de traitement du langage arabe, favorisant l'innovation et la compétitivité dans ces secteurs.

LLMsOutil
1 source
Lorsque plusieurs GPT s'associent pour travailler ensemble : Règles critiques de traduction française
585HuggingFace Blog 

Lorsque plusieurs GPT s'associent pour travailler ensemble : Règles critiques de traduction française

Consilium est une nouvelle approche qui permet à plusieurs grands modèles linguistiques (LLMs) de collaborer pour améliorer la précision et la pertinence des réponses générées. Cette méthode vise à surmonter les limitations individuelles des LLMs en combinant leurs forces pour produire des résultats plus complets et nuancés.

LLMsPaper
1 source
Améliorez vos LLMs avec les serveurs MCP Gradio
586HuggingFace Blog 

Améliorez vos LLMs avec les serveurs MCP Gradio

Cet article propose des méthodes pour améliorer les compétences des modèles de langage grand (LLMs) grâce aux serveurs Gradio MCP. Il explique comment utiliser ces outils pour affiner et évaluer efficacement les LLMs.

LLMsTuto
1 source
SmolLM3 : compact, multilingue et performant sur les longs contextes
587HuggingFace Blog 

SmolLM3 : compact, multilingue et performant sur les longs contextes

SmolLM3 est un modèle multilingue capable de raisonnement sur de longues contexts, présenté dans cet article. Il s'agit d'un système "smol" (petit) conçu pour traiter plusieurs langues simultanément.

UESmolLM3, développé par HuggingFace (entreprise française), renforce la souveraineté européenne en IA avec un modèle multilingue compact et open-source accessible aux développeurs et entreprises de l'UE.

LLMsPaper
1 source
Règles critiquées : une nouvelle génération de VLM pour automatiser les interfaces graphiques, alimentant l'agent Surfer-H
588HuggingFace Blog 

Règles critiquées : une nouvelle génération de VLM pour automatiser les interfaces graphiques, alimentant l'agent Surfer-H

Holo1 est une nouvelle famille de VLM (Virtual Machine for GUI Automation) conçue pour automatiser les interfaces graphiques, soutenant l'agent Surfer-H.

UELa startup française H Company renforce sa position dans l'automatisation d'interfaces graphiques avec Holo1, consolidant l'écosystème européen de l'IA agentique face aux acteurs américains.

LLMsOutil
1 source
SmolVLA : Modèle efficace Vision-Langue-Action formé sur les données de la communauté Lerobot
589HuggingFace Blog 

SmolVLA : Modèle efficace Vision-Langue-Action formé sur les données de la communauté Lerobot

SmolVLA est un modèle efficace Vision-Langue-Action (VLA) développé à l'aide des données recueillies par la communauté Lerobot. Ce modèle innovant combine la vision par ordinateur et le traitement du langage naturel pour interpréter et générer des descriptions décrivant des actions dans des vidéos.

UEHuggingFace, entreprise française, contribue à la démocratisation de la robotique ouverte en Europe avec SmolVLA, un modèle Vision-Langue-Action entraîné sur les données communautaires de son projet LeRobot.

LLMsPaper
1 source
Remplissage préalable et décodage pour les demandes simultanées - Optimisation des performances LLM
590HuggingFace Blog 

Remplissage préalable et décodage pour les demandes simultanées - Optimisation des performances LLM

Title: Pré-remplissage et décodage pour les demandes simultanées - Optimisation des performances LLM Résumé: Cet article aborde l'optimisation des performances des modèles de langage (LLM) grâce à des techniques de pré-remplissage et de décodage pour les demandes simultanées, augmentant ainsi l'efficacité et réduisant les temps de réponse.

UEL'optimisation des modèles de langage (LLM) par pré-remplissage et décodage pour les demandes simultanées améliore les performances des entreprises européennes, notamment celles en France, en réduisant les temps de réponse et en augmentant l'efficacité, en conformité potentielle avec le RGPD pour la gestion des données utilisateur, dans des secteurs tels que la technologie et le service client.

LLMsOutil
1 source
4 modèles Millionièmes examinés : Protéger l'IA avec Hugging Face, six mois plus tard
591HuggingFace Blog 

4 modèles Millionièmes examinés : Protéger l'IA avec Hugging Face, six mois plus tard

Protect AI, en collaboration avec Hugging Face, a scanné 4 millions de modèles en 6 mois, renforçant la sécurité des modèles d'IA contre les attaques malveillantes.

UELa sécurisation de 4 millions de modèles sur Hugging Face, plateforme co-fondée par des Français, renforce la fiabilité de l'écosystème IA pour les développeurs et entreprises européens qui l'utilisent massivement.

LLMsActu
1 source
Llama 4 Maverick et Scout arrivent sur Hugging Face
592HuggingFace Blog 

Llama 4 Maverick et Scout arrivent sur Hugging Face

Titre: Bienvenue à Llama 4 Maverick & Scout sur Hugging Face Résumé: Hugging Face présente Llama 4 Maverick et Scout, deux nouvelles versions de modèles de langage de pointe, offrant des capacités avancées en compréhension et génération de texte, avec une meilleure performance sur divers benchmarks.

UEAucun impact direct — cet article se concentre sur la présentation de deux nouveaux modèles de langage, Llama 4 Maverick et Scout, par Hugging Face, sans spécifier de conséquences spécifiques pour des entreprises françaises ou européennes, des lois telles que l'AI Act ou le RGPD, des secteurs particuliers ou des opportunités/menaces concrètes.

LLMsOutil
1 source
Les règles critiquées : le Master en Intelligence Artificielle remplace le LLM en Droit
593HuggingFace Blog 

Les règles critiquées : le Master en Intelligence Artificielle remplace le LLM en Droit

L'université introduit un cours de master en droit (LLM) axé sur le traitement automatique du langage (NLP), fusionnant ainsi les expertises en droit et en intelligence artificielle.

LLMsActu
1 source
Réponse : "Interrogations performantes pour les files d'attente : optimisation des systèmes de Machine Learning à grande échelle
594HuggingFace Blog 

Réponse : "Interrogations performantes pour les files d'attente : optimisation des systèmes de Machine Learning à grande échelle

L'article discute des méthodes d'amélioration des performances des modèles de langage (LLM) grâce à une gestion efficace des demandes en file d'attente. Il explore diverses techniques pour optimiser l'efficacité du traitement des requêtes et améliorer les résultats globaux des systèmes de langage.

LLMsTuto
1 source
🚀 Accélération de l'inférence LLM avec TGI sur Intel Gaudi
595HuggingFace Blog 

🚀 Accélération de l'inférence LLM avec TGI sur Intel Gaudi

🚀 L'article présente une méthode nommée TGI (Token Grouping Inference) pour accélérer l'inférence des modèles de langage grand (LLM) sur les processeurs Intel Gaudi. TGI réorganise les tokens du texte pour optimiser l'utilisation des ressources parallèles, augmentant ainsi les performances de 1.7 à 2.2 fois par rapport aux méthodes traditionnelles. Les expérimentations ont montré une amélioration significative dans l'inférence de grande échelle des LLMs.

UETGI accélère l'inférence des grands modèles de langage sur les processeurs Intel Gaudi, bénéficiant potentiellement aux entreprises européennes comme Hugging Face, utilisant ce type de matériel, en optimisant leur efficacité et leurs performances.

LLMsOutil
1 source
Bienvenue à Gemma 3 : le nouveau grand langage modèle multimodal, multilingue et contextuel à longue portée de Google
596HuggingFace Blog 

Bienvenue à Gemma 3 : le nouveau grand langage modèle multimodal, multilingue et contextuel à longue portée de Google

Bienvenue à Gemma 3, le nouveau modèle multimodal, multilingue et à grande capacité de contexte développé par Google, qui représente une avancée significative dans le domaine des grands langages ouverts (LLM). Faits clés: - Gemma 3 est un modèle multimodal qui peut traiter et générer à la fois du texte et des données visuelles. - Il est multilingue, ce qui signifie qu'il peut comprendre et produire du contenu dans plusieurs langues. - Le modèle est conçu pour gérer des contextes longs, permettant une meilleure compréhension et génération de texte en tenant compte de l'ensemble du discours plutôt que de fragments isolés. - Google annonce que Gemma 3 offre des améliorations notables par rapport aux modèles précédents en termes de précision, de cohérence et de capacité à gérer des tâches complexes. Chiffres: - Bien que des détails spécifiques sur les performances ne soient pas fournis dans l'article, on mentionne que Gemma 3 surpasse les modèles existants dans divers benchmarks. Noms importants: - Google - le développeur du modèle Gemma 3.

UEGoogle présente Gemma 3, un modèle multimodal, multilingue et contextuel à longue portée, offrant des avancées significatives pour les entreprises françaises et européennes en améliorant la précision et la cohérence dans des tâches complexes, tout en respectant les exigences du RGPD et potentiellement aidant à naviguer dans le cadre de l'AI Act.

LLMsOutil
1 source
Inférence de LLM sur l'appareil : Une guide amusant et simple pour exécuter des LLMs via React Native sur votre téléphone!
597HuggingFace Blog 

Inférence de LLM sur l'appareil : Une guide amusant et simple pour exécuter des LLMs via React Native sur votre téléphone!

Cette guide propose une méthode ludique pour exécuter des modèles de langage (LLM) directement sur votre smartphone en utilisant React Native. Elle offre une explication claire et accessible pour mettre en œuvre cette technologie.

LLMsTuto
1 source
Présentation de GPT-4.5
598OpenAI Blog 

Présentation de GPT-4.5

L'article présente GPT-4.5, un modèle de chat plus avancé et plus puissant, résultat d'une amélioration dans l'échelle de pré-entraînement et de post-entraînement.

LLMsActu
1 source
Corrigner le classement Open des grands modèles linguistiques avec Math-Verify
599HuggingFace Blog 

Corrigner le classement Open des grands modèles linguistiques avec Math-Verify

Titre: Corriger le classement Open LLM avec Math-Verify Résumé: Un nouveau système appelé Math-Verify a été développé pour améliorer l'exactitude des classements des grands modèles linguistiques (LLM) sur Open LLM Leaderboard, corrigeant ainsi les erreurs et les incohérences précédentes.

UEMath-Verify améliore l'exactitude des classements des grands modèles linguistiques sur le leaderboard Open LLM, bénéficiant potentiellement aux entreprises européennes telles qu'Hugging Face et Snips, en assurant des évaluations de modèles plus fiables, en conformité avec le RGPD et l'AI Act.

LLMsOutil
1 source
Classement mondial du tournoi Open LLM : 2e place en arabe
600HuggingFace Blog 

Classement mondial du tournoi Open LLM : 2e place en arabe

Le classement Open Arabic LLM est une évaluation comparative des modèles de langage arabe. Il met en avant OpenLLM, un modèle développé par DPRK, qui domine avec une précision de 88,1%. Le modèle de Hugging Face, arabic-bert, se place deuxième avec 85,2%. OpenLLM démontre une amélioration significative par rapport à son prédécesseur, OpenLLM v1, qui avait obtenu 78,9% de précision. Ce classement met en lumière les avancées dans les modèles de traitement du langage arabe, avec DPRK en tête grâce à OpenLLM.

UEAucun impact direct — Cet article se concentre sur un classement mondial de modèles de langage arabe, n'abordant pas spécifiquement les entreprises françaises ou européennes, les lois (comme l'AI Act ou le RGPD) ou les secteurs concernés par la France ou l'Union Européenne.

LLMsOutil
1 source