Après DeepSeek, Alibaba publie son nouveau modèle d'intelligence artificielle : Qwen 2.5 va-t-il concurrencer R1 ?
L'entreprise technologique chinoise Alibaba a publié aujourd'hui (29 janvier) une nouvelle version de son modèle d'intelligence artificielle Qwen 2.5, affirmant qu'il surpasse DeepSeek V3.
12punto
12punto INFORMATIONS INTERNATIONALES
Qwen 2.5-Max a été lancé après le début des congés officiels dans tout le pays à l'occasion du Nouvel An chinois. Cette situation a alimenté les commentaires selon lesquels DeepSeek aurait provoqué une « panique » non seulement aux États-Unis, mais aussi parmi les entreprises technologiques opérant en Chine.
Dans une annonce publiée sur son compte WeChat officiel, Alibaba a fait référence aux modèles d'intelligence artificielle open source les plus avancés d'OpenAI et de Meta, déclarant ce qui suit :
« Qwen 2.5-Max affiche des performances supérieures à la quasi-totalité des modèles GPT-4o, DeepSeek-V3 et Llama-3.1-405B. »
Le lancement de l'assistant d'intelligence artificielle V3 de DeepSeek le 10 janvier, suivi du modèle R1 le 20 janvier, a entraîné une baisse des actions technologiques des entreprises opérant dans la Silicon Valley aux États-Unis.
Les faibles coûts de développement et d'utilisation de l'entreprise chinoise ont conduit les investisseurs à s'interroger sur les plans d'investissement à gros budget des principales entreprises d'intelligence artificielle américaines.
Selon les informations de Reuters, le succès de DeepSeek a également poussé ses concurrents nationaux à se lancer dans la course au développement de leurs propres modèles d'intelligence artificielle.
Deux jours après la publication de DeepSeek-R1, ByteDance, propriétaire de TikTok, a publié une mise à jour de son propre modèle d'intelligence artificielle. L'entreprise chinoise a affirmé que son modèle surpassait le modèle o1 d'OpenAI, soutenu par Microsoft, lors du test AIME, une évaluation mesurant la capacité des modèles d'IA à comprendre et à répondre à des instructions complexes.
GUERRES DE L'INTELLIGENCE ARTIFICIELLE EN CHINE
Le modèle V2, lancé par DeepSeek en mai dernier, a déclenché une guerre des prix entre les modèles d'intelligence artificielle en Chine.
Le fait que DeepSeek V2 soit open source et d'un coût sans précédent (1 yuan, soit 0,14 dollar) a conduit Alibaba à appliquer des réductions allant jusqu'à 97 % sur ses modèles d'intelligence artificielle.
D'autres entreprises technologiques chinoises ont également rejoint la bataille des prix. La célèbre marque technologique Baidu et Tencent, qui a développé le premier modèle d'IA équivalent à ChatGPT en Chine, ont réduit leurs tarifs.
Dans une interview accordée en juillet 2024 au média chinois Waves, le fondateur de DeepSeek, Liang Wenfeng, avait déclaré à l'époque qu'ils ne se « souciaient pas » des guerres des prix et que leur objectif principal était de construire une AGI (intelligence artificielle générale).
LA DIFFÉRENCE DE DEEPSEEK RÉSIDE-T-ELLE DANS SA STRUCTURE D'ENTREPRISE ?
Alors que les grandes entreprises technologiques chinoises comme Alibaba comptent des centaines de milliers d'employés, DeepSeek mène ses activités avec une équipe composée principalement de jeunes diplômés et de doctorants issus des plus grandes universités chinoises.
Dans son interview de juillet, Liang avait indiqué qu'il pensait que les grandes entreprises technologiques chinoises pourraient ne pas avoir une structure adaptée à l'avenir du secteur de l'intelligence artificielle.
Comparant les coûts élevés et les structures hiérarchiques de ces entreprises au fonctionnement simplifié et au style de gestion flexible de DeepSeek, Wenfeng avait noté ce qui suit :
« Les grands modèles fondamentaux (pionniers) nécessitent une innovation constante, les capacités des géants de la technologie sont limitées. »