Moonshot AI

Cet article est orphelin. Moins de trois articles lui sont liés (février 2026).

Moonshot AI
Moonshot AI
Histoire
Fondation
Cadre
Type
Siège
Pays
Organisation
Fondateur
Yang Zhilin (en)Voir et modifier les données sur Wikidata
Site web
(zh-Hans) www.moonshot.aiVoir et modifier les données sur Wikidata

Moonshot AI est une entreprise chinoise d'intelligence artificielle fondée en 2023 à Pékin, et considérée comme l'un des « AI Tigers » du pays (avec DeepSeek et MiniMax)[1]. L'objectif déclaré du fondateur était de développer des modèles fondamentaux capables de mener à l'intelligence artificielle générale (IAG), reposant sur trois jalons : fenêtre contextuelle très longues ; modèle du monde multimodal et architecture générale auto‑améliorative sans intervention humaine[2].

Anthropic affirme, en , que Moonshot AI (ainsi que DeepSeek et MiniMax) ont mené une vaste attaque, via des milliers de comptes frauduleux, visant à extraire illégalement les capacités avancées de son intelligence artificielle Claude, au risque de produire de graves défauts d'alignement des intelligences artificielles ainsi construites.

Histoire

Créée par trois anciens étudiants qui se sont connus à l'université Tsinghua (Yang Zhilin, Zhou Xinyu et Wu Yuxin), elle tire son nom de l'album The Dark Side of the Moon, sorti 50 ans plus tôt et cher à Yang Zhilin[3],[4].

L'entreprise s'est fait connaître en (moment de la grande émergence de ChatGPT, en lançant son premier chatbot, Kimi, capable de traiter jusqu'à 200 000 caractères chinois. En , des rumeurs évoquent une entrée sur le marché américain avec des produits comme Ohai ou Noisee, ce que Moonshot dément[5]. En , elle publie Kimi K2.5, version multimodale dotée d'un encodeur visuel MoonViT de 400 millions de paramètres, permettant de traiter images et vidéos et d'exécuter des tâches agentiques complexes[6], trois mois seulement après la sortie de K2[7]. En , Anthropic accuse Moonshot d'avoir utilisé des milliers de comptes frauduleux pour générer des millions de conversations avec Claude afin d'entraîner ses propres modèles[8].

En , Anthropic dénonce une vaste campagne d'extraction illégale de données orchestrée par Moonshot AI avec DeepSeek et MiniMax. L'opération, de type attaque par distillation, a permis à l'entreprise via des milliers de comptes frauduleux de soumettre plusieurs millions de requêtes ciblées aux modèles de la famille Claude, de manière à capturer les capacités avancées de raisonnement et de programmation d'Anthropic, « en violation de nos conditions d’utilisation et des restrictions d’accès régionales ». Les preuves de ce détournement incluent l'analyse de métadonnées liant directement les requêtes à des chercheurs seniors de ces trois entreprises, et la détection de réseaux de proxys coordonnés.
Anthropic alerte la communauté internationale quant aux risques de sécurité nationale, expliquant que les modèles dérivés de cette distillation échappent aux protocoles de modération originaux, ce qui ouvrant la voie à des usages malveillants des modèles ainsi construits[9]. Cette affaire survient dans un contexte de tensions croissantes entre les laboratoires américains de la Silicon Valley et les acteurs de l'IA en Chine, ici pris en flagrant délit de contournement. Des contre-mesures sont prises par Anthropic, qui, en , appelle à une « réponse coordonnée entre l’industrie de l’IA, les fournisseurs cloud et les décideurs politiques »[10],[9].

Finances, investissements

Moonshot AI, valorisée à 300 millions de dollars lors d'un premier apport de 60 millions alors qu'elle employait 40 personnes[11],[4], a rapidement attiré les principaux investisseurs technologiques chinois. En , un tour de table d'un milliard de dollars mené par Alibaba Group porte sa valorisation à 2,5 milliards. En , Tencent et Gaorong Capital participent à une levée de 300 millions, faisant grimper la valorisation à 3,3 milliards[12]. En , l'entreprise serait sur le point de finaliser un nouveau financement d'environ 600 millions, conduit par IDG Capital avec le soutien d'investisseurs existants dont Tencent, pour une valorisation pré‑money estimée à 3,8 milliards[13],[14].

Produits, recherches

Moonshot AI développe la famille de modèles Kimi, lancée en comme principal concurrent d'Ernie Bot ; ce chatbot, initialement limité à 200 000 caractères, atteint en une capacité revendiquée de deux millions de caractères, mais subit alors une panne de deux jours due à l'afflux d'utilisateurs[15],[16].
Classé troisième en utilisateurs actifs en , Kimi recule à la septième place en [17]. En , Kimi K1.5 est publié, Moonshot affirmant qu'il égale OpenAI o1 en mathématiques, en code et en raisonnement multimodal[18]. En , Moonshot diffuse les poids ouverts de Kimi K2, un modèle MoE d'un billion de paramètres (32 milliards actifs), entraîné sur 15,5 billions de tokens et publié sous licence MIT modifiée[19],[20],[21]. K2, téléchargeable et modifiable connaît un pic de popularité immédiat et se distingue en programmation (LiveCodeBench), rivalisant parfois avec ses équivalents occidentaux[22]. Le , Kimi‑K2‑Instruct‑0905 améliore les performances en tâches agentiques et double la fenêtre de contexte à 256 000 tokens[23],[24]. En , Moonshot publie Kimi K2 Thinking, version ouverte orientée raisonnement avancé, dotée d'une architecture MoE d'un billion de paramètres (32 milliards actifs), d'un contexte de 256 000 tokens, capable de 200–300 appels d'outils séquentiels, et surpassant GPT‑5 et Claude Sonnet 4.5 sur plusieurs benchmarks (Humanity's Last Exam 44,9 %, BrowseComp 60,2 %, SWE‑Bench Verified 71,3 %[25],[26],[27]).

En Chine, Kimi est proposé en six formules tarifaires d(de 5,2 ¥ pour quatre jours à 399 ¥ pour un an)[28].

En juillet 2026, la version Kimi K3 est présentée et provoque de nombreuses réactions dans le secteur du fait de sa performance et son accessibilité[29].

Recherche et développement

Moonshot AI mène des travaux de recherche, notamment sur :

  • l'optimiseur Muon, démontré comme scalable pour l'entraînement de modèles MoE de 16 milliards de paramètres avec un gain d'efficacité d'un facteur 2 par rapport à AdamW[30],
  • les méthodes de renforcement utilisées pour Kimi K1.5, fondées sur l'extension du contexte et l'optimisation de politique sans recourir à des techniques complexes comme MCTS ou les modèles de récompense de processus[31].

Mooncake

La plateforme Mooncake, qui sert Kimi, traite 100 milliards de tokens par jour et a valu à Moonshot le prix Erik Riedel à l'USENIX FAST pour sa description architecturale[32].

Optimisation : montée en échelle de l'optimiseur Muon

Dans une étude conjointe Moonshot–UCLA, les chercheurs affirment avoir étendu l'optimiseur Muon, auparavant performant sur de petits modèles, à l'entraînement d'un modèle MoE de 16 milliards de paramètres, dont 3 milliards actifs. Ils rapportent un gain d'efficacité d'un facteur 2 par rapport à l'optimiseur standard AdamW, ce qui en ferait une solution notable pour réduire les coûts de calcul lors de l'entraînement de grands modèles[30]. L'équipe a publié en open source l'implémentation de Muon ainsi que les checkpoints pré‑entraînés et instruction‑tunés associés[2].

Apprentissage par renforcement : mise à l'échelle pour les LLM

Dans leur rapport technique consacré au modèle Kimi K1.5, les chercheurs de Moonshot décrivent des méthodes d'apprentissage par renforcement qui, selon eux, permettent d'atteindre des capacités de raisonnement de niveau état‑de‑l'art, comparables à celles du modèle OpenAI o1 ; Ils soulignent que ces performances reposent sur deux leviers : 1) l'extension du contexte, permettant au modèle de traiter des séquences beaucoup plus longues ; 2) l'amélioration de l'optimisation de politique, sans recourir à des techniques complexes telles que la recherche arborescente Monte‑Carlo, les fonctions de valeur ou les modèles de récompense de processus[31].

Notes et références

  1. (en) « Meet the 'Six Tigers' that dominate China's AI industry », sur Quartz, (consulté le ).
  2. a et b (zh-CN) 腾讯网, « 月之暗面杨植麟复盘大模型创业这一年:向延绵而未知的雪山前进_腾讯新闻 », sur news.qq.com,‎ (consulté le ).
  3. (en-US) Ingrid Lunden, Rita Liao, « China's Moonshot AI zooms to $2.5B valuation, raising $1B for an LLM focused on long context | TechCrunch », TechCrunch,‎ (lire en ligne [archive du ], consulté le ).
  4. a et b (en) « Moonshot AI founder builds business in the mould of ByteDance, OpenAI », South China Morning Post,‎ (lire en ligne [archive du ], consulté le ).
  5. « Kimi也要出海?月之暗面:目前没有开发和发布海外产品计划_10%公司_澎湃新闻-The Paper », sur thepaper.cn (consulté le ).
  6. (en) « moonshotai/Kimi-K2.5 · Hugging Face », sur huggingface.co, (consulté le ).
  7. (en) Evelyn Cheng, « One year after DeepSeek, Chinese AI firms from Alibaba to Moonshot race to release new models », sur CNBC, (consulté le ).
  8. (en-US) Cade Metz, « Anthropic Accuses 3 Chinese Companies of Harvesting Its Data », The New York Times,‎ (ISSN 0362-4331, lire en ligne, consulté le ).
  9. a et b (en) « Detecting and preventing distillation attacks », sur anthropic.com (consulté le ).
  10. « MSN », sur wmsn.com (consulté le ).
  11. (en) « Alibaba Leads Record Deal to Mint $2.5 Billion China AI Firm », Bloomberg.com,‎ (lire en ligne [archive du ], consulté le ).
  12. (en) « Tencent Joins $300 Million Financing for China's AI Unicorn », Bloomberg.com,‎ (lire en ligne [archive du ], consulté le ).
  13. (en) « Kimi Nears $600 Million Funding Round, IDG Reportedly to Join », Pandaily,‎ (lire en ligne [archive du ], consulté le ).
  14. (en-US) TechNode Feed, « China's Moonshot AI reportedly raising several hundred million dollars in new funding round · TechNode », sur TechNode, (consulté le ).
  15. Olcott, Eleanor (3 mai 2024). « Four start-ups lead China's race to match OpenAI's ChatGPT ». ft.com. consulté le 10 septembre 2024.
  16. Le, Kelly (20 mai 2024). « Moonshot AI's Kimi Chatbot offers paid service in bid to profit from mass users ». South China Morning Post. Archived from the original on 26 June 2024. Retrieved 10 September 2024.
  17. Mo, Liam; Goh, Brenda. « China's Moonshot AI releases open-source model to reclaim market position ». Reuters. https://www.reuters.com/business/media-telecom/chinas-moonshot-ai-releases-open-source-model-reclaim-market-position-2025-07-11/ Consulté le 13 novembre 2025.
  18. (en) « Chinese AI Firms Debut New LLMs to Rival OpenAI's Powerful O1 in Math and Coding », sur yicaiglobal.com (consulté le ).
  19. (en) Evelyn Cheng, « Alibaba-backed Moonshot releases new Kimi AI model that beats ChatGPT, Claude in coding — and it costs less », sur CNBC, (consulté le ).
  20. « Kimi K2: Open Agentic Intelligence », sur moonshotai.github.io (consulté le ).
  21. « Licence · moonshotai/Kimi-K2-Instruct at main », sur huggingface.co, (consulté le ).
  22. (en) Elizabeth Gibney, « ‘Another DeepSeek moment': Chinese AI model Kimi K2 stirs excitement », Nature, vol. 643, no 8073,‎ , p. 889–890 (ISSN 1476-4687, DOI 10.1038/d41586-025-02275-6, lire en ligne, consulté le ).
  23. « moonshotai/Kimi-K2-Instruct-0905 · Hugging Face », sur huggingface.co, (consulté le ).
  24. (en) « Moonshot AI's updated Kimi model offers expanded context window, improved coding », sur South China Morning Post, (consulté le ).
  25. (en) Evelyn Cheng, « Alibaba-backed Moonshot releases its second AI update in four months as China's AI race heats up », sur CNBC, (consulté le ).
  26. (en) « China's Moonshot AI launches new model lauded as No 1 among open-source systems », sur South China Morning Post, (consulté le ).
  27. (en-US) « Moonshot's open source Kimi K2 Thinking outperforms GPT-5, Claude Sonnet 4.5 », Venturebeat,‎ (lire en ligne [archive du ], consulté le ).
  28. (en) « Moonshot AI's Kimi Chatbot offers paid service in bid to profit from mass users », sur South China Morning Post, (consulté le ).
  29. Tech - Qu’est-ce que Kimi K3, le modèle chinois qui sème la panique dans le secteur de l’IA ?, Libération, Arthur Cerf, 23 juillet 2026
  30. a et b (en) Jingyuan Liu, Jianlin Su, Xingcheng Yao et Zhejun Jiang, Muon is Scalable for LLM Training, (DOI 10.48550/arXiv.2502.16982, lire en ligne).
  31. a et b (en) Kimi k1.5: Scaling Reinforcement Learning with LLMs (Kimi Team ), (DOI 10.48550/arXiv.2501.12599, lire en ligne).
  32. (en) Zhang Tong, « Chinese team wins award for AI booster that may help counter US chip ban », sur South China Morning Post, (consulté le ).

Voir aussi

Articles connexes

Liens externes

Content Disclaimer

Informasi ini disarikan dari Wikipedia dan disajikan kembali untuk tujuan edukasi. Konten tersedia di bawah lisensi CC BY-SA 3.0. Kami tidak bertanggung jawab atas ketidakakuratan data yang bersumber dari kontribusi publik tersebut.

  1. The information displayed on this website is sourced in part or in whole from Wikipedia and has been adapted for the purpose of restating it. We strive to provide accurate and relevant information, however:
  2. There is no guarantee of absolute accuracy. Wikipedia is an open, collaborative project that can be edited by anyone, so information is subject to change.
  3. It is not intended to constitute professional advice. The content displayed is for informational and educational purposes only. For important decisions (e.g., medical, legal, or financial), please consult a professional.
  4. Content copyright. Wikipedia is licensed under the Creative Commons Attribution-ShareAlike License (CC BY-SA). This means that content may be reused with appropriate attribution and shared under a similar license.
  5. Responsible use. Any risk arising from the use of information from this website is entirely the responsibility of the user.