TL;DR
- Kimi K3 officiellement publié et open-sourcé (17 juillet, veille du WAIC) : 2,8 billions (2 800 Mds) de paramètres, le plus gros modèle à poids ouverts au monde et le premier à approcher les 3 000 Mds. Confirmation du teaser du 15 juillet, avec cette fois des scores détaillés.
- Ouverture du WAIC 2026 (17 juillet, Shanghai) : le thème dominant est le « moho » (摸高) — les labos de tête assument à nouveau la course à la taille, avec un consensus émergent autour de la barre des 2 000 Mds de paramètres pour la génération suivante.
- MiniMax : le M3 (~428 Mds) n’a pas marqué les esprits ; le prochain modèle, nom de code M3 Pro, viserait plus de 2 000 Mds et resterait open source. Lancement du client desktop MiniMax Code 2.0.
- Valorisation DeepSeek dévoilée : plus de 320 Mds ¥ (au-delà de 50 Mds $) après son premier tour de financement externe — chiffre confirmé en marge du WAIC.
- Bascule « modèles → agents » : selon les synthèses de la première journée, le nombre de fournisseurs de modèles de fondation exposant est retombé à ~18, tandis que l’agentique, la robotique et le compute domestique occupent le devant de la scène.
Actualités du jour
Kimi K3 officiellement publié et open-sourcé — le plus gros modèle ouvert au monde
Acteur : 月之暗面 Moonshot AI (Kimi) Apport clé : modèle de fondation open source de 2,8 billions de paramètres (2 800 Mds), architecture MoE activant 16 experts sur 896, mécanisme d’attention linéaire hybride KDA (Kimi Delta Attention) + résidus d’attention, support natif de la vision, contexte de 1M tokens. L’efficacité de passage à l’échelle serait ~2,5× supérieure à la génération K2 grâce au framework Stable Latent MoE. Type de source : annonce officielle Moonshot + reprises presse (新浪财经/财中社, 网易, 知乎, 鉅亨網) Benchmark vérifié : non — scores AI Arena / auto-déclarés au lancement, pas encore d’évaluation tierce indépendante consolidée
Il s’agit de la concrétisation de la fuite et du teaser couverts dans le rapport du 16 juillet : le modèle est désormais réellement en ligne, avec des chiffres précis. Moonshot le positionne comme premier modèle ouvert à franchir presque la barre des 3 000 Mds. Selon les évaluations communiquées par le labo, le niveau d’intelligence global de K3 ne serait dépassé que par Claude Fable 5 et GPT-5.6 Sol ; sur l’arène de code AI Arena Code, K3 devancerait même Fable 5, GPT-5.6 Sol et GLM-5.2 (智谱). Autres scores mis en avant : 1 687 points (3ᵉ) sur GDPval-AA v2, 1 527 (2ᵉ) sur AA-Briefcase, 91,2 (1ᵉʳ) sur BrowseComp, et 1 679 (1ᵉʳ mondial) sur l’arène de code frontend Arena.AI. Le labo reconnaît toutefois rester derrière les meilleurs modèles fermés.
Les poids complets seront publiés à la communauté open source avant le 27 juillet. L’API est déjà en ligne (compatible SDK OpenAI) : 3 $/M tokens en entrée, 15 $/M en sortie, 0,3 $/M en cas de cache hit. L’investisseur Gavin Baker (Atreides Management) a qualifié K3 de possible « point de bascule » pour l’écosystème IA, susceptible d’empêcher deux ou trois labos de front de monopoliser les marges d’inférence.
新浪财经/财中社 — 月之暗面开源Kimi K3 — 新浪财经, 17 juillet 2026 知乎 — Kimi K3 发布:开源大模型第一次摸到闭源前沿的门槛 — 知乎, 17 juillet 2026 网易 — 月之暗面发布Kimi K3,2.8万亿参数全球最大开源模型 — 网易, 17 juillet 2026
WAIC 2026 : le retour du « moho », la course à la taille assumée
Acteur : écosystème LLM chinois (Moonshot, MiniMax, 科大讯飞 iFlytek, 阶跃星辰 StepFun, 商汤 SenseTime, Alibaba DAMO…) Apport clé : l’ouverture du WAIC 2026 (17–20 juillet, Shanghai) est marquée par un consensus renaissant sur le scaling. Après K3, plusieurs responsables présents estiment que la barre des 2 000 Mds de paramètres deviendra le standard de la prochaine génération de modèles phares. Type de source : reprise presse (第一财经 via 新浪科技, 甲子光年 via 凤凰网/网易) Benchmark vérifié : N/A — analyse de tendance
Selon 第一财经, un responsable d’iFlytek attribue ce « moho » (摸高, littéralement « toucher plus haut ») à la conjonction de trois forces : le consensus autour des lois d’échelle, le besoin d’automatisation par les agents, et la demande de tâches longues. 印奇 (Yin Qi, président de StepFun) juge que la capacité des modèles franchit en 2026 un seuil critique, passant de tâches de quelques secondes à un travail autonome de plusieurs dizaines d’heures. L’industrie se structurerait en deux familles : modèles à ~100 Mds pour le rapport coût/efficacité et l’usage courant, et modèles « moho » à plus de 1 000 Mds pour le raisonnement complexe et l’agentique de substitution au travail humain.
Le débat « langage au cœur » vs « multimodal comme socle » a animé la table ronde SenseTime : 邱锡鹏 (Fudan) défend le langage comme cœur du raisonnement, tandis que 张祥雨 (StepFun) et 赵德丽 (Alibaba DAMO) plaident pour une évolution vers des paradigmes d’apprentissage autonome et multimodal, condition d’un vrai saut vers l’AGI. Côté structure de salon, une synthèse de 甲子光年 note que le nombre de fournisseurs de modèles de fondation exposants est retombé à ~18 (contre la « guerre des cent modèles » de l’an dernier), l’agentique, la robotique et le compute domestique (~20 % des exposants) prenant le relais.
新浪科技/第一财经 — WAIC现场,国产大模型集体”摸高” — 第一财经, 18 juillet 2026 凤凰网/甲子光年 — WAIC 2026大洗牌:基础大模型只剩18家 — 甲子光年, 18 juillet 2026
MiniMax : M3 Pro (>2 000 Mds) en préparation, lancement de Code 2.0
Acteur : MiniMax / 稀宇科技 Apport clé : le M3 déjà publié (~428 Mds de paramètres totaux) est jugé « équilibré mais sans point saillant » et n’a pas suscité de fort écho. Selon des informations sectorielles, le prochain modèle, nom de code M3 Pro, dépasserait 2 000 Mds de paramètres, resterait open source et mettrait l’accent sur le raisonnement complexe et les tâches d’agent multi-étapes. En parallèle, MiniMax a présenté le client desktop MiniMax Code 2.0. Type de source : reprise presse (第一财经 via 新浪科技) + couverture WAIC Benchmark vérifié : non — M3 Pro non confirmé officiellement par MiniMax
Un responsable de MiniMax, sans confirmer le M3 Pro, reconnaît que « la tendance de toute l’industrie va vers l’échelle des 2 000 Mds, parce que cette voie a été validée par Anthropic ». C’est la trajectoire de la série Claude (Sonnet → Opus 4 → Fable 5) qui sert de référence : chaque bond de taille s’est accompagné d’une extension nette des capacités. Ce positionnement confirme le mouvement de fond du WAIC, MiniMax se plaçant clairement dans le camp du scaling ouvert.
新浪科技/第一财经 — WAIC现场,国产大模型集体”摸高” — 第一财经, 18 juillet 2026
En bref
-
Valorisation DeepSeek dévoilée : plus de 320 Mds ¥. En marge du WAIC, la presse financière chinoise chiffre la valorisation de 深度求索 DeepSeek à plus de 320 Mds ¥ (au-delà de 50 Mds $) après son premier tour de financement externe bouclé en juin, avec au moins deux sociétés cotées A détenant indirectement des parts. Cela prolonge le tableau des valorisations en forte hausse (智谱 et MiniMax cotés, Moonshot à ~31,5 Mds $ pré-money). (新浪财经, 17 juillet)
-
Financement Moonshot : estimation pré-money à ~31,5 Mds $. Détail issu de la couverture K3 : après le tour D de 2 Mds $ à 20 Mds $ post-money (mené par 美团龙珠, avec entrée de fonds « équipe nationale »), la nouvelle levée en cours valoriserait Moonshot à ~31,5 Mds $ pré-money — soit une croissance de plus de 700 % en six mois. Le revenu récurrent annuel (ARR) aurait dépassé 300 M$ mi-juin, l’API représentant plus de 70 % des revenus. (新浪财经/财中社, 17 juillet)
-
« Six tendances » du WAIC 2026. Synthèses concordantes (钛媒体, 新浪) : (1) les modèles ouverts recollent au front fermé (K3 comme « nouveau moment DeepSeek ») ; (2) concentration du capital — le financement mondial des startups IA au T1 2026 dépasserait le total 2025, les deux tiers venant de trois méga-tours ; (3) essor de l’IA incarnée (~43,8 Mds ¥ levés au S1) ; (4) le compute (supernœuds refroidis par liquide) passe sur le devant de la scène ; (5) bascule des modèles vers les agents et les terminaux (téléphones, lunettes, écouteurs) ; (6) industrialisation et gouvernance de l’IA. (钛媒体 / 新浪财经, 18 juillet)
-
磐石·科学基础大模型 2.0 (AI for Science). Présenté au WAIC, ce « modèle de fondation scientifique » 2.0 vise à outiller la recherche fondamentale (nouveau paradigme d’IA au service des sciences). Mise à jour d’une famille dédiée à l’AI4Science, distincte des LLM généralistes. (搜狐, 17 juillet)
Tableau récapitulatif
| Modèle / Actu | Labo | Apport clé | Licence / Score | Source (datée) |
|---|---|---|---|---|
| Kimi K3 (publié + open source) | 月之暗面 Moonshot | 2 800 Mds MoE (16/896 experts), KDA, 1M ctx, multimodal | Poids ouverts ≤ 27 juil. ; API 3/15 $ | 新浪财经, 17 juil. |
| Tendance « moho » (>2 000 Mds) | Écosystème WAIC | Retour assumé au scaling comme voie la plus rapide | N/A | 第一财经, 18 juil. |
| M3 Pro (préparation) + Code 2.0 | MiniMax | M3 Pro >2 000 Mds open source (non confirmé) ; desktop Code 2.0 | À venir | 第一财经, 18 juil. |
| Valorisation DeepSeek | 深度求索 DeepSeek | >320 Mds ¥ (>50 Mds $) après 1ᵉʳ tour externe | N/A | 新浪财经, 17 juil. |
| Base « 18 fournisseurs » | Analyse 甲子光年 | Rebond agentique/robotique/compute, moins de modèles de fondation | N/A | 凤凰网, 18 juil. |
Sources
- 新浪财经/财中社 — 月之暗面开源Kimi K3 — 新浪财经 — 17 juillet 2026
- 知乎 — Kimi K3 发布:开源大模型第一次摸到闭源前沿的门槛 — 知乎 — 17 juillet 2026
- 网易 — 月之暗面发布Kimi K3,2.8万亿参数全球最大开源模型 — 网易 — 17 juillet 2026
- 鉅亨網 — 全球最大開源模型Kimi K3發布 2.8兆參數 — 鉅亨網 — 17 juillet 2026
- 新浪科技/第一财经 — WAIC现场,国产大模型集体”摸高” — 第一财经 — 18 juillet 2026
- 凤凰网/甲子光年 — WAIC 2026大洗牌:基础大模型只剩18家 — 甲子光年 — 18 juillet 2026
- 新浪财经 — WAIC 2026今天开幕!超300款产品将全球首发 — 新浪财经 — 17 juillet 2026
- 新浪财经 — DeepSeek估值已”揭秘”:超3200亿元 — 新浪财经 — 17 juillet 2026
- 钛媒体 — WAIC,我们看到这六个趋势 — 钛媒体 — 18 juillet 2026
- 新浪财经 — WAIC,我们看到这六个趋势 — 新浪财经 — 18 juillet 2026
- 搜狐 — WAIC 2026 磐石·科学基础大模型2.0发布 — 搜狐 — 17 juillet 2026