Rétro 2025 : l'année où l'IA a tout changé (et nous avec)
Kling, DeepSeek R1, Claude Code, Veo 3, GPT-5, Nano Banana, AdCP : les avancées qui ont compté en 2025, et ce qu'on en a fait chez Mobsuccess. Mois par mois.
Vous la sentez, l’exponentielle ?
Cette impression que chaque semaine apporte un nouveau modèle, un nouveau benchmark pulvérisé, un nouveau paradigme. On pourrait commenter l’actu au jour le jour, il y en aura une autre demain de toute façon. On a préféré prendre du recul. Regarder dans le rétro. Mesurer ce qui a vraiment bougé.
Et surtout : croiser chaque avancée avec ce qu’on en a fait. Parce que chez Beta by Mobsuccess, on ne regarde pas les modèles comme des curieux. On les teste, on les pousse, on les casse. Et quand ils tiennent, on construit dessus.
Voici notre rétrospective d’une année qui a redéfini l’horizon de nombreuses entreprises, et nous y compris.
Décembre 2024 - janvier 2025 : le réveil de la Chine avec Kling 1.6
Si 2024 avait été l’année de Runway pour la vidéo et de Flux pour l’image, la fin d’année a marqué un virage qu’on avait vu venir. Le 19 décembre 2024, Kuaishou, géant chinois inconnu du grand public occidental, lançait Kling 1.6.
Les modèles chinois étaient sous-estimés. On les surveillait depuis des mois. Quand Kling 1.5 a montré des capacités de motion transfer (possibilité de lui donner un exemple de mouvement à reproduire dans la vidéo) intéressantes, on a su que la suite serait sérieuse.
Kling 1.6 affiche +195 % d’amélioration sur l’image-vers-vidéo par rapport à Kling 1.5, avec pour la première fois des vidéos directement exploitables sans retouches humaines. Mais le vrai différenciateur, c’est la cohérence des expressions faciales et l’interprétation des descriptions de mouvement complexes. On a passé des heures à tester des cas limites. Résultat : premier modèle chinois state-of-the-art, point.
Côté Mobsuccess : Decathlon. Des visuels statiques transformés en vidéos ultra réalistes. Un runner en plein effort, un sac à dos qui se balance au rythme d’une randonnée, générés en quelques secondes. Ce qui nécessitait un studio de production vidéo peut maintenant être réalisé en quelques prompts par nos experts.

20 janvier 2025 : DeepSeek R1 et le séisme open source
L’année commence à peine. DeepSeek, labo chinois encore confidentiel quelques semaines plus tôt, publie R1 sous licence MIT.
Un modèle de raisonnement avancé comparable aux meilleurs propriétaires. Gratuit. Librement modifiable. On observait la montée en puissance de l’open source depuis Llama 2 : la question n’était pas « si » mais « quand » un modèle de ce calibre serait libéré. DeepSeek était sur notre radar.
On l’a benchmarké en interne : le gap avec GPT-4 était devenu marginal sur certaines tâches. L’économie du secteur venait de changer. Llama 4, Qwen, Mistral 3 suivront. L’open source est devenu un standard.
Ça a validé notre approche : ne jamais dépendre d’un fournisseur unique. Notre stack intègre GPT-5, Anthropic, Google, Mistral, selon les cas d’usage.
24 février 2025 : Claude 3.7 Sonnet et l’ère du coding agentique
Pour tous les développeurs informatiques, il y aura un avant et un après le 24 février 2025. Anthropic lance simultanément Claude 3.7 Sonnet et Claude Code.
Les modèles « reasoners » (o1, o3) avaient montré que le thinking time améliorait drastiquement les performances sur les tâches complexes. Mais ils étaient rigides : soit rapides, soit réfléchis, jamais les deux. Claude 3.7 Sonnet casse cette limite, premier modèle hybride capable de réponses instantanées ou de raisonnement étendu via l’extended thinking.
Pour prouver ses capacités agentiques, Anthropic a fait jouer Claude 3.7 Sonnet à Pokémon Red. Trois champions d’arène battus là où les versions précédentes tournaient en rond. Un détail technique révélateur : le modèle maintient un contexte sur des centaines d’actions successives sans perdre le fil.
Claude Code, lancé le même jour, c’est ce modèle dans le terminal. Il comprend un codebase entier et exécute des tâches de développement complexes en langage naturel.
L’adoption chez nous a été immédiate. 45 % de nos lignes de code sont écrites par l’IA. Ni un gadget, ni un POC : notre nouvelle façon de travailler. Boilerplate, tests unitaires, refactoring, documentation, délégués. Nos développeurs se concentrent sur l’architecture et les choix stratégiques. Le time-to-market de nos nouvelles fonctionnalités ? Divisé par deux.

Mars - mai 2025 : Gemini 2.5 Pro et l’analyse vidéo révolutionnée
Google fait son retour. Après des années à courir derrière OpenAI, 2025 est l’année de la revanche.
Les LLM multimodaux étaient prometteurs mais les performances sur la vidéo longue restaient décevantes. Mauvaise rétention de contexte, erreurs de localisation temporelle. On attendait le premier modèle qui tiendrait vraiment sur du contenu de plusieurs minutes.
25 mars : version expérimentale. 6 mai : preview I/O.
84,8 % sur VideoMME, évaluation qui teste la capacité des modèles à comprendre des images et des vidéos, un benchmark qu’on considérait quasi inatteignable un an plus tôt. L’architecture nativement multimodale fait la différence. Audio, vidéo, texte, code : traités de manière fluide sans pipelines de pré-traitement. Un seul modèle, un seul appel API.
Deux solutions Mobsuccess ont été renforcées par cette nouvelle capacité :
- Octopus, l’audit vidéo automatisé. YouTube, Instagram, TikTok. Environ 50 indicateurs propriétaires : structure, hooks, clarté pédagogique, optimisation plateforme. Les 4 heures d’analyse d’un expert sont désormais réduites à quelques minutes, pour se concentrer sur la stratégie et les recommandations.
- RAIdar, l’audit de créas publicitaires (images et vidéos). Nous prédisons la performance publicitaire d’une création sur trois axes : attractivité (capter l’attention), engagement (maintenir l’intérêt), conversion (déclencher l’action). La corrélation avec les performances réelles en campagne ne cesse de s’améliorer.
20 mai 2025 : Veo 3 et la vidéo avec son
Google I/O 2025. Parmi les annonces : Veo 3.
La génération vidéo progressait, mais le son restait le parent pauvre. Soit muet, soit ajouté en post-production avec des modèles audio séparés. L’intégration native semblait être le prochain cap logique, et c’est exactement ce que Veo 3 a livré.
Dialogues, bruits ambiants, effets sonores, créés nativement et synchronisés avec l’image. Jusqu’à 8 secondes en 1080p. On l’a testé sur des dizaines de prompts : la synchronisation labiale tient, les ambiances sont cohérentes.
C’est devenu un pilier de nos projets Avatar IA. Chaque responsable de magasin peut disposer de son propre avatar pour présenter les offres de la semaine.
Pour Carrefour : des centaines de magasins avec leur communication locale incarnée. Un présentateur virtuel qui parle des promotions spécifiques du point de vente. Généré automatiquement, chaque semaine, sans équipe de production.
L’hyper-localisation publicitaire vient de gagner un nouveau territoire. Compliquée hier, l’hyper-personnalisation devient accessible et industrialisable grâce à la GenAI.
7 août 2025 : GPT-5 et l’avènement du vibe coding
GPT-5 débarque enfin.
Claude Code avait transformé la productivité de nos développeurs. GPT-5 va plus loin : il ouvre le coding à ceux qui n’ont jamais écrit une ligne de code.
74,9 % sur SWE-bench Verified. 88 % sur Aider Polyglot, deux benchmarks de référence sur la capacité des IA à rédiger du code. Des scores qui écrasent tout. Mais le vrai basculement, c’est le one shot : décrire un site, une app, un outil en quelques phrases. Obtenir un résultat fonctionnel, esthétique, déployable. Le vibe coding, terme popularisé par Andrej Karpathy, devient réalité. OpenAI le dit : GPT-5 transforme « intuitivement et avec goût les idées en réalité ».
Chez Mobsuccess, des collaborateurs sans formation technique créent désormais des outils internes qu’on utilise tous les jours. Un outil de création de campagnes Snapchat, un lead magnet, un outil de valorisation des sales. La culture a changé. L’IA n’est plus l’affaire des développeurs, c’est l’affaire de tous.
Et ce sont des gains très concrets :
- Un outil vibe codé d’historisation de données sur SharePoint nous fait économiser plusieurs milliers d’euros par an.
- L’outil de création Snapchat nous fait gagner plusieurs heures par semaine.
On en a tiré Vibely, notre plateforme interne de vibe coding.
26 août 2025 : Nano Banana, le mystère devenu révolution
Août 2025. Sur LMArena, un nom étrange apparaît : nano-banana. Personne ne sait d’où il vient. Et pourtant, il pulvérise tous les records.
On surveillait l’arena quotidiennement. Quand un modèle anonyme prend la tête avec un écart significatif, c’est soit un leak, soit un labo majeur qui teste en secret. Vu la qualité, on penchait pour Google. Bingo : quelques jours plus tard, ils révèlent être derrière. Le 26 août, le modèle devient public.
La capacité qui change tout : mixer plusieurs ingrédients et raisonner sur des prompts ultra complexes. Plus besoin d’entraîner des LoRA pour chaque sujet. Photo d’une personne + vêtements + contexte = essayage virtuel réaliste. Sans entraînement préalable. Juste un prompt.
C’est le moteur de Moby Studio, notre studio photo 100 % IA pour le retail. Le problème qu’on résout : la création de contenu pour des milliers de références produit, qui avait historiquement des coûts de shooting astronomiques et des délais de plusieurs semaines.
Avec Moby Studio et Nano Banana :
- Plus de 1 000 images produit générées par heure.
- -95 % de coûts par rapport à un shooting traditionnel.
- -70 % de time-to-market.
Un libellé produit suffit pour générer automatiquement trois types de visuels : fond blanc, fond transparent, mise en ambiance. Notre pipeline d’agents IA fait le reste.
15 octobre 2025 : AdCP et l’avènement de la pub agentique
Le 15 octobre 2025, à New York, un consortium mené par Yahoo, PubMatic, Optable, Scope3, Swivel et Triton Digital annonce l’Ad Context Protocol (AdCP).
L’IA agentique progressait vite côté développement (Claude Code, GPT-5). Mais côté publicité, les agents restaient isolés : chaque plateforme avait son API, son langage, ses contraintes. Pas de standard commun. On attendait l’équivalent d’OpenRTB pour l’ère des agents.
AdCP comble ce vide. Construit sur le Model Context Protocol (MCP) d’Anthropic, c’est un standard ouvert qui permet aux agents IA de communiquer avec les plateformes publicitaires, et bientôt entre eux, dans un langage unifié. Briefer un agent en langage naturel (« toucher les acheteurs éco-responsables sur CTV cette semaine ») et le laisser négocier directement avec les systèmes publishers : c’est la promesse.
Côté Mobsuccess, l’agentification des campagnes est un axe stratégique majeur pour 2026. On a déjà depuis longtemps des agents capables d’optimiser les budgets, d’ajuster les créas en temps réel et de prendre des décisions tactiques sans intervention humaine (Sensego). AdCP fournit le langage commun entre ces agents et l’écosystème. La roadmap 2026 du protocole inclut la génération créative et l’attribution de performance, exactement nos territoires. On construit dessus.
Décembre 2025 : Kling AI Avatar v2 Pro et les vidéos longues
Kuaishou clôture l’année 2025 avec une nouvelle avancée.
La génération vidéo IA avait un plafond de durée qui nous frustrait. Quelques secondes au maximum chez Veo 3, Sora, Runway. Pour des cas d’usage comme les tutoriels ou les présentations produit complètes, c’était insuffisant.
5 décembre 2025 : API Avatar v2 Pro. Une photo et un fichier audio donnent un avatar parlant avec un lip-sync d’une précision bluffante. Mais le vrai basculement : Kling génère des vidéos jusqu’à 2 minutes, extensibles à 3 minutes. Une éternité quand la concurrence plafonne à quelques secondes. On a testé sur des scripts de 90 secondes : la cohérence tient, les expressions restent naturelles.
Kling Avatar v2 Pro vient renforcer notre solution Avatar IA avec deux approches complémentaires : Veo 3 pour les vidéos courtes avec son natif, Kling pour les vidéos longues nécessitant un lip-sync précis. Plus de montage, plus d’assemblage de clips.

17 décembre 2025 : Gemini 3 Flash, la vitesse au niveau Pro
Google termine l’année. Le 17 décembre, Gemini 3 Flash devient le modèle par défaut de l’application Gemini.
Le compromis intelligence/vitesse semblait incontournable. Les gros modèles étaient lents et chers, les petits étaient rapides mais limités. Gemini 3 Flash casse cette barrière : 90,4 % sur GPQA Diamond (raisonnement de niveau doctorat), 33,7 % sur Humanity’s Last Exam. Des scores de modèle frontier. Le tout en étant 3 fois plus rapide que Gemini 2.5 Pro.
Google a compressé l’intelligence frontier dans un format optimisé pour la vitesse et le coût.
Gemini 3 Flash s’intègre parfaitement dans notre stack. Pour les tâches nécessitant du raisonnement avancé mais avec des contraintes de latence, analyse en temps réel, recommandations instantanées, c’est le meilleur des deux mondes. Octopus, par exemple : l’audit d’une vidéo qui prenait quelques minutes peut désormais être effectué en moins d’une minute. Sans sacrifier la qualité.

Le Grand Prix du Jury : Brico Dépôt et l’IA full-funnel
Au milieu de cette année, une reconnaissance : le Grand Prix du Jury Cas d’Or 2025 pour notre travail avec Brico Dépôt.
Ce cas illustre ce que 2025 a rendu possible : l’IA déployée sur toute la chaîne de valeur publicitaire.
- IA prédictive : dimensionnement des budgets, optimisation de la couverture locale.
- IA générative : transformation de visuels statiques en assets dynamiques.
- Machine learning : progression des KPI en temps réel.
Les résultats :
- 17 millions d’impressions délivrées.
- +63 % de taux de clics.
- -28 % de CPC.
- -69 % de coût de consultation catalogue.
Dans un contexte retail difficile, la surperformance grâce à l’IA n’est pas un luxe.

Et maintenant ?
2025 touche à sa fin. Qu’avons-nous observé ?
L’exponentielle est réelle. Chaque trimestre apporte des capacités qui auraient semblé impensables l’année précédente. Génération vidéo, IA agentique, assistants de coding : tout cela n’existait pas sous cette forme il y a 18 mois.
L’adoption fait la différence. Les technologies sont disponibles pour tous. Ce qui distingue ceux qui en tirent profit, c’est la vitesse et la profondeur de l’adoption. 45 % de notre code est écrit par l’IA. Des non-techniciens créent des outils. L’IA n’est plus un projet pilote, c’est notre façon de travailler.
Le meilleur est à venir. 2026 promet l’IA agentique à grande échelle, l’automatisation de bout en bout des campagnes, des capacités créatives qui repoussent encore les limites.
L’IA utile. L’IA concrète. L’IA qui génère des résultats.
2026 ? On vous en reparle très vite. L’horizon ne fait que s’élargir.