Skip to main content
LLMUpstageAI automation

Solar Open 2 : 250B-A15B sans bruit et tourné vers la production

Upstage a annoncé Solar Open 2, un modèle ouvert de mélange d'experts avec 250B de paramètres mais seulement 15B actifs par token. Conçu pour les agents à long terme, le code et les flux documentaires lourds, il pourrait réduire les coûts et rendre l'automatisation par IA plus pratique sans API fermées. Idéal pour les entreprises manipulant de longs documents.

Ce que j’ai vu dans la sortie

J’ai plongé dans l’annonce et le rapport technique pas par curiosité, mais avec une question simple : est-ce que ça peut atterrir correctement dans l’automatisation par IA plutôt que simplement afficher un joli chiffre sur une diapo. C’est exactement le cas. Upstage a sorti Solar Open 2, un modèle MoE open-weight de 250B paramètres, mais avec seulement 15B actifs par token.

C’est le duo 250B-A15B qui rend cette sortie intéressante. Sur le papier, c’est un gros modèle, mais l’inférence donne l’impression d’être plus proche d’une classe plus raisonnable que d’un réseau dense de 250B. Pour l’intégration de l’IA dans les produits, ce n’est plus un détail académique, mais une discussion directe sur le coût par réponse, la latence et où l’on peut héberger le modèle.

Architecturalement, ils utilisent l’Attention Hybride : pour une couche d’attention softmax, il y a trois couches d’attention linéaire. D’habitude, je freine sur ce genre de choses parce que le marketing adore le mot hybride, mais ici l’idée est claire : réduire le coût des longs contextes et des longues exécutions agentives, là où le modèle ne doit pas s’effondrer en mémoire et en temps.

En termes de positionnement, le pari est très concret : agents à long horizon, codage, workflows lourds en documents. Dans les benchmarks, ils revendiquent le leadership parmi les modèles open-weight de taille comparable sur MMLU-Pro, LiveCodeBench et APEX-Agents. Sans oublier un solide bloc coréen : KMMLU-Pro, CLiCk, HAE-RAE et un accent général sur l’anglais, le coréen et le japonais.

Je prendrais les comparaisons avec DeepSeek et les autres avec recul. Ce sont encore des supports de lancement, pas un terrain de test indépendant. Mais j’aime la direction : pas juste un énième « chat intelligent », mais un modèle immédiatement poussé vers le travail agentif avec du code, des tâches bureautiques et des documents longs.

Ce que ça change en pratique

Je vois trois gains ici. Premièrement : pour les équipes qui ont besoin d’un stack multilingue avec un fort coréen, voilà un autre candidat sérieux sans dépendance à une API fermée. Deuxièmement : pour les pipelines documentaires et les flux agentifs, le profil MoE peut offrir une économie plus raisonnable que les gros modèles denses.

Mais il y a un filtre. Sans une architecture IA solide, un tel modèle devient facilement une expérience coûteuse avec de belles démos et un mauvais débit. Surtout si on lui ajoute tout de suite de la récupération, de l’utilisation d’outils et une orchestration multicouche.

Je vois régulièrement ce genre de goulots dans les systèmes clients : on choisit le modèle par hype, puis on s’étonne que l’automatisation par IA soit instable et plus chère qu’un humain. Si vous avez une histoire similaire avec des agents, des documents ou un support multilingue, vous pouvez analyser sereinement la stack avec Nahornyi AI Lab et construire un développement de solutions IA pour une charge réelle, pas pour un tweet avec des benchmarks.

Nous avons précédemment couvert l'apparition inattendue du modèle Pony Alpha sur OpenRouter, offrant un accès gratuit et une fenêtre de contexte de 200K tokens. C'est un autre rappel que de nouveaux acteurs peuvent surgir de nulle part, tout comme ce modèle coréen.

Partager cet article