Il existe un chemin où votre modèle 27B tourne avec 5,4 Go de VRAM — et où aucun dollar ne part chez NVIDIA. Ce chemin n'est pas une fiction. Il s'appelle Strix Souverain, et il est en train de se matérialiser à l'intersection exacte de notre pipeline SSA+BitLinear et de la plus grande bascule géopolitique que le compute ait connue depuis l'invention du GPU.
Le monopole silencieux qui étrangle l'Europe
Regardons la réalité en face. Aujourd'hui, chaque inférence de transformer, chaque backward pass, chaque token généré par un modèle conséquent passe par CUDA. Pas parce que CUDA est techniquement supérieur — mais parce que NVIDIA a passé quinze ans à rendre toute alternative économiquement irrationnelle. Le résultat : l'Europe importe 100 % de son compute IA avancé, dans une chaîne de dépendance qui passe par TSMC (Taiwan), NVIDIA (Californie), et une supply chain que personne ne contrôle vraiment.
Le Chips Act 1.0 a posé les fondations. Le Chips Act 2.0, actuellement en discussion à Bruxelles, change de paradigme : il ne s'agit plus de subventionner des usines, mais de financer un runtime logiciel souverain — la couche qui manquait entre le silicium européen et les workloads IA réels.
Et pendant ce temps, Qualcomm a mis 10 milliards de dollars sur la table pour construire un écosystème RISC-V capable de rivaliser avec l'architecture CUDA. Ce n'est pas un pari. C'est un signal. Le marché a compris que la prochaine décennie de l'IA ne s'écrira pas en PTX — elle s'écrira en RISC-V.
SSA + BitLinear : le moteur qui rend la souveraineté possible
Notre pipeline unifié SSA+BitLinear+FlashAttention change la donne sur le plan algorithmique. Là où un transformer classique réclame des dizaines de gigaoctets pour un 27B, notre architecture ternarise les poids et remplace l'attention quadratique par une attention sparse sous-quadratique (SSA). Résultat concret : 5,4 Go pour un modèle 27B. Division par 4 à 8 de l'empreinte mémoire par rapport à un modèle équivalent en FP16.
Actuellement, ce pipeline tourne sur RunPod A100 — du NVIDIA, donc. C'était l'étape de validation. Mais le véritable objectif n'a jamais été de rester sur CUDA. Il a toujours été de démontrer que l'architecture fonctionne, puis de la faire atterrir sur du hardware dont vous contrôlez la chaîne de confiance.
La convergence qui change tout
Trois signaux ont convergé en juin 2026 :
- VSORA Jotunn8 arrive chez Scaleway — le premier accélérateur RISC-V disponible en cloud européen, avec une architecture massivement parallèle conçue pour l'inférence de transformers.
- Qualcomm officialise son investment RISC-V à 10B$, ciblant explicitement le marché de l'inférence IA comme tête de pont contre le monopole CUDA.
- Le Chips Act 2.0 introduit des mécanismes de financement pour les runtimes logiciels souverains — la couche entre le silicium et le modèle.
Pris isolément, chaque signal est intéressant. Pris ensemble, ils dessinent une fenêtre d'opportunité qui ne se présente qu'une fois par génération technologique : la possibilité de construire un stack IA qui, de la puce au modèle, n'emprunte rien à l'écosystème NVIDIA.
Strix Souverain : pas de portage, du natif
Ici, il faut être clair sur ce que nous ne proposons pas. Nous ne proposons pas d'entraîner sur A100 et de déployer sur RISC-V. Ce modèle « train on NVIDIA, deploy on RISC-V » est une impasse stratégique : il maintient la dépendance au moment le plus capitalistique du cycle de vie — l'entraînement.
Strix Souverain vise l'inverse : entraîner et inférer nativement sur l'écosystème RISC-V européen. Le pipeline SSA+BitLinear a été conçu dès le départ pour que sa frugalité algorithmique corresponde aux contraintes du hardware émergent — pas l'inverse. Un modèle 27B qui tient dans 5,4 Go n'a pas besoin d'un GPU à 80 Go. Il a besoin d'un accélérateur dont vous possédez le jeu d'instructions, le compilateur, et la chaîne d'approvisionnement.
C'est la différence entre porter une pile logicielle et posséder une pile logicielle. La première vous rend compatible. La seconde vous rend souverain.
Ce que KINETIC AXIOM construit
Dans le cadre de notre initiative HERMYTHOS V2.0, nous construisons le runtime qui fait le pont entre le pipeline SSA+BitLinear et les accélérateurs RISC-V. Ce n'est pas une couche de compatibilité. C'est un runtime natif qui parle directement au jeu d'instructions RISC-V vectoriel, sans passer par une couche d'abstraction qui émule CUDA.
Le stack cible est le suivant :
- Modèle
- Architecture SSA + BitLinear ternarisée, 27B paramètres effectifs
- Runtime
- HERMYTHOS V2.0 — orchestration d'inférence native RISC-V
- Compute
- VSORA Jotunn8 / accélérateurs RISC-V vectoriels (Scaleway, cloud EU)
- Déploiement
- Infrastructure souveraine, conformité Chips Act 2.0, données sur sol européen
Vous construisez la prochaine infrastructure IA européenne ?
Nous cherchons des partenaires hardware, des fournisseurs cloud, et des early adopters prêts à déployer le premier stack IA 100 % souverain sur RISC-V. Le pipeline tourne. Le hardware arrive. La fenêtre est ouverte.
Parlons architecture →