Aller au contenu principal
Vantaige

Guide Juridique & Licences

Open Source vs. Poids Ouverts dans l'Intelligence Artificielle

Les frontières légales et opérationnelles entre les logiciels réellement Open Source et les modèles à poids ouverts soumis à des clauses d'usage, de seuils et de distillation.

Top Open Weights & Open Source Models License Comparison

Compare commercial use, user caps, synthetic data rules, and OSI compliance at a glance.

Model & PublisherLicense NameCommercial UseUser Cap / LimitsDataset Released?Train Competing Models?
DeepSeek-V3 / R1
DeepSeek AI
MIT License
Permissive License
Full Commercial

Completely permissive. No user threshold or synthetic data restrictions.

No user limit Private Allowed
Llama 3.1 / 3.2 / 3.3
Meta AI
Llama 3.3 Community License
Custom Open Weights
Conditional

Free for standard business, but cannot use outputs to train non-Llama models.

> 700M monthly active users requires custom license Private Restricted
Llama 4 Scout / Maverick
Meta AI
Llama 4 Community License
Custom Open Weights
Conditional

MoE multimodal models. Same community license structure as Llama 3 — no output-based training of competing models.

> 700M MAU requires Meta's separate commercial agreement Private Restricted
Meta Muse Glimmer 30B
Meta Superintelligence Labs
Apache 2.0
Permissive License
Full Commercial

Full Apache 2.0. Distilled from Muse Spark — no use restrictions beyond the open license.

No user limit Private Allowed
Qwen3 (0.6B to 32B dense)
Alibaba Cloud / Qwen Team
Apache 2.0
Permissive License
Full Commercial

All dense Qwen3 sizes are Apache 2.0. Full commercial freedom including fine-tuning and redistribution.

No user limit Private Allowed
Qwen3 235B-A22B (MoE)
Alibaba Cloud / Qwen Team
Apache 2.0
Permissive License
Full Commercial

Apache 2.0. MoE flagship. 22B active params. Requires >100M MAU to be reviewed by Alibaba for certain commercial uses.

Notify Alibaba Cloud for deployments >100M MAU Private Allowed
Qwen 2.5 (0.5B to 72B)
Alibaba Cloud
Apache 2.0 (most sizes) / Tongyi
Permissive License
Full Commercial

Apache 2.0 for 0.5B to 32B models. Full commercial freedom.

> 100M MAU for certain 72B variants Private Allowed
OLMo 2 (7B / 13B)
Allen Institute for AI (Ai2)
Apache 2.0 (Code, Weights & Dolma Data)
Permissive License
Full Commercial

100% OSI-compliant Open Source AI: weights, code, and full Dolma dataset released.

No user limit Full Data (Dolma) Allowed
Gemma 3 (4B / 12B / 27B)
Google DeepMind
Gemma Terms of Use
Custom Open Weights
Conditional

Multimodal open weights. Google acceptable-use policy restricts harmful content, competitive distillation, and misrepresentation.

No user limit Private Restricted
Mistral NeMo / 7B v0.3
Mistral AI
Apache 2.0
Permissive License
Full Commercial

Permissive Apache 2.0. Note that Mistral Large uses proprietary licensing.

No user limit Private Allowed
Xiaomi MiMo V2.6 (Flash / Pro)
Xiaomi AI
Apache 2.0
Permissive License
Full Commercial

Apache 2.0. MoE omnimodal models (text, image, video, audio). Full commercial use permitted.

No user limit Private Allowed
Phi-4 (14B)
Microsoft
MIT License
Permissive License
Full Commercial

Standard MIT open software license.

No user limit Private Allowed

1. Ce que Signifie Réellement l'Open Source en IA (Définition OSI)

D'après l'Open Source Initiative (OSI), une IA véritablement Open Source exige une transparence totale sur toute la chaîne d'apprentissage : code source, jeux de données d'entraînement, scripts de préparation et hyperparamètres. La seule mise à disposition des poids ne suffit pas à obtenir ce qualificatif.

2. Poids Ouverts : Pourquoi Llama, Mistral et Qwen ne Sont Pas Strictement Open Source

Des modèles renommés comme Meta Llama 3, Mistral Commercial ou d'autres publications récentes sont des modèles à Poids Ouverts (Open Weights). Les poids sont téléchargeables librement, mais les données d'entraînement restent confidentielles et leur emploi est encadré par des licences dédiées.

3. Plafonds d'Usage Commercial et la Règle des 700 Millions d'Utilisateurs

La licence Meta Llama 3 Community impose aux entreprises dépassant 700 millions d'utilisateurs actifs par mois de négocier un accord commercial distinct avec Meta. Si ce seuil ne concerne pas les PME, il constitue un point d'attention majeur pour la conformité des grands groupes.

4. La Clause Restrictive sur la Distillation de Données Synthétiques

La majorité des licences propriétaires et à poids ouverts (dont Llama 3) interdisent formellement d'utiliser les réponses générées pour entraîner ou optimiser d'autres modèles concurrents. Si vous prévoyez de distiller un grand modèle vers un modèle compact, privilégiez des modèles sous licence permissive comme Apache 2.0 (OLMo) ou MIT (DeepSeek).

Foire Aux Questions

Non au sens strict. Llama 3 est un modèle à poids ouverts régi par la licence Meta Llama 3 Community. En fixant un plafond d'utilisateurs commerciaux (700M MAU) et en interdisant l'entraînement de modèles concurrents, il ne répond pas aux critères de l'OSI.

Les modèles de DeepSeek (V3, R1) sont distribués sous la licence très libérale MIT. Allen AI OLMo est proposé sous Apache 2.0 avec ses données d'entraînement accessibles. Les modèles Falcon sont également sous Apache 2.0.

Sous licences Apache 2.0 et MIT, vous disposez d'une totale liberté commerciale. Sous licence Llama 3 Community, cela est également permis tant que votre entreprise ne dépasse pas 700 millions d'utilisateurs actifs par mois et respecte les conditions d'usage éthique.

Le non-respect de cette clause peut entraîner l'annulation de vos droits commerciaux d'exploitation et exposer votre entreprise à des poursuites pour violation de propriété intellectuelle.

Les licences validées par l'OSI (comme MIT ou Apache 2.0) s'appuient sur une jurisprudence solide et éprouvée depuis des décennies. Les contrats communautaires sur mesure introduisent des incertitudes sur les œuvres dérivées et les responsabilités.

Comparez licences et besoins matériels

Consultez les caractéristiques techniques et les licences de centaines de modèles dans notre Calculateur VRAM.

Ouvrir le Calculateur VRAM

Knowledge & Deep Dives

Centre de Connaissances VRAM & LLM Locaux

Guides approfondis, analyses architecturales et manuels de dimensionnement matériel pour déployer et exécuter vos modèles d'IA en local sans mauvaise surprise.

50+ Termes8 min de référence
Maîtrisez le vocabulaire technique: GGUF vs Safetensors, K-quants, cache KV, GQA, paramètres actifs MoE et mémoire unifiée Apple Silicon.
Recherche et filtrage interactif par catégorie
Enseignements matériels concrets pour chaque terme
Définitions claires sans jargon inutile
Index alphabétique de consultation rapide
Consulter le Guide
Outil Interactif6 min de lecture
Comprenez pourquoi la longueur de contexte sature la VRAM, la formule mathématique exacte et comment économiser de 50% à 75% de mémoire.
Calculateur interactif de mémoire de contexte
Architectures MHA vs GQA vs DeepSeek MLA
Gains de la quantification du cache en FP8 et INT4
Consommation mémoire en dialogue multi-tours
Consulter le Guide
Décodeur de Configuration7 min de lecture
Examinez les dépôts Hugging Face comme un ingénieur ML: déchiffrez config.json, identifiez les vraies limites de contexte et évitez le piège des paramètres MoE.
Inspecteur interactif des paramètres config.json
Nomenclature des quantifications GGUF expliquée
Règles de mémoire des paramètres actifs vs totaux MoE
Fenêtres de contexte et mise à l'échelle RoPE
Consulter le Guide
Guide Matériel8 min de lecture
Découvrez pourquoi la bande passante mémoire surpasse la puissance brute, comment choisir entre Apple Silicon et Nvidia, et la VRAM requise de 8B à 70B.
Paliers de VRAM (de 8 Go à 128 Go+)
Formule bande passante mémoire vs calcul
Comparatif Apple Silicon Mac vs PC Nvidia
Configuration station de travail Dual-GPU pour 70B
Consulter le Guide