Région officielle : République de Corée (bêta) · Consultation : mondiale · Inscription, paiement et support : Corée d'abord
TECHNOLOGIE · DÉVELOPPEMENT LLM
Expérience IA· Ingénierie · StackASI and civilization language is a research and brand roadmap—not a claim about current product certification.
Dual-head culture LLM builds on Qwen3 4B-class open weights with XenLook fine-tuning, evaluation, and hosting. Dialogue (XenLook 4b-Ko) uses curated SFT then full fine-tuning; code (XenLook-Coder) uses QLoRA + micro-DPO. Tuning and TRACK run on NVIDIA DGX Spark (GB10); production vLLM runs on dedicated RTX GPUs. We do not claim foundation pretraining or universal SOTA.
Recettes partagées sous NDA uniquement pour la coopération technique.
LLM CULTURE LOCALE · SUR SITE
Stockage local · inférence · Vault. Séparé du on web par défaut.
Compagnon installable et confidentialité comme contraintes produit.
LLM culturel local = Companion/Vault uniquement. Pas une revendication « entreprise d'IA souveraine ». Le transfert transfrontalier suit Confidentialité §8④ et tableaux §12.
Companion sur site →DÉV · INFRA PROD
DGX Spark sert de station de travail pour l'ajustement et l'évaluation. Le service de production est hébergé sur un serveur GPU distinct.
NVIDIA DGX Spark (GB10 Grace Blackwell) — SFT · FT complet · Expériences DPO · Évaluation TRACK-DLG/CODER · Tests vLLM
NVIDIA RTX GPU · vLLM · LiteLLM xenlook-4b-ko / xenlook-coder · routage Companion activé
XenLook 4b-Ko : Qwen3 4B → SFT supervisé → **ajustement complet** → processus de correction IF. XenLook-Coder : QLoRA c1 → fusion micro-DPO (**pas d'ajustement complet**). Il s'agit dans les deux cas d'un affinage de modèles à poids ouverts, et non d'un pré-entraînement ex nihilo.
Membre du programme NVIDIA Inception (Phase 1). Aucune étude de cas ou approbation officielle de NVIDIA n'est revendiquée avant publication par NVIDIA.
DONNÉES CORÉENNES · PROVENANCE
Nous divulguons uniquement les étapes du pipeline à partir de sources publiques. Les règles de filtrage, le mélange des sources et les détails des jeux de données de référence sont partagés uniquement sous NDA.
Données brutes AI Hub 20M+ lignes
Curation · dédoublonnage · filtres qualité ~900K SFT
Mélange actuel moteur de dialogue 24K
Les jeux de données AI Hub respectent leurs licences et politiques respectives. Le SFT Persona 144K est une piste distincte de la source Nemotron 7M (CC BY 4.0). Il ne s'agit pas d'une création ex nihilo de 20M, mais d'un pipeline de curation XenLook à partir de sources publiques.
Politique IA · sources de données →PRESSE · ÉVALUATIONS
Self-measured benchmark scores in plain language. Not a global #1 or third-party audit claim.
Dialogue · FT complet
Perception du service
82%
DQ100 prod ion · Gemini holistic judge · N=100 · 2026-08-18
88.0/100
user_quality · hard_fail 0%
91.42%
Composite IF-repair · clôture le 30/06/2026 · base de référence historique
Chaque axe utilise un chemin, une date et une méthodologie distincts. Il ne s'agit pas d'un score composite unique.
Code · QLoRA+DPO
84 points
Indice composite d'auto-évaluation en codage Python (moyenne HumanEval + MBPP). Tâche représentative HumanEval : 91 points.
Protocole interne · inférence A2 (best-of-4) · mesuré le 08/07/2026
XenLook 4b-Ko self-benchmark composite 91 pts (closed 2026-06-30). Self-protocol measurement pending third-party audit.
FICHE MODÈLE
Recettes détaillées accessibles uniquement sous accord de confidentialité (NDA).
Promoted to production · July 2026
Dialogue · FT complet
Dialogue avec persona coréen
Code · QLoRA+DPO
Génération de code Python EvalPlus
ROADMAP · (DESIGN GOAL)
Les dates et indicateurs sont sujets à modification.
2026 · DÉPLOYÉ
Dialogue full-FT + code QLoRA+DPO · Optimisation DGX Spark · Production RTX
2027+ · (OBJECTIF DE CONCEPTION)
Double tête Companion/On-prem/Edge — Candidats open-weight EU/US : Llama 3.2 1B · SmolLM2-1.7B · Gemma 2 2B · Gemma 3n E2B · Granite 3.1 2B (en attente de validation TRACK).
2027+ · (OBJECTIF DE CONCEPTION)
Priorité aux jalons TRACK
We do not claim benchmark superiority without published audit evidence.