تقنية · تطوير LLM
تجربة الذكاء الاصطناعي· الهندسة · التقنياتلغة ASI والحضارة هي خارطة طريق بحثية وتجارية - وليست ادعاءً بشأن شهادة المنتج الحالية.
Dual-head culture LLM builds on Qwen3 4B-class open weights with XenLook fine-tuning, evaluation, and hosting. Dialogue (XenLook 4b-Ko) uses curated SFT then full fine-tuning; code (XenLook-Coder) uses QLoRA + micro-DPO. Tuning and TRACK run on NVIDIA DGX Spark (GB10); production vLLM runs on dedicated RTX GPUs. We do not claim foundation pretraining or universal SOTA.
تتم مشاركة الوصفات بموجب اتفاقية عدم إفشاء للتعاون الفني فقط.
LLM للثقافة المحلية · في الموقع
تخزين محلي · استدلال · Vault. منفصل عن on الويب الافتراضي.
رفيق قابل للتثبيت والخصوصية كقيود منتج.
LLM ثقافي محلي = Companion/Vault فقط. ليس ادعاء «شركة ذكاء اصطناعي سيادية». نقل الذكاء الاصطناعي عبر الحدود يتبع الخصوصية §8④ وجداول §12.
رفيق محلي →تطوير · بنية إنتاج
DGX Spark هو محطة عمل الضبط/التقييم. خدمة الإنتاج هي خادم GPU منفصل.
NVIDIA DGX Spark (GB10 Grace Blackwell) — SFT · ضبط دقيق كامل · تجارب DPO · تقييم TRACK-DLG/CODER · اختبار vLLM.
NVIDIA RTX GPU · vLLM · LiteLLM xenlook-4b-ko / xenlook-coder · على · توجيه الرفيق
XenLook 4b-Ko: Qwen3 فئة 4B → SFT → **ضبط دقيق كامل** → مسار عمليات IF-repair. XenLook-Coder: QLoRA c1 → دمج micro-DPO (**ليس ضبطًا دقيقًا كاملاً**). كلاهما ضبط دقيق للعمود الفقري مفتوح الوزن، وليس تدريبًا مسبقًا من الصفر.
عضو في برنامج NVIDIA Inception المرحلة 1. لا توجد دراسة حالة رسمية من NVIDIA أو تأييد للمنتج حتى تنشره NVIDIA.
بيانات كورية · نسب
نحن نكشف عن مراحل خط الإنتاج فقط - بدءًا من المصادر العامة. يتم مشاركة قواعد التصفية ومزيج المصادر وتفاصيل المجموعة الذهبية بموجب اتفاقية عدم إفشاء فقط.
AI Hub خام 20 مليون+ صف
تنظيم · إزالة التكرار · بوابات الجودة ~900 ألف SFT
مزيج إنتاج محرك الحوار الحالي 24 ألف
مجموعات بيانات AI Hub تتبع كل ترخيص وسياسة AI Hub. Persona 144K SFT هو مسار منفصل عن مصدر Nemotron 7M (CC BY 4.0). هذا ليس "لقد بنينا 20 مليونًا من الصفر" - بل هو مصادر عامة → خط إنتاج XenLook.
سياسة الذكاء الاصطناعي · مصادر البيانات →إعلام · نتائج
Self-measured benchmark scores in plain language. Not a global #1 or third-party audit claim.
حوار · full-FT
91 pts
Korean dialogue & persona self-benchmark composite — XenLook 4b-Ko
Self-protocol · TRACK-DLG · closed 2026-06-30
كود · QLoRA+DPO
84 pts
Python coding self-benchmark composite (HumanEval + MBPP average). HumanEval representative task: 91 pts.
Self-protocol · inference A2 (best-of-4) · measured 2026-07-08
XenLook 4b-Ko self-benchmark composite 91 pts (closed 2026-06-30). Self-protocol measurement pending third-party audit.
بطاقة النموذج
وصفات مفصلة بموجب اتفاقية عدم إفشاء فقط.
Promoted to production · July 2026
حوار · full-FT
حوار شخصية كورية
كود · QLoRA+DPO
توليد كود بايثون EvalPlus
خارطة طريق · (هدف التصميم)
قد تتغير التواريخ والمقاييس.
2026 · تم الشحن
حوار كامل · QLoRA+DPO · ضبط DGX Spark · إنتاج RTX
2027+ · (هدف التصميم)
Llama 3.2 1B · SmolLM2-1.7B · Gemma 2/3n E2B · Granite 3.1 2B (قيد التحديد)
2027+ · (هدف التصميم)
تحقيق أهداف المسار أولاً
We do not claim benchmark superiority without published audit evidence.