Wilayah resmi: Republik Korea (beta) · Jelajah: global · Daftar, bayar & dukungan: Korea dulu
TEKNOLOGI · PENGEMBANGAN LLM
Eksperimen AI· Teknik · TumpukanASI and civilization language is a research and brand roadmap—not a claim about current product certification.
Dual-head culture LLM builds on Qwen3 4B-class open weights with XenLook fine-tuning, evaluation, and hosting. Dialogue (XenLook 4b-Ko) uses curated SFT then full fine-tuning; code (XenLook-Coder) uses QLoRA + micro-DPO. Tuning and TRACK run on NVIDIA DGX Spark (GB10); production vLLM runs on dedicated RTX GPUs. We do not claim foundation pretraining or universal SOTA.
Resep dibagikan di bawah NDA hanya untuk kerja sama teknis.
LLM BUDAYA LOKAL · ON-PREM
Penyimpanan lokal · inferensi · Vault. Terpisah dari on web default.
Companion yang dapat diinstal dan privasi sebagai batasan produk.
LLM budaya lokal = hanya Companion/Vault. Bukan klaim «perusahaan AI berdaulat». Transfer AI lintas batas mengikuti Privasi §8④ dan tabel §12.
Pendamping lokal →INFRA PENGEMBANGAN · PRODUKSI
DGX Spark adalah workstation tuning/evaluasi. Penyajian produksi adalah server GPU terpisah.
NVIDIA DGX Spark (GB10 Grace Blackwell) — SFT · full-FT · eksperimen DPO · evaluasi TRACK-DLG/CODER · smoke test vLLM
GPU NVIDIA RTX · vLLM · LiteLLM xenlook-4b-ko / xenlook-coder · aktif · perutean Companion
XenLook 4b-Ko: Qwen3 4B-class → SFT terkurasi → **fine-tuning penuh** → alur operasional IF-repair. XenLook-Coder: QLoRA c1 → penggabungan micro-DPO (**bukan full-FT**). Keduanya merupakan **fine-tuning backbone open-weight**, bukan pelatihan awal dari nol.
Anggota Tahap 1 program NVIDIA Inception. Tidak ada studi kasus resmi atau dukungan produk NVIDIA hingga NVIDIA merilisnya secara resmi.
DATA KOREA · LINEAGE
Kami hanya mengungkapkan tahapan pipeline — dimulai dari sumber publik. Aturan filter, campuran sumber, dan detail golden-set hanya dibagikan di bawah NDA.
Data mentah AI Hub 20jt+ baris
Kurasi · dedup · gerbang kualitas ~900rb SFT
Campuran produksi mesin dialog saat ini 24rb
Dataset AI Hub mematuhi lisensi dan kebijakan AI Hub. Persona 144K SFT adalah jalur terpisah dari sumber Nemotron 7M (CC BY 4.0). Ini bukan klaim "membangun 20 juta dari nol" — melainkan kurasi dari sumber publik melalui alur kerja XenLook.
Kebijakan AI · sumber data →TEKANAN · SKOR
Self-measured benchmark scores in plain language. Not a global #1 or third-party audit claim.
Dialog · FT Penuh
Persepsi layanan
82%
DQ100 prod ion · Gemini holistic judge · N=100 · 2026-08-18
88.0/100
user_quality · hard_fail 0%
91.42%
Komposit perbaikan-IF · ditutup 30-06-2026 · garis dasar historis
Setiap sumbu menggunakan jalur, tanggal, dan metodologi yang berbeda. Bukan skor komposit tunggal.
Kode · QLoRA+DPO
84 poin
Komposit tolok ukur mandiri pengodean Python (rata-rata HumanEval + MBPP). Tugas representatif HumanEval: 91 poin.
Protokol mandiri · inferensi A2 (best-of-4) · diukur pada 08-07-2026
XenLook 4b-Ko self-benchmark composite 91 pts (closed 2026-06-30). Self-protocol measurement pending third-party audit.
KARTU MODEL
Resep detail hanya tersedia melalui kerja sama NDA.
Promoted to production · July 2026
Dialog · FT Penuh
Dialog persona bahasa Korea
Kode · QLoRA+DPO
Pembuatan kode Python EvalPlus
ROADMAP · (DESIGN GOAL)
Tanggal dan metrik dapat berubah sewaktu-waktu.
2026 · SIAP KIRIM
Dialog full-FT + kode QLoRA+DPO · tuning DGX Spark · produksi RTX
2027+ · (TARGET DESAIN)
Pendamping·On-prem·Edge dual-head — Kandidat open-weight EU/US: Llama 3.2 1B · SmolLM2-1.7B · Gemma 2 2B · Gemma 3n E2B · Granite 3.1 2B (Menunggu konfirmasi, prioritas TRACK)
2027+ · (TARGET DESAIN)
Prioritas gerbang TRACK
We do not claim benchmark superiority without published audit evidence.