เทคโนโลยี · การพัฒนา LLM
การทดลอง AI· วิศวกรรม · สแต็กภาษา ASI และอารยธรรมเป็นแผนงานการวิจัยและแบรนด์ ไม่ใช่การอ้างสิทธิ์เกี่ยวกับการรับรองผลิตภัณฑ์ในปัจจุบัน
Dual-head culture LLM builds on Qwen3 4B-class open weights with XenLook fine-tuning, evaluation, and hosting. Dialogue (XenLook 4b-Ko) uses curated SFT then full fine-tuning; code (XenLook-Coder) uses QLoRA + micro-DPO. Tuning and TRACK run on NVIDIA DGX Spark (GB10); production vLLM runs on dedicated RTX GPUs. We do not claim foundation pretraining or universal SOTA.
สูตรอาหารที่แชร์ภายใต้ NDA เพื่อความร่วมมือทางเทคนิคเท่านั้น
LLM วัฒนธรรมท้องถิ่น · แบบติดตั้งภายในองค์กร
จัดเก็บท้องถิ่น · อนุมาน · Vault แยกจาก on เว็บเริ่มต้น
คอมแพนญอนติดตั้งได้และความเป็นส่วนตัวเป็นข้อจำกัดผลิตภัณฑ์
LLM วัฒนธรรมท้องถิ่น = Companion/Vault เท่านั้น ไม่อ้าง «บริษัท AI อธิปไตย» การถ่ายโอน AI ข้ามพรมแดนตามความเป็นส่วนตัว §8④ และตาราง §12
Companion แบบติดตั้งภายในองค์กร →การพัฒนา · โครงสร้างพื้นฐานการผลิต
DGX Spark คือเวิร์กสเตชันสำหรับการปรับแต่ง/ประเมิน การให้บริการการผลิตคือเซิร์ฟเวอร์ GPU แยกต่างหาก
NVIDIA DGX Spark (GB10 Grace Blackwell) — SFT · full-FT · การทดลอง DPO · การประเมิน TRACK-DLG/CODER · vLLM smoke
NVIDIA RTX GPU · vLLM · LiteLLM xenlook-4b-ko / xenlook-coder · บน · Companion routing
XenLook 4b-Ko: Qwen3 4B-class → SFT → **full fine-tuning** → IF-repair ops path. XenLook-Coder: QLoRA c1 → micro-DPO merge (**ไม่ใช่ full-FT**). ทั้งสองเป็นการ fine-tuning backbone แบบ open-weight ไม่ใช่การ pretrain จากศูนย์
สมาชิก NVIDIA Inception program Stage 1. ไม่มีการศึกษา กรณีศึกษาอย่างเป็นทางการ หรือการรับรองผลิตภัณฑ์ของ NVIDIA จนกว่า NVIDIA จะเผยแพร่
ข้อมูล · ต้นกำเนิด
เราเปิดเผยเฉพาะขั้นตอนของไปป์ไลน์เท่านั้น — เริ่มต้นจากแหล่งข้อมูลสาธารณะ กฎการกรอง ส่วนผสมของแหล่งที่มา และรายละเอียด golden-set จะถูกแชร์ภายใต้ NDA เท่านั้น
AI Hub raw 20M+ แถว
การคัดสรร · การลบซ้ำ · เกณฑ์คุณภาพ ~900K SFT
ส่วนผสมการผลิตเอ็นจิ้นบทสนทนาปัจจุบัน 24K
ชุดข้อมูล AI Hub เป็นไปตามใบอนุญาตและนโยบาย AI Hub แต่ละรายการ Persona 144K SFT เป็นแทร็กแยกต่างหากจาก Nemotron 7M source (CC BY 4.0). นี่ไม่ใช่ “เราสร้าง 20M จากศูนย์” — แต่เป็นแหล่งข้อมูลสาธารณะ → ไปป์ไลน์การคัดสรรของ XenLook
นโยบาย AI · แหล่งข้อมูล →ข่าว · คะแนน
Self-measured benchmark scores in plain language. Not a global #1 or third-party audit claim.
บทสนทนา · full-FT
91 pts
Korean dialogue & persona self-benchmark composite — XenLook 4b-Ko
Self-protocol · TRACK-DLG · closed 2026-06-30
โค้ด · QLoRA+DPO
84 pts
Python coding self-benchmark composite (HumanEval + MBPP average). HumanEval representative task: 91 pts.
Self-protocol · inference A2 (best-of-4) · measured 2026-07-08
XenLook 4b-Ko self-benchmark composite 91 pts (closed 2026-06-30). Self-protocol measurement pending third-party audit.
การ์ดโมเดล
รายละเอียดสูตรอาหารภายใต้ข้อตกลง NDA เท่านั้น
Promoted to production · July 2026
บทสนทนา · full-FT
บทสนทนาบุคลิกเกาหลี
โค้ด · QLoRA+DPO
การสร้างโค้ด Python EvalPlus
ROADMAP · (DESIGN GOAL)
วันที่และตัวชี้วัดอาจมีการเปลี่ยนแปลง
2026 · เสร็จสิ้น
Full-FT dialogue + QLoRA+DPO code · การปรับแต่ง DGX Spark · RTX prod
2027+ · (เป้าหมายการออกแบบ)
Llama 3.2 1B · SmolLM2-1.7B · Gemma 2/3n E2B · Granite 3.1 2B (อยู่ระหว่างการพิจารณา)
2027+ · (เป้าหมายการออกแบบ)
TRACK gates ก่อน
We do not claim benchmark superiority without published audit evidence.