เผยแพร่สิงหาคม 2026 · บันทึกจาก 3DN
ในเดือนกรกฎาคมเราเขียนว่า NVLink ยังอยู่กับเสือรวย ขณะที่ Huawei เปิดบัส: แฟบริค multi-GPU แบบปิดสำหรับสแต็ก NVIDIA องค์กร กับ interconnect แบบ scale-out เปิดสำหรับใครที่สร้างบน NPU ในประเทศ นั่นไม่ใช่กระแสแฟชั่น แต่เป็นการเดิมพันว่าฝั่งไหนของกำแพงที่ compute จีนจะพยายามครอบครอง
รายงาน Reuters ว่า DeepSeek กลับมาพร้อมรุ่นโมเดลใหม่ที่ปรับให้เข้ากับชิป Huawei คือครึ่งซอฟต์แวร์ของเรื่องเดียวกัน การพุ่งไวรัลของ DeepSeek รุ่นแรกเกี่ยวกับประสิทธิภาพการเทรนและ open weights การกลับมาครั้งนี้เกี่ยวกับว่าโมเดลแนว frontier จะอยู่บนสแต็ก non-CUDA ได้โดยไม่ต้องขอโทษหรือไม่

การกลับมาของ DeepSeek ส่งสัญญาณอะไรจริงๆ
ถอดวัฏจักรข่าวออก เหลือสามข้อที่สำคัญต่อผู้รันระบบและใครที่คิดเรื่อง digital sovereignty:
- โมเดลไม่ใช่แค่แข่งเบนช์มาร์ก รุ่น Pro/Flash, context ยาว, agentic coding และ STEM คือผิวสินค้า ผิวกลยุทธ์คือ day-zero tuning สำหรับ accelerator ตระกูล Huawei Ascend และคลัสเตอร์ supernode — ไม่ใช่แค่ “แล้วก็รันที่ไหนสักแห่งในเอเชีย”
- Inference คือตลาดมวลชน ทราฟฟิก production ส่วนใหญ่คือ inference ไม่ใช่ pre-training เต็มรูป ถ้า NPU ในประเทศ “ดีพอ” สำหรับเสิร์ฟ open weights ใน token cost ที่แข่งได้ CUDA จะไม่บังคับสำหรับงาน AI engineering ก้อนใหญ่
- Training ยังเป็นครึ่งที่ยาก ความพยายามก่อนหน้าที่จะบังคับรันเทรนทั้งก้อนบน Ascend มีรายงานว่าสะดุดเรื่อง interconnect กับความสุกของซอฟต์แวร์ การเทรน/post-train บางส่วนบนซิลิคอนในประเทศคือความคืบหน้า ยังไม่ใช่ “เราไม่ต้องการ GPU ถูกควบคุมส่งออกอีกแล้ว” ความซื่อสัตย์กัน “บอกแล้ว” ไมให้กลายเป็นโฆษณาชวนเชื่อ
กระดานคะแนนเงียบจึงไม่ใช่ “จีนมีพาร์กับ NVIDIA” แต่เป็น “จีนส่งโมเดล open-weight จริงจังที่บ้านหลังโปรดเป็นสแต็ก accelerator จีนได้” นั่นคือข้ออ้างที่ยั่งยืนกว่า
เราพูดครึ่ง interconnect ไปแล้ว
บทความกรกฎาคมพูดตรงเรื่องแบ่งตลาด: แฟบริค peer ระดับ NVLink สงวนให้เครื่อง multi-GPU องค์กร; กล่องผู้ใช้/แล็บอยู่บน PCIe; ความเปิดแบบ UnifiedBus ของ Huawei ชี้ทางตรงข้าม — เชื่อม NPU หลายตัวเป็นเครื่องเดียวโดยไม่ต้องเช่าสมาชิกคลับปิด
DeepSeek-บน-Ascend คือหน้าตาของสมมุตินั้นเมื่อ weights มาถึง ปรัชญา interconnect โดยไม่มีโมเดลคือ whitepaper โมเดลโดยไม่มีแฟบริคในประเทศยังพึ่งบอร์ด แผนที่หน่วยความจำ และ roadmap ไดรเวอร์ของคนอื่นอยู่เสมอ รวมกันแล้วได้เส้นทางสู่สแต็กเต็ม: ซิลิคอน ลิงก์ runtime และ weights
เราไม่ได้อ้างว่ารู้ล่วงหน้าทุกอย่าง เราอ้างการจดจำแพทเทิร์น การควบคุมส่งออกไม่ได้แช่แข็ง AI จีน — มันเบนทุนไปที่คลัสเตอร์ NPU คอมไพเลอร์ในประเทศ และกลเม็ดประสิทธิภาพที่แล็บตะวันตกมีแรงจูงใจน้อยกว่าจะคิดค้น ขณะที่ H100 ยังสั่งซื้อได้
ความเป็นอิสระของฮาร์ดแวร์จีนมีโอกาสแค่ไหน?
อิสระไม่ใช่ค่า boolean มองเป็นชั้น แต่ละชั้นมีความน่าจะเป็นในช่วงสามถึงห้าปี
1. เสิร์ฟ open weights บน accelerator ในประเทศ — สูง
สำหรับ inference องค์กรและผู้ใช้จำนวนมาก คลัสเตอร์ Ascend (หรือเพื่อน) ที่ “ดีพอ” ชนะ “ไม่มี GPU เลย” และมักชนะ “รอ SKU ส่งออกที่ขาดแคลน” เคอร์เนลซอฟต์แวร์ไล่ตามแบบขี้เหร่แต่ต่อเนื่อง เมื่อโมเดลธงชาติรองรับ first-class คลาวด์และแพลตฟอร์มภายในจะมาตรฐานตาม Lock-in ทำงานสองทาง: CUDA เหนียว — default ในประเทศที่ใช้งานได้ก็เหนียว
2. แฟบริค multi-accelerator แข่งได้ในจีน — ปานกลางถึงสูง
นี่คือฝั่ง UnifiedBus / SuperPoD ของอาร์กิวเมนต์กรกฎาคม คุณไม่ต้องโคลน NVLink ทีละบิตเพื่อชนะความจุระดับชาติ คุณต้องการแบนด์วิดท์พอและเรื่องซอฟต์แวร์ที่สอดคล้อง เพื่องาน tensor-parallel / expert-parallel แบบ multi-GPU (multi-NPU) จะไม่ตายบน host bus Huawei และเพื่อนจะยังขาดความละเอียดของ NVIDIA — และจะยังส่งแร็กที่เทรนและเสิร์ฟโมเดลซึ่งตะวันตกห้ามกลางทางไม่ได้
3. พาร์ pre-training เต็มโดยไม่มี GPU ตะวันตก — ปานกลาง ไม่สม่ำเสมอ
Frontier pre-training ยังชอบโดเมนแบนด์วิดท์หนา collectives ที่สุก และระบบนิเวศรูป CUDA สแต็กในประเทศปิดช่องว่างบนบาง workload และ post-training การปิดทุกสาขาวิจัยช้ากว่า คาด hybrid ไปอีกพัก: บางเฟสบนของที่ยังเล็ดลอด เฟสมากขึ้นบนเหล็ก Ascend แรงกดดันให้ลบ hybrid ออก
4. อธิปไตยปลายทางจริง (lithography, HBM, EDA, tools) — ต่ำกว่า แต่ขึ้นภายใต้แรงกด
accelerator ไม่ใช่ทั้งบิลวัสดุ โหนดกระบวนการขั้นสูง ซัพพลาย HBM packaging และ memory wall คือคอขวดภูมิรัฐศาสตร์ จีนออกแบบเลี่ยงบางข้อจำกัดด้วยคลัสเตอร์ใหญ่ sparsity ฉลาดกว่า และ quantization แรง มันไม่อาจอธิษฐานให้ฟิสิกส์หรือ dependency ของ toolchain หายในจังหวะแถลงข่าว อิสระชั้นนี้คือนโยบายอุตสาหกรรมระดับทศวรรษ ไม่ใช่การเปิดตัวโมเดลครั้งเดียว
5. คูน้ำซอฟต์แวร์ (CUDA กับ CANN และผองเพื่อน) — สมรภูมิจริง
ฮาร์ดแวร์ไม่มีนักพัฒนาคือโกดัง การขยับแบบ DeepSeek สำคัญเพราะดึงชุมชนโมเดล open source และเฟรมเวิร์ก agent ไปยัง runtime ในประเทศ Coding agent แอปลอง context และ RAG production ไม่สนความภักดีแบรนด์ — สน latency ราคา และไดรเวอร์วันจันทร์ ทุกโมเดลจริงจังที่ชอบ Ascend สอนวิศวกรรุ่นใหม่ว่า CUDA เป็นทางเลือก
สรุปความน่าจะเป็น: สูงที่จีนสร้าง เลน compute AI ที่มีอธิปไตยใช้การได้ — โครงสร้างพื้นฐานพอเทรน ปรับจูน และเสิร์ฟโมเดลสำคัญระดับชาติโดยไม่ต้องขอ NVIDIA รุ่นท็อป ต่ำที่ default โลกของทุกแล็บตะวันตกพลิกในคืนเดียว ปานกลางที่การควบคุมส่งออกเร่งการแยกถาวร: สองสแต็กเต็ม สองปรัชญา interconnect สองชุด “best practice”
ถ้าคุณรันระบบจริง ความหมายคืออะไร
ที่ 3DN เราสนใจ production ไม่ใช่ขบวนพาเหรด อ่านแบบปฏิบัติ:
- ราคาและความพร้อมจะแยกตามภูมิภาคต่อไป API pricing และการเช่า GPU สะท้อนอยู่แล้วว่าใครซื้อเหล็กแบบไหนได้ ตระกูลโมเดลที่ optimize สำหรับ NPU ในประเทศจะดึงราคาคลาวด์จีนห่างจากใบเสนอราคา CUDA-only มากขึ้น
- ความพกพาคือฟีเจอร์สินค้า ถ้าไปป์ไลน์ AI engineering สมมติ collectives ของเวนเดอร์เดียวตลอดไป คุณกำลังเขียนภาษี migration ของวันพรุ่งนี้ ชอบ open weights อินเทอร์เฟซ inference สะอาด และวินัยรีเบนช์เมื่อสแต็กใหม่เคลมพาร์
- อธิปไตยคือปฏิบัติการ ไม่ใช่สโลแกน digital sovereignty สำหรับผู้ให้บริการยุโรปหรือเอเชียไม่ใช่ “คลับปิดเดิมใต้แบรนด์อื่น” แต่คือรู้ว่าชั้นไหนย้ายได้จริง — โมเดล runtime accelerator สถานที่ — เมื่อนโยบายหรือซัพพลายเชนขาด
managed hosting และ infrastructure ที่น่าเบื่อยังชนะ: ไฟ ระบายความร้อน เครือข่าย observability และงานไม่หรูที่ค้ำ inference ไว้ขณะแถลงข่าวโมเดลหมุนเวียน
บอกแล้ว — โดยไม่ฉลองชัย
เราบอกว่าทางแยก interconnect จริง การกลับมาทรง Huawei ของ DeepSeek คือหลักฐานฝั่งโมเดลของทางแยกนั้น ความเป็นอิสระของฮาร์ดแวร์จีนไม่ใช่มeme และไม่ใช่โปรเจกต์จบ มันคือการแจกแจงความน่าจะเป็นที่เพิ่งขยับขึ้นบนชั้นที่สำคัญก่อน — เสิร์ฟ ปรับจูน และความจุระดับชาติ — ขณะที่ dependency การผลิตชั้นลึกยังถูกแย่งชิง
จำหนึ่งบรรทัด: การคว่ำบาตรพยายามแช่แข็งลูกค้า อาจไปทุนกองสแต็กเต็มของคู่แข่ง ที่เหลือคือรายละเอียด engineering และรายละเอียดนั้นเคลื่อนเร็วกว่าเรื่องเล่ารายไตรมาสยอมรับ
เกี่ยวข้อง: NVLink สำหรับเสือรวย PCIe สำหรับที่เหลือ — และ Huawei เปิดบัส · ยุโรป พลังงาน และ AI: GLM 5.2 บน Ascend เทียบ Grok บน NVIDIA
ใส่ความเห็น