三角洲,不是河流:以路由器为单位,以睡眠为HA,以互联网为地图
前沿模型是一条重量级河流。3DN勾勒出三角洲:小型专家、分层路由器、睡眠双胞胎、默认不透明向前——模块化人工智能工程对抗遗忘和记忆墙。
前沿模型是一条重量级河流。3DN勾勒出三角洲:小型专家、分层路由器、睡眠双胞胎、默认不透明向前——模块化人工智能工程对抗遗忘和记忆墙。
聊天式大型语言模型没有永久目标。市场有几十年的数据;政治家的价值没有。一个冻结的英语基础、最大化收益的目标,以及可插拔的 LoRA 适配器——在 PolitiCap 和 DutchBud 账本数据渗透的情况下离线训练。
建造日志:七台120毫米风扇永远不够用。将备用格力管道多联头插入堆叠的6U四路RTX-3090机箱——T型接头、阻尼器、密封GPU格栅、仅冷柱。
我们正在 Unbabel TowerInstruct-7B 上构建一个小型 LoRA,以便英语到泰语的机器翻译可以在我们自己的 GPU 上进行改进,而无需在每段文本上使用边界标记。
我们向本地 Qwen2.5-Coder 14B 编码代理(运行在我们的 Gaia GPU 上)提交了一个真正的多文件 React Native 功能。它报告成功。Git 保持干净。以下是故障模式——以及我们现在如何分配 AI 工程工作。
混合Grok桌面:前沿判断,盖亚塔,EN→ZH/NL。本地翻译59篇文章;节省这批约12美元。
在我们的编码桌面上,开放权重输给了 Grok 4.5,四路 3090 + EPYC 盒子看起来像是撤资。混合是 Grok Build 的一流功能:将 Grok 保留在 API 上进行判断,将大量转换卸载到本地推理 – 并进行成本计算。
到 2031 年 8 月 11 日,中国前沿人工智能的主要路径不再依赖于偷运的 NVIDIA 主板和西方 HBM。这场竞赛涉及的是内存壁垒、封装、兆瓦和编译器——而不是下一个小玩意路线图。
开放权重模型的宣传比 API 模型更开放。无论哪种方式,神经网络都是数十亿个不透明的浮点数。开放主要意味着自行运行 – 通常在 NVIDIA 上运行,有时是 Ascend 投注。
DeepSeek 的新模型生成器针对华为 Ascend 进行优化,是 NVLink-vs-open-bus 分支的软件部分。中国硬件独立性有多大可能性?在主权推理通道上很高;在最深的制造层受到争议。