近日,一名网名为 u/EcstaticDentist 的海外用户在 Reddit 社区分享了一项本地大模型极限测试:在一张经过超频的 NVIDIA RTX 3090 显卡上,借助两套本地推理框架(Harness),调用 Q4KM 量化版本的 Qwen3.8-27B 模型,耗时约 5 小时,成功打造出一款可玩的第一人称僵尸射击游戏。
阿里开源模型再进化
据 IT之家此前报道,阿里巴巴于今年 8 月开源 Qwen3.8-27B 模型。相比上一代 Qwen3.6-27B,新模型在编程与办公场景下的性能大幅提升,表现甚至超越了参数规模更大的 Qwen3.7-Plus。该模型还新增了 reasoning_effort(推理强度)功能,可根据任务难度自动调节思考深度,在保障效果的同时更节省算力资源。
单卡跑通大模型游戏开发
此次测试的意义在于验证了消费级显卡运行大参数模型的潜力。测试者表示,选择 Qwen3.8-27B 是为挑战本地部署的性能上限。硬件方面,整套方案仅使用一张 RTX 3090 显卡,并借助微星(MSI)Afterburner 工具进行超频,频率提升约 12%。模型则采用 Q4KM 量化版本——这是 GGUF 格式中一种 4-bit 混合量化档位,能在显存受限的设备上显著降低资源占用。

开源生态降低创作门槛
从调用本地推理框架到产出可玩成品,整个过程约 5 小时完成,显示出通义千问系列模型在代码生成与多轮协作上的进步。对普通玩家与独立开发者而言,这类开放权重的模型意味着无需依赖云端算力,也能在自家显卡上完成游戏原型、工具脚本等创意项目,本地大模型的实用边界正被不断拓宽。







