挑战成功,Qwen 3.8 27B 实现 900K 的代码上下文。
利用 YaRN 技术实现 Qwen 3.8 27B 模型从 786K 提升到 900K 的挑战,整个模型占了 120GB 的显存。
900K 的上下文无限接近于 1M 上下文,意味着世界上 99% 的代码项目,利用 Qwen 3.8 27B 本地 AI 都很难遇到因为上下文不足而降智的问题。
做个对比:
- 懒猫 AI 算力舱单流可以实现 133 Tokens 的速度,4090 只能实现 40 ~ 50 Tokens
- 懒猫 AI 算力舱上下文可以达到 900K,4090 因为显存太小最多只能实现 128K 的上下文
- 4090 上你只能跑 Qwen 3.8 27B,但是你一旦遇到大型的代码项目,马上就会因为上下文不足降智
懒猫 AI 算力舱跑 Qwen 3.8 27B 不但速度超快,还可以不降智地支持 99% 的大型代码项目稳定运行。

