Qwen 3.8 27B 实现 900K 代码上下文
AI
Tech

挑战成功,Qwen 3.8 27B 实现 900K 的代码上下文。

利用 YaRN 技术实现 Qwen 3.8 27B 模型从 786K 提升到 900K 的挑战,整个模型占了 120GB 的显存。

900K 上下文调整并验证完成

900K 的上下文无限接近于 1M 上下文,意味着世界上 99% 的代码项目,利用 Qwen 3.8 27B 本地 AI 都很难遇到因为上下文不足而降智的问题。

做个对比:

  • 懒猫 AI 算力舱单流可以实现 133 Tokens 的速度,4090 只能实现 40 ~ 50 Tokens
  • 懒猫 AI 算力舱上下文可以达到 900K,4090 因为显存太小最多只能实现 128K 的上下文
  • 4090 上你只能跑 Qwen 3.8 27B,但是你一旦遇到大型的代码项目,马上就会因为上下文不足降智

Pi Agent 状态栏里的 900K 上下文

懒猫 AI 算力舱跑 Qwen 3.8 27B 不但速度超快,还可以不降智地支持 99% 的大型代码项目稳定运行。