Tag: 大模型
All the articles with the tag "大模型".
-
我们在 Qwen3.5-9B 部署中踩过的所有坑(及参数调优全记录)
从输出乱码到思考泄露到 KV Cache OOM,这是在一台 RTX 3080 上部署 Qwen3.5-9B 的全过程记录。
-
生产环境 vs 测试环境:模型参数配置的那些坑
一台 RTX 3080、20GB 显存、9B 模型,能撑起生产服务吗?能。但照搬测试参数,等着你的就是乱码、OOM 和思考泄露。
-
Harness Engineering:8B 模型从 53% 到 99%,秘密不在模型本身
一篇解读「Forge — Guardrails take an 8B model from 53% to 99%」的文章,以及 Harness Engineering 对我们意味着什么。
-
不换模型只改 Prompt:让本地 Agent 从「每步都问」变成「全自动执行」
如何通过 system prompt 优化,让本地 Qwen3.5-9B 模型从每步询问用户变成主动全自动执行。