ARTICLES / 写作
文章
把做过的事、遇到的问题和形成的方法写清楚。
全部文章7 篇文章
双 RTX 2080 Ti 22GB 部署 Qwen3.8-27B:一次 llama.cpp 实践
记录双卡硬件、容器化部署、切分方式、256K 上下文及实际验收结果。
GPT-5.6 Sol、Terra、Luna 怎么选:从任务出发看三个档位
根据 OpenAI 官方文档核对 GPT-5.6 三档模型的定位,并给出实际任务的比较方法。
Java 项目怎么做一次真正有用的依赖漏洞扫描
从 SBOM 到 OSV-Scanner 报告,说明 SCA 的扫描步骤、结果解读和修复优先级。
MySQL DATETIME 没变,为什么 Java 里差了八小时
用 DATETIME、TIMESTAMP、LocalDateTime 和 Timestamp 的区别,拆解 JDBC 时区问题的排查顺序。
双 22GB 显卡如何选择 27B 模型量化
用一次 Qwen3.8-27B 选型说明权重、GGUF、KV Cache 和推理引擎各自解决什么问题。
Qwen3.8-27B 是什么:从模型能力到本地部署边界
认识 Qwen3.8-27B 的模型结构、图文能力和上下文长度,以及本地部署时真正需要准备的东西。
测到 223 token/s 之后,我为什么切回 llama.cpp
一次双 2080 Ti 上的 vLLM 试验:短请求测速通过,真实客户端的回答质量却没有通过验收。
没有找到匹配的文章
换个关键词,或查看全部文章。