ARTICLES / 写作

文章

把做过的事、遇到的问题和形成的方法写清楚。

07 ARTICLES
全部文章7 篇文章
AI大模型2026/9/27阅读全文 →

双 RTX 2080 Ti 22GB 部署 Qwen3.8-27B:一次 llama.cpp 实践

记录双卡硬件、容器化部署、切分方式、256K 上下文及实际验收结果。

AI大模型2026/9/27阅读全文 →

GPT-5.6 Sol、Terra、Luna 怎么选:从任务出发看三个档位

根据 OpenAI 官方文档核对 GPT-5.6 三档模型的定位,并给出实际任务的比较方法。

软件供应链安全2026/9/27阅读全文 →

Java 项目怎么做一次真正有用的依赖漏洞扫描

从 SBOM 到 OSV-Scanner 报告,说明 SCA 的扫描步骤、结果解读和修复优先级。

Java与数据库2026/9/27阅读全文 →

MySQL DATETIME 没变,为什么 Java 里差了八小时

用 DATETIME、TIMESTAMP、LocalDateTime 和 Timestamp 的区别,拆解 JDBC 时区问题的排查顺序。

AI大模型2026/9/27阅读全文 →

双 22GB 显卡如何选择 27B 模型量化

用一次 Qwen3.8-27B 选型说明权重、GGUF、KV Cache 和推理引擎各自解决什么问题。

AI大模型2026/9/27阅读全文 →

Qwen3.8-27B 是什么:从模型能力到本地部署边界

认识 Qwen3.8-27B 的模型结构、图文能力和上下文长度,以及本地部署时真正需要准备的东西。

AI大模型2026/9/27阅读全文 →

测到 223 token/s 之后,我为什么切回 llama.cpp

一次双 2080 Ti 上的 vLLM 试验:短请求测速通过,真实客户端的回答质量却没有通过验收。