内容标签

GGUF

返回全部文章
AI Playground
从 ModelScope 下载 Qwen3.8-27B 的 UD-Q4_K_M 权重和 mmproj-F16 投影文件,在 RTX 4090 24GB 上启动 llama-server,给出图片输入的验证方法,并记录文本生成速度、KV Cache 复用与 unused tensor 警告。
AI Playground
使用 uv tool 安装 ModelScope,配置 MODELSCOPE_CACHE,扫描、校验和清理本地模型缓存,并按需下载 Qwen GGUF 权重与视觉投影文件。说明新版目录、旧缓存重复、容量统计不一致及完整重建缓存的安全处理方法。
AI Playground
在 Debian 和 RTX 4090 上编译 llama.cpp,使用 ModelScope 下载 Qwen3.6-27B,并接入 Claude Code 与 Codex。包含新版缓存路径、服务参数、接口与真实工具调用验证,以及已经确认的兼容边界与排错方法。