图解Windows10+优麒麟双系统安装

为防止超速翻车,建议通读全文后再进行操作。

(此处双系统以 Windows 10+优麒麟 20.04 LTS Pro 为例,其他版本的系统仅供参考)

01

安装前的准备

四小步

第一步:查看电脑基础信息

按”win+r”快捷键回车确认,输入”msinfo32″,回车,出现系统信息界面,可查看 BIOS 模式:

BIOS 有多种模式,此教程以 UEFI 模式为例;

第二步:下载优麒麟镜像

官网下载:(www.ubuntukylin.com/downloads/)

页面下方还有多个开源镜像站下载途径可供选择;

注:下载完成后,为确认优麒麟系统镜像的完整性,可以使用 MD5 校验工具(网页搜索下载即可)验证 MD5 值与官网的是否一致。

第三步:准备一个 U 盘

打开冰箱门,拿出一个新鲜的U盘(或移动硬盘、DVD,此处以 U 盘为例)插在电脑上

要求:U 盘内存大于 4G;

第四步:制作启动盘

此处推荐 Ventoy,下载链接:https://www.lanzoui.com/b01bd54gb

选择结尾为 windows.zip 的最新版本进行下载解压,接着进入解压目录,双击运行 Ventoy2Disk.exe。

运行界面如下图所示:

① 是插入的 U 盘信息;

② 是此 Ventoy 的版本信息;

③ 是 U 盘内的 Ventoy 版本信息(没有安装 Ventoy 的显示为空);

④ 是安装选项,点击安装,就可以将 Ventoy 安装进对应的 U 盘里;

注:此处安装会提示是否格式化,也就是清空 U 盘内的所有数据,请提前将 U 盘原有数据备份。

安装完成后,设备内部 Ventoy 的版本信息就会显示出来,若内部版本低于安装包版本我们可以点击下方的“升级”选择进行升级。

注:升级操作是安全的,不会让 U 盘里已有的镜像文件丢失。

Ventoy 安装成功后,将优麒麟系统的镜像文件复制进到 U 盘,如下图:

此时 U 盘启动盘已经制作完成。以下为启动界面展示图:

02

安装进行时

三大步

第一步:关闭快速启动

如果不关掉可能会存在无法进入 BIOS 的情况

选择“控制面板–硬件和声音–电源选项–选择电源按钮的功能–更改当前不可用的设置”,在关机设置栏下找到“启动快速启动”,取消勾选,然后点击“保存修改”;

第二步:进行磁盘分区

磁盘分区是为了给优麒麟操作系统分配空间,默认选择分区尾部的磁盘(考虑到机械硬盘的读写特性,尽可能切靠前的分区)

首先需要在 Win10 上创建空白磁盘分区,选择“此电脑”–右键点击“管理”。

进入“计算机管理”页,点击“存储>磁盘管理”,选择要分割的磁盘空间,右键点击该磁盘,选择“压缩卷”。

此时会弹出压缩窗口,输入压缩空间量的大小,此处展示约分配 135G (空间分配建议最低不少于 30 G,如果大小不够可以重新分配一下磁盘空间,确保分区空余空间充足,原分区的大小也足够使用)。确认压缩空间量后点击“压缩”。

注:1G=1024MB,为方便计算,可以估算成 1G=1000MB。

压缩结束后,会多出一块可用空间,磁盘分区到此结束。

第三步:正式安装

插入制作好的 U 盘启动盘,重启电脑,在开机时按“F2”进入 BIOS 系统,然后在奇奇的带领下,一步步完成双系统的安装吧~

注:根据不同机型进入 BIOS 系统的快捷键有所不同,请根据自身机型搜索对应的快捷键进行操作。

首先关闭安全启动,通过左右方向键进入“Security”界面,按上下方向键移动到“Secure Boot”选项,回车进入修改状态,按上下键选择“Disabled”,回车确认。

接着通过左右方向键进入“Boot”界面,按上下方向键选择“Boot Option #1”选项卡,回车。选择启动方式为从 USB 启动,即选中自己的 U 盘,回车。

之后通过左右方向键进入“Save & Exit”界面,选择“Save Changes and Exit”,回车。在弹出的选择框里选择“Yes”,回车。

现在电脑开始重新启动,然后你会看到优麒麟开源操作系统安装的准备界面:

稍作等待,进入优麒麟新版安装界面,双击“安装 Kylin”。如下图:

接下来进入安装配置页面–选择语言、时区以及设置用户信息,大家根据自身情况进行设置哦。

直到出现选择安装方式界面,选择“自定义安装”。

注:记住我们是安装双系统,不要点击快速安装,否则有丢失数据的风险!

之后进到分区页面,如下图:

可以看到,系统已经存在 Windows 系统,“空闲”对应的就是我们刚刚压缩出来的空闲分区。 因为我们是安装双系统,所以接下来我们要做的就是将优麒麟系统安装在这个空闲分区内。

选中“空闲”分区–点击最右侧的“添加”按钮,进入新建分区页面。

首先添加根分区,奇奇在此处分配的大小是 80G,大家可以根据自身需求进行分配,但一定要确保之后有充足的空间可供使用,如下图:

由于 Windows 系统已经存在 EFI 引导分区了,所以我们再次不用添加 EFI 引导分区。

之后,添加 data 和 backup 分区,作为数据分区和备份还原分区,此处分别分配 20G。

全部分配完成后点击“下一步”,开始安装优麒麟开源操作系统。

等待安装完成,点击“现在重启”。

重启后便会出现选择系统界面,如下图:

通过上下键选择我们想要进入的系统,回车。到此,双系统已经安装好啦。

怎么样,你安装成功了吗?

03

常见问题解决方案

希望你用不到

Q:如果双系统安装完成后没有启动项选择界面,该怎么解决?

A:可能是启动项出现问题,可以下载安装用 EasyBCD 软件修复启动项。

Q:配置完分区后提示没有根分区、EFI分区、数据备份或还原分区,该怎么办?

A:根分区对应的是“/”,EFI 分区需要在分区时将“用于”类型改为 EFI,数据备份分区对应的是“/data”,还原分区对应的是“/backup”,请根据提示查找对应的分区是否创建。

Q:配置完分区提示“只能存在一个 EFI 分区”,该怎么办?

A:应该是已有的 Windows 系统也存在 EFI 分区,我们需要把自己添加的 EFI 分区进行删除。

Q:笔记本安装完双系统之后,进入 Windows 系统出现花屏,该怎么办?

A:笔记本只有集显,在系统启动时会先加载优麒麟的显卡驱动以用来加载选择系统的界面,致使在选择进入Windows时出现花屏情况
解决办法:首先,进入优麒麟系统中,打开 /etc/default/grub:
将如下语句取消注释即可(删掉 #)。
# Uncomment to disable graphical terminal (grub-pc only)
# GRUB_TERMINAL=console

Q:使用 USB 启动盘安装时,出现”try ubuntu kylin without installation”或“install ubuntu kylin”,Enter 选择“安装”后,显示器黑屏无任何显示,该怎么办?

A:

方法一:显示黑屏,可能是显卡显示的支持有问题,尝试手动修复。

移动光标到”install ubuntu kylin” , 按”e”进入编辑模式,进入命令行模式,

找到”quite splash”然后去掉”—“后,添加“nomodeset”,按  F10 安装。

注:依照不同显卡进行不同显卡驱动选项的添加,此处使用的是Nvidia显卡,添加 nomodeset。

方法二:移动光标到“Try Ubuntu Kylin without installing(safe graphics)”进入安全试用界面尝试使用。

Q:系统安装完成之后,提示未检测到无线网卡,该怎么办?

A:重启,然后在 grub 界面选择高级选项,选择低版本内核,回车,查看网络是否正常:

04

结语

投个票吧投个票吧

如果有什么看不懂的地方,或者在安装过程中出现了文章中未提及的问题,欢迎小伙伴们加入交流群一起探讨,群里不仅有 Linux 忠实爱好者,还有不定时的惊喜福利等你哦~!

扫一扫添加小优微信拉你进群:

lama.cpp 已处理内容(KV/Prompt)缓存完整配置指南

llama.cpp 里已处理文本缓存本质是 KV Cache:模型前置prompt、系统提示、长对话前缀计算后的Key/Value张量,缓存后重复请求无需重新全量预填充(prefill),速度提升数倍。分4种缓存方案,同时配套你之前写的Windows环境变量编辑器可一键配置。

一、4种缓存机制区分(按需选用)

1. 内存前缀自动复用缓存(默认开启,最常用)

作用:同模型多请求共享相同前缀(固定System提示词、通用模板),自动匹配复用KV,重启程序丢失缓存。

关键参数/环境变量(可在你的环境编辑器直接设置)

环境变量 对应启动参数 说明
LLAMA_ARG_CACHE_RAM --cache-ram N 内存缓存最大容量 MiB,默认8192;0关闭,-1无上限
LLAMA_ARG_CACHE_REUSE --cache-reuse N 可复用缓存块最小token长度,建议512/1024,开启前缀复用
LLAMA_ARG_KV_UNIFIED --kv-unified 统一KV缓冲区,多会话共享缓存,默认开启
LLAMA_ARG_CACHE_IDLE_SLOTS --cache-idle-slots 保留空闲会话缓存不立即释放

示例启动命令(main/llama-server通用)

# Windows cmd/PowerShell
set LLAMA_ARG_CACHE_RAM=16384
set LLAMA_ARG_CACHE_REUSE=512
llama-server -m qwen3-8b.gguf -c 8192 -ngl 35

2. 持久化Prompt缓存(单会话固定前缀,保存到磁盘文件)

作用:把固定系统提示词、超长前置文档一次性计算,保存.bin缓存文件,下次启动直接加载,跳过prefill。

参数

  • 启动参数:--prompt-cache cache_sys.bin
  • 无独立环境变量,只能命令行传入

流程

  1. 第一次运行带完整系统prompt,生成缓存文件
llama-cli -m model.gguf -c 8192 --prompt-cache sys_cache.bin -f system_prompt.txt
  1. 后续直接加载缓存,无需重复处理系统提示
llama-cli -m model.gguf -c 8192 --prompt-cache sys_cache.bin

3. Server多会话Slot持久化缓存(长对话断点续聊)

作用:llama-server HTTP服务每个对话独立slot,手动保存/加载单条对话完整KV缓存,重启服务仍可恢复聊天上下文。

核心参数/环境变量

环境变量 参数 功能
LLAMA_ARG_SLOT_SAVE_PATH --slot-save-path ./kv_slots 指定缓存存放目录,启用slot读写API

使用方式

  1. 启动服务开启slot持久化
$env:LLAMA_ARG_SLOT_SAVE_PATH="D:\llama_cache\slots"
llama-server -m model.gguf -c 16384 -ngl 40 --port 8080
  1. HTTP API 保存/恢复对话缓存
# 保存slot 1到文件chat1.bin
POST http://127.0.0.1:8080/slots/1?action=save
Content-Type: application/json
{"filename":"chat1.bin"}

# 重启服务后恢复对话
POST http://127.0.0.1:8080/slots/restore
{"slot_id":1,"filename":"chat1.bin"}

4. SSD磁盘KV Offload缓存(低显存/内存超长上下文)

作用:KV缓存放不下内存时,溢出到SSD磁盘,支持百万token超长上下文,需要编译时开启LLAMA_SSD=1

环境变量/参数

LLAMA_SSD=1 # 编译时开启
LLAMA_ARG_SSD_CACHE=1
LLAMA_ARG_SSD_CACHE_PATH=D:\llama_cache\ssd_kv

启动示例:

$env:LLAMA_ARG_SSD_CACHE=1
$env:LLAMA_ARG_SSD_CACHE_PATH="D:\llama_cache\ssd_kv"
llama-server -m model.gguf -c 131072

二、KV缓存压缩(降低缓存内存占用,可配合所有缓存)

修改KV存储精度,大幅减少缓存体积,环境变量直接配置:

环境变量 参数 可选值 效果
LLAMA_ARG_CACHE_TYPE_K --cache-type-k f16/q8_0/q4_0 K向量量化压缩
LLAMA_ARG_CACHE_TYPE_V --cache-type-v f16/q8_0/q4_0 V向量量化压缩

推荐配置(平衡速度/显存):

LLAMA_ARG_CACHE_TYPE_K=q8_0
LLAMA_ARG_CACHE_TYPE_V=q8_0

三、完整推荐生产缓存配置(环境变量一键设置)

通用桌面GPU(8G显存,多请求共享System提示)

# 基础推理
LLAMA_NUM_THREADS=12
LLAMA_ARG_CTX_SIZE=8192
LLAMA_ARG_N_GPU_LAYERS=35
# 缓存核心配置
LLAMA_ARG_CACHE_RAM=16384
LLAMA_ARG_CACHE_REUSE=512
LLAMA_ARG_KV_UNIFIED=1
LLAMA_ARG_CACHE_IDLE_SLOTS=1
# KV量化省显存
LLAMA_ARG_CACHE_TYPE_K=q8_0
LLAMA_ARG_CACHE_TYPE_V=q8_0
# 对话持久化保存目录
LLAMA_ARG_SLOT_SAVE_PATH=D:\AI\llama_kv_slots

低内存CPU机器(无独立显卡,SSD溢出缓存)

LLAMA_ARG_CTX_SIZE=32768
LLAMA_ARG_SSD_CACHE=1
LLAMA_ARG_SSD_CACHE_PATH=D:\AI\llama_ssd_cache
LLAMA_ARG_CACHE_RAM=4096
LLAMA_ARG_CACHE_TYPE_K=q4_0
LLAMA_ARG_CACHE_TYPE_V=q4_0

四、常见问题

  1. 缓存不生效,每次都完整prefill
    • 检查LLAMA_ARG_CACHE_REUSE大于0,必须开启统一KV缓冲区--kv-unified
    • 前缀token长度必须≥cache-reuse设定值才会复用
  2. slot保存API找不到
    • 必须配置LLAMA_ARG_SLOT_SAVE_PATH目录,服务启动才加载slot接口
  3. SSD缓存报错
    • 源码编译时加LLAMA_SSD=1,预编译二进制大多未开启SSD缓存
  4. 内存占用持续上涨
    • 调低LLAMA_ARG_CACHE_RAM限制最大缓存,或开启cache-idle-slots自动清理闲置slot

五、缓存生效验证

启动llama-server/llama-cli时,控制台输出prompt cache is enabled即代表自动前缀缓存正常工作;
复用缓存时prefill耗时会从几秒降到几十毫秒,日志可见cache hit命中标记。