# 可选:接入真实开源小模型(RTX 4060 8GB 可跑 0.5B-4B 量化模型) # 安装:pip install -r requirements-ml.txt torch>=2.2 transformers>=4.40 accelerate>=0.30 peft>=0.11 sentencepiece protobuf bitsandbytes # 轻量推理引擎(可选) # llama-cpp-python