# Tag: 大模型

URL: https://xingwangzhe.fun/tags/%E5%A4%A7%E6%A8%A1%E5%9E%8B/

## 1 posts

- [人工智能实训Day2：大模型对齐技术实践——SFT与DPO](https://xingwangzhe.fun/posts/ai-training-sft-dpo-day2.md): 人工智能实训Day2笔记：使用LLaMA-Factory对Qwen1.5-0.5B-Chat进行SFT监督微调（GSM8K）与DPO直接偏好优化（Math-Step-DPO-10K），包括CoT推理增强与β参数敏感性分析。
