首页
AI / 大模型
  • 智能体 Agent
  • 大模型工程
  • 模型原理
  • AI 应用
  • 检索增强 RAG
大数据
  • Flink
  • Kafka
  • ClickHouse
  • Hive
  • ZooKeeper
  • Hadoop
运维部署
  • 网站部署
  • 后端与工程
项目管理 关于本站
峰的个人知识库 菜单
  1. 首页
  2. AI / 大模型
    1. 智能体 Agent
    2. 大模型工程
    3. 模型原理
    4. AI 应用
    5. 检索增强 RAG
  3. 大数据
    1. Flink
    2. Kafka
    3. ClickHouse
    4. Hive
    5. ZooKeeper
    6. Hadoop
  4. 运维部署
    1. 网站部署
    2. 后端与工程
  5. 项目管理
  6. 关于本站
快捷操作
登录

Transformer 与模型微调
模型原理 2025.10.10
阅读 2 评论 0 点赞 0

Transformer 与模型微调

Transformer基于Encoder-Decoder双模块架构,Encoder通过双向自注意力理解上下文,Decoder通过单向自注意力生成文本。自注意力机制以Q/K/V三向量交互为核心,结合多头注意力和位置编码实现全局语义建模。大模型(如GPT-4)是Transformer在数据和算力极致扩展的产物。主流架构包括Causal Decoder(LLaMA)、Prefix Decoder(ChatGLM)和Encoder-Decoder(T5),其中Decoder-only因训练高效、生成能力强成为主流。微调技术中,LoRA通过低秩矩阵仅训练1%~5%参数,适应多任务;RLHF分SFT、奖励模型、PPO三阶段对齐人类偏好,DPO可简化流程。实际应用中建议优先高质量指令数据,小数据量用Chat模型,大数据量用Base模型,RLHF可跳过奖励模型直接DPO。掌握这些核心知识能帮助高效落地大模型任务。

#Transformer#微调#LoRA
DATA · LLM · DEVOPS DATA · LLM · DEVOPS DATA · LLM · DEVOPS DATA · LLM · DEVOPS
F Archive

沉淀后端底层、大数据工程与大模型落地实践,结构化归档技术学习笔记。

导航

  • 首页
  • AI / 大模型
  • 大数据
  • 运维部署
  • 项目管理
  • 关于本站

© 2026 峰的个人知识库. 保留所有权利.

用 ♥ 与氢气构建

Built with Theme 氢·简 CMS Halo