MindSpore Transformers

介绍

  • 快速开始
  • 整体架构
  • 模型支持库

安装

  • 安装指南

训练指南

  • 训练指南

功能特性

  • 功能特性概述
  • 启动任务
  • 配置文件说明
  • 日志
  • 数据集
  • 训练超参数与优化器
  • 分布式并行训练
  • 训练内存优化
  • 权重保存与加载
  • 断点续训
  • 训练指标监控与 Profiling
  • 其它训练特性
  • 静态图实现特性

环境变量

  • 环境变量说明

贡献指南

  • MindSpore Transformers贡献指南
  • 魔乐社区贡献指南

FAQ

  • 模型相关 FAQ
  • 功能相关 FAQ

静态图实现(Deprecated)

  • 整体架构
  • 大模型全流程指南
  • 功能特性
    • 功能特性概述
    • 启动任务
    • Ckpt权重
    • Safetensors权重
    • 配置文件说明
    • 加载 Hugging Face 模型配置
    • 日志
    • 使用Tokenizer
    • 数据集
    • 训练超参数
    • 训练指标监控
    • 断点续训
    • checkpoint保存和加载
    • 断点续训2.0
    • 分布式并行训练
    • 训练高可用
    • 训练内存优化
    • 数据跳过和健康监测
    • Pre-trained Model Average 权重合并
    • 其它训练特性
    • 量化
  • 高阶开发
  • 优秀实践
  • 环境变量说明

RELEASE NOTES

  • Release Notes
MindSpore Transformers
  • »
  • 功能特性
  • 查看页面源码

功能特性

  • 功能特性概述
  • 启动任务
  • Ckpt权重
  • Safetensors权重
  • 配置文件说明
  • 加载 Hugging Face 模型配置
  • 日志
  • 使用Tokenizer
  • 数据集
  • 训练超参数
  • 训练指标监控
  • 断点续训
  • checkpoint保存和加载
  • 断点续训2.0
  • 分布式并行训练
  • 训练高可用
  • 训练内存优化
  • 数据跳过和健康监测
  • Pre-trained Model Average 权重合并
  • 其它训练特性
  • 量化
上一页 下一页

© 版权所有 MindSpore.

利用 Sphinx 构建,使用的 主题 由 Read the Docs 开发.