mindspore/docs/api/api_python/dataset/mindspore.dataset.Dataset.s...

64 lines
1.9 KiB
ReStructuredText
Raw Normal View History

2022-07-21 10:55:35 +08:00
.. py:method:: save(file_name, num_files=1, file_type='mindrecord')
2022-08-30 17:46:45 +08:00
将数据处理管道中正处理的数据保存为通用的数据集格式。数据集格式仅支持:'mindrecord'。可以使用'MindDataset'类来读取保存的'mindrecord'文件。
2022-07-21 10:55:35 +08:00
将数据保存为'mindrecord'格式时存在隐式类型转换。转换表展示如何执行类型转换。
.. list-table:: 保存为'mindrecord'格式时的隐式类型转换
:widths: 25 25 50
:header-rows: 1
* - 'dataset'类型
- 'mindrecord'类型
- 说明
* - bool
- None
- 不支持
* - int8
- int32
-
* - uint8
- bytes
- 丢失维度信息
* - int16
- int32
-
* - uint16
- int32
-
* - int32
- int32
-
* - uint32
- int64
-
* - int64
- int64
-
* - uint64
- None
- 不支持
* - float16
- float32
-
* - float32
- float32
-
* - float64
- float64
-
* - string
- string
- 不支持多维字符串
.. note::
1. 如需按顺序保存数据,将数据集的 `shuffle` 设置为False`num_files` 设置为1。
2. 在执行保存操作之前不要使用batch操作、repeat操作或具有随机属性的数据增强的map操作。
3. 当数据的维度可变时只支持1维数组或者在第0维变化的多维数组。
4. 不支持UINT64类型、多维的UINT8类型、多维STRING类型。
参数:
- **file_name** (str) - 数据集文件的路径。
- **num_files** (int, 可选) - 数据集文件的数量默认值1。
- **file_type** (str, 可选) - 数据集格式,默认值:'mindrecord'。