跳到主要内容

aclprofGetOpEnd

aclprofGetOpNameLen

函数功能

获取算子名称的字符串长度,用于内存申请。同步接口。

建议用户新建一个线程,在新线程内调用该接口,否则可能阻塞主线程中的其它任务调度。

函数原型

aclError aclprofGetOpNameLen(const void *opInfo, size_t opInfoLen, uint32_t index, size_t *opNameLen)

参数说明

参数名输入/输出说明
opInfo输入包含算子信息的地址。
opInfoLen输入算子信息的长度。
index输入指定获取第几个算子的算子名称长度。 用户调用aclprofGetOpNum接口获取算子数量后,这个index的取值范围:[0, (算子数量-1)]。
opNameLen输出opName的实际内存申请长度。

返回值说明

返回0表示成功,返回其它值表示失败。

参考资源

接口调用示例,参见Profiling性能数据采集

父主题: Profiling AscendCL API for Subscription(订阅算子信息的Profiling AscendCL API)

aclprofGetOpName

函数功能

获取指定算子的算子名称。同步接口。

建议用户新建一个线程,在新线程内调用该接口,否则可能阻塞主线程中的其它任务调度。

函数原型

aclError aclprofGetOpName(const void *opInfo, size_t opInfoLen, uint32_t index, char *opName, size_t opNameLen)

参数说明

参数名输入/输出说明
opInfo输入包含算子信息的地址。
opInfoLen输入算子信息的长度。
index输入指定获取第几个算子的算子名称。 用户调用aclprofGetOpNum接口获取算子数量后,这个index的取值范围:[0, (算子数量-1)]。
opName输出算子名称。
opNameLen输入opName的实际内存申请长度。取值范围建议不小于aclprofGetOpNameLen,否则内容会有截断。

返回值说明

返回0表示成功,返回其它值表示失败。

参考资源

接口调用示例,参见Profiling性能数据采集

父主题: Profiling AscendCL API for Subscription(订阅算子信息的Profiling AscendCL API)

aclprofGetOpStart

函数功能

获取算子执行的开始时间,单位为ns。同步接口。

建议用户新建一个线程,在新线程内调用该接口,否则可能阻塞主线程中的其它任务调度。

函数原型

uint64_t aclprofGetOpStart(const void *opInfo, size_t opInfoLen, uint32_t index)

参数说明

参数名输入/输出说明
opInfo输入包含算子信息的地址。
opInfoLen输入算子信息的长度。
index输入指定获取第几个算子执行的开始时间。 用户调用aclprofGetOpNum接口获取算子数量后,这个index的取值范围:[0, (算子数量-1)]。

返回值说明

算子执行的开始时间。

参考资源

接口调用示例,参见Profiling性能数据采集

父主题: Profiling AscendCL API for Subscription(订阅算子信息的Profiling AscendCL API)

aclprofGetOpEnd

函数功能

获取算子执行的结束时间,单位为ns。同步接口。

建议用户新建一个线程,在新线程内调用该接口,否则可能阻塞主线程中的其它任务调度。

函数原型

uint64_t aclprofGetOpEnd(const void *opInfo, size_t opInfoLen, uint32_t index)

参数说明

参数名输入/输出说明
opInfo输入包含算子信息的地址。
opInfoLen输入算子信息的长度。
index输入指定获取第几个算子执行的结束时间。 用户调用aclprofGetOpNum接口获取算子数量后,这个index的取值范围:[0, (算子数量-1)]。

返回值说明

算子执行结束时间。

参考资源

接口调用示例,参见Profiling性能数据采集

父主题: Profiling AscendCL API for Subscription(订阅算子信息的Profiling AscendCL API)

aclprofGetOpDuration

函数功能

获取算子执行的耗时时间,单位为ns。同步接口。

建议用户新建一个线程,在新线程内调用该接口,否则可能阻塞主线程中的其它任务调度。

函数原型

uint64_t aclprofGetOpDuration(const void *opInfo, size_t opInfoLen, uint32_t index)

参数说明

参数名输入/输出说明
opInfo输入包含算子信息的地址。
opInfoLen输入算子信息的长度。
index输入指定获取第几个算子执行的耗时时间。 用户调用aclprofGetOpNum接口获取算子数量后,这个index的取值范围:[0, (算子数量-1)]。

返回值说明

算子执行的耗时时间。

参考资源

接口调用示例,参见Profiling性能数据采集

父主题: Profiling AscendCL API for Subscription(订阅算子信息的Profiling AscendCL API)

aclprofGetModelId

函数功能

获取指定算子所在模型的ID。同步接口。

建议用户新建一个线程,在新线程内调用该接口,否则可能阻塞主线程中的其它任务调度。

函数原型

size_t aclprofGetModelId(const void *opInfo, size_t opInfoLen, uint32_t index)

参数说明

参数名输入/输出说明
opInfo输入包含算子信息的地址。
opInfoLen输入算子信息的长度。
index输入指定获取第几个算子所在模型的ID。 用户调用aclprofGetOpNum接口获取算子数量后,这个index的取值范围:[0, (算子数量-1)]。

返回值说明

模型的ID。

参考资源

接口调用示例,参见Profiling性能数据采集

父主题: Profiling AscendCL API for Subscription(订阅算子信息的Profiling AscendCL API)

aclprofGetStepTimestamp

函数功能

利用单算子加载与执行接口实现训练的场景下,使用本接口用于标记迭代开始与结束时间,为后续Profiling解析提供迭代标识,以便以迭代为粒度展示性能数据。

函数原型

aclError aclprofGetStepTimestamp(aclprofStepInfo* stepInfo, aclprofStepTag tag, aclrtStream stream)

参数说明

参数名输入/输出说明
stepinfo输入指定迭代信息。需提前调用aclprofCreateStepInfo接口创建**aclprofStepInfo**类型的数据。
tag输入用于标记迭代开始或结束。在迭代开始时传入枚举值ACL_STEP_START,迭代结束时需传入枚举值ACL_STEP_END。
stream输入指定Stream。

返回值说明

返回0表示成功,返回其它值表示失败。

父主题: Profiling AscendCL API(PyTorch场景标记迭代时间)

在线提单