aclprofGetOpEnd
aclprofGetOpNameLen
函数功能
获取算子名称的字符串长度,用于内存申请。同步接口。
建议用户新建一个线程,在新线程内调用该接口,否则可能阻塞主线程中的其它任务调度。
函数原型
aclError aclprofGetOpNameLen(const void *opInfo, size_t opInfoLen, uint32_t index, size_t *opNameLen)
参数说明
| 参数名 | 输入/输出 | 说明 |
|---|---|---|
| opInfo | 输入 | 包含算子信息的地址。 |
| opInfoLen | 输入 | 算子信息的长度。 |
| index | 输入 | 指定获取第几个算子的算子名称长度。 用户调用aclprofGetOpNum接口获取算子数量后,这个index的取值范围:[0, (算子数量-1)]。 |
| opNameLen | 输出 | opName的实际内存申请长度。 |
返回值说明
返回0表示成功,返回其它值表示失败。
参考资源
接口调用示例,参见Profiling性能数据采集。
父主题: Profiling AscendCL API for Subscription(订阅算子信息的Profiling AscendCL API)
aclprofGetOpName
函数功能
获取指定算子的算子名称。同步接口。
建议用户新建一个线程,在新线程内调用该接口,否则可能阻塞主线程中的其它任务调度。
函数原型
aclError aclprofGetOpName(const void *opInfo, size_t opInfoLen, uint32_t index, char *opName, size_t opNameLen)
参数说明
| 参数名 | 输入/输出 | 说明 |
|---|---|---|
| opInfo | 输入 | 包含算子信息的地址。 |
| opInfoLen | 输入 | 算子信息的长度。 |
| index | 输入 | 指定获取第几个算子的算子名称。 用户调用aclprofGetOpNum接口获取算子数量后,这个index的取值范围:[0, (算子数量-1)]。 |
| opName | 输出 | 算子名称。 |
| opNameLen | 输入 | opName的实际内存申请长度。取值范围建议不小于aclprofGetOpNameLen,否则内容会有截断。 |
返回值说明
返回0表示成功,返回其它值表示失败。
参考资源
接口调用示例,参见Profiling性能数据采集。
父主题: Profiling AscendCL API for Subscription(订阅算子信息的Profiling AscendCL API)
aclprofGetOpStart
函数功能
获取算子执行的开始时间,单位为ns。同步接口。
建议用户新建一个线程,在新线程内调用该接口,否则可能阻塞主线程中的其它任务调度。
函数原型
uint64_t aclprofGetOpStart(const void *opInfo, size_t opInfoLen, uint32_t index)
参数说明
| 参数名 | 输入/输出 | 说明 |
|---|---|---|
| opInfo | 输入 | 包含算子信息的地址。 |
| opInfoLen | 输入 | 算子信息的长度。 |
| index | 输入 | 指定获取第几个算子执行的开始时间。 用户调用aclprofGetOpNum接口获取算子数量后,这个index的取值范围:[0, (算子数量-1)]。 |
返回值说明
算子执行的开始时间。
参考资源
接口调用示例,参见Profiling性能数据采集。
父主题: Profiling AscendCL API for Subscription(订阅算子信息的Profiling AscendCL API)
aclprofGetOpEnd
函数功能
获取算子执行的结束时间,单位为ns。同步接口。
建议用户新建一个线程,在新线程内调用该接口,否则可能阻塞主线程中的其它任务调度。
函数原型
uint64_t aclprofGetOpEnd(const void *opInfo, size_t opInfoLen, uint32_t index)
参数说明
| 参数名 | 输入/输出 | 说明 |
|---|---|---|
| opInfo | 输入 | 包含算子信息的地址。 |
| opInfoLen | 输入 | 算子信息的长度。 |
| index | 输入 | 指定获取第几个算子执行的结束时间。 用户调用aclprofGetOpNum接口获取算子数量后,这个index的取值范围:[0, (算子数量-1)]。 |
返回值说明
算子执行结束时间。
参考资源
接口调用示例,参见Profiling性能数据采集。
父主题: Profiling AscendCL API for Subscription(订阅算子信息的Profiling AscendCL API)
aclprofGetOpDuration
函数功能
获取算子执行的耗时时间,单位为ns。同步接口。
建议用户新建一个线程,在新线程内调用该接口,否则可能阻塞主线程中的其它任务调度。
函数原型
uint64_t aclprofGetOpDuration(const void *opInfo, size_t opInfoLen, uint32_t index)
参数说明
| 参数名 | 输入/输出 | 说明 |
|---|---|---|
| opInfo | 输入 | 包含算子信息的地址。 |
| opInfoLen | 输入 | 算子信息的长度。 |
| index | 输入 | 指定获取第几个算子执行的耗时时间。 用户调用aclprofGetOpNum接口获取算子数量后,这个index的取值范围:[0, (算子数量-1)]。 |
返回值说明
算子执行的耗时时间。
参考资源
接口调用示例,参见Profiling性能数据采集。
父主题: Profiling AscendCL API for Subscription(订阅算子信息的Profiling AscendCL API)
aclprofGetModelId
函数功能
获取指定算子所在模型的ID。同步接口。
建议用户新建一个线程,在新线程内调用该接口,否则可能阻塞主线程中的其它任务调度。
函数原型
size_t aclprofGetModelId(const void *opInfo, size_t opInfoLen, uint32_t index)
参数说明
| 参数名 | 输入/输出 | 说明 |
|---|---|---|
| opInfo | 输入 | 包含算子信息的地址。 |
| opInfoLen | 输入 | 算子信息的长度。 |
| index | 输入 | 指定获取第几个算子所在模型的ID。 用户调用aclprofGetOpNum接口获取算子数量后,这个index的取值范围:[0, (算子数量-1)]。 |
返回值说明
模型的ID。
参考资源
接口调用示例,参见Profiling性能数据采集。
父主题: Profiling AscendCL API for Subscription(订阅算子信息的Profiling AscendCL API)
aclprofGetStepTimestamp
函数功能
利用单算子加载与执行接口实现训练的场景下,使用本接口用于标记迭代开始与结束时间,为后续Profiling解析提供迭代标识,以便以迭代为粒度展示性能数据。
函数原型
aclError aclprofGetStepTimestamp(aclprofStepInfo* stepInfo, aclprofStepTag tag, aclrtStream stream)
参数说明
| 参数名 | 输入/输出 | 说明 |
|---|---|---|
| stepinfo | 输入 | 指定迭代信息。需提前调用aclprofCreateStepInfo接口创建**aclprofStepInfo**类型的数据。 |
| tag | 输入 | 用于标记迭代开始或结束。在迭代开始时传入枚举值ACL_STEP_START,迭代结束时需传入枚举值ACL_STEP_END。 |
| stream | 输入 | 指定Stream。 |
返回值说明
返回0表示成功,返回其它值表示失败。
父主题: Profiling AscendCL API(PyTorch场景标记迭代时间)
在线提单