mindspore-ci-bot
|
64abbeaa89
|
!705 add pynative cache
Merge pull request !705 from chujinjin/add_pynative_cache
|
2020-04-28 15:43:10 +08:00 |
kswang
|
e6f36e050f
|
change cpu kernel dir
|
2020-04-27 21:14:03 +08:00 |
mindspore-ci-bot
|
63712848e2
|
!494 Split ccsrc cmake to individual sub-directories
Merge pull request !494 from zhoufeng/cmake-sub
|
2020-04-27 11:42:05 +08:00 |
zhoufeng
|
b681cec8f2
|
cmake refactor
|
2020-04-26 20:51:18 +08:00 |
chujinjin
|
e2b0a28142
|
add pynative cache
|
2020-04-26 20:47:10 +08:00 |
mindspore-ci-bot
|
da8c74b54c
|
!688 [MS]fix kernel select bug
Merge pull request !688 from chenjianping/fix-bugs
|
2020-04-26 20:21:23 +08:00 |
chenjianping
|
6d47036f95
|
erase datatype raise kernel
|
2020-04-26 10:52:53 +00:00 |
limingqi107
|
664f2628e5
|
optimize gpu allReduce alloc memory performance
|
2020-04-26 15:22:41 +08:00 |
mindspore-ci-bot
|
2a31fce599
|
!647 change profiling iter_end point after last tbe kernel
Merge pull request !647 from caifubi/profiling_iter_end_point
|
2020-04-26 11:24:00 +08:00 |
caifubi
|
3f69b5b518
|
insert profiling iteration end point after last tbe kernel
|
2020-04-26 09:50:46 +08:00 |
mindspore-ci-bot
|
ffdad1acd4
|
!617 Match format when kernel selecting using raise or reduce precision
Merge pull request !617 from lianliguang/fix-bug-of-raise-precision
|
2020-04-24 14:13:56 +08:00 |
mindspore-ci-bot
|
bfab0bc856
|
!618 clean ascend runtime codex
Merge pull request !618 from caifubi/clean-runtime-codex
|
2020-04-24 09:15:14 +08:00 |
caifubi
|
246fc290d0
|
clean runtime codex
|
2020-04-23 22:32:44 +08:00 |
lianliguang
|
c4aeb5a0b8
|
add format chooice when kernel selecting reduce or raise precision
|
2020-04-23 21:58:03 +08:00 |
limingqi107
|
0f0e8fe874
|
gpu dynamic memory pool can not reuse allReduce in multi-stream
|
2020-04-23 20:40:35 +08:00 |
liubuyu
|
0b6b5e5123
|
fix codedex warning
|
2020-04-23 18:01:19 +08:00 |
caifubi
|
0cef4d8abd
|
set fp_start profiling point after getnext node
|
2020-04-23 11:53:57 +08:00 |
mindspore-ci-bot
|
ca3aa6071a
|
!527 gpu dynamic memory pool supports multi-allReduce
Merge pull request !527 from limingqi107/master
|
2020-04-22 16:28:24 +08:00 |
mindspore-ci-bot
|
ae31e8b516
|
!571 GPU change the strategy of computing capacity
Merge pull request !571 from VectorSL/update-gpu-compute-capacity
|
2020-04-22 15:51:30 +08:00 |
limingqi107
|
2891f0d20d
|
gpu dynamic memory pool supports multi-allReduce
|
2020-04-22 15:43:45 +08:00 |
VectorSL
|
b8d7cd9775
|
gpu change compute capacity strategy
|
2020-04-22 14:40:00 +08:00 |
mindspore-ci-bot
|
715c0735a8
|
!487 add dtype trans template
Merge pull request !487 from liubuyu/master
|
2020-04-22 14:29:36 +08:00 |
liubuyu
|
ac2d5df2a1
|
add dtype trans template
|
2020-04-22 11:25:23 +08:00 |
mindspore-ci-bot
|
1f7f11a3df
|
!553 insert profiling kernel for hccl kernel automaticly
Merge pull request !553 from caifubi/profiling-communication-op
|
2020-04-22 11:07:44 +08:00 |
mindspore-ci-bot
|
77b62c7f16
|
!555 [MS][Wndows]support default log level
Merge pull request !555 from chenjianping/fix-windows-bug
|
2020-04-22 10:51:43 +08:00 |
chenjianping
|
18d8a1d2d3
|
support default log level on windows 10
|
2020-04-22 02:24:48 +00:00 |
caifubi
|
94a455dace
|
insert profiling kernel for hccl automaticly
|
2020-04-22 10:14:25 +08:00 |
zhoufeng
|
c2b3360d69
|
update clang format rule
|
2020-04-21 21:21:19 +08:00 |
mindspore-ci-bot
|
475f62f680
|
!499 pynative support topk and print op
Merge pull request !499 from JoyLvliang/pynative-support-topk-and-print
|
2020-04-21 15:58:51 +08:00 |
lvliang
|
0e4824cd89
|
pynative-support-topk-and-print
|
2020-04-21 11:58:48 +08:00 |
gukecai
|
f8208c7c52
|
Support GetNext Parallel
|
2020-04-21 11:39:07 +08:00 |
limingqi107
|
5e01b94ccd
|
gpu dynamic memory pool suppoerts multi-graph
|
2020-04-18 18:15:52 +08:00 |
mindspore-ci-bot
|
093c2caed4
|
!337 optimize execute order sort
Merge pull request !337 from kisnwang/optimize-execute-order-sort
|
2020-04-18 17:27:55 +08:00 |
mindspore-ci-bot
|
b418b18447
|
!443 add cpu one hot
Merge pull request !443 from kisnwang/add-cpu-onehot-new
|
2020-04-18 16:10:32 +08:00 |
kswang
|
6775190e48
|
add cpu one hot
|
2020-04-18 14:44:03 +08:00 |
mindspore-ci-bot
|
7c06d292c8
|
!387 auto mix precision
Merge pull request !387 from liubuyu/master
|
2020-04-18 11:43:42 +08:00 |
liubuyu
|
852e61d46c
|
bug fix
|
2020-04-18 09:49:12 +08:00 |
liubuyu
|
b1585f862d
|
auto mix precision
|
2020-04-17 20:46:42 +08:00 |
liubuyu
|
fc07cd908e
|
add 6d format transfer
|
2020-04-17 19:23:53 +08:00 |
kswang
|
83eeac9310
|
optimize execute order sort
|
2020-04-17 15:09:48 +08:00 |
jjfeing
|
f9ef78609f
|
add nc1hwc0_c04 format
|
2020-04-17 14:16:54 +08:00 |
caifubi
|
bce5f57752
|
use GraphId as key of DavinciModel in ascend_kernel_runtime.cc
|
2020-04-16 17:22:42 +08:00 |
ZPaC
|
b8a9121597
|
Add GPU send and recv controlling kernels.
|
2020-04-16 11:28:54 +08:00 |
mindspore-ci-bot
|
58b013c319
|
!363 clear the warmming scan by package
Merge pull request !363 from SanjayChan/labao
|
2020-04-16 09:18:44 +08:00 |
chenzomi
|
b77f41d658
|
clear the warmming scan by package
|
2020-04-15 21:45:06 +08:00 |
mindspore-ci-bot
|
f9dd47620c
|
!300 refactor kernel select priority scheme
Merge pull request !300 from lianliguang/refactor-kernel_select
|
2020-04-15 21:26:20 +08:00 |
mindspore-ci-bot
|
285e258b3b
|
!347 fix e2e dump shape not match
Merge pull request !347 from dengwentao/dump
|
2020-04-15 19:34:21 +08:00 |
mindspore-ci-bot
|
4c3969e12a
|
!351 fix bug of TensorAddGrad single op run fail
Merge pull request !351 from caifubi/fix-bug-tensoradd-grad-op
|
2020-04-15 19:24:26 +08:00 |
jojobugfree
|
762bf9ac25
|
fix tensoradd grad op run fail
|
2020-04-15 18:42:36 +08:00 |
dengwentao
|
593c4fc700
|
fix shape used for dump
|
2020-04-15 17:39:50 +08:00 |