Commit Graph

90 Commits

Author SHA1 Message Date
mindspore-ci-bot 64abbeaa89 !705 add pynative cache
Merge pull request !705 from chujinjin/add_pynative_cache
2020-04-28 15:43:10 +08:00
kswang e6f36e050f change cpu kernel dir 2020-04-27 21:14:03 +08:00
mindspore-ci-bot 63712848e2 !494 Split ccsrc cmake to individual sub-directories
Merge pull request !494 from zhoufeng/cmake-sub
2020-04-27 11:42:05 +08:00
zhoufeng b681cec8f2 cmake refactor 2020-04-26 20:51:18 +08:00
chujinjin e2b0a28142 add pynative cache 2020-04-26 20:47:10 +08:00
mindspore-ci-bot da8c74b54c !688 [MS]fix kernel select bug
Merge pull request !688 from chenjianping/fix-bugs
2020-04-26 20:21:23 +08:00
chenjianping 6d47036f95 erase datatype raise kernel 2020-04-26 10:52:53 +00:00
limingqi107 664f2628e5 optimize gpu allReduce alloc memory performance 2020-04-26 15:22:41 +08:00
mindspore-ci-bot 2a31fce599 !647 change profiling iter_end point after last tbe kernel
Merge pull request !647 from caifubi/profiling_iter_end_point
2020-04-26 11:24:00 +08:00
caifubi 3f69b5b518 insert profiling iteration end point after last tbe kernel 2020-04-26 09:50:46 +08:00
mindspore-ci-bot ffdad1acd4 !617 Match format when kernel selecting using raise or reduce precision
Merge pull request !617 from lianliguang/fix-bug-of-raise-precision
2020-04-24 14:13:56 +08:00
mindspore-ci-bot bfab0bc856 !618 clean ascend runtime codex
Merge pull request !618 from caifubi/clean-runtime-codex
2020-04-24 09:15:14 +08:00
caifubi 246fc290d0 clean runtime codex 2020-04-23 22:32:44 +08:00
lianliguang c4aeb5a0b8 add format chooice when kernel selecting reduce or raise precision 2020-04-23 21:58:03 +08:00
limingqi107 0f0e8fe874 gpu dynamic memory pool can not reuse allReduce in multi-stream 2020-04-23 20:40:35 +08:00
liubuyu 0b6b5e5123 fix codedex warning 2020-04-23 18:01:19 +08:00
caifubi 0cef4d8abd set fp_start profiling point after getnext node 2020-04-23 11:53:57 +08:00
mindspore-ci-bot ca3aa6071a !527 gpu dynamic memory pool supports multi-allReduce
Merge pull request !527 from limingqi107/master
2020-04-22 16:28:24 +08:00
mindspore-ci-bot ae31e8b516 !571 GPU change the strategy of computing capacity
Merge pull request !571 from VectorSL/update-gpu-compute-capacity
2020-04-22 15:51:30 +08:00
limingqi107 2891f0d20d gpu dynamic memory pool supports multi-allReduce 2020-04-22 15:43:45 +08:00
VectorSL b8d7cd9775 gpu change compute capacity strategy 2020-04-22 14:40:00 +08:00
mindspore-ci-bot 715c0735a8 !487 add dtype trans template
Merge pull request !487 from liubuyu/master
2020-04-22 14:29:36 +08:00
liubuyu ac2d5df2a1 add dtype trans template 2020-04-22 11:25:23 +08:00
mindspore-ci-bot 1f7f11a3df !553 insert profiling kernel for hccl kernel automaticly
Merge pull request !553 from caifubi/profiling-communication-op
2020-04-22 11:07:44 +08:00
mindspore-ci-bot 77b62c7f16 !555 [MS][Wndows]support default log level
Merge pull request !555 from chenjianping/fix-windows-bug
2020-04-22 10:51:43 +08:00
chenjianping 18d8a1d2d3 support default log level on windows 10 2020-04-22 02:24:48 +00:00
caifubi 94a455dace insert profiling kernel for hccl automaticly 2020-04-22 10:14:25 +08:00
zhoufeng c2b3360d69 update clang format rule 2020-04-21 21:21:19 +08:00
mindspore-ci-bot 475f62f680 !499 pynative support topk and print op
Merge pull request !499 from JoyLvliang/pynative-support-topk-and-print
2020-04-21 15:58:51 +08:00
lvliang 0e4824cd89 pynative-support-topk-and-print 2020-04-21 11:58:48 +08:00
gukecai f8208c7c52 Support GetNext Parallel 2020-04-21 11:39:07 +08:00
limingqi107 5e01b94ccd gpu dynamic memory pool suppoerts multi-graph 2020-04-18 18:15:52 +08:00
mindspore-ci-bot 093c2caed4 !337 optimize execute order sort
Merge pull request !337 from kisnwang/optimize-execute-order-sort
2020-04-18 17:27:55 +08:00
mindspore-ci-bot b418b18447 !443 add cpu one hot
Merge pull request !443 from kisnwang/add-cpu-onehot-new
2020-04-18 16:10:32 +08:00
kswang 6775190e48 add cpu one hot 2020-04-18 14:44:03 +08:00
mindspore-ci-bot 7c06d292c8 !387 auto mix precision
Merge pull request !387 from liubuyu/master
2020-04-18 11:43:42 +08:00
liubuyu 852e61d46c bug fix 2020-04-18 09:49:12 +08:00
liubuyu b1585f862d auto mix precision 2020-04-17 20:46:42 +08:00
liubuyu fc07cd908e add 6d format transfer 2020-04-17 19:23:53 +08:00
kswang 83eeac9310 optimize execute order sort 2020-04-17 15:09:48 +08:00
jjfeing f9ef78609f add nc1hwc0_c04 format 2020-04-17 14:16:54 +08:00
caifubi bce5f57752 use GraphId as key of DavinciModel in ascend_kernel_runtime.cc 2020-04-16 17:22:42 +08:00
ZPaC b8a9121597 Add GPU send and recv controlling kernels. 2020-04-16 11:28:54 +08:00
mindspore-ci-bot 58b013c319 !363 clear the warmming scan by package
Merge pull request !363 from SanjayChan/labao
2020-04-16 09:18:44 +08:00
chenzomi b77f41d658 clear the warmming scan by package 2020-04-15 21:45:06 +08:00
mindspore-ci-bot f9dd47620c !300 refactor kernel select priority scheme
Merge pull request !300 from lianliguang/refactor-kernel_select
2020-04-15 21:26:20 +08:00
mindspore-ci-bot 285e258b3b !347 fix e2e dump shape not match
Merge pull request !347 from dengwentao/dump
2020-04-15 19:34:21 +08:00
mindspore-ci-bot 4c3969e12a !351 fix bug of TensorAddGrad single op run fail
Merge pull request !351 from caifubi/fix-bug-tensoradd-grad-op
2020-04-15 19:24:26 +08:00
jojobugfree 762bf9ac25 fix tensoradd grad op run fail 2020-04-15 18:42:36 +08:00
dengwentao 593c4fc700 fix shape used for dump 2020-04-15 17:39:50 +08:00