i-robot
dfd71f668b
!26556 modify parallel api note for master
...
Merge pull request !26556 from lilei/modify_parallel_API_note
2021-11-25 03:02:55 +00:00
i-robot
8c58c2dc1d
!26730 [Auto parallel] [MoE] Changing large transpose for performace in MoE
...
Merge pull request !26730 from Xiaoda/109-change-moe-transpose-for-performance
2021-11-25 02:22:54 +00:00
lilei
f8827a09fb
modify parallel API note for master
2021-11-24 17:44:35 +08:00
Xiaoda Zhang
23387e154c
using multiple operators to implement the sematic of a large transpose
2021-11-24 15:13:47 +08:00
i-robot
519f14a909
!26006 slice recompute activation
...
Merge pull request !26006 from yao_yf/add_transformer_slice_activation_config
2021-11-24 06:14:28 +00:00
huangxinjing
55efaabe2a
Fix api doc error
2021-11-24 09:24:40 +08:00
Xiaoda Zhang
2c25b277d0
adding constraints checking and examples for MoEConfig
2021-11-22 16:59:22 +08:00
yao_yf
188d39da83
slice_activation_in_recompute
...
slice recompute activation
2021-11-19 10:51:54 +08:00
huangxinjing
8c2dec7fe2
Fix coo layers
2021-11-12 16:06:02 +08:00
i-robot
781b2ace39
!26039 Fix Merge Error For the Linear in Transformer API
...
Merge pull request !26039 from huangxinjing/fix_linear_merger_error
2021-11-10 01:06:56 +00:00
huangxinjing
d1123c9b20
fix linear merge error for pangu model
2021-11-09 11:58:07 +08:00
huangxinjing
f354ab22a3
add pipeline shard interface
...
Add support for no pipeline accugradient
Add delay tag for fusion op
Optimizer the visite order
add mirror for mini step control
Move the group to attributes
Add gradient_shard control for the mini step
Fix code stype
Fix ut description
Add interface
2021-11-09 09:11:13 +08:00
Xiaoda Zhang
7165c2158d
adjusting symbols
2021-11-05 10:02:12 +08:00
i-robot
b8ec196d6e
!25708 Add mode check
...
Merge pull request !25708 from huangxinjing/add_mode_check
2021-11-04 07:09:06 +00:00
i-robot
27be612516
!25719 Add Device number check
...
Merge pull request !25719 from huangxinjing/add_device_number_check
2021-11-04 01:34:22 +00:00
huangxinjing
bd5cfafe2c
Add mode check
...
Add parallel mode check
2021-11-04 09:05:34 +08:00
huangxinjing
741e3604eb
Add Device Number Check
2021-11-01 15:36:50 +08:00
i-robot
1cd6573bff
!25406 Fix bug for GPU Pipeline
...
Merge pull request !25406 from Cononlly/gpu-moe
2021-11-01 06:12:12 +00:00
b00518648
ef715a54a0
clean code
2021-10-30 09:23:23 +08:00
huangxinjing
e0674b37d3
Remove the comments
...
fix matmul name
2021-10-28 11:18:01 +08:00
huangxinjing
7bd77e549c
Fix number of the input params error
2021-10-26 12:04:12 +08:00
cononlly
cc83b8064f
Fix code for GPU Pipeline
2021-10-26 10:41:51 +08:00
i-robot
6ca06c2502
!25176 Fix dropout strategy
...
Merge pull request !25176 from huangxinjing/origin/master
2021-10-21 06:07:22 +00:00
huangxinjing
4dc8e99d7c
Fix transformer dropout error
2021-10-20 14:27:04 +08:00
i-robot
ae87f31dea
!25088 Optimize the comment and log descriptions for the python source code
...
Merge pull request !25088 from zhunaipan/master
2021-10-20 06:26:56 +00:00
zhunaipan
8ce4e62725
optimize the comment and log description
...
修改: ops/operations/_inner_ops.py
修改: ops/operations/_quant_ops.py
修改: ops/operations/array_ops.py
修改: ops/operations/comm_ops.py
修改: ops/operations/math_ops.py
修改: ops/operations/quantum_ops.py
修改: ops/operations/rl_ops.py
修改: ops/operations/sponge_ops.py
修改: ops/operations/sponge_update_ops.py
修改: train/__init__.py
修改: common/tensor.py
修改: train/serialization.py
修改: ccsrc/pipeline/jit/parse/parse.h
修改: explainer/benchmark/_attribution/metric.py
修改: ops/composite/multitype_ops/_constexpr_utils.py
修改: ops/operations/comm_ops.py
修改: RELEASE.md
修改: mindspore/_extends/parse/standard_method.py
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/concat_offset_cpu_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/dynamic_shape_cpu_kernel.cc
修改: mindspore/ccsrc/frontend/parallel/ops_info/reshape_info.cc
修改: mindspore/ccsrc/frontend/parallel/ops_info/tile_info.cc
修改: mindspore/ccsrc/frontend/parallel/ops_info/transpose_info.cc
修改: mindspore/ccsrc/frontend/parallel/strategy.h
修改: mindspore/common/tensor.py
修改: mindspore/core/abstract/prim_arrays.cc
修改: mindspore/core/abstract/prim_nn.cc
修改: mindspore/core/ops/conv2d.cc
修改: mindspore/core/ops/logical_and.h
修改: mindspore/core/ops/logical_not.h
修改: mindspore/core/ops/logical_or.h
修改: mindspore/core/ops/reduce_all.h
修改: mindspore/core/ops/reduce_any.h
修改: mindspore/lite/src/runtime/kernel/arm/fp32_grad/sgd.cc
修改: mindspore/nn/layer/quant.py
修改: mindspore/nn/optim/sgd.py
修改: mindspore/nn/sparse/sparse.py
修改: mindspore/numpy/array_creations.py
修改: mindspore/numpy/array_ops.py
修改: mindspore/numpy/logic_ops.py
修改: mindspore/numpy/math_ops.py
修改: mindspore/ops/operations/_inner_ops.py
修改: mindspore/ops/operations/array_ops.py
修改: mindspore/ops/operations/rl_ops.py
修改: mindspore/train/_utils.py
修改: tests/ut/python/model/test_lenet_core_after_exception.py
修改: mindspore/_extends/parse/standard_method.py
修改: mindspore/ops/operations/rl_ops.py
修改: mindspore/core/abstract/prim_nn.cc
修改: mindspore/core/ops/conv2d.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/ctcloss_cpu_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/fl/fused_pull_weight_kernel.h
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/fl/fused_push_weight_kernel.h
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/mkldnn/conv2d_grad_filter_cpu_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/mkldnn/conv2d_grad_input_cpu_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/ps/sparse_apply_ftrl_ps_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/ps/sparse_apply_lazy_adam_ps_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/rolling_cpu_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/scatter_arithmetic_cpu_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/split_cpu_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/update_cache_cpu_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/gpu/arrays/split_gpu_kernel.h
修改: mindspore/ccsrc/backend/kernel_compiler/gpu/math/broadcast_gpu_kernel.h
修改: mindspore/ccsrc/backend/kernel_compiler/gpu/nn/conv2d_grad_input_gpu_kernel.h
修改: mindspore/ccsrc/fl/server/server.cc
修改: mindspore/ccsrc/frontend/optimizer/ad/kpynative.cc
修改: mindspore/ccsrc/frontend/optimizer/irpass/incorporate_getitem.h
修改: mindspore/ccsrc/frontend/optimizer/irpass/inline.h
修改: mindspore/ccsrc/minddata/dataset/core/device_tensor.cc
修改: mindspore/ccsrc/minddata/dataset/core/tensor.cc
修改: mindspore/ccsrc/minddata/dataset/engine/datasetops/source/emnist_op.cc
修改: mindspore/ccsrc/minddata/dataset/engine/datasetops/source/mnist_op.cc
修改: mindspore/ccsrc/minddata/dataset/engine/datasetops/source/qmnist_op.cc
修改: mindspore/ccsrc/minddata/dataset/engine/ir/datasetops/dataset_node.cc
修改: mindspore/ccsrc/minddata/dataset/engine/opt/pre/epoch_ctrl_pass.cc
修改: mindspore/ccsrc/minddata/dataset/kernels/image/lite_image_utils.cc
修改: mindspore/ccsrc/pipeline/jit/action.cc
修改: mindspore/ccsrc/pipeline/jit/static_analysis/evaluator.cc
修改: mindspore/ccsrc/runtime/device/ascend/executor/tiling/op_tiling_adapter.cc
修改: mindspore/compression/quant/quant_utils.py
修改: mindspore/core/abstract/prim_nn.cc
修改: mindspore/dataset/engine/validators.py
修改: mindspore/lite/micro/coder/opcoders/nnacl/fp32/affine_fp32_coder.cc
修改: mindspore/lite/micro/coder/opcoders/nnacl/int8/affine_int8_coder.cc
修改: mindspore/lite/src/runtime/kernel/ascend310/src/custom_kernel.cc
修改: mindspore/lite/src/runtime/kernel/opencl/kernel/matmul.cc
修改: mindspore/lite/src/runtime/kernel/opencl/kernel/strassen.cc
修改: mindspore/lite/tools/common/graph_util.h
修改: mindspore/lite/tools/optimizer/fisson/fisson_util.cc
修改: mindspore/ops/composite/math_ops.py
修改: mindspore/ops/operations/_inner_ops.py
修改: mindspore/ops/operations/array_ops.py
修改: mindspore/ops/operations/math_ops.py
修改: mindspore/ops/operations/other_ops.py
修改: mindspore/boost/boost_cell_wrapper.py
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/update_cache_cpu_kernel.cc
修改: mindspore/ccsrc/common/trans.cc
修改: mindspore/ccsrc/frontend/parallel/cache_embedding/cache_embedding.cc
修改: mindspore/ccsrc/frontend/parallel/ops_info/gather_info.cc
修改: mindspore/lite/src/common/log_util.h
修改: mindspore/nn/wrap/loss_scale.py
修改: mindspore/parallel/nn/moe.py
修改: tests/mindspore_test_framework/mindspore_test.py
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/split_cpu_kernel.cc
修改: mindspore/lite/tools/common/graph_util.h
修改: mindspore/ccsrc/frontend/parallel/ops_info/gather_info.cc
修改: mindspore/core/ops/conv2d.cc
修改: tests/ut/python/model/test_lenet_core_after_exception.py
2021-10-20 12:02:40 +08:00
Xiaoda Zhang
50e0fa79af
adjust indent
2021-10-18 18:25:00 +08:00
i-robot
94ed3d9f97
!24665 [Auto parallel] Refine the comments of parallel-related interfaces
...
Merge pull request !24665 from Xiaoda/95-add-comments-of-parallel-interfaces
2021-10-14 03:56:43 +00:00
Xiaoda Zhang
88b6a58462
refine the comments of parallel-related interfaces
2021-10-12 19:35:24 +08:00
huangxinjing
ebdad2e450
Fix api comment
2021-10-11 09:11:16 +08:00
i-robot
ab5c15074a
!24486 modify parallel api note for master
...
Merge pull request !24486 from lilei/code_docs_modify_parallel_note
2021-10-09 02:36:31 +00:00
lilei
36596cc7e6
modify parallel API note
2021-09-30 17:42:24 +08:00
huangxinjing
a3ee85ede4
Fix reshape error
2021-09-30 11:06:46 +08:00
huangxinjing
827597f6fe
Add transformer example
2021-09-29 21:08:27 +08:00
huangxinjing
9ddd2b7669
Add past none check
...
Add if else for past none
2021-09-26 09:13:29 +08:00
linqingke
acde7febef
update pangu reshape and softmax performance.
...
Add layer norm judge
Fix layer norm name error
Fix input tyoe check
Fix ut test
Add 3d supports
2021-09-24 09:06:16 +08:00
huangxinjing
b787c5c8c8
Fix spell error
2021-09-22 14:21:41 +08:00
huangxinjing
31b3b46852
Replace TensorAdd with Add
2021-09-16 21:25:15 +08:00
i-robot
cdbe9b9a64
!23596 [Auto parallel] Move the MoE-related staff to an isolated file
...
Merge pull request !23596 from Xiaoda/89-moe-adaption
2021-09-16 09:57:04 +00:00
Xiaoda Zhang
615be06ec8
move moe-related staff to an isolated file
2021-09-16 14:26:19 +08:00
huangxinjing
0b89d5c9c4
fix batch size error
2021-09-16 10:56:40 +08:00
i-robot
be10bb7af6
!23517 fix parallel opt recompute pass warning
...
Merge pull request !23517 from yao_yf/parallel_opt_recompute_pass_warning_fix
2021-09-15 08:18:14 +00:00
yao_yf
b647bbf444
fix warning
2021-09-15 11:57:58 +08:00
huangxinjing
c3a98bab2b
Add code check
...
fix pangu error
fix leakyrelu error
2021-09-14 19:43:51 +08:00
i-robot
7828fb0028
!23328 Fix error message
...
Merge pull request !23328 from huangxinjing/fix_error_msg
2021-09-13 08:38:16 +00:00
yao_yf
3d1f74b9d0
fixed sparse atten add strategy for div
2021-09-13 10:03:41 +08:00
huangxinjing
7932c88aaf
fix message error
2021-09-13 09:00:20 +08:00
huangxinjing
110008e868
fix input error
2021-09-10 10:51:13 +08:00
huangxinjing
e02f553010
Fix spell error and add mode check
2021-09-09 18:50:53 +08:00
Xiaoda Zhang
5613c0b974
add a moe implementation:
...
1) extend the Liner cell for including BatchMatMul implementation, in
which the first dimension indicates the expert number;
2) implement a Switch (top1) router;
3) implement a MoE cell, which extends the FeedForward cell.
2021-09-09 11:53:42 +08:00