InfiniOps
Operator Library for Accelerators
Loading...
Searching...
No Matches
infini::ops::MoeWna16Gemm Member List

This is the complete list of members for infini::ops::MoeWna16Gemm, including all inherited members.

active_implementation_indices(Device::Type dev_type)infini::ops::Operator< MoeWna16Gemm >inlinestatic
active_implementation_indices(Device::Type dev_type)infini::ops::Operator< MoeWna16Gemm >inlinestatic
bit_infini::ops::MoeWna16Gemmprotected
block_size_k_infini::ops::MoeWna16Gemmprotected
block_size_m_infini::ops::MoeWna16Gemmprotected
block_size_n_infini::ops::MoeWna16Gemmprotected
Call(const Handle &handle, const Config &config, const Args &... args)infini::ops::Operator< MoeWna16Gemm >static
Call(const Tensor tensor, const Args &... args)infini::ops::Operator< MoeWna16Gemm >inlinestatic
Call(const TensorLike &tensor, const Args &... args)infini::ops::Operator< MoeWna16Gemm >inlinestatic
Call(const Handle &handle, const Config &config, const Args &... args)infini::ops::Operator< MoeWna16Gemm >inlinestatic
Call(const Tensor tensor, const Args &... args)infini::ops::Operator< MoeWna16Gemm >inlinestatic
Call(const TensorLike &tensor, const Args &... args)infini::ops::Operator< MoeWna16Gemm >inlinestatic
clear_cache()infini::ops::Operator< MoeWna16Gemm >inlinestatic
clear_cache()infini::ops::Operator< MoeWna16Gemm >inlinestatic
config_ptr_infini::ops::OperatorBaseprotected
device_index_infini::ops::MoeWna16Gemmprotected
device_type_infini::ops::MoeWna16Gemmprotected
dtype_infini::ops::MoeWna16Gemmprotected
expert_ids_size_infini::ops::MoeWna16Gemmprotected
group_size_infini::ops::MoeWna16Gemmprotected
handle_ptr_infini::ops::OperatorBaseprotected
has_qzeros_infini::ops::MoeWna16Gemmprotected
has_topk_weights_infini::ops::MoeWna16Gemmprotected
implementation_index_infini::ops::Operator< MoeWna16Gemm >protectedstatic
k_infini::ops::MoeWna16Gemmprotected
m_infini::ops::MoeWna16Gemmprotected
Make(const Config &config, const Tensor tensor, Args &&... args)infini::ops::Operator< MoeWna16Gemm >inlinestatic
Make(const Tensor tensor, Args &&... args)infini::ops::Operator< MoeWna16Gemm >inlinestatic
Make(const Config &config, const std::vector< Tensor > tensors, Args &&... args)infini::ops::Operator< MoeWna16Gemm >inlinestatic
Make(const std::vector< Tensor > tensors, Args &&... args)infini::ops::Operator< MoeWna16Gemm >inlinestatic
Make(const Config &config, const Tensor tensor, Args &&... args)infini::ops::Operator< MoeWna16Gemm >inlinestatic
Make(const Tensor tensor, Args &&... args)infini::ops::Operator< MoeWna16Gemm >inlinestatic
Make(const Config &config, const std::vector< Tensor > tensors, Args &&... args)infini::ops::Operator< MoeWna16Gemm >inlinestatic
Make(const std::vector< Tensor > tensors, Args &&... args)infini::ops::Operator< MoeWna16Gemm >inlinestatic
MoeWna16Gemm(const Tensor input, const Tensor b_qweight, const Tensor b_scales, std::optional< Tensor > b_qzeros, std::optional< Tensor > topk_weights, const Tensor sorted_token_ids, const Tensor expert_ids, const Tensor num_tokens_post_pad, const int64_t top_k, const int64_t block_size_m, const int64_t block_size_n, const int64_t block_size_k, const int64_t bit, Tensor output)infini::ops::MoeWna16Gemminline
n_infini::ops::MoeWna16Gemmprotected
num_experts_infini::ops::MoeWna16Gemmprotected
num_groups_infini::ops::MoeWna16Gemmprotected
operator()(const Tensor input, const Tensor b_qweight, const Tensor b_scales, std::optional< Tensor > b_qzeros, std::optional< Tensor > topk_weights, const Tensor sorted_token_ids, const Tensor expert_ids, const Tensor num_tokens_post_pad, const int64_t top_k, const int64_t block_size_m, const int64_t block_size_n, const int64_t block_size_k, const int64_t bit, Tensor output) const =0infini::ops::MoeWna16Gemmpure virtual
Operator< MoeWna16Gemm >::operator()(const Handle &handle, const Args &... args)infini::ops::Operator< MoeWna16Gemm >inline
Operator< MoeWna16Gemm >::operator()(const Args &... args) constinfini::ops::Operator< MoeWna16Gemm >inline
set_config(const Config &config)infini::ops::OperatorBaseinline
set_config(const Config &config)infini::ops::OperatorBaseinline
set_handle(const Handle &handle)infini::ops::OperatorBaseinline
set_handle(const Handle &handle)infini::ops::OperatorBaseinline
set_stream(void *stream)infini::ops::OperatorBaseinline
set_stream(void *stream)infini::ops::OperatorBaseinline
set_workspace(void *workspace)infini::ops::OperatorBaseinline
set_workspace(void *workspace)infini::ops::OperatorBaseinline
set_workspace_size_in_bytes(std::size_t workspace_size_in_bytes)infini::ops::OperatorBaseinline
set_workspace_size_in_bytes(std::size_t workspace_size_in_bytes)infini::ops::OperatorBaseinline
sorted_token_ids_size_infini::ops::MoeWna16Gemmprotected
stream_infini::ops::OperatorBaseprotected
top_k_infini::ops::MoeWna16Gemmprotected
ValidateCallMetadata(const Tensor input, const Tensor b_qweight, const Tensor b_scales, std::optional< Tensor > b_qzeros, std::optional< Tensor > topk_weights, const Tensor sorted_token_ids, const Tensor expert_ids, const Tensor num_tokens_post_pad, const int64_t top_k, const int64_t block_size_m, const int64_t block_size_n, const int64_t block_size_k, const int64_t bit, const Tensor output) constinfini::ops::MoeWna16Gemminlineprotected
workspace_infini::ops::OperatorBaseprotected
workspace_size_in_bytes() constinfini::ops::OperatorBaseinlinevirtual
workspace_size_in_bytes() constinfini::ops::OperatorBaseinlinevirtual
workspace_size_in_bytes_infini::ops::OperatorBaseprotected
~OperatorBase()=defaultinfini::ops::OperatorBasevirtual
~OperatorBase()=defaultinfini::ops::OperatorBasevirtual