InfiniOps
Operator Library for Accelerators
Loading...
Searching...
No Matches
infini::ops::GptqMarlinRepack Member List

This is the complete list of members for infini::ops::GptqMarlinRepack, including all inherited members.

active_implementation_indices(Device::Type dev_type)infini::ops::Operator< GptqMarlinRepack >inlinestatic
active_implementation_indices(Device::Type dev_type)infini::ops::Operator< GptqMarlinRepack >inlinestatic
b_q_weight_metadata_infini::ops::GptqMarlinRepackprotected
Call(const Handle &handle, const Config &config, const Args &... args)infini::ops::Operator< GptqMarlinRepack >static
Call(const Tensor tensor, const Args &... args)infini::ops::Operator< GptqMarlinRepack >inlinestatic
Call(const TensorLike &tensor, const Args &... args)infini::ops::Operator< GptqMarlinRepack >inlinestatic
Call(const Handle &handle, const Config &config, const Args &... args)infini::ops::Operator< GptqMarlinRepack >inlinestatic
Call(const Tensor tensor, const Args &... args)infini::ops::Operator< GptqMarlinRepack >inlinestatic
Call(const TensorLike &tensor, const Args &... args)infini::ops::Operator< GptqMarlinRepack >inlinestatic
clear_cache()infini::ops::Operator< GptqMarlinRepack >inlinestatic
clear_cache()infini::ops::Operator< GptqMarlinRepack >inlinestatic
config_ptr_infini::ops::OperatorBaseprotected
device_index_infini::ops::GptqMarlinRepackprotected
device_type_infini::ops::Operator< GptqMarlinRepack >protectedstatic
GptqMarlinRepack(const Tensor b_q_weight, const Tensor perm, const int64_t size_k, const int64_t size_n, const int64_t num_bits, const bool is_a_8bit, Tensor out)infini::ops::GptqMarlinRepackinline
handle_ptr_infini::ops::OperatorBaseprotected
has_perm_infini::ops::GptqMarlinRepackprotected
implementation_index_infini::ops::Operator< GptqMarlinRepack >protectedstatic
is_a_8bit_infini::ops::GptqMarlinRepackprotected
Make(const Config &config, const Tensor tensor, Args &&... args)infini::ops::Operator< GptqMarlinRepack >inlinestatic
Make(const Tensor tensor, Args &&... args)infini::ops::Operator< GptqMarlinRepack >inlinestatic
Make(const Config &config, const std::vector< Tensor > tensors, Args &&... args)infini::ops::Operator< GptqMarlinRepack >inlinestatic
Make(const std::vector< Tensor > tensors, Args &&... args)infini::ops::Operator< GptqMarlinRepack >inlinestatic
Make(const Config &config, const Tensor tensor, Args &&... args)infini::ops::Operator< GptqMarlinRepack >inlinestatic
Make(const Tensor tensor, Args &&... args)infini::ops::Operator< GptqMarlinRepack >inlinestatic
Make(const Config &config, const std::vector< Tensor > tensors, Args &&... args)infini::ops::Operator< GptqMarlinRepack >inlinestatic
Make(const std::vector< Tensor > tensors, Args &&... args)infini::ops::Operator< GptqMarlinRepack >inlinestatic
num_bits_infini::ops::GptqMarlinRepackprotected
operator()(const Tensor b_q_weight, const Tensor perm, const int64_t size_k, const int64_t size_n, const int64_t num_bits, const bool is_a_8bit, Tensor out) const =0infini::ops::GptqMarlinRepackpure virtual
Operator< GptqMarlinRepack >::operator()(const Handle &handle, const Args &... args)infini::ops::Operator< GptqMarlinRepack >inline
Operator< GptqMarlinRepack >::operator()(const Args &... args) constinfini::ops::Operator< GptqMarlinRepack >inline
out_metadata_infini::ops::GptqMarlinRepackprotected
pack_factor_infini::ops::GptqMarlinRepackprotected
perm_metadata_infini::ops::GptqMarlinRepackprotected
set_config(const Config &config)infini::ops::OperatorBaseinline
set_config(const Config &config)infini::ops::OperatorBaseinline
set_handle(const Handle &handle)infini::ops::OperatorBaseinline
set_handle(const Handle &handle)infini::ops::OperatorBaseinline
set_stream(void *stream)infini::ops::OperatorBaseinline
set_stream(void *stream)infini::ops::OperatorBaseinline
set_workspace(void *workspace)infini::ops::OperatorBaseinline
set_workspace(void *workspace)infini::ops::OperatorBaseinline
set_workspace_size_in_bytes(std::size_t workspace_size_in_bytes)infini::ops::OperatorBaseinline
set_workspace_size_in_bytes(std::size_t workspace_size_in_bytes)infini::ops::OperatorBaseinline
size_k_infini::ops::GptqMarlinRepackprotected
size_n_infini::ops::GptqMarlinRepackprotected
stream_infini::ops::OperatorBaseprotected
ValidateCallMetadata(const Tensor b_q_weight, const Tensor perm, const int64_t size_k, const int64_t size_n, const int64_t num_bits, const bool is_a_8bit, const Tensor out) constinfini::ops::GptqMarlinRepackinlineprotected
workspace_infini::ops::OperatorBaseprotected
workspace_size_in_bytes() constinfini::ops::OperatorBaseinlinevirtual
workspace_size_in_bytes() constinfini::ops::OperatorBaseinlinevirtual
workspace_size_in_bytes_infini::ops::OperatorBaseprotected
~OperatorBase()=defaultinfini::ops::OperatorBasevirtual
~OperatorBase()=defaultinfini::ops::OperatorBasevirtual