| active_implementation_indices(Device::Type dev_type) | infini::ops::Operator< PagedAttentionInfinilm > | inlinestatic |
| active_implementation_indices(Device::Type dev_type) | infini::ops::Operator< PagedAttentionInfinilm > | inlinestatic |
| block_size_ | infini::ops::PagedAttentionInfinilm | protected |
| block_table_batch_stride_ | infini::ops::PagedAttentionInfinilm | protected |
| Call(const Handle &handle, const Config &config, const Args &... args) | infini::ops::Operator< PagedAttentionInfinilm > | static |
| Call(const Tensor tensor, const Args &... args) | infini::ops::Operator< PagedAttentionInfinilm > | inlinestatic |
| Call(const TensorLike &tensor, const Args &... args) | infini::ops::Operator< PagedAttentionInfinilm > | inlinestatic |
| Call(const Handle &handle, const Config &config, const Args &... args) | infini::ops::Operator< PagedAttentionInfinilm > | inlinestatic |
| Call(const Tensor tensor, const Args &... args) | infini::ops::Operator< PagedAttentionInfinilm > | inlinestatic |
| Call(const TensorLike &tensor, const Args &... args) | infini::ops::Operator< PagedAttentionInfinilm > | inlinestatic |
| clear_cache() | infini::ops::Operator< PagedAttentionInfinilm > | inlinestatic |
| clear_cache() | infini::ops::Operator< PagedAttentionInfinilm > | inlinestatic |
| config_ptr_ | infini::ops::OperatorBase | protected |
| device_type_ | infini::ops::Operator< PagedAttentionInfinilm > | protectedstatic |
| dtype_ | infini::ops::PagedAttentionInfinilm | protected |
| handle_ptr_ | infini::ops::OperatorBase | protected |
| head_size_ | infini::ops::PagedAttentionInfinilm | protected |
| implementation_index_ | infini::ops::Operator< PagedAttentionInfinilm > | protectedstatic |
| index_dtype_ | infini::ops::PagedAttentionInfinilm | protected |
| IsIndexDtype(DataType dtype) | infini::ops::PagedAttentionInfinilm | inlineprotectedstatic |
| k_cache_block_stride_ | infini::ops::PagedAttentionInfinilm | protected |
| k_cache_head_stride_ | infini::ops::PagedAttentionInfinilm | protected |
| k_cache_slot_stride_ | infini::ops::PagedAttentionInfinilm | protected |
| Make(const Config &config, const Tensor tensor, Args &&... args) | infini::ops::Operator< PagedAttentionInfinilm > | inlinestatic |
| Make(const Tensor tensor, Args &&... args) | infini::ops::Operator< PagedAttentionInfinilm > | inlinestatic |
| Make(const Config &config, const std::vector< Tensor > tensors, Args &&... args) | infini::ops::Operator< PagedAttentionInfinilm > | inlinestatic |
| Make(const std::vector< Tensor > tensors, Args &&... args) | infini::ops::Operator< PagedAttentionInfinilm > | inlinestatic |
| Make(const Config &config, const Tensor tensor, Args &&... args) | infini::ops::Operator< PagedAttentionInfinilm > | inlinestatic |
| Make(const Tensor tensor, Args &&... args) | infini::ops::Operator< PagedAttentionInfinilm > | inlinestatic |
| Make(const Config &config, const std::vector< Tensor > tensors, Args &&... args) | infini::ops::Operator< PagedAttentionInfinilm > | inlinestatic |
| Make(const std::vector< Tensor > tensors, Args &&... args) | infini::ops::Operator< PagedAttentionInfinilm > | inlinestatic |
| max_num_blocks_per_seq_ | infini::ops::PagedAttentionInfinilm | protected |
| num_heads_ | infini::ops::PagedAttentionInfinilm | protected |
| num_kv_heads_ | infini::ops::PagedAttentionInfinilm | protected |
| num_seqs_ | infini::ops::PagedAttentionInfinilm | protected |
| operator()(const Tensor q, const Tensor k_cache, const Tensor v_cache, const Tensor block_tables, const Tensor seq_lens, std::optional< Tensor > alibi_slopes, float scale, Tensor out) const =0 | infini::ops::PagedAttentionInfinilm | pure virtual |
| Operator< PagedAttentionInfinilm >::operator()(const Handle &handle, const Args &... args) | infini::ops::Operator< PagedAttentionInfinilm > | inline |
| Operator< PagedAttentionInfinilm >::operator()(const Args &... args) const | infini::ops::Operator< PagedAttentionInfinilm > | inline |
| out_head_stride_ | infini::ops::PagedAttentionInfinilm | protected |
| out_stride_ | infini::ops::PagedAttentionInfinilm | protected |
| PagedAttentionInfinilm(const Tensor q, const Tensor k_cache, const Tensor v_cache, const Tensor block_tables, const Tensor seq_lens, std::optional< Tensor > alibi_slopes, float scale, Tensor out) | infini::ops::PagedAttentionInfinilm | inline |
| q_head_stride_ | infini::ops::PagedAttentionInfinilm | protected |
| q_stride_ | infini::ops::PagedAttentionInfinilm | protected |
| scale_ | infini::ops::PagedAttentionInfinilm | protected |
| seq_lens_stride_ | infini::ops::PagedAttentionInfinilm | protected |
| set_config(const Config &config) | infini::ops::OperatorBase | inline |
| set_config(const Config &config) | infini::ops::OperatorBase | inline |
| set_handle(const Handle &handle) | infini::ops::OperatorBase | inline |
| set_handle(const Handle &handle) | infini::ops::OperatorBase | inline |
| set_stream(void *stream) | infini::ops::OperatorBase | inline |
| set_stream(void *stream) | infini::ops::OperatorBase | inline |
| set_workspace(void *workspace) | infini::ops::OperatorBase | inline |
| set_workspace(void *workspace) | infini::ops::OperatorBase | inline |
| set_workspace_size_in_bytes(std::size_t workspace_size_in_bytes) | infini::ops::OperatorBase | inline |
| set_workspace_size_in_bytes(std::size_t workspace_size_in_bytes) | infini::ops::OperatorBase | inline |
| stream_ | infini::ops::OperatorBase | protected |
| v_cache_block_stride_ | infini::ops::PagedAttentionInfinilm | protected |
| v_cache_head_stride_ | infini::ops::PagedAttentionInfinilm | protected |
| v_cache_slot_stride_ | infini::ops::PagedAttentionInfinilm | protected |
| workspace_ | infini::ops::OperatorBase | protected |
| workspace_size_in_bytes() const | infini::ops::OperatorBase | inlinevirtual |
| workspace_size_in_bytes() const | infini::ops::OperatorBase | inlinevirtual |
| workspace_size_in_bytes_ | infini::ops::OperatorBase | protected |
| ~OperatorBase()=default | infini::ops::OperatorBase | virtual |
| ~OperatorBase()=default | infini::ops::OperatorBase | virtual |