List of all items
Structs
- arch::ArchMismatch
- arch::SmArch
- capabilities::ModelCapabilities
- compute::NvidiaTarget
- config::GgufConfigInputs
- config::ModelConfig
- config::PeftAdapterConfig
- config::QuantizationConfig
- config::VisionConfig
- cuda_host::CudaHost
- device::AtlasDevice
- dtype::QuantConfig
- fault::FaultLatch
- kernel::KernelModule
- kimi_k3::attnres::AttnResHub
- kimi_k3::cache::HybridCache
- kimi_k3::cache::MlaKv
- kimi_k3::expert_backend::MmapExpertStore
- kimi_k3::expert_backend::PrefetchPlanner
- kimi_k3::kda::KdaConfig
- kimi_k3::kda::KdaState
- kimi_k3::latent_moe::LatentMoeConfig
- kimi_k3::layer::K3Graph
- kimi_k3::layer::K3LayerSpec
- kimi_k3::mla::MlaConfig
- registry::AtlasRegistry
- registry::RawCudaFunc
- safetensors::TensorSpan
- scope::Teardown
- stream::AtlasStream
- target::KernelTarget
- tensor::TensorRef
Enums
- arch::SmSuffix
- capabilities::AttentionType
- capabilities::SsmArchitecture
- compute::Vendor
- config::Glm5NextRouterMode
- config::LayerType
- dtype::DType
- error::AtlasError
- fault::Fatality
- kimi_k3::cache::LayerCache
- kimi_k3::expert_backend::ExpertBackendKind
- kimi_k3::layer::MixerKind
- kimi_k3::layer::MlpKind
Traits
Functions
- arch::parse_sm_arch
- arch::ptx_arch_runs_on_device
- arch::target_hint
- compute::target_for_vendor
- config::allow_partial_targets
- config::config_from_gguf
- config::glm5_next_mtp_layer_index
- config::parse_config
- config::parse_mistral_params
- config::parse_peft_adapter_config
- config::parse_quantization_config
- cuda_host::host
- cuda_host::release
- fault::classify
- fault::exit_code
- fault::global
- kernel::launch_config
- kernel::launch_vector_add
- kimi_k3::attnres::attnres_blend
- kimi_k3::attnres::attnres_mix
- kimi_k3::attnres::attnres_softmax_mix
- kimi_k3::attnres::rms_norm
- kimi_k3::expert_backend::kind_from_env
- kimi_k3::expert_backend::pack_path
- kimi_k3::expert_backend::read_pack_file
- kimi_k3::expert_backend::write_dummy_pack
- kimi_k3::kda::bounded_gate
- kimi_k3::kda::conv_update
- kimi_k3::kda::cuda_kda_enabled
- kimi_k3::kda::full_rank_output_gate
- kimi_k3::kda::kda_decode_token
- kimi_k3::kda::kda_from
- kimi_k3::kda::kda_recurrent_step
- kimi_k3::latent_moe::expert_situ
- kimi_k3::latent_moe::latent_moe_forward
- kimi_k3::latent_moe::mix_routed_experts
- kimi_k3::latent_moe::moe_from
- kimi_k3::latent_moe::sigmoid_topk
- kimi_k3::mla::apply_output_gate
- kimi_k3::mla::cuda_mla_enabled
- kimi_k3::mla::gated_mla_attend
- kimi_k3::mla::maybe_rope
- kimi_k3::mla::mla_decode_token
- kimi_k3::mla::mla_from
- kimi_k3::mla::sdpa
- kimi_k3::mla::sdpa_one
- kimi_k3::situ::sigmoid
- kimi_k3::situ::silu
- kimi_k3::situ::situ_gate
- kimi_k3::situ::situ_glu
- kimi_k3::situ::situ_glu_vec
- kimi_k3::situ::situ_up
- kimi_k3::situ::softcap
- kimi_k3::situ::swiglu_mutant
- mxfp4_e8m0::dequant_nvfp4_e8m0_to_bf16
- mxfp4_e8m0::dequant_nvfp4_e8m0_to_f32
- mxfp4_e8m0::fp8_e8m0_to_f32
- numeric::bf16_bytes_to_f32
- numeric::f32_to_bf16
- numeric::fp8_e4m3_to_f32
- registry::cuda_error_text
- registry::is_teardown_noop
- safetensors::tensor_span
Type Aliases
Statics
Constants
- config::PEFT_SUPPORTED_TARGET_MODULES
- device::sm121::COMPUTE_MAJOR
- device::sm121::COMPUTE_MINOR
- device::sm121::MAX_REGS_PER_THREAD
- device::sm121::MAX_THREADS_PER_BLOCK
- device::sm121::MEMORY_BW_GBS
- device::sm121::NUM_SMS
- device::sm121::SMEM_PER_SM
- device::sm121::WARP_SIZE
- fault::EXIT_GPU_FAULT
- kimi_k3::expert_backend::ENV
- kimi_k3::kda::KDA_L2_EPS
- mxfp4_e8m0::E2M1
- mxfp4_e8m0::GROUP_SIZE
- registry::CUDA_ERROR_DEINITIALIZED