atlas_core/kimi_k3/
mod.rs1pub mod attnres;
10pub mod cache;
11pub mod expert_backend;
12pub mod kda;
13pub mod latent_moe;
14pub mod layer;
15pub mod mla;
16pub mod situ;
17
18pub use attnres::{AttnResHub, attnres_blend, attnres_mix, attnres_softmax_mix};
19pub use cache::{HybridCache, LayerCache, MlaKv};
20pub use expert_backend::{ExpertBackendKind, MmapExpertStore, PrefetchPlanner, kind_from_env};
21pub use kda::{KDA_L2_EPS, KdaConfig, KdaState, cuda_kda_enabled, kda_decode_token, kda_from};
22pub use latent_moe::{
23 LatentMoeConfig, latent_moe_forward, mix_routed_experts, moe_from, sigmoid_topk,
24};
25pub use layer::{K3Graph, K3LayerSpec, MixerKind, MlpKind};
26pub use mla::{MlaConfig, cuda_mla_enabled, gated_mla_attend, mla_decode_token, mla_from};
27pub use situ::{situ_glu, situ_glu_vec, softcap};