atlas_core/kimi_k3/
mod.rs

1// SPDX-License-Identifier: AGPL-3.0-only
2
3//! Kimi K3 host graph. This slice is **KDA only**.
4//!
5//! K3-DECISION: KDA is a new backend. Do not copy GDN / Mamba-2 /
6//! Qwen3-Next / glm5next_kda kernels into `kernels/gb10/kimi-k3/`.
7//! CUDA: `kda_decode.cu` (default; `K3_CUDA_KDA=0` CPU escape).
8
9pub mod attnres;
10pub mod cache;
11pub mod expert_backend;
12pub mod kda;
13pub mod latent_moe;
14pub mod layer;
15pub mod mla;
16pub mod situ;
17
18pub use attnres::{AttnResHub, attnres_blend, attnres_mix, attnres_softmax_mix};
19pub use cache::{HybridCache, LayerCache, MlaKv};
20pub use expert_backend::{ExpertBackendKind, MmapExpertStore, PrefetchPlanner, kind_from_env};
21pub use kda::{KDA_L2_EPS, KdaConfig, KdaState, cuda_kda_enabled, kda_decode_token, kda_from};
22pub use latent_moe::{
23    LatentMoeConfig, latent_moe_forward, mix_routed_experts, moe_from, sigmoid_topk,
24};
25pub use layer::{K3Graph, K3LayerSpec, MixerKind, MlpKind};
26pub use mla::{MlaConfig, cuda_mla_enabled, gated_mla_attend, mla_decode_token, mla_from};
27pub use situ::{situ_glu, situ_glu_vec, softcap};