1pub mod attention;
4pub mod audiovae;
5pub mod dit;
6pub mod dsv4;
7pub mod fcd;
8pub mod fcd_ops;
9pub mod g3n;
10pub mod gptq_capture;
11pub mod gpu;
12#[cfg(target_os = "macos")]
13pub mod gpu_metal;
14#[cfg(feature = "gpu")]
15pub mod gpu_wgpu;
16#[cfg(all(
19 feature = "gpu",
20 any(target_os = "linux", target_os = "windows", target_os = "android")
21))]
22pub mod vulkan;
23pub mod imagegen;
24pub mod inference;
25pub mod kv_cache;
26pub mod linear_core;
27pub mod loader;
28pub mod mmh3;
29pub mod nystrom;
30pub mod pin;
31pub mod pipeline;
32pub mod pool;
33pub mod qtensor;
34pub mod qwen3te;
35pub mod qwen3vis;
36pub mod router;
37pub mod runtime;
38pub mod sampler;
39pub mod skillbake;
40pub mod swarm;
41pub mod textenc;
42pub mod tokenizer;
43pub mod vae;
44pub mod vae3d;
45pub mod videogen;
46
47pub use nystrom::NystromState;
48pub use pipeline::{GenerateResult, Pipeline, TokenCallback, TokenTrace};
49pub use runtime::CortiqRuntime;
50
51#[doc(hidden)]
53#[cfg(target_os = "macos")]
54pub fn gpu_empty_submit_for_test(n: usize) -> f64 {
55 gpu_metal::empty_submit_bench(n)
56}
57
58#[doc(hidden)]
60#[cfg(target_os = "macos")]
61pub fn gpu_pipelined_submit_for_test(n: usize) -> f64 {
62 gpu_metal::pipelined_submit_bench(n)
63}
64
65#[doc(hidden)]
67#[cfg(target_os = "macos")]
68pub fn gpu_moe_job_for_test(
69 gi: usize,
70 ui: usize,
71 di: usize,
72 inter: usize,
73 hidden: usize,
74 x: Vec<f32>,
75) -> gpu::MoeJob<'static> {
76 gpu::MoeJob {
77 gate: (gi, inter, hidden, &[]),
78 up: (ui, inter, hidden, &[]),
79 down: (di, hidden, inter, &[]),
80 xs_gate: x.clone(),
81 xs_up: x,
82 down_col: &[],
83 w: 1.0,
84 q1: true,
85 q4t: false,
86 q4tp: false,
87 gu_q2: false,
88 swiglu_limit: 0.0,
89 }
90}
91
92#[doc(hidden)]
94#[cfg(target_os = "macos")]
95pub fn gpu_moe_block_for_test(
96 model: &std::sync::Arc<cortiq_core::CmfModel>,
97 job: gpu::MoeJob<'_>,
98 out: &mut [f32],
99) -> bool {
100 gpu_metal::moe_block(model, &[job], out)
101}
102
103#[doc(hidden)]
106#[cfg(target_os = "macos")]
107pub fn gpu_batch_q1_for_test(
108 model: &std::sync::Arc<cortiq_core::CmfModel>,
109 shapes: &[(usize, usize, usize)],
110 x: &[f32],
111 xi: &[f32],
112 outs: &mut [&mut [f32]],
113) -> bool {
114 let jobs: Vec<gpu::BatchJob> = shapes
115 .iter()
116 .enumerate()
117 .map(|(k, &(idx, rows, cols))| gpu::BatchJob {
118 idx,
119 rows,
120 cols,
121 row_scale: &[],
122 xs: if k < 2 { x.to_vec() } else { xi.to_vec() },
123 layout: gpu::BatchLayout::Q1,
124 })
125 .collect();
126 gpu_metal::matvec_batch(model, &jobs, outs)
127}
128
129#[doc(hidden)]
131#[cfg(target_os = "macos")]
132pub fn gpu_q1_matvec_for_test(
133 model: &std::sync::Arc<cortiq_core::CmfModel>,
134 idx: usize,
135 xs: &[f32],
136 rows: usize,
137 cols: usize,
138 out: &mut [f32],
139) -> bool {
140 gpu_metal::q1_matvec(model, idx, xs, rows, cols, out)
141}
142pub use sampler::SamplerConfig;