pub struct ResidentExpertProvider;Expand description
Provider for a fully resident expert bank.
Trait Implementations§
Source§impl Clone for ResidentExpertProvider
impl Clone for ResidentExpertProvider
Source§fn clone(&self) -> ResidentExpertProvider
fn clone(&self) -> ResidentExpertProvider
Returns a duplicate of the value. Read more
1.0.0 (const: unstable) · Source§fn clone_from(&mut self, source: &Self)
fn clone_from(&mut self, source: &Self)
Performs copy-assignment from
source. Read moreimpl Copy for ResidentExpertProvider
Source§impl Debug for ResidentExpertProvider
impl Debug for ResidentExpertProvider
Source§impl Default for ResidentExpertProvider
impl Default for ResidentExpertProvider
Source§fn default() -> ResidentExpertProvider
fn default() -> ResidentExpertProvider
Returns the “default value” for a type. Read more
Source§impl<B> RoutedExpertProvider<B> for ResidentExpertProviderwhere
B: GroupedNeuralBackend,
impl<B> RoutedExpertProvider<B> for ResidentExpertProviderwhere
B: GroupedNeuralBackend,
Source§fn forward_grouped(
&mut self,
resident_bank: &mut B::GatedProductGroups,
request: RoutedExpertRequest<'_, B::Tensor>,
context: &<B::Tensor as Tensor>::Context,
) -> Result<B::Tensor, Self::Error>
fn forward_grouped( &mut self, resident_bank: &mut B::GatedProductGroups, request: RoutedExpertRequest<'_, B::Tensor>, context: &<B::Tensor as Tensor>::Context, ) -> Result<B::Tensor, Self::Error>
Executes one typed route batch while retaining its acquired resources.
Source§fn forward_relu2_routed(
&mut self,
resident_bank: &mut B::Relu2Groups,
request: RoutedExpertRequest<'_, B::Tensor>,
context: &<B::Tensor as Tensor>::Context,
) -> Result<B::Tensor, Self::Error>
fn forward_relu2_routed( &mut self, resident_bank: &mut B::Relu2Groups, request: RoutedExpertRequest<'_, B::Tensor>, context: &<B::Tensor as Tensor>::Context, ) -> Result<B::Tensor, Self::Error>
Executes one ReLU-squared route batch through the same residency boundary.
Source§fn forward_compact_grouped(
&mut self,
resident_bank: &mut B::GatedProductGroups,
request: RoutedExpertRequest<'_, B::Tensor>,
context: &<B::Tensor as Tensor>::Context,
) -> Result<B::Tensor, Self::Error>
fn forward_compact_grouped( &mut self, resident_bank: &mut B::GatedProductGroups, request: RoutedExpertRequest<'_, B::Tensor>, context: &<B::Tensor as Tensor>::Context, ) -> Result<B::Tensor, Self::Error>
Executes destination-local rows that were already expanded to one
owner-local expert per row by the neutral expert exchange. Read more
Source§impl<B> TensorParallelRoutedExpertProvider<B> for ResidentExpertProviderwhere
B: TensorParallelGroupedNeuralBackend,
impl<B> TensorParallelRoutedExpertProvider<B> for ResidentExpertProviderwhere
B: TensorParallelGroupedNeuralBackend,
Source§fn forward_grouped_tensor_parallel(
&mut self,
resident_bank: &mut B::GatedProductGroups,
request: RoutedExpertRequest<'_, B::Tensor>,
partitions: usize,
context: &<B::Tensor as Tensor>::Context,
) -> Result<RoutedExpertTensorParallelOutput<B::Tensor>, Self::Error>
fn forward_grouped_tensor_parallel( &mut self, resident_bank: &mut B::GatedProductGroups, request: RoutedExpertRequest<'_, B::Tensor>, partitions: usize, context: &<B::Tensor as Tensor>::Context, ) -> Result<RoutedExpertTensorParallelOutput<B::Tensor>, Self::Error>
Executes a rank-local gated-product contribution.
Source§fn forward_relu2_routed_tensor_parallel(
&mut self,
resident_bank: &mut B::Relu2Groups,
request: RoutedExpertRequest<'_, B::Tensor>,
partitions: usize,
context: &<B::Tensor as Tensor>::Context,
) -> Result<RoutedExpertTensorParallelOutput<B::Tensor>, Self::Error>
fn forward_relu2_routed_tensor_parallel( &mut self, resident_bank: &mut B::Relu2Groups, request: RoutedExpertRequest<'_, B::Tensor>, partitions: usize, context: &<B::Tensor as Tensor>::Context, ) -> Result<RoutedExpertTensorParallelOutput<B::Tensor>, Self::Error>
Executes a rank-local ReLU-squared contribution.
Source§fn forward_compact_grouped_tensor_parallel(
&mut self,
resident_bank: &mut B::GatedProductGroups,
request: RoutedExpertRequest<'_, B::Tensor>,
partitions: usize,
context: &<B::Tensor as Tensor>::Context,
) -> Result<RoutedExpertTensorParallelOutput<B::Tensor>, Self::Error>
fn forward_compact_grouped_tensor_parallel( &mut self, resident_bank: &mut B::GatedProductGroups, request: RoutedExpertRequest<'_, B::Tensor>, partitions: usize, context: &<B::Tensor as Tensor>::Context, ) -> Result<RoutedExpertTensorParallelOutput<B::Tensor>, Self::Error>
Executes destination-local, one-expert-per-row contributions while
preserving the backend’s TP reduction and post-bias structure.
Auto Trait Implementations§
impl Freeze for ResidentExpertProvider
impl RefUnwindSafe for ResidentExpertProvider
impl Send for ResidentExpertProvider
impl Sync for ResidentExpertProvider
impl Unpin for ResidentExpertProvider
impl UnsafeUnpin for ResidentExpertProvider
impl UnwindSafe for ResidentExpertProvider
Blanket Implementations§
Source§impl<T> BorrowMut<T> for Twhere
T: ?Sized,
impl<T> BorrowMut<T> for Twhere
T: ?Sized,
Source§fn borrow_mut(&mut self) -> &mut T
fn borrow_mut(&mut self) -> &mut T
Mutably borrows from an owned value. Read more