pub struct ResidentExpertProvider;Expand description
Provider for a fully resident expert bank.
Trait Implementations§
Source§impl Clone for ResidentExpertProvider
impl Clone for ResidentExpertProvider
Source§fn clone(&self) -> ResidentExpertProvider
fn clone(&self) -> ResidentExpertProvider
Returns a duplicate of the value. Read more
1.0.0 (const: unstable) · Source§fn clone_from(&mut self, source: &Self)
fn clone_from(&mut self, source: &Self)
Performs copy-assignment from
source. Read moreimpl Copy for ResidentExpertProvider
Source§impl Debug for ResidentExpertProvider
impl Debug for ResidentExpertProvider
Source§impl Default for ResidentExpertProvider
impl Default for ResidentExpertProvider
Source§fn default() -> ResidentExpertProvider
fn default() -> ResidentExpertProvider
Returns the “default value” for a type. Read more
Source§impl<B> RoutedExpertProvider<B> for ResidentExpertProviderwhere
B: GroupedNeuralBackend,
impl<B> RoutedExpertProvider<B> for ResidentExpertProviderwhere
B: GroupedNeuralBackend,
Source§fn forward_grouped(
&mut self,
resident_bank: &mut B::GatedProductGroups,
request: RoutedExpertRequest<'_, B::Tensor>,
context: &<B::Tensor as Tensor>::Context,
) -> Result<B::Tensor, Self::Error>
fn forward_grouped( &mut self, resident_bank: &mut B::GatedProductGroups, request: RoutedExpertRequest<'_, B::Tensor>, context: &<B::Tensor as Tensor>::Context, ) -> Result<B::Tensor, Self::Error>
Executes one typed route batch while retaining its acquired resources.
Source§fn forward_relu2_routed(
&mut self,
resident_bank: &mut B::Relu2Groups,
request: RoutedExpertRequest<'_, B::Tensor>,
context: &<B::Tensor as Tensor>::Context,
) -> Result<B::Tensor, Self::Error>
fn forward_relu2_routed( &mut self, resident_bank: &mut B::Relu2Groups, request: RoutedExpertRequest<'_, B::Tensor>, context: &<B::Tensor as Tensor>::Context, ) -> Result<B::Tensor, Self::Error>
Executes one ReLU-squared route batch through the same residency boundary.
Source§impl<B> TensorParallelRoutedExpertProvider<B> for ResidentExpertProviderwhere
B: TensorParallelGroupedNeuralBackend,
impl<B> TensorParallelRoutedExpertProvider<B> for ResidentExpertProviderwhere
B: TensorParallelGroupedNeuralBackend,
Source§fn forward_grouped_tensor_parallel(
&mut self,
resident_bank: &mut B::GatedProductGroups,
request: RoutedExpertRequest<'_, B::Tensor>,
partitions: usize,
context: &<B::Tensor as Tensor>::Context,
) -> Result<RoutedExpertTensorParallelOutput<B::Tensor>, Self::Error>
fn forward_grouped_tensor_parallel( &mut self, resident_bank: &mut B::GatedProductGroups, request: RoutedExpertRequest<'_, B::Tensor>, partitions: usize, context: &<B::Tensor as Tensor>::Context, ) -> Result<RoutedExpertTensorParallelOutput<B::Tensor>, Self::Error>
Executes a rank-local gated-product contribution.
Source§fn forward_relu2_routed_tensor_parallel(
&mut self,
resident_bank: &mut B::Relu2Groups,
request: RoutedExpertRequest<'_, B::Tensor>,
partitions: usize,
context: &<B::Tensor as Tensor>::Context,
) -> Result<RoutedExpertTensorParallelOutput<B::Tensor>, Self::Error>
fn forward_relu2_routed_tensor_parallel( &mut self, resident_bank: &mut B::Relu2Groups, request: RoutedExpertRequest<'_, B::Tensor>, partitions: usize, context: &<B::Tensor as Tensor>::Context, ) -> Result<RoutedExpertTensorParallelOutput<B::Tensor>, Self::Error>
Executes a rank-local ReLU-squared contribution.
Auto Trait Implementations§
impl Freeze for ResidentExpertProvider
impl RefUnwindSafe for ResidentExpertProvider
impl Send for ResidentExpertProvider
impl Sync for ResidentExpertProvider
impl Unpin for ResidentExpertProvider
impl UnsafeUnpin for ResidentExpertProvider
impl UnwindSafe for ResidentExpertProvider
Blanket Implementations§
Source§impl<T> BorrowMut<T> for Twhere
T: ?Sized,
impl<T> BorrowMut<T> for Twhere
T: ?Sized,
Source§fn borrow_mut(&mut self) -> &mut T
fn borrow_mut(&mut self) -> &mut T
Mutably borrows from an owned value. Read more