pub struct FullAttentionLayer<'a, Q: QuantWeights> {
pub input_ln: DevicePtr,
pub q_norm: DevicePtr,
pub k_norm: DevicePtr,
pub post_ln: DevicePtr,
pub q_proj: &'a Q,
pub k_proj: &'a Q,
pub v_proj: &'a Q,
pub o_proj: &'a Q,
pub gate_proj: &'a Q,
pub up_proj: &'a Q,
pub down_proj: &'a Q,
}Expand description
Full-attention layer weights, parameterised over the backend’s quantised weight type.
Fields§
§input_ln: DevicePtr§q_norm: DevicePtr§k_norm: DevicePtr§post_ln: DevicePtr§q_proj: &'a Q§k_proj: &'a Q§v_proj: &'a Q§o_proj: &'a Q§gate_proj: &'a Q§up_proj: &'a Q§down_proj: &'a QAuto Trait Implementations§
impl<'a, Q> Freeze for FullAttentionLayer<'a, Q>
impl<'a, Q> RefUnwindSafe for FullAttentionLayer<'a, Q>where
Q: RefUnwindSafe,
impl<'a, Q> Send for FullAttentionLayer<'a, Q>
impl<'a, Q> Sync for FullAttentionLayer<'a, Q>
impl<'a, Q> Unpin for FullAttentionLayer<'a, Q>
impl<'a, Q> UnwindSafe for FullAttentionLayer<'a, Q>where
Q: RefUnwindSafe,
Blanket Implementations§
Source§impl<T> BorrowMut<T> for Twhere
T: ?Sized,
impl<T> BorrowMut<T> for Twhere
T: ?Sized,
Source§fn borrow_mut(&mut self) -> &mut T
fn borrow_mut(&mut self) -> &mut T
Mutably borrows from an owned value. Read more