ENG
ҚАЗ
Paper Review 4: Self-attention Does Not Need O(n^2) Memory
January 22, 2024
Бұл бет қазақ тілінде әзірленуде.
tags:
LLM
efficiency
long input transformers
← Paper Review 3: Pix2Struct is an image-encoder-text-decoder based on the Vision Transformer (ViT)
Paper Review 5: Mistral 7B →