2021-12-16から1日間の記事一覧

[論文メモ] SELF-ATTENTION DOES NOT NEED O(n^2) MEMORY

arxiv.orgself-attentionの計算にメモリは必要ないself-attentionはクエリ、長さのキーとバリューをそれぞれ、として次の式で表せる(ただしクエリが1つのとき)。 普通に実装するとの計算・保存ためにの計算量とメモリが必要。そしてself-attentionは必要。…