linear-attention
Erfasste Open-Source-Repos mit dem Tag linear-attention, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit linear-attention am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit linear-attention getaggt wurden.
- #1
Ein 2,78-Billionen-Parameter-Modell Kimi K3, das Inferenz auf einer einzigen CPU in 8,24 GB RAM ausführt. Tragbares C99: kein BLAS, kein Framework, keine GPU.
★ 7.161
- #1
RWKV (ausgesprochen RwaKuv) ist ein RNN mit hervorragender LLM-Leistung, das auch wie ein GPT-Transformer direkt trainiert werden kann (parallelisierbar). Wir sind bei RWKV-7 „Goose“. Es kombiniert also das Beste aus RNN und Transformer – hohe Leistung, lineare Zeit, konstanter Speicherplatz (kein KV-Cache), schnelles Training, unendliche ctx_len und kostenloses Sentence Embedding.
★ 14.695+8Sterne-Änderung der letzten 7 Tage - #2
Ein 2,78-Billionen-Parameter-Modell Kimi K3, das Inferenz auf einer einzigen CPU in 8,24 GB RAM ausführt. Tragbares C99: kein BLAS, kein Framework, keine GPU.
★ 7.161+442Sterne-Änderung der letzten 7 Tage