bitcoin
bitcoin

$85882.489292 USD

2.66%

ethereum
ethereum

$2726.255136 USD

1.23%

tether
tether

$0.999653 USD

-0.01%

bnb
bnb

$776.085808 USD

1.09%

xrp
xrp

$1.521475 USD

1.66%

usd-coin
usd-coin

$0.999947 USD

-0.02%

solana
solana

$121.201562 USD

2.45%

tron
tron

$0.334191 USD

-0.95%

zcash
zcash

$1376.191162 USD

-3.52%

hyperliquid
hyperliquid

$89.815179 USD

0.93%

dogecoin
dogecoin

$0.095724 USD

0.60%

chainlink
chainlink

$14.345509 USD

0.03%

monero
monero

$548.721371 USD

-0.11%

cardano
cardano

$0.253733 USD

0.94%

unus-sed-leo
unus-sed-leo

$8.970136 USD

1.38%

Nachrichtenvideo zur Kryptowährung

Aufmerksamkeit und Transformatoren erklärt und von Grund auf in PyTorch codiert (Multi-Head Attention) #ai #llm

Oct 02, 2026 at 05:40 pm Mehdi Hosseini Moghadam

Achtung, Multi-Head-Aufmerksamkeit und der vollständige Transformer, von Grund auf erklärt und von Grund auf in PyTorch codiert, wobei jeder Schritt von Hand an einem winzigen Beispiel und jede Tensorform auf dem Bildschirm ausgeführt wurde. Wir beginnen damit, warum wiederkehrende Netzwerke Probleme hatten, wandeln Wörter in Vektoren um und bauen die Aufmerksamkeit Schritt für Schritt auf: Skalarprodukte, Softmax, Abfragen, Schlüssel und Werte, warum wir durch die Quadratwurzel von d_k dividieren, Kausal- und Füllmasken. Dann Multi-Head-Aufmerksamkeit: Aufteilen von 512 Dimensionen in 8 Köpfe zu je 64, die Formen nach jeder Codezeile und eine Prüfung mit PyTorchs eigener nn.MultiheadAttention. Als nächstes der Rest des Transformers: sinusförmige Positionscodierungen, Restverbindungen und LayerNorm, der Feed-Forward-Block, Encoder- und Decoderschichten, Queraufmerksamkeit und die vollständige Architektur. Abschließend trainieren wir es live auf einer GPU, dekodieren Schritt für Schritt und schauen uns die gelernten Aufmerksamkeitskarten an. Das Wichtigste zum Mitnehmen: Aufmerksamkeit lässt jeden Token jeden anderen Token in einem Schritt betrachten, und das ist der gesamte Transformer. Zeitleiste 0:00 – 3:55 Warum Aufmerksamkeit 3:55 – 7:35 Wörter zu Vektoren werden 7:35 – 16:07 Aufmerksamkeit, Schritt für Schritt 16:07 – 19:12 Masken 19:12 – 26:50 Aufmerksamkeit mit mehreren Köpfen 26:50 – 32:48 Positionen, Normen und Feed-Forward 32:48 – 38:25 Der vollständige Transformer 38:25 – 44:30 Training und Inferenz 44:30 – 46:50 Zusammenfassung Abonnieren Sie für mehr: https://www.youtube.com/@mehdihosseinimoghadam GitHub: https://github.com/mehdihosseinimoghadam LinkedIn: https://linkedin.com/in/mehdi-hosseini-moghadam-384912198 #Transformer #Attention #SelfAttention #MultiHeadAttention #PyTorch #DeepLearning #MachineLearning #LLM #NLP #AI #Python #AttentionIsAllYouNeed #ArtificialIntelligence
Videoquelle:Youtube

Haftungsausschluss:info@kdj.com

Die bereitgestellten Informationen stellen keine Handelsberatung dar. kdj.com übernimmt keine Verantwortung für Investitionen, die auf der Grundlage der in diesem Artikel bereitgestellten Informationen getätigt werden. Kryptowährungen sind sehr volatil und es wird dringend empfohlen, nach gründlicher Recherche mit Vorsicht zu investieren!

Wenn Sie glauben, dass der auf dieser Website verwendete Inhalt Ihr Urheberrecht verletzt, kontaktieren Sie uns bitte umgehend (info@kdj.com) und wir werden ihn umgehend löschen.

Weitere Videos veröffentlicht auf Oct 03, 2026