bitcoin
bitcoin

$69369.102839 USD

8.18%

ethereum
ethereum

$2241.870186 USD

17.66%

tether
tether

$0.999259 USD

0.01%

bnb
bnb

$624.777506 USD

3.98%

usd-coin
usd-coin

$0.999884 USD

0.00%

xrp
xrp

$1.102378 USD

10.39%

solana
solana

$84.754724 USD

10.60%

tron
tron

$0.333199 USD

0.13%

hyperliquid
hyperliquid

$71.371953 USD

22.89%

dogecoin
dogecoin

$0.074650 USD

6.88%

zcash
zcash

$551.990706 USD

10.06%

unus-sed-leo
unus-sed-leo

$9.347923 USD

1.29%

chainlink
chainlink

$10.459641 USD

9.27%

monero
monero

$412.103053 USD

0.02%

cardano
cardano

$0.183081 USD

4.68%

Vidéo d’actualité sur les crypto-monnaies

Conférence 6 -Transformateurs et grands modèles de langage (LLM)

Jul 01, 2026 at 04:02 pm Luis R Soenksen

Cette conférence explore les transformateurs et les grands modèles linguistiques (LLM), l'architecture d'apprentissage en profondeur qui alimente les systèmes d'IA modernes tels que ChatGPT, Claude, Gemini, Llama et de nombreux modèles de base multimodaux. Nous commençons par présenter les principales familles de modèles de langage, y compris les architectures autorégressives, auto-encodées et encodeurs-décodeurs, et retraçons l'évolution rapide des LLM depuis les premiers modèles de transformateurs comme BERT et GPT jusqu'aux systèmes multimodaux à grande échelle d'aujourd'hui. La conférence examine ensuite comment la mise à l'échelle, le réglage des instructions, l'apprentissage par renforcement, l'augmentation de la récupération et l'ingénierie des systèmes ont transformé les capacités LLM au-delà de la simple augmentation de la taille du modèle. La seconde moitié de la conférence propose une présentation intuitive mais rigoureuse de l'architecture Transformer, expliquant les intégrations de jetons, les codages de position, l'auto-attention, les vecteurs Query-Key-Value (QKV), l'attention des produits scalaires à l'échelle, l'attention multi-têtes, les connexions résiduelles, la normalisation des couches, les réseaux à action directe et les blocs de transformateur de style GPT. Grâce à des exemples visuels et à des formulations mathématiques, les étudiants développent une compréhension de niveau ingénierie de la manière dont les transformateurs construisent des représentations contextuelles et effectuent la prédiction du jeton suivant. Enfin, nous explorons comment la même architecture s'étend au-delà du langage naturel pour inclure le texte biomédical, les dossiers de santé électroniques (DSE), les séquences biologiques, l'imagerie médicale, les graphiques et les applications de soins de santé multimodales, tout en discutant de considérations pratiques telles que les hallucinations, l'alignement des modèles, la sécurité, l'interprétabilité et le déploiement responsable en médecine et en santé mondiale. #IA #IntelligenceArtificielle #MachineLearning #DeepLearning #Transformers #LargeLanguageModels #LLMs #GPT #ChatGPT #AttentionMechanism #SelfAttention #GenerativeAI #FoundationModels #NaturalLanguageProcessing #NLP #BiomedicalAI #MedicalAI #HealthcareAI #ClinicalAI #ElectronicHealthRecords #Bioinformatics #ComputationalBiology #VisionTransformer #MultimodalAI #AIEducation #GraduateCourse #AIInMedicine #GlobalHealth #MedicalEducation #MachineLearningCourse
Source vidéo:Youtube

Clause de non-responsabilité:info@kdj.com

Les informations fournies ne constituent pas des conseils commerciaux. kdj.com n’assume aucune responsabilité pour les investissements effectués sur la base des informations fournies dans cet article. Les crypto-monnaies sont très volatiles et il est fortement recommandé d’investir avec prudence après une recherche approfondie!

Si vous pensez que le contenu utilisé sur ce site Web porte atteinte à vos droits d’auteur, veuillez nous contacter immédiatement (info@kdj.com) et nous le supprimerons dans les plus brefs délais.

Autres vidéos publiées sur Aug 21, 2026