|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
Articles d’actualité sur les crypto-monnaies
Co-citation based data augmentation for contrastive learning of scientific domains
Apr 29, 2025 at 02:08 pm

Data compilation
We used co-citations as a similarity heuristic to generate sufficiently large training datasets for contrastive learning over scientific domains. Our strategy enabled the production of large training datasets from small amounts of data due to the nonlinear scaling of citation graphs, as a single paper citing N other papers produces (N2) co-citation pairs. For context, a dataset of 10,000 individual papers can produce well over 125,000 co-citation pairs. While this measurement of similarity is not perfect, co-citations have generally been shown to imply a high degree of similarity between papers21. We assume for our modeling purposes that two co-cited papers are more similar than two random papers, even if they are from the same field.
To build our dataset, we randomly chose five biomedical subfields with little overlap. The domains of choice include papers related to cardiovascular disease (CVD), chronic obstructive pulmonary disease (COPD), parasitic diseases, autoimmune diseases, and skin cancers. PubMed Central was queried with Medical Subject Heading (MeSH) terms for each domain, requiring at least one citation and an abstract present between 2010 and 2022. This means that within the time period, we kept the co-citation pairs of the possible (N2) co-citations per paper that were returned from the same common MeSH terms. We sampled preferentially from samples co-cited more times when constructing our final dataset.
For evaluation, we constructed “negative” examples of abstract pairs that were not co-cited. The training dataset was split randomly in a 99:1 ratio followed by deduplication. We built negative pairs by pairing abstracts that had not been co-cited and had both been cited at least 15 times. This criteria allowed us to construct a representative evaluation set for binary classification with balanced classes, with 1’s for co-cited pairs and 0 if not. The exact dataset counts are outlined in Table 1.
Transformer neural networks
The transformer architecture is adept at sequential processing and is state-of-the-art for various natural language processing (NLP) and vision tasks24,25,26,27,28,29,30. A transformer block comprised a self-attention layer and multi-layer perception (MLP) interleaved with skip connections. Full transformers were made of T transformer blocks stacked together1.
Prior to the transformer blocks is the token embedding process, where tokenization maps an input string into a list of L integers from a dictionary. These integers served as the indices for a matrix We, where each row is a learnable representative vector for that token, making We∈ Rv×d where v is the total number of unique tokens in the vocabulary and d an arbitrarily chosen hidden dimension. The initial embedding is Rl×d.
Each block in the transformer then transforms this embedding, i.e., the i^{th} transformer block maps the embedding X(i-1) = [x1(i-1), ..., xL(i-1)]⊤∈Rl×d to X(i) = [x1(i), ..., xL(i)]⊤∈Rl × d1,31,32. X(T) is the last hidden state of the network. The first part of this map is self-attention, which mixes information across the vectors, followed by the MLP which mixes information across d31,33.
Including the MLP, the entire transformer block can be written as:
where b1 and b2 are biases associated with learned linear transformations W1 ∈ Rd×I and W2 ∈ RI×d, where I > d. The activation function σ, e.g., ReLU or GeLU, introduces non-linearity1. More recently, biases are not included, which improves training stability, throughput, and final performance. Additionally, improvements like SwiGLU activation functions and rotary positional embeddings are also commonly utilized3,4,34,35.
GPT (Generative Pretrained Transformer) models, such as OpenAI’s GPT series (GPT-3, GPT-4, etc.), are designed for generative tasks and use transformer decoders36,37,38. They employ causal (unidirectional) attention, meaning each token attends only to previous tokens in the sequence, enabling autoregressive generation during inference. This allows them to predict the next word in a sequence without direct access to future words.
In contrast, BERT models utilize transformer encoders with bidirectional attention, meaning they can attend to all tokens within an input simultaneously. This structure enables them to capture additional contextual dependencies, making them well-suited for tasks like text classification and sentence similarity39. Unlike GPT models, BERT is trained using a masked language modeling (MLM) objective, where some tokens are randomly hidden, requiring the model to predict them based on the surrounding context.
Mixture of Experts
Mixture of
Clause de non-responsabilité:info@kdj.com
Les informations fournies ne constituent pas des conseils commerciaux. kdj.com n’assume aucune responsabilité pour les investissements effectués sur la base des informations fournies dans cet article. Les crypto-monnaies sont très volatiles et il est fortement recommandé d’investir avec prudence après une recherche approfondie!
Si vous pensez que le contenu utilisé sur ce site Web porte atteinte à vos droits d’auteur, veuillez nous contacter immédiatement (info@kdj.com) et nous le supprimerons dans les plus brefs délais.
-
- Compte HBO Max Reddit piraté pour une attaque de logiciel malveillant de vol de crypto : une nouvelle vague d'escroqueries sophistiquées
- Sep 17, 2026 at 12:05 pm
- Une campagne sophistiquée de malware, baptisée PasteSwitch, a exploité le compte HBO Max Reddit vérifié pour distribuer des logiciels malveillants de vol de cryptographie, mettant en évidence l'évolution des menaces sur les comptes d'utilisateurs et les actifs numériques.
-
- Le comité de la Chambre fait progresser le projet de loi sur la réserve stratégique de Bitcoin, façonnant l'avenir des avoirs fédéraux en cryptographie
- Sep 17, 2026 at 12:05 pm
- Le comité des services financiers de la Chambre des représentants a approuvé l'American Reserve Modernization Act, faisant avancer le projet de loi sur la réserve stratégique de Bitcoin pour établir des stocks fédéraux de Bitcoin et d'actifs numériques.
-
- Projet de loi fiscale sur les crypto-monnaies : les actifs numériques sont confrontés à de nouvelles règles fiscales, mais la clarté reste insaisissable
- Sep 17, 2026 at 08:05 am
- La Chambre a avancé un projet de loi fiscale sur les crypto-monnaies visant à aligner les règles fiscales sur les actifs numériques avec la finance traditionnelle, offrant un certain allègement mais laissant des questions clés, notamment en matière d'exploitation minière et de jalonnement, non résolues.
-
- MemeToro révolutionne les lancements de Memecoin sur la chaîne BNB avec l'IA et des contrats intelligents de lancement équitable
- Sep 17, 2026 at 08:05 am
- MemeToro présente une rampe de lancement alimentée par l'IA et un dépôt de lancement équitable sur BNB Chain, établissant une nouvelle norme en matière de transparence et de sécurité dans les actualités memecoin.
-
- Bitcoin et Ether se préparent à une volatilité continue alors que la hausse unanime des taux de la Fed signale une résolution hawkish
- Sep 17, 2026 at 07:55 am
- La hausse unanime des taux d'un quart de point de la Réserve fédérale le 16 septembre 2026 a fait basculer Bitcoin et Ether, alors que le président Kevin Warsh a doublé son approche axée sur l'inflation, ouvrant la voie au recalibrage continu du marché de la cryptographie.
-
- Naviguer en toute sécurité dans les préventes de crypto : conseils essentiels pour acheter de la crypto, faire confiance à la sécurité du portefeuille et vérifier les contrats
- Sep 17, 2026 at 07:45 am
- Apprenez à acheter des préventes de crypto en toute sécurité, à garantir la sécurité de Trust Wallet et à vérifier les contrats intelligents pour éviter les escroqueries. Votre guide pour sécuriser les investissements cryptographiques.
-
- La loi CLARITY trébuche, les règles cryptographiques sont transférées aux régulateurs, 5 pièces en focus
- Sep 17, 2026 at 07:45 am
- L'échec du Sénat de la loi CLARITY redirige l'élaboration des règles cryptographiques vers les agences, ce qui a un impact sur des pièces spécifiques telles que Hedera, Gigachad, Algorand, Notcoin et Fartcoin.
-
-
- Intervention de 7,8 millions de dollars de MEV Bot Yoink : une course folle dans la saga des exploits Ethereum rsETH
- Sep 17, 2026 at 07:45 am
- Un robot MEV nommé Yoink a récemment lancé un exploit rsETH de 7,8 millions de dollars sur Ethereum, sécurisant ainsi les fonds avant qu'un pirate informatique ne le puisse. Cet incident met en évidence l’interaction complexe des robots MEV, les vulnérabilités DeFi et la quête continue de sécurité de la blockchain.

































