Javascript must be enabled to continue!
Context-dependent similarity searching for small molecular fragments
View through CrossRef
Abstract
Similarity searching is a mainstay in cheminformatics that is generally used to identify compounds with desired properties. For small molecular fragments, similarity calculations based on standard descriptors often have limited utility for establishing meaningful similarity relationships due to feature sparseness. As an alternative, we have adapted the concept of context-depending word pair similarity from natural language processing to evaluate similarity relationships between substituents (R-groups) taking latent characteristics into account. Context-dependent similarity assessment is based on vector embeddings as fragment representations generated using neural networks. With active analogue series as a model system to establish a global structure–activity context, we demonstrate that this approach is applicable to systematic similarity searching for substituents and increases the performance of standard descriptor representations. Context-dependent similarity searching is capable of detecting remote and functionally relevant similarity relationships between substituents. Alternative search queries are introduced focusing on individual substituents within a global substituent context or individual sequences of substituents establishing a local context. For similarity searching, different structural or structure–property contexts can be established, providing opportunities for various applications.
Springer Science and Business Media LLC
Title: Context-dependent similarity searching for small molecular fragments
Description:
Abstract
Similarity searching is a mainstay in cheminformatics that is generally used to identify compounds with desired properties.
For small molecular fragments, similarity calculations based on standard descriptors often have limited utility for establishing meaningful similarity relationships due to feature sparseness.
As an alternative, we have adapted the concept of context-depending word pair similarity from natural language processing to evaluate similarity relationships between substituents (R-groups) taking latent characteristics into account.
Context-dependent similarity assessment is based on vector embeddings as fragment representations generated using neural networks.
With active analogue series as a model system to establish a global structure–activity context, we demonstrate that this approach is applicable to systematic similarity searching for substituents and increases the performance of standard descriptor representations.
Context-dependent similarity searching is capable of detecting remote and functionally relevant similarity relationships between substituents.
Alternative search queries are introduced focusing on individual substituents within a global substituent context or individual sequences of substituents establishing a local context.
For similarity searching, different structural or structure–property contexts can be established, providing opportunities for various applications.
Related Results
Pelatihan Searching dan Drafting Paten Di Perguruan Tinggi Muhammadiyah Mataram
Pelatihan Searching dan Drafting Paten Di Perguruan Tinggi Muhammadiyah Mataram
Dalam pelaksanaan pengabdian ini kami memberikan pemahaman dan pelatihan akan searching dan drafting paten sesuai kebutuhan dari peserta. Untuk searching kami berikan dengan menunj...
News event
News event
When analyzing news media data with automated content analysis techniques, studies often aggregate their measures at the article level (Nicholls & Bright, 2019). However, many ...
Deep Learning Based Methods for Molecular Similarity Searching: A Systematic Review
Deep Learning Based Methods for Molecular Similarity Searching: A Systematic Review
In rational drug design, the concept of molecular similarity searching is frequently used to identify molecules with similar functionalities by looking up structurally related mole...
Improved Deep Learning Based Method for Molecular Similarity Searching Using Stack of Deep Belief Networks
Improved Deep Learning Based Method for Molecular Similarity Searching Using Stack of Deep Belief Networks
Virtual screening (VS) is a computational practice applied in drug discovery research. VS is popularly applied in a computer-based search for new lead molecules based on molecular ...
ANÁLISE DO ÍNDICE DE ÁREA DOS FRAGMENTOS EXISTENTES NA FOZ DOS RIOS DO OESTE PAULISTA-SP
ANÁLISE DO ÍNDICE DE ÁREA DOS FRAGMENTOS EXISTENTES NA FOZ DOS RIOS DO OESTE PAULISTA-SP
O presente trabalho tem como objetivo analisar o índice de área dos fragmentos florestais existentes na foz dos rios do Oeste Paulista/SP, através de técnicas de sistema de informa...
Bacillus subtilis bacteriophages SP82, SPO1, and phie: a comparison of DNAs and of peptides synthesized during infection
Bacillus subtilis bacteriophages SP82, SPO1, and phie: a comparison of DNAs and of peptides synthesized during infection
The genomes of Bacillus subtilis phages phie, SPO1, and SP82 were compared by DNA-DNA hybridization, analysis of DNA fragments produced by digestion with restriction endonucleases,...
Spectral Jaccard Similarity for long-read alignment
Spectral Jaccard Similarity for long-read alignment
A key step in genomic analysis pipelines is the identification of regions of similarity between pairs of DNA sequencing reads. This task, known as pairwise sequence alignment, is a...
Similarity Search with Data Missing
Similarity Search with Data Missing
Similarity search is a fundamental research problem with broad applications in various research fields, including data mining, information retrieval, and machine learning. The core...

