💻 bioinformatics

Tox21mer, A transformer foundation model for Tox21 high-throughput concentration-response curves data

यह शोध पत्र Tox21mer को प्रस्तुत करता है, जो कि 2.5 मिलियन Tox21 सांद्रता-प्रतिक्रिया वक्रों (concentration-response curves) के माध्यम से मास्क्ड-रिस्पॉन्स रिकंस्ट्रक्शन (masked-response reconstruction) द्वारा प्रीट्रेन किया गया एक 43.5-मिलियन-पैरामीटर वाला ट्रांसफॉर्मर फाउंडेशन मॉडल है, जो उच्च गुणवत्ता वाले 768-आयामी एम्बेडिंग्स उत्पन्न करता है जो परख परिणामों (assay outcomes) और AC50 मानों की भविष्यवाणी करने में अत्याधुनिक प्रदर्शन प्राप्त करते हैं और साथ ही अनपरीक्षित यौगिकों तक एक्सट्रपलेशन (extrapolation) करने में सक्षम बनाते हैं।

Li, L., Hwang, J., Shockley, K., Li, Y., Motsinger-Reif, A., Hsieh, J.-H., Auerbach, S. S., Reif, D.2026-06-19
💻 bioinformatics

Children's DNA Methylation and Family Dynamics in a Congo Basin Subsistence Community: Links with Parental Conflict and Fathers' Caregiving

यह अध्ययन प्रदर्शित करता है कि कांगो बेसिन के एक निर्वाह समुदाय में, बच्चों के डीएनए मिथाइलेशन पैटर्न माता-पिता के संघर्ष और पिता की देखभाल से महत्वपूर्ण रूप से जुड़े हुए हैं, जो इन पारिवारिक गतिशीलता को तनाव, प्रतिरक्षा और विकास में शामिल जीन से जोड़ते हैं, जिससे यह सुझाव मिलता है कि पारिवारिक वातावरण का जैविक समावेश विविध सामाजिक-पारिस्थितिक संदर्भों में एक सार्वभौमिक घटना है।

Chan, M. H.-M., Merrill, S. S., Zhuang, B. C., Lin, D. T. S., Macisaac, J. L., Miegakanda, V., Lew-Levy, S., Boyette, A. (…)2026-06-19
💻 bioinformatics

MorphoStat: A Statistics-Aware Pipeline for Morphological Profiling Analysis

MorphoStat एक ओपन-सोर्स पायथन पाइपलाइन है जो रोबस्ट मॉर्फोलॉजिकल प्रोफाइलिंग विश्लेषण को सुगम बनाने के लिए हाई-कंटेंट इमेजिंग डेटा के नॉर्मलाइजेशन, डिस्ट्रीब्यूशन-अवेयर स्टैटिस्टिकल टेस्टिंग और मल्टीपल-टेस्टिंग करेक्शन को ऑटोमेट करती है।

Altobi, A., Heo, D.2026-06-18
💻 bioinformatics

Predicting optimal growth temperatures of bacteria using learned structural information from a single protein

यह शोध पत्र ROSEATE को प्रस्तुत करता है, जो एक नवीन ढांचा (framework) है जो एक सर्वव्यापी प्रोटीन, एडेनाइलेट काइनेज (adenylate kinase) से प्राप्त MSA ट्रांसफॉर्मर-व्युत्पन्न संरचनात्मक हस्ताक्षरों का लाभ उठाकर, बैक्टीरिया के इष्टतम विकास तापमान की सटीक भविष्यवाणी करता है, जिससे विविध वातावरणों में सुदृढ़, जातिवृत्तीय रूप से सामान्यीकरण योग्य और समुदाय-स्तरीय तापीय अनुमान सक्षम होता है।

Hoffert, M., Myerscough, D., Dragone, N. B., Gebert, M. J., Silberg, J. J., Fierer, N.2026-06-18
💻 bioinformatics

MetaHarmonizer: robust biomedical metadata harmonization and a contamination control for inflated LLM performance on public benchmarks

MetaHarmonizer एक सुदृढ़, पूर्णतः स्थानीय और नियतात्मक स्वचालित प्रणाली है जो बायोमेडिकल मेटाडेटा सामंजस्य के लिए नियंत्रित शब्दावलियों के साथ एक बहु-चरणीय कैस्केड को संयोजित करती है ताकि मतिभ्रम (hallucinations) और अतिरंजित बेंचमार्क प्रदर्शन को रोका जा सके, जिससे स्कीमा और ऑन्टोलॉजी मैपिंग में अत्याधुनिक सटीकता प्राप्त होती है और सिद्धांतिक मानव-इन-द-लूप ट्राइएज सक्षम होता है।

Li, C., Dahl, A., Gravel-Pucillo, K. D., Long, K., Waters, M., de Bruijin, I., Davis, S., Oh, S.2026-06-17
💻 bioinformatics

VLab4Mic: prediction of structural resolvability in super-resolution microscopy

VLab4Mic एक सिमुलेशन प्लेटफॉर्म है जो विभिन्न सुपर-रेज़ोल्यूशन माइक्रोस्कोपी मोडैलिटीज के माध्यम से प्रोटीन असेंबली की संरचनात्मक रिज़ॉल्वेबिलिटी (resolvability) की भविष्यवाणी करने के लिए प्रोब प्लेसमेंट और स्टेरिक बाधाओं (steric constraints) को मॉडल करता है, जिससे शोधकर्ताओं को भौतिक प्रयोग करने से पहले प्रयोगात्मक व्यवहार्यता का आकलन करने में सक्षम बनाया जा सके।

Martinez, D., Saraiva, B. M., Shakespeare, T., Bates, M., Owen, D. M., Leterrier, C., Del Rosario, M., Henriques, R.2026-06-16
💻 bioinformatics

THEOBROMA: an aggregated open database of 1.13 million natural products with per-compound license auditing, three-tier classification, and stereochemistry-aware deduplication

THEOBROMA 29 स्रोतों से 1.13 मिलियन से अधिक प्राकृतिक उत्पादों को एकत्रित करने वाला एक खुला डेटाबेस है जो लाइसेंस-अनुपालन वर्चुअल स्क्रीनिंग और आइसोमर-विशिष्ट जैव-सक्रियता विश्लेषण को सक्षम करने के लिए प्रति-यौगिक लाइसेंस ऑडिटिंग, एक त्रि-स्तरीय वर्गीकरण प्रणाली और स्टीरियोकेमिस्ट्री-जागरूक डीडुप्लीकेशन के माध्यम से स्वयं को विशिष्ट बनाता है।

Klamt, T., Jaczkowski, A., Franke, J., Nejdl, W.2026-06-16
💻 bioinformatics

Rapid and consistent clustering of millions of genomes highlights the diversity of prokaryotic life

लेखक gemsparcl प्रस्तुत करते हैं, जो एक अत्यधिक स्केलेबल और कुशल उपकरण है जो लगभग 14 घंटों में 5.6 मिलियन से अधिक जीवाणु जीनोम को 92,954 प्रजाति-स्तर की जीनोमिक सुसंगत इकाइयों में क्लस्टर करता है, जिससे प्रोकैरियोटिक विविधता और वर्गीकरण के व्यापक, संदर्भ-मुक्त विश्लेषण को सक्षम करने के लिए कम्प्यूटेशनल बाधाओं को दूर किया जा सके।

von Wachsmann, J. H., Lorenz, L. J., Gurbich, T. A., Russell, M. J., Rodriguez Bouza, V., Horsfield, S. T., Lees, J. A. (…)2026-06-15
💻 bioinformatics

Biological meaning in protein embedding space is resolution-dependent

यह अध्ययन प्रदर्शित करता है कि प्रोटीन लैंग्वेज मॉडल एम्बेडिंग्स का जैविक अर्थ स्थिर नहीं है बल्कि रिज़ॉल्यूशन-निर्भर है, जहाँ जैविक पदानुक्रमों के साथ विभिन्न संरेखण स्तर सदस्यता सीमाओं, कार्यात्मक समूहों या स्थानीय पारिवारिक संरचनाओं जैसे विशिष्ट संगठनात्मक संबंधों को चुनिंदा रूप से संरक्षित करते हैं।

Zong, L., Ren, J., Li, Y., Finn, R. D., Wang, J.2026-06-15
💻 bioinformatics

WitChi: Efficient Detection and Pruning of Compositional Bias in Phylogenomic Alignments Using Empirical Chi-Squared Testing

WitChi एक गणनात्मक रूप से कुशल उपकरण है जो बड़े पैमाने के फाइलोगेनोमिक संरेखणों (phylogenomic alignments) से संरचनात्मक रूप से पक्षपाती स्थलों का पता लगाने और उन्हें पुनरावृत्ति के माध्यम से हटाने के लिए अनुभवजन्य ची-स्क्वेर्ड परीक्षण (empirical chi-squared testing) का उपयोग करता है, जिससे जटिल संरचना-जागरूक मॉडलों की उच्च गणना लागत के बिना सटीक फाइलोगेनेटिक टोपोलॉजी को पुनर्स्थापित किया जा सके।

Koestlbacher, S., Panagiotou, K., Tamarit, D., Ettema, T.2026-06-13