La bioinformatique se situe à la croisée fascinante de la biologie et de l'informatique, où des données biologiques complexes sont transformées en connaissances actionnables grâce à des algorithmes puissants. Ce domaine permet aux chercheurs de décrypter le code de la vie, d'analyser des séquences génétiques massives et de modéliser des interactions moléculaires avec une précision inédite, accélérant ainsi les découvertes médicales et biologiques.

Sur Gist.Science, nous nous engageons à rendre ces travaux accessibles à tous. Chaque nouvelle prépublication soumise sur bioRxiv dans cette catégorie est traitée par nos soins, offrant à la fois un résumé technique détaillé pour les experts et une explication claire en langage courant pour le grand public.

Vous trouverez ci-dessous la sélection des dernières études parues dans ce domaine, prêtes à être explorées.

💻 bioinformatics

A Framework for Quantifying DNA Methylation Heterogeneity and Detecting Co-methylated loci from Native Nanopore Sequencing

Cet article présente un cadre évolutif intégré au package DMRcaller qui exploite le séquençage natif d'Oxford Nanopore pour quantifier l'hétérogénéité de la méthylation de l'ADN à l'échelle de la molécule unique et détecter les locus co-méthylés, révélant ainsi des motifs épigénétiques et des interactions régulatrices occultés par les analyses traditionnelles de moyennes au niveau des sites.

Kim, Y. J., Zabet, N. R.2026-09-13
💻 bioinformatics

Towards reconstruction of the human interactome from positive and negative experimental evidence

Cet article présente une méthodologie pour reconstruire l'espace de recherche expérimentale des criblages d'interactions protéine-protéine (IPP) afin d'inférer les paires de protéines ne présentant probablement pas d'interaction, permettant ainsi une meilleure estimation du taux d'erreur, un étalonnage des modèles et un entraînement amélioré de l'apprentissage automatique pour une cartographie plus précise et complète de l'interactome humain.

As, J., Pelz, K., Bernett, J., Battini, F., List, M., Blumenthal, D. B., Schaefer, M. H.2026-09-13
💻 bioinformatics

Inverse FoldDir: Structure-conditioned Protein Sequence Design by Dirichlet Flow Matching

Le papier introduit Inverse FoldDir, une méthode de repliement inverse contrôlable basée sur le flux de Dirichlet (Dirichlet flow matching) qui génère des séquences protéiques diverses, validées expérimentalement, avec des contraintes définies par l'utilisateur en effectuant un débruitage itératif sur le simplexe de probabilité des acides aminés, atteignant des mesures de récupération structurelle de pointe et un redessin fonctionnel réussi d'un nanocorps anti-GFP.

TARTICI, A., Stojkovic, M., Tian, A., Jewett, M. C., Altman, R. B., Wittmann, B. J.2026-09-11✓ Author reviewed ⓘ
💻 bioinformatics

Perturbation-Aware Neural ODE (pNODE) Learns Microbiome Dynamics from Clinical Data and Predicts Gut-Borne Bloodstream Infections in Patients Receiving Cancer Treatment

Cette étude introduit le cadre de l'ODE neuronale sensible aux perturbations (pNODE), qui surpasse les modèles traditionnels en prévoyant avec précision la dynamique du microbiote intestinal et en prédisant les infections de la circulation sanguine d'origine intestinale chez les patients cancéreux subissant une transplantation de cellules souches hématopoïétiques allogéniques grâce à l'intégration des abondances microbiennes et des perturbations antibiotiques résolues dans le temps.

Stamper, I. C., Aeria, B., Xavier, J.2026-09-10
💻 bioinformatics

Systematic benchmarking of small variant calling pipelines for long-read RNA sequencing data

Cette étude évalue systématiquement les pipelines de détection de variants de petite taille et de phasage d'haplotypes pour le séquençage d'ARN en lectures longues à travers divers ensembles de données et technologies, révélant que la qualité du séquençage est le principal déterminant de la performance tout en identifiant Clair3-RNA, DeepVariant et longcallR comme les meilleurs détecteurs, ainsi que WhatsHap ou HapCUT2 comme les outils de phasage optimaux selon le contexte spécifique.

Wang, J., Robinson, M. D.2026-09-10
💻 bioinformatics

Classical baselines outperform released deep-learning ITS classifiers, which collapse on ITS2 where predictions follow the flanking regions

Cette étude démontre que, bien que les classificateurs d'apprentissage profond pour les séquences ITS fongiques atteignent une grande précision sur les références de pleine longueur, ils échouent de manière spectaculaire sur la sous-région ITS2 couramment utilisée en s'appuyant sur les régions flanquantes plutôt que sur le code-barres lui-même, ce qui fait que les méthodes de référence classiques surpassent significativement ces derniers dans des scénarios réalistes de métabarcoding environnemental.

O'Brien, A., Gardette, A., Marin, C., Parada, P.2026-09-10
💻 bioinformatics

Reference-guided pseudotime inference across species and biological contexts

L'article présente Cavebear, un cadre d'apprentissage automatique qui exploite des données de séries temporelles de scRNA-seq de référence provenant d'une espèce ou d'une condition pour inférer avec précision le pseudotemps et cartographier le vieillissement biologique ou la progression de maladies dans des contextes de requête dépourvus de labels temporels fiables.

Rittenhouse, N., Dannenfelser, R., Filippova, G. N., Yao, V., Deng, X., Disteche, C. M., Zhang, R.2026-09-10
💻 bioinformatics

Scaling Quantum Optimisation Beyond Hardware Limits for Real-World Scientific Workloads: Genome Assembly on Current Quantum Hardware

Cette recherche démontre que le cadre d'optimisation de la décomposition automatique hamiltonienne (HADOF) peut surmonter les limitations actuelles du matériel NISQ pour assembler avec succès un génome de 7,1 millions de paires de bases de *Pseudomonas aeruginosa* sur du matériel quantique réel, atteignant une fraction génomique de 99,348 % et prouvant la viabilité de l'optimisation quantique évolutive pour les charges de travail scientifiques à grande échelle.

G Sankar, N., Miliotis, G., Caton, S.2026-09-09
💻 bioinformatics

Predicted and experimental protein-ligand coordinates with distance labels and evaluation splits

Cet article présente PLI-Parallax, un ensemble de données complet qui intègre des structures protéine-ligand prédites et expérimentales avec des étiquettes de précision calibrées et des divisions d'évaluation rigoureuses, permettant l'estimation de la fiabilité des prédictions par l'accord entre les méthodes, même en l'absence de vérité terrain expérimentale.

Klamt, T.2026-09-09
💻 bioinformatics

Atlas-scale single-cell analysis beyond in-memory paradigm with scAtlasPy

scAtlasPy est un nouveau cadre de calcul résidant sur disque qui surmonte les limitations de mémoire des stations de travail standard, permettant l'analyse à pleine résolution d'atlas de cellules uniques massifs (par exemple, 100 millions de cellules) avec une utilisation de la mémoire nettement inférieure et des vitesses de traitement plus élevées par rapport aux plateformes existantes de pointe.

Xu, H., Ye, Y., Zhang, S., Xie, R., Li, J., Lin, J., Hu, Y., Gao, L.2026-09-08