Ma Clinique
  • À la une
  • Actualités
    • Médecines douces
    • Enfants
    • Chirurgie esthétique
  • Chirurgiens esthétiquesNew
  • Contactez-nous
Pas de résultat
View All Result
Ma Clinique : L'information médicale par des professionnels de la santé
Pas de résultat
View All Result

Accueil » Actualités médicales » L’outil xFakeSci peut-il identifier le faux contenu généré par l’IA ?

L’outil xFakeSci peut-il identifier le faux contenu généré par l’IA ?

par Ma Clinique
6 septembre 2024
dans Actualités médicales
Temps de lecture : 4 min
L’outil xFakeSci peut-il identifier le faux contenu généré par l’IA ?

Sommaire

    • Un outil d'IA de pointe qui surpasse les méthodes traditionnelles pour repérer le contenu généré par l'IA comme les articles ChatGPT, contribuant ainsi à protéger la recherche scientifique contre le plagiat !
  • Les menaces posées à la recherche par l’IA générative
  • Objectif et aperçu de l'étude
  • Différences entre deux types de contenu
  • Résultats des tests
  • Analyse comparative de xFakeSci
  • Conclusions

Un outil d'IA de pointe qui surpasse les méthodes traditionnelles pour repérer le contenu généré par l'IA comme les articles ChatGPT, contribuant ainsi à protéger la recherche scientifique contre le plagiat !

Étude: Détection de fausses informations scientifiques sur ChatGPT grâce à l'algorithme d'apprentissage xFakeSciCrédit photo : dauf / Shutterstock.com

L'utilisation croissante d'outils d'intelligence artificielle générative (IA) comme ChatGPT a augmenté le risque de plagiat de contenu d'apparence humaine provenant d'autres sources. Une nouvelle étude publiée dans Rapports scientifiques évalue les performances de xFakeSci pour différencier le contenu scientifique authentique du contenu généré par ChatGPT.

Les menaces posées à la recherche par l’IA générative

L’IA génère du contenu en fonction des messages ou des commandes qui lui sont envoyés pour en orienter le traitement. Avec l’aide et la complicité des réseaux sociaux, des revues prédatrices ont publié de faux articles scientifiques pour donner de l’autorité à des points de vue douteux. Cette situation pourrait être encore aggravée par la publication de contenu généré par l’IA dans de véritables publications scientifiques.

Des recherches antérieures ont souligné les difficultés associées à la distinction entre le contenu généré par l’IA et le contenu scientifique authentique. Il demeure donc urgent de développer des algorithmes de détection précis.

Objectif et aperçu de l'étude

Dans l’étude actuelle, les chercheurs ont utilisé xFakeSci, un nouvel algorithme d’apprentissage capable de différencier le contenu généré par l’IA du contenu scientifique authentique. Cet algorithme de prédiction d’étiquettes piloté par réseau englobe à la fois des modes de fonctionnement simples et multiples qui sont entraînés à l’aide d’un ou de plusieurs types de ressources, respectivement.

Au cours de la formation, les chercheurs ont utilisé des invites conçues pour identifier les faux documents et leurs caractéristiques distinctives avec ChatGPT. Par la suite, xFakeSci a été utilisé pour prédire la classe du document et son authenticité.

Deux types de modèles de formation de réseau ont été basés sur du contenu généré par ChatGPT et rédigé par des humains, obtenu à partir de résumés de PubMed. Les deux ensembles de données ont été analysés pour des articles sur le cancer, la dépression et la maladie d'Alzheimer (MA).

Différences entre deux types de contenu

L’une des différences frappantes entre les articles générés par ChatGPT et ceux générés par l’homme était le nombre de nœuds et d’arêtes calculés à partir de chaque type de contenu.

Le contenu généré par ChatGPT comportait beaucoup moins de nœuds, mais un nombre plus élevé d'arêtes pour un rapport nœud/arête inférieur. De plus, les ensembles de données générés par l'IA présentaient des ratios plus élevés pour chacun des k-Folds par rapport au contenu réel dérivé des scientifiques sur les trois maladies.

Résultats des tests

Après la formation et l'étalonnage, xFakeSci a été testé sur 100 articles pour chaque maladie, 50 de PubMed et 50 de ChatGPT. Les scores F1 ont été calculés à partir des vrais positifs, des vrais négatifs, des faux positifs et des faux négatifs.

Des scores F1 de 80 %, 91 % et 89 % ont été obtenus pour les articles sur la dépression, le cancer et la maladie d'Alzheimer, respectivement. Alors que tout le contenu généré par l'homme a été détecté par xFakeSci, seuls 25, 41 et 38 des documents générés par ChatGPT sur ces trois maladies, respectivement, ont été identifiés avec précision. Le contenu généré par ChatGPT a été identifié avec plus de précision lorsqu'il a été mélangé à des articles authentiques plus anciens pour une analyse dans une classe mixte.

ChatGPT est classé comme PubMed avec (FP (faux positifs) = 25), indiquant que 50 % des documents de test sont classés à tort comme de vraies publications.”

Analyse comparative de xFakeSci

Par rapport aux algorithmes d'exploration de données conventionnels acceptés ou classés parmi les 10 meilleurs comme Naïve Bayes, Support Vector Machine (SVM), Linear SVM et Logistic Regression, les scores de xFakeSci sont restés entre 80 % et 91 % pour les articles publiés entre 2020 et 2024. En comparaison, les autres algorithmes ont montré des performances fluctuantes, avec des scores compris entre 43 % et 52 %.

Dans les articles précédents publiés entre 2014-2019 et 2010-2014, la même disparité a été observée pour xFakeSci et d'autres algorithmes, à 80-94 % et 38-52 %, respectivement. Ainsi, xFakeSci surpasse les autres algorithmes sur toutes les périodes.

Conclusions

L'algorithme xFakeSci est particulièrement adapté à la classification multi-mode pour tester un ensemble de tests mixtes et produire des étiquettes précises pour chaque type. L'inclusion d'une étape d'étalonnage basée sur des ratios et des distances de proximité améliore l'aspect classification de cet algorithme ; cependant, elle empêche l'ajout de quantités d'échantillons excessives.

L'aspect de classification multi-mode de xFakeSci a permis à cet algorithme d'identifier avec précision les articles réels, même lorsqu'ils étaient mélangés à des articles générés par ChatGPT. Cependant, xFakeSci n'a pas réussi à identifier tous les contenus générés par ChatGPT.

Les réseaux générés à partir de ChatGPT étaient associés à un rapport nœud/bord inférieur, indiquant ainsi leur connectivité plus élevée, qui s'accompagnait d'un rapport accru de bigrammes par rapport au nombre total de mots pour chaque document.

Étant donné que ChatGPT a été développé pour produire un contenu de type humain en prédisant le mot suivant sur la base de corrélations statistiques, ses objectifs ne correspondent pas aux objectifs scientifiques de documentation des tests d’hypothèses, de l’expérimentation et des observations.

L’algorithme xFakeSci pourrait avoir d’autres applications, comme la distinction de parties potentiellement fausses de notes cliniques, d’interventions et de résumés d’expériences cliniques générés par ChatGPT. Néanmoins, des lignes directrices éthiques doivent être appliquées pour empêcher l’utilisation irresponsable des outils d’IA générative, même si l’on reconnaît leurs avantages.

L’IA peut fournir des données simulées, créer des segments de code pour de multiples applications de programmation et aider à l’enseignement, tout en aidant à présenter la recherche scientifique dans un anglais grammaticalement lisible pour les locuteurs non natifs. Cependant, le contenu généré par l’IA peut plagier des documents de recherche disponibles en ligne, ce qui pourrait interférer avec le progrès scientifique et l’apprentissage. Ainsi, les éditeurs de revues ont un rôle important à jouer dans la mise en œuvre d’algorithmes de détection et d’autres technologies pour identifier les rapports contrefaits.

Les recherches futures pourraient utiliser des graphiques de connaissances pour regrouper des domaines de publication étroitement liés afin d'améliorer la précision de la détection, de la formation et de l'étalonnage, ainsi que de tester les performances de xFakeSci à l'aide de plusieurs sources de données.

Précédent

Consommation de viande et risque de diabète de type 2 : une étude mondiale

Suivant

Grâce à Reddit, un nouveau diagnostic fait surface à travers le pays

Ma Clinique

Ma Clinique

L'équipe Ma Clinique : professionnels de la santé et spécialistes en médecine générale. Notre objectif est de vous fournir les informations dont vous avez besoin pour prendre des décisions éclairées sur vos soins de santé.

Articles populaires

Rééducation : quel sol choisir pour limiter l’impact des chutes ?

Rééducation : quel sol choisir pour limiter l’impact des chutes ?

1 août 2026
Le métier d'infirmier : un pilier essentiel du système de santé

Le métier d’infirmier : un pilier essentiel du système de santé

28 juillet 2026
Santé de la vessie : mieux comprendre les fuites urinaires pour vivre plus sereinement

Santé de la vessie : mieux comprendre les fuites urinaires pour vivre plus sereinement

27 juillet 2026
Que manger la veille d’une prise de sang pour le cholestérol ?

Que manger la veille d’une prise de sang pour le cholestérol ?

17 juillet 2026
Pourquoi notre façon de nous informer sur les petits problèmes de santé a changé

Pourquoi notre façon de nous informer sur les petits problèmes de santé a changé

15 juillet 2026

Articles recommandés

Quels sont les urgences médicales dans le domaine des dentistes ?

Les urgences médicales dans le domaine des dentistes

23 septembre 2022
Les aliments qui calment les hémorroïdes

Les aliments qui calment les hémorroïdes

10 août 2023
Utilisation des huiles essentielles pour les brûlures

Utilisation des huiles essentielles pour les brûlures

30 septembre 2022
L'accompagnement par un patient aidant pour mieux vivre avec le cancer

L’accompagnement par un patient aidant pour mieux vivre avec le cancer

22 septembre 2023
Les avancées technologiques pour mieux contrôler la vessie

Les avancées technologiques pour mieux contrôler la vessie

30 novembre 2022
Les bas de contention contre les phlébites en avion

Les bas de contention contre les phlébites en avion

1 avril 2022
Les risques d'une chirurgie esthétique en Corée

Les risques d’une chirurgie esthétique en Corée du Sud

5 janvier 2021
Quels sont les avantages d'une brosse à dents ultrasonique ?

Quels sont les avantages d’une brosse à dents ultrasonique ?

23 septembre 2022
URGO engagé dans la prise en charge de l’épidermolyse bulleuse depuis 25 ans

URGO engagé dans la prise en charge de l’épidermolyse bulleuse depuis 25 ans

27 octobre 2025
Thérapie cognitivo-comportementale contre la dépression

Thérapie cognitivo-comportementale contre la dépression

5 mai 2022
La musicothérapie contre les troubles du comportement dus à la maladie d’Alzheimer

La musicothérapie contre les troubles du comportement dus à la maladie d’Alzheimer

8 janvier 2022
Comprendre les critères d'éligibilité pour une greffe de cheveux

Comprendre les critères d’éligibilité pour une greffe de cheveux

15 mars 2024

Qui sommes-nous ?

Ma Clinique

Ma Clinique : L'information médicale par des professionnels de la santé.

Ma Clinique est géré par des professionnels de la santé qui ont à cœur de fournir des informations médicales précises et actualisées. Nous sommes une équipe de médecins et d'autres professionnels de la santé, et avons des années d'expérience dans le domaine de la médecine.

Nous trouver

Ma Clinique
11 rue Jules Ferry
01500 Ambérieu-en-Bugey
France

[email protected]

  • Mentions légales
  • Contactez-nous

© 2026 Copyright - Ma Clinique - [email protected]

Pas de résultat
View All Result
  • À la une
  • Actualités
    • Médecines douces
    • Enfants
    • Chirurgie esthétique
  • Chirurgiens esthétiques
  • Contactez-nous

© 2026 Copyright - Ma Clinique - [email protected]

Ce site utilise les cookies. En continuant votre navigation sur ce site, vous acceptez l'utilisation des cookies afin d'assurer le bon déroulement de votre visite et de réaliser des statistiques d'audience. Visitez nos mentions légales .