ai-deepfake • arXiv cs.CR

Des chercheurs présentent WorldMark, une interface plug-and-play pour le watermarking de modèles de langage utilisant

Des chercheurs présentent WorldMark, une interface plug-and-play pour le watermarking de modèles de langage utilisant la connaissance du monde pour améliorer la détection de textes générés tout en réduisant la complexité et en maintenant la qualité du texte. L'étude montre des résultats prometteurs sur les jeux de données C4 et OpenGen.

#LLM watermarking#token-level saliency scoring#asymmetric knowledge modulation#memory graph integration#adaptive-strength watermarking
Des chercheurs présentent WorldMark, une interface plug-and-play pour le watermarking de modèles de langage utilisant

Une nouvelle étude publiée sur arXiv (2608.06416) présente WorldMark, une interface plug-and-play pour le watermarking de modèles de langage utilisant la connaissance du monde afin d'améliorer la détection de textes générés. Cette recherche, menée par och Display Aspect Ratio och Display Aspect Ratio (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") (PAR) och Display Aspect Ratio och Display Aspect Ratio (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") (PAR) och Display Aspect Ratio och Display Aspect Ratio och Display Aspect Ratio och Display Aspect Ratio och Display Aspect Ratio och Display Aspect Ratio och Display Aspect Ratio och Display Aspect Ratio (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") des experts en sécurité de l'IA, aborde un défi majeur en criminalistique numérique : tracer l'origine des textes générés par och Display Aspect Ratio och Display Aspect Ratio och Display Aspect Ratio och Display Aspect Ratio och Display Aspect Ratio (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") les grands modèles de langage (LLM).

Les techniques traditionnelles de watermarking pour les LLM reposent sur des statistiques locales de tokens, ce qui peut s'avérer insuffisant dans des scénarios de génération de texte ouverts nécessitant une compréhension contextuelle. WorldMark résout ce problème en intégrant une mémoire de connaissances mondiales (World Knowledge Memory, WKM), une représentation structurée des connaissances organisant les savoirs sémantiques et épisodiques dans un graphe de mémoire. En convertissant les connaissances récupérées en un score de saillance au niveau des tokens, le système peut ajuster la force d'un watermark hôte via une modulation asymétrique des connaissances (Asymmetric Knowledge Modulation, AKM).

L'une des caractéristiques les plus remarquables de WorldMark est sa capacité à fonctionner sans nécessiter de réentraînement du modèle de base ni d'ajout de modèles ou de paramètres spécifiques au détecteur. Cela rend la technique particulièrement adaptée à une application pratique en criminalistique numérique, où un déploiement rapide et une compatibilité avec les systèmes existants sont cruciaux. L'étude démontre que WorldMark améliore la détection des échantillons de texte, qu'ils soient intacts ou attaqués, sur le jeu de données C4, tout en réduisant légèrement la perplexité.

Les chercheurs ont également mené des expériences pilotes sur C4 et OpenGen pour évaluer le conditionnement direct de la mémoire à travers plusieurs familles de watermarking. Les résultats indiquent que la technique peut être transférée à différents systèmes de watermarking, mais nécessite un mécanisme de stabilisation comme la modulation sensible à la saillance de WorldMark pour éviter les instabilités. Cette flexibilité fait de WorldMark un outil précieux pour les enquêtes forensiques où diverses techniques de watermarking peuvent être rencontrées.

L'application pratique de WorldMark en criminalistique numérique est significative. En permettant un traçage robuste des textes générés, la technique peut faciliter les enquêtes sur la désinformation, la fraude et d'autres formes de criminalité numérique où des textes générés par och Display Aspect Ratio och Display Aspect Ratio och Display Aspect Ratio och Display Aspect Ratio (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") (DAR) för att förhindra att fordon och ansikten förvrängs i bredd.") LLM sont utilisés. De plus, WorldMark peut être intégré dans des cadres DFIR existants pour renforcer la chaîne de custody lors de l'analyse des preuves numériques.

L'étude souligne que WorldMark introduit une surcharge négligeable dans le protocole principal, ce qui signifie que son implémentation n'affectera pas négativement les performances des systèmes d'enquête. Cela est crucial pour les enquêtes forensiques où le temps et les ressources sont souvent limités.

Pour les examinateurs en criminalistique numérique, WorldMark représente une nouvelle opportunité d'améliorer l'analyse des textes générés par LLM. En combinant la connaissance du monde avec des techniques avancées de watermarking, les enquêteurs peuvent déterminer de manière plus fiable l'origine et l'intégrité des textes, ce qui est essentiel pour les procédures judiciaires et les enquêtes.

Conclusions & mesures recommandées

  • Focus forensique : Auditer les journaux système, analyser les artefacts et préserver la chaîne de preuve.
  • Provenance des sources : Synthèse technique vérifiée à partir des avis de arXiv cs.CR.
  • Action recommandée : Mettre à jour les indicateurs (IOC) et vérifier les systèmes exposés.

Sources et références

← Toutes les actualités Outils