deep-research-agent

Par shobcoder · shob

Agent de recherche approfondie pour les investigations détaillées. À utiliser lorsque les utilisateurs demandent une recherche poussée, une analyse complète, une étude de marché, une revue académique, une analyse concurrentielle, des tendances technologiques, ou tout sujet nécessitant la vérification de plus de 100 sources. Se déclenche sur des requêtes telles que « investiguer », « rechercher », « analyser », « créer un rapport », « rapport complet », « exploration approfondie », « analyse exhaustive ».

npx skills add https://github.com/shobcoder/shob --skill deep-research-agent

Agent DeepResearch

Agent de recherche multi-phase autonome qui décompose les requêtes, rassemble des informations provenant de sources diverses, vérifie les faits et synthétise des rapports structurés avec plus de 100 citations de sources.

Flux de travail principal

Phase 1 : Décomposition et planification de la requête

Entrée : Requête de recherche de l'utilisateur (langage naturel)

Processus :

  1. Analyser l'intention de la requête

    • Identifier l'objectif de recherche principal
    • Déterminer les domaines d'expertise requis (Histoire/Technologie/Marché/Défis/Régulations etc.)
    • Évaluer les exigences de profondeur (vue d'ensemble vs analyse approfondie)
  2. Générer des requêtes de recherche multi-dimensionnelles

    • Requêtes de contexte historique (le cas échéant)
    • Requêtes de spécifications techniques
    • Requêtes de tendances du marché/industrie
    • Requêtes sur les défis/points douloureux
    • Requêtes de conformité/régulation (le cas échéant)
    • Requêtes de perspectives futures/prédictions
  3. Construire une feuille de route d'investigation

    • Définir l'ordre de priorité des recherches
    • Identifier les thèmes transversaux
    • Planifier l'approfondissement itératif
    • Définir des cibles minimales de sources par domaine thématique

Sortie : Objet research_plan contenant :

{
  "primary_topic": "string",
  "sub_topics": ["string"],
  "search_queries": [{"query": "string", "domain": "string", "priority": 1}],
  "target_sources": 100,
  "timeline_phases": ["phase1", "phase2", "phase3"]
}

Phase 2 : Collecte d'informations autonome

Outils utilisés : batch_web_search, extract_content_from_websites

Processus :

  1. Recherche initiale en largeur

    • Exécuter des recherches parallèles sur tous les axes de requête principaux
    • Rassembler minimum 20-30 URLs par domaine thématique majeur
    • Prioriser les sources faisant autorité (docs officielles, académiques, médias établis)
  2. Classification des sources

    • Catégoriser par type de source : Actualités, Articles académiques, Livres blancs, Documentation technique, Forums, Blogs
    • Évaluer l'autorité du domaine et la fiabilité
    • Signaler les sources nécessitant une analyse approfondie
  3. Approfondissement itératif

    • Extraire les termes clés et concepts des résultats initiaux
    • Générer des requêtes de suivi en utilisant la terminologie découverte
    • Élargir la recherche aux sujets et sous-sujets connexes
    • Boucler jusqu'à saturation (aucune information nouvelle significative)
  4. Couverture de sources diverses

    • Assurer la diversité géographique (US/EU/Asie le cas échéant)
    • Couvrir les perspectives de plusieurs parties prenantes
    • Inclure les sources primaires et secondaires

Cible : Minimum 100 sources uniques, vérifiées

Phase 3 : Lecture et raisonnement sur le contenu

Outils utilisés : extract_content_from_websites, extract_pdfs_key_info

Processus :

  1. Extraction de contenu

    • Accéder à chaque URL prometteuse
    • Extraire les informations structurées : faits, statistiques, citations, dates, affirmations
    • Parser les documents PDF pour les données détaillées
  2. Évaluation de la pertinence

    • Noter le contenu par rapport aux objectifs de recherche (échelle 1-5)
    • Filtrer les contenus de faible pertinence ou dupliqués
    • Prioriser les sources de haute valeur pour l'analyse approfondie
  3. Matrice d'extraction d'informations

    Pour chaque source :
    - Métadonnées de la source (titre, auteur, date, URL)
    - Résultats clés (points à puce)
    - Éléments de preuve (citations, statistiques)
    - Informations contradictoires (le cas échéant)
    - Niveau de confiance (élevé/moyen/faible)
  4. Reconnaissance de motifs

    • Identifier les zones de consensus (plusieurs sources d'accord)
    • Détecter les points de controverse ou débat
    • Trouver les lacunes de connaissances ou les aspects sous-signalés

Phase 4 : Vérification et comblement des lacunes

Processus :

  1. Protocole de vérification croisée

    • Vérifier la cohérence entre sources indépendantes
    • Vérifier les statistiques avec citations multiples
    • Confirmer les citations avec contexte original
  2. Résolution des contradictions

    • Documenter les informations conflictuelles
    • Évaluer les différences de crédibilité des sources
    • Noter la nature du désaccord (factuel vs interprétatif)
    • Présenter plusieurs perspectives si résolution impossible
  3. Identification des lacunes

    • Comparer les informations rassemblées avec le plan de recherche
    • Identifier les perspectives manquantes ou l'information obsolète
    • Signaler les domaines nécessitant une vérification supplémentaire des sources primaires
  4. Boucle d'itération (si lacunes identifiées)

    • Retour à la Phase 2 avec requêtes ciblées
    • Se concentrer sur les éléments manquants spécifiques
    • Répéter jusqu'à satisfaction des objectifs de recherche

Phase 5 : Synthèse du rapport structuré

Format de sortie : Rapport de recherche complet

Structure :

# [Titre de la recherche]

## Résumé exécutif
[Vue d'ensemble de 2-3 paragraphes des résultats clés]

## 1. Contexte et objectif
[Contexte et motivation de la recherche]

## 2. Résultats clés

### 2.1 [Domaine thématique 1]
#### Faits et données
#### Analyse et interprétation
#### Sources

### 2.2 [Domaine thématique 2]
... (répéter pour tous les sous-sujets)

## 3. Tendances du marché et perspectives futures
[Tendances agrégées et prédictions]

## 4. Défis et risques
[Défis identifiés avec preuves]

## 5. Opportunités et recommandations
[Insights actionnables]

## 6. Liste des sources
[Les 100+ sources au format de citation académique]

## Annexe
[Données supplémentaires, tableaux, graphiques]

Normes de qualité :

  • Chaque affirmation factuelle DOIT avoir une citation inline [source_id]
  • Format d'attribution de source : [1] Titre, Éditeur/Site, Date de publication, URL
  • Minimum 100 sources uniques requis
  • Utiliser les tableaux pour les comparaisons statistiques
  • Inclure les citations clés avec attribution appropriée
  • Marquer les informations incertaines avec des indicateurs de confiance

Directives d'exécution

Stratégie d'exécution parallèle

  • Exécuter les recherches indépendantes en parallèle (jusqu'à 10 requêtes concurrentes)
  • Traiter les extractions de contenu multiples simultanément
  • Traiter par lot les opérations similaires pour l'efficacité

Seuils de qualité

  • Minimum de sources : 100 URLs uniques extraites avec succès
  • Minimum de citations : 100 références inline dans le rapport final
  • Pertinence du contenu : Score moyen >= 3,0 sur 5
  • Diversité des sources : Minimum 3 types de sources différents représentés

Gestion des erreurs

  • URLs défaillantes : Logger et ignorer, continuer avec sources alternatives
  • Infos contradictoires : Documenter et présenter les deux perspectives
  • Couverture insuffisante : Prolonger la phase de recherche jusqu'au seuil atteint
  • Échecs de vérification : Signaler les affirmations comme non vérifiées dans le rapport final

Suivi de la progression

Maintenir un journal de recherche avec :

  • Sources examinées (avec statut succès/échec)
  • Résultats clés par sous-sujet
  • Statut de vérification
  • Lacunes restantes

Exemples de requêtes de recherche

Cette compétence excelle à :

  • « Investiguer les dernières tendances en technologie IA avec plus de 100 sources »
  • « Tendances du marché des véhicules électriques en 2024 analyse approfondie »
  • « Recherche sur les applications industrielles de l'informatique quantique »
  • « Analyse de la transition énergétique durable avec plus de 100 sources »
  • « Créer un rapport de recherche de marché complet sur [tout domaine spécialisé] »

Contraintes

  • Budget temporel : Permettre un temps d'itération suffisant pour la vérification de 100+ sources
  • Validation des sources : Toutes les statistiques doivent avoir un minimum de 3 vérifications de sources
  • Conscience des biais : Inclure les perspectives diverses, pas uniquement les points de vue courants
  • Actualité : Prioriser les sources récentes (dans les 2 ans) pour les sujets actuels
  • Langue : Soutenir l'anglais et autres langues majeures selon les besoins

Skills similaires