deep-research

Par shobcoder · shob

Skill de recherche approfondie en mode GOD MODE. Boucle de recherche autonome multi-phases : décomposition des requêtes → crawling multi-sources → recoupement des affirmations → résolution des conflits → synthèse structurée avec citations intégrées. À utiliser pour toute question exigeant profondeur, sourçage et exactitude vérifiable.

npx skills add https://github.com/shobcoder/shob --skill deep-research

Deep Research — GOD MODE

Trigger

/deep-research <query> ou quand l'utilisateur dit « research this deeply », « go deep on », « full research report on », « investigate this thoroughly ».

Core Philosophy

Les résultats bruts de recherche sont du bruit. La synthèse vérifiée est un signal. Chaque affirmation a besoin d'une source. Chaque conflit a besoin d'une résolution. Un excellent rapport de deep research est un briefing d'intelligence structuré, pas un résumé de recherche.

Architecture

Query
  └── Phase 1: Décomposition → Sous-questions
        └── Phase 2: Recherche parallèle → Sources brutes
              └── Phase 3: Crawl & Extraction → Affirmations
                    └── Phase 4: Contre-référence → Vérification / Conflit
                          └── Phase 5: Synthèse → Rapport
                                └── Phase 6: Quality Gates → Livraison

Phase 1 — Décomposition de la Query

Décomposez la query de l'utilisateur en 3–7 sous-questions atomiques. Chacune doit être :

  • Independently searchable
  • Non-chevauchante avec les autres
  • Ordonnée du fondamental à l'avancé

Exemple :

Query : « La Société X est-elle rentable ? »

Sous-questions :

  1. Quel est le modèle de revenu actuel de la Société X ?
  2. Quels sont ses chiffres d'ARR et de revenu déclarés ?
  3. Quel est son burn rate et sa structure de coûts ?
  4. Que disent les investisseurs sur son chemin vers la rentabilité ?
  5. Comment se compare-t-elle aux concurrents sur les unit economics ?

Phase 2 — Stratégie de Recherche Multi-Sources

Pour chaque sous-question, lancez 2–4 recherches ciblées avec des angles de query variés :

[primary term] [year]
[primary term] site:official OR filetype:pdf
[primary term] analysis OR breakdown OR report
[primary term] vs [competitor]

Tiers de Priorité des Sources :

Tier Type Trust Weight
1 Docs officielles, SEC filings, blogs d'entreprise, données gouvernementales, articles peer-reviewed 1,0
2 Grands médias (Reuters, Bloomberg, FT), analystes industrie (Gartner, CB Insights) 0,85
3 Tech blogs, newsletters, podcasts 0,65
4 Forums, Reddit, réseaux sociaux 0,40

Minimum de sources par rapport : 8 domaines uniques Cible pour sujets complexes : 15–25 sources


Phase 3 — Deep Crawl et Extraction

Pour chaque source, récupérez la page entière (pas juste le snippet), puis extrayez les affirmations structurées :

  • Faits numériques (stats, dates, prix, pourcentages)
  • Entités nommées (personnes, entreprises, produits)
  • Affirmations causales (« X a causé Y parce que Z »)
  • Affirmations comparatives (« A est mieux que B »)

Taggez chaque affirmation avec l'URL source, la date de publication, le tier rating, et une paraphrase ou citation verbatim de moins de 15 mots.

Template d'extraction par source :

source: https://example.com/article
published: 2026-04-12
tier: 2
claims:
  - text: "Company reached $100M ARR in Q1 2026"
    type: numerical
    confidence: high
  - text: "CEO stated profitability target by 2027"
    type: causal
    confidence: medium

Phase 4 — Contre-Référence et Résolution de Conflits

4a. Regroupement des Affirmations

Regroupez les affirmations identiques ou liées à travers les sources. Si 3+ sources Tier 1–2 s'accordent, marquez comme Verified.

4b. Détection de Conflits

Signalez les affirmations où les sources se contredisent :

CONFLICT DETECTED
  Affirmation A: "Revenue is $50M ARR" — Source A, 2026-01
  Affirmation B: "Revenue is $80M ARR" — Source B, 2026-03
  Resolution: Use most recent Tier 1–2 source. Note discrepancy in report.

4c. Détection de Lacunes

Si une sous-question a zéro sources Tier 1–2, marquez-la [unverified] et signalez-la dans le rapport.

4d. Scoring de Confiance

Confidence = (sum of tier_weights x recency_factor) / num_claims

recency_factor:
  < 30 days:   1,0
  30–90 days:  0,9
  3–12 months: 0,75
  > 1 year:    0,60

Phase 5 — Synthèse du Rapport

Structure du Rapport

# [Topic] — Deep Research Report

> Researched: [date] | Sources: [N] | Confidence: [X]% | Sub-questions: [N]

---

## Executive Summary

2–4 sentence synthesis of the most important findings.
Lead with the single most important fact.

---

## Table of Contents

1. [Sub-question 1 title](#anchor)
2. [Sub-question 2 title](#anchor)
...
N.   Conflicts and Uncertainties
N+1. Sources

---

## 1. [Sub-question Title]

### Finding
One clear, direct answer to the sub-question.

### Evidence
- [Claim] — Source: [Name], [Date], Tier 1
- [Claim] — Source: [Name], [Date], Tier 2
- [Claim] — Source: [Name], [Date], unverified

### Confidence: [X]% | Coverage: [N] sources

---

## [Repeat for each sub-question]

---

## Conflicts and Uncertainties

| Topic | Claim A | Claim B | Resolution |
|-------|---------|---------|------------|
| Revenue | $50M (Source A) | $80M (Source B) | Use Source B (more recent) |

---

## Knowledge Gaps

- [Field X]: No Tier 1–2 sources found. Flagged as unverified.
- [Field Y]: Only sources older than 12 months available.

---

## Research Metadata

| Metric | Value |
|--------|-------|
| Total sources | N |
| Tier 1–2 sources | N |
| Sub-questions answered | N / N |
| Average confidence | X% |
| Date range of sources | YYYY-MM to YYYY-MM |
| Conflicts detected | N |
| Gaps flagged | N |

---

## Sources

| # | URL | Type | Tier | Date | Used For |
|---|-----|------|------|------|----------|
| 1 | https://... | Official | 1 | 2026-05-01 | Revenue data |
| 2 | https://... | News | 2 | 2026-04-10 | Funding round |

Phase 6 — Quality Gates

Exécutez tous les contrôles avant de livrer le rapport. Fail = ne pas livrer tant que non résolu.

Gate Requirement Action if Fail
Source minimum 8+ unique domains Run additional search passes
Tier coverage 40%+ Tier 1–2 sources Flag low-quality sourcing in report
Conflict resolution All conflicts documented Add to conflicts table
Gap flagging All unanswered sub-questions noted Add to gaps section
Citation accuracy Every claim has a source Remove or flag orphan claims
Recency 50%+ sources within 12 months Flag stale data in report

Output Modes

Utilisez un flag dans le trigger pour changer de mode :

Flag Mode Description
(none) Standard Full report as specified above
[academic] Academic Adds abstract, methodology, limitations, further research
[brief] Quick Brief Executive summary + top 5 facts + source list. Max 300 words
[compare] Comparison Side-by-side table of N items across shared dimensions

Iteration Protocol

Si la confiance est inférieure à 70% après la première passe :

ITERATION 2:
  - Re-run searches with refined queries
  - Target gaps identified in Phase 4
  - Fetch Tier 1 sources directly (company.com, arxiv.org, gov sites)
  - Update confidence scores
  - Note in report: "This section required 2 research iterations"

Maximum iterations: 3
If confidence remains below 60% after 3 iterations, deliver with prominent uncertainty warnings.

Anti-Hallucination Rules

  1. Ne jamais inventer une statistique. Si un nombre n'est pas sourcé, écrivez [no data found].
  2. Ne jamais paraphraser en une affirmation plus forte. Si une source dit « may reach », n'écrivez pas « will reach ».
  3. Ne jamais fusionner les affirmations de deux sources en une seule phrase sans attribuer les deux.
  4. Ne jamais omettre un conflit parce qu'il est gênant — surfacez-le dans la table des conflits.
  5. Datez chaque affirmation. Les affirmations non datées reçoivent une pénalité de recency dans le scoring de confiance.
  6. En cas d'incertitude, dites-le explicitement en utilisant les tags [unverified] ou [disputed] inline.
  7. Ne jamais reproduire plus de 15 mots verbatim d'une seule source.

Trigger Examples

/deep-research What is the current state of fusion energy?
/deep-research [academic] Impact of LLMs on scientific paper quality
/deep-research [compare] React vs Vue vs Svelte for large-scale apps
/deep-research [brief] What caused the 2023 banking crisis?

Skill Outputs

File Description
{topic}/report.md Full research report
{topic}/sources.yaml Structured source list with tier ratings
{topic}/claims.yaml All extracted claims with provenance
{topic}/conflicts.md Conflict log with resolutions
{topic}/metadata.json Confidence scores, coverage stats, iteration log

Skills similaires