> For the complete documentation index, see [llms.txt](https://dataset-generation-doc.gitbook.io/dataset-generation-doc/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://dataset-generation-doc.gitbook.io/dataset-generation-doc/pattern/correlation.md).

# Corrélation

La Corrélation est la relation existant entre deux notions dont l'une ne peut être pensée sans l'autre, entre deux faits liés par une dépendance nécessaire.&#x20;

Dans notre cas cela permet par exemple de créer sur un dataset une corrélation positive forte (la variable 1 influence très fortement la variable 2 ), comme une relation entre le nombre la vitesse des routes et le nombre d'accidents par jour.&#x20;

Il est possible de configurer 2 paramètres :

1. Préciser le degrès de corrélation entre les deux variables (colonnes) entre -1 et 1
2. Cibler la variable indépendante celle qui influence l'autre&#x20;

### Créer une corrélation

Il est possbile de faire des corrélation négative de 0 à -1 .

Il suffit d'ajouter le champ **correlation** indiquant le degrés de corrélation avec la variable mentionné dans **correlation\_target .**

**correlation\_target** est un paramètre qui prend le nom de la variable qui influencera le champs dans lequelle elle est présente.

```yaml
#Valeur d'origine de la corrélation qui influencera l'autre variable
- fieldName: budget
    type: integer
    seasonnality : date_de_naissance
    rules:
      range:
        min: 0
        max: 101



- fieldName: test_corr_var
    type: integer
    correlation: 0.991
        # les correalations ne peuvent prendre comme cible 
        #que les valeurs de type int et qui ne sont pas présente dans les tableau []
    correlation_target: budget 
    rules:
      range:
        min: 0
        max: 10
```
