Skip to content

Commit 6062660

Browse files
authored
Configuration des datasets prioritaires du dédoublonnage IRVE dans un fichier à part (#5409)
1 parent 288bc72 commit 6062660

2 files changed

Lines changed: 23 additions & 11 deletions

File tree

apps/transport/lib/irve/deduplicator.ex

Lines changed: 6 additions & 11 deletions
Original file line numberDiff line numberDiff line change
@@ -6,17 +6,12 @@ defmodule Transport.IRVE.Deduplicator do
66

77
require Explorer.DataFrame
88

9-
# Lowest priority number = highest priority, 1 = main priority, 2 = second priority, etc.
10-
# Don’t put two datasets on the same priority level
11-
# Prioritary datasets must have only a single resource tagged at static IRVE schema
12-
@prioritary_datasets [
13-
# Gireve
14-
%{datagouv_dataset_id: "63dccb1307e9b2f213a5130c", priority: 1},
15-
# Eco-movement
16-
%{datagouv_dataset_id: "64060c2ac773dcf3fabbe5d2", priority: 2},
17-
# Qualicharge
18-
%{datagouv_dataset_id: "6818bce2d9af175f6e01a1b2", priority: 3}
19-
]
9+
# Loaded at compile time from priv/irve_prioritary_datasets.yml
10+
@prioritary_datasets :transport
11+
|> Application.app_dir("priv")
12+
|> Kernel.<>("/irve_prioritary_datasets.yml")
13+
|> File.read!()
14+
|> YamlElixir.read_from_string!()
2015

2116
@doc """
2217
Main method of deduplication.
Lines changed: 17 additions & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -0,0 +1,17 @@
1+
# Prioritary datasets for IRVE deduplication.
2+
#
3+
# Lowest priority number = highest priority (1 = top priority).
4+
# Don't put two datasets on the same priority level.
5+
# Each dataset must have only a single resource tagged as static IRVE schema.
6+
7+
# Gireve
8+
- datagouv_dataset_id: "63dccb1307e9b2f213a5130c"
9+
priority: 1
10+
11+
# Eco-movement
12+
- datagouv_dataset_id: "64060c2ac773dcf3fabbe5d2"
13+
priority: 2
14+
15+
# Qualicharge
16+
- datagouv_dataset_id: "6818bce2d9af175f6e01a1b2"
17+
priority: 3

0 commit comments

Comments
 (0)