Compare commits

..

28 Commits

Author SHA1 Message Date
Colin Maudry 2f3ce6a467 Amélioration du message d'annonce 2025-11-11 09:04:11 +01:00
Colin Maudry efd9bd4238 Merge branch 'hotfix/2.1.7' 2025-11-11 08:39:58 +01:00
Colin Maudry 39844071ad Changelog 2.1.7 2025-11-11 08:39:41 +01:00
Colin Maudry 5c64177c6a Remplacement du formulaire de contact par email 2025-11-11 08:37:47 +01:00
Colin Maudry ee91e7a91f Merge branch 'hotfix/2.1.6' 2025-10-15 19:44:09 +02:00
Colin Maudry 392f862baa Changelog 2.1.6 2025-10-15 19:44:02 +02:00
Colin Maudry 199476ec30 Stabilisation affichage fiche marché #40 2025-10-15 19:42:53 +02:00
Colin Maudry c98a36f759 Fix fiche marche 2025-10-14 12:54:47 +02:00
Colin Maudry 65e0f4c5f0 Gestion des montants inexistants 2025-10-10 18:25:08 +02:00
Colin Maudry bc7652f336 Merge branch 'main' into dev 2025-10-10 17:48:47 +02:00
Colin Maudry 188383a882 Changelog 2.1.5 2025-10-10 17:47:18 +02:00
Colin Maudry 7f3a0bcb21 Renommage de la Github action d'auto release 2025-10-10 17:45:15 +02:00
Colin Maudry 3270abb7f6 Refactor du filtre pour être plus résilient (et fonctionner sur les montants) 2025-10-10 17:44:51 +02:00
Colin Maudry 2eb984a95f Ne plus afficher de nulls dans les tableaux de données (tableau, titulaire, acheteur) 2025-10-10 17:44:16 +02:00
Colin Maudry 776126a481 Merge tag 'v2.1.4' into dev
- possibilité de filtrer sur le champ "Source"
- création automatique d'une release Github quand je push un tag
2025-10-08 09:34:30 +02:00
Colin Maudry 59abf35a12 Merge branch 'hotfix/2.1.4' 2025-10-08 09:34:00 +02:00
Colin Maudry a40eb64245 Changelog 2.1.4 2025-10-08 09:33:51 +02:00
Colin Maudry acae1517cb Nouvelle tentative auto-release 2025-10-08 09:31:41 +02:00
Colin Maudry 9a9decde6e Possible de filtrer sur le champ 'Source' 2025-10-08 09:26:44 +02:00
Colin Maudry a1ae962c73 Changelog 2.1.3 2025-10-04 19:15:56 +02:00
Colin Maudry 0404aa0973 Adaptation au format TableSchema 2025-10-04 19:13:51 +02:00
Colin Maudry effe01dedf Tentative d'auto release à partir d'un tag 2025-10-04 19:13:25 +02:00
Colin Maudry aaa70039d2 Merge branch 'hotfix/2.1.2' 2025-10-03 16:45:35 +02:00
Colin Maudry 7dc5f09545 Changelog 2.1.2 2025-10-03 16:45:29 +02:00
Colin Maudry 91e7f373ec Coquille 2025-10-03 16:42:44 +02:00
Colin Maudry c7768ea8f1 Global lf => global df pour être moins sensible au update de fichier source 2025-10-03 16:29:58 +02:00
Colin Maudry 816d0de324 Merge tag 'v2.1.1' into dev
- ajout d'une section dans À propos sur la qualité et l'exhaustivité des données ([#43](https://github.com/ColinMaudry/decp.info/issues/43))
- ajout du nombre de marchés en plus du nombre de lignes dans la vue Tableau
2025-10-01 13:22:42 +02:00
Colin Maudry 90e9bc3c8c Merge tag 'v2.1.0' into dev
- Ajout des vues [acheteur](https://decp.info/acheteurs/24350013900189) ([#28](https://github.com/ColinMaudry/decp.info/issues/28)), [titulaire](https://decp.info/titulaires/51903758414786)
([#35](https://github.com/ColinMaudry/decp.info/issues/35)) et [marché](https://decp.info/marches/532239472000482025S00004) ([#40](https://github.com/ColinMaudry/decp.info/issues/40)) 🔎
 - Ajout des balises HTML meta Open Graph et Twitter ([#39](https://github.com/ColinMaudry/decp.info/issues/39)) pour de beaux aperçus de liens 🖼️
- Formulaire de contact ([#48](https://github.com/ColinMaudry/decp.info/issues/48)) 📨
- Nom de colonnes plus_agréables ([#33](https://github.com/ColinMaudry/decp.info/issues/33)) 💅
- Définition des colonnes quand vous passez votre souris sur les en-têtes ([#33](https://github.com/ColinMaudry/decp.info/issues/33)) 📖#
- Affichage du numéro de version près du logo et lien vers ici 🤓
- Variables globales uniquement en lecture (😁)
2025-09-30 17:16:45 +02:00
15 changed files with 314 additions and 203 deletions
+29
View File
@@ -0,0 +1,29 @@
on:
push:
# Sequence of patterns matched against refs/tags
tags:
- 'v*' # Push events to matching v*, i.e. v1.0, v20.15.10
name: Auto-release d'un tag
jobs:
build:
name: auto-release
runs-on: ubuntu-latest
steps:
- name: Checkout code
uses: actions/checkout@master
- name: Get tag message
run: echo "TAG_MESSAGE=`git show ${{ github.ref_name }} | grep '^\- '`" >> "$GITHUB_ENV"
- name: Create Release
id: create_release
uses: actions/create-release@latest
env:
GITHUB_TOKEN: ${{ secrets.GITHUB_TOKEN }} # This token is provided by Actions, you do not need to create your own token
TAG_MESSAGE: ${{ env.TAG_MESSAGE }}
with:
tag_name: ${{ github.ref }}
release_name: ${{ github.ref_name }}
body: ${{ env.TAG_MESSAGE }}
draft: false
prerelease: false
+30 -3
View File
@@ -1,6 +1,6 @@
# decp.info # decp.info
> v2.1.1 > v2.1.7
Outil d'exploration et de téléchargement des données essentielles de la commande publique. Outil d'exploration et de téléchargement des données essentielles de la commande publique.
@@ -38,12 +38,39 @@ Ne pas oublier de mettre à jour les fichier .env.
## Notes de version ## Notes de version
##### 2.1.1 ##### 2.1.7 (11 novembre 2025)
- Remplacement du formulaire de contact par une adresse email
##### 2.1.6 (15 octobre 2025)
- Stabilisation de la vue marché
##### 2.1.5 (10 octobre 2025)
- réparation des filtres (notamment < > sur les montants)
- remplacement des valeurs "null" dans les tableaux par des cellules vides
##### 2.1.4 (8 octobre 2025)
- possibilité de filtrer sur le champ "Source"
- création automatique d'une release Github quand je push un tag
##### 2.1.3 (4 octobre 2025)
- tentative d'auto-release à chaque création de tag git
- adaptation au format TableSchema
##### 2.1.2 (3 octobre 2025)
- dataframe global plutôt que lazyframe, pour plus de résilience et charger toutes les données en mémoire
##### 2.1.1 (1er octobre 2025)
- ajout d'une section dans À propos sur la qualité et l'exhaustivité des données ([#43](https://github.com/ColinMaudry/decp.info/issues/43)) - ajout d'une section dans À propos sur la qualité et l'exhaustivité des données ([#43](https://github.com/ColinMaudry/decp.info/issues/43))
- ajout du nombre de marchés en plus du nombre de lignes dans la vue Tableau - ajout du nombre de marchés en plus du nombre de lignes dans la vue Tableau
#### 2.1.0 #### 2.1.0 (30 septembre 2025)
- Ajout des vues [acheteur](https://decp.info/acheteurs/24350013900189) ([#28](https://github.com/ColinMaudry/decp.info/issues/28)), [titulaire](https://decp.info/titulaires/51903758414786) ([#35](https://github.com/ColinMaudry/decp.info/issues/35)) et [marché](https://decp.info/marches/532239472000482025S00004) ([#40](https://github.com/ColinMaudry/decp.info/issues/40)) 🔎 - Ajout des vues [acheteur](https://decp.info/acheteurs/24350013900189) ([#28](https://github.com/ColinMaudry/decp.info/issues/28)), [titulaire](https://decp.info/titulaires/51903758414786) ([#35](https://github.com/ColinMaudry/decp.info/issues/35)) et [marché](https://decp.info/marches/532239472000482025S00004) ([#40](https://github.com/ColinMaudry/decp.info/issues/40)) 🔎
- Ajout des balises HTML meta Open Graph et Twitter ([#39](https://github.com/ColinMaudry/decp.info/issues/39)) pour de beaux aperçus de liens 🖼️ - Ajout des balises HTML meta Open Graph et Twitter ([#39](https://github.com/ColinMaudry/decp.info/issues/39)) pour de beaux aperçus de liens 🖼️
+1 -1
View File
@@ -1,7 +1,7 @@
[project] [project]
name = "decp.info" name = "decp.info"
description = "Interface d'exploration et d'analyse des marchés publics français." description = "Interface d'exploration et d'analyse des marchés publics français."
version = "2.1.1" version = "2.1.7"
requires-python = ">= 3.10" requires-python = ">= 3.10"
authors = [ authors = [
{ name = "Colin Maudry", email = "colin+decp@maudry.com" } { name = "Colin Maudry", email = "colin+decp@maudry.com" }
+6
View File
@@ -90,6 +90,12 @@ app.layout = html.Div(
], ],
className="logo", className="logo",
), ),
html.Div(
id="announcements",
children=dcc.Markdown(
"️ Le formulaire de contact, défectueux, a été remplacé par [une adresse email](/contact)."
),
),
html.Div( html.Div(
[ [
dcc.Link( dcc.Link(
Binary file not shown.

After

Width:  |  Height:  |  Size: 333 KiB

+7
View File
@@ -142,6 +142,13 @@ td[data-dash-column="objet"] {
margin: 0 0 20px 20px; margin: 0 0 20px 20px;
} }
/* Annonces */
#announcements {
margin-top: 25px;
max-width: 30%;
font-size: 90%;
}
/* Menu de navigation */ /* Menu de navigation */
.navbar { .navbar {
+6 -4
View File
@@ -5,7 +5,8 @@ import polars as pl
from dash import dash_table, dcc, html from dash import dash_table, dcc, html
def get_map_count_marches(lf: pl.LazyFrame): def get_map_count_marches(df: pl.DataFrame):
lf = df.lazy()
lf = lf.with_columns( lf = lf.with_columns(
pl.col("lieuExecution_code").str.head(2).str.zfill(2).alias("Département") pl.col("lieuExecution_code").str.head(2).str.zfill(2).alias("Département")
) )
@@ -26,7 +27,7 @@ def get_map_count_marches(lf: pl.LazyFrame):
for f in departements["features"]: for f in departements["features"]:
f["id"] = f["properties"]["code"] f["id"] = f["properties"]["code"]
df = lf.collect() df = lf.collect(engine="streaming")
fig = px.choropleth( fig = px.choropleth(
df, df,
@@ -54,7 +55,8 @@ def get_map_count_marches(lf: pl.LazyFrame):
return fig return fig
def get_barchart_sources(lf: pl.LazyFrame, type_date: str): def get_barchart_sources(df: pl.DataFrame, type_date: str):
lf = df.lazy()
labels = { labels = {
"dateNotification": "notification", "dateNotification": "notification",
"datePublicationDonnees": "publication des données", "datePublicationDonnees": "publication des données",
@@ -97,7 +99,7 @@ def get_barchart_sources(lf: pl.LazyFrame, type_date: str):
# ) # )
lf = lf.sort(by=["sourceDataset"], descending=False) lf = lf.sort(by=["sourceDataset"], descending=False)
df: pl.DataFrame = lf.collect() df: pl.DataFrame = lf.collect(engine="streaming")
fig = px.bar( fig = px.bar(
df, df,
+1 -1
View File
@@ -55,7 +55,7 @@ les fonctionnalités actuelles de decp.info. Il est ainsi possible de rajouter
- [du traitement des données](https://github.com/ColinMaudry/decp-processing) - [du traitement des données](https://github.com/ColinMaudry/decp-processing)
"""), """),
html.H4("Qualité et exhaustivité des données", id="qualite-exhausitivite"), html.H4("Qualité et exhaustivité des données", id="qualite-exhausitivite"),
dcc.Markdown("""Les données visibles sur ce site proviennent exclusivement de la publication de données ouvertes par les acheteurs publics ou en leur nom, régie par [l'arrêté du 22 décembre 2022](https://www.legifrance.gouv.fr/jorf/id/JORFTEXT000046850496). Leur qualité est donc principalement liée à la qualité de leur saisie par les agents publics, parfois peu aidé·es par la qualité des outils à leur disposition. Je pense que l'analyse de marchés individuels et le comptage de marchés sur des critères autres que financiers sont plutôt fiables. En revanche, certains montants de marché estimés à des valeurs farfelues ([1 euro](https://decp.info/marches/432766947000192025S01301), [1 milliard](https://decp.info/marches/2459004280001320210000000271) faussent les calculs par aggrégation (sommes, moyennes, médianes) et donc la production de statistiques financières fiables. Acheteurs, acheteuses : s'il vous plaît, essayez d'estimer les montants des marchés publics attribués de manière plus précise. dcc.Markdown("""Les données visibles sur ce site proviennent exclusivement de la publication de données ouvertes par les acheteurs publics ou en leur nom, régie par [l'arrêté du 22 décembre 2022](https://www.legifrance.gouv.fr/jorf/id/JORFTEXT000046850496). Leur qualité est donc principalement liée à la qualité de leur saisie par les agents publics, parfois peu aidé·es par la qualité des outils à leur disposition. Je pense que l'analyse de marchés individuels et le comptage de marchés sur des critères autres que financiers sont plutôt fiables. En revanche, certains montants de marché estimés à des valeurs farfelues ([1 euro](https://decp.info/marches/432766947000192025S01301), [1 milliard](https://decp.info/marches/2459004280001320210000000271)) faussent les calculs par aggrégation (sommes, moyennes, médianes) et donc la production de statistiques financières fiables. Acheteurs, acheteuses : s'il vous plaît, essayez d'estimer les montants des marchés publics attribués de manière plus précise.
Quant à l'exhaustivité, je consolide toutes les sources de données exploitables que j'ai pu identifier (voir [statistiques](/statistiques)). Certains profils d'acheteurs ne publient pas leurs données malgré l'obligation réglementaire : Quant à l'exhaustivité, je consolide toutes les sources de données exploitables que j'ai pu identifier (voir [statistiques](/statistiques)). Certains profils d'acheteurs ne publient pas leurs données malgré l'obligation réglementaire :
+7 -5
View File
@@ -6,11 +6,11 @@ from dash import Input, Output, State, callback, dash_table, dcc, html, register
from src.figures import point_on_map from src.figures import point_on_map
from src.utils import ( from src.utils import (
add_links_in_dict, add_links_in_dict,
df,
format_montant, format_montant,
format_number, format_number,
get_annuaire_data, get_annuaire_data,
get_departement_region, get_departement_region,
lf,
meta_content, meta_content,
setup_table_columns, setup_table_columns,
) )
@@ -148,7 +148,7 @@ def update_acheteur_infos(url):
def update_acheteur_stats(data): def update_acheteur_stats(data):
df = pl.DataFrame(data) df = pl.DataFrame(data)
if df.height == 0: if df.height == 0:
df = pl.DataFrame(schema=lf.collect_schema()) df = pl.DataFrame(schema=df.collect_schema())
df_marches = df.unique("id") df_marches = df.unique("id")
nb_marches = format_number(df_marches.height) nb_marches = format_number(df_marches.height)
# somme_marches = format_number(int(df_marches.select(pl.sum("montant")).item())) # somme_marches = format_number(int(df_marches.select(pl.sum("montant")).item()))
@@ -171,10 +171,10 @@ def update_acheteur_stats(data):
Input(component_id="url", component_property="pathname"), Input(component_id="url", component_property="pathname"),
Input(component_id="acheteur_year", component_property="value"), Input(component_id="acheteur_year", component_property="value"),
) )
def get_acheteur_marches_data(url, acheteur_year: str) -> pl.LazyFrame: def get_acheteur_marches_data(url, acheteur_year: str) -> list[dict]:
acheteur_siret = url.split("/")[-1] acheteur_siret = url.split("/")[-1]
lff = lf.filter(pl.col("acheteur_id") == acheteur_siret) lff = df.lazy()
lff = lff.fill_null("") lff = lff.filter(pl.col("acheteur_id") == acheteur_siret)
lff = lff.select( lff = lff.select(
"id", "id",
"uid", "uid",
@@ -203,6 +203,8 @@ def get_acheteur_marches_data(url, acheteur_year: str) -> pl.LazyFrame:
) )
def get_last_marches_table(data) -> html.Div: def get_last_marches_table(data) -> html.Div:
dff = pl.DataFrame(data) dff = pl.DataFrame(data)
dff = dff.cast(pl.String)
dff = dff.fill_null("")
dff = format_montant(dff) dff = format_montant(dff)
columns, tooltip = setup_table_columns( columns, tooltip = setup_table_columns(
dff, dff,
+117 -120
View File
@@ -1,11 +1,7 @@
import os
import re import re
import smtplib
import time import time
from email.mime.multipart import MIMEMultipart
from email.mime.text import MIMEText
from dash import Input, Output, State, callback, dcc, html, register_page from dash import dcc, html, register_page
from flask import request from flask import request
from src.utils import meta_content from src.utils import meta_content
@@ -25,51 +21,52 @@ layout = html.Div(
className="container", className="container",
children=[ children=[
html.H2("Contact", id="contact"), html.H2("Contact", id="contact"),
html.P( # html.P(
"Votre message arrivera directement dans ma boîte mail, et je reviendrai vers vous rapidement." # "Votre message arrivera directement dans ma boîte mail, et je reviendrai vers vous rapidement."
), # ),
html.Div( # html.Div(
[ # [
html.Label("Votre nom"), # html.Label("Votre nom"),
dcc.Input( # dcc.Input(
id="input-name", # id="input-name",
type="text", # type="text",
style={"width": "100%", "padding": "8px", "margin": "8px 0"}, # style={"width": "100%", "padding": "8px", "margin": "8px 0"},
), # ),
html.Label("Votre adresse email"), # html.Label("Votre adresse email"),
dcc.Input( # dcc.Input(
id="input-email", # id="input-email",
type="email", # type="email",
style={"width": "100%", "padding": "8px", "margin": "8px 0"}, # style={"width": "100%", "padding": "8px", "margin": "8px 0"},
), # ),
html.Label("Message"), # html.Label("Message"),
dcc.Textarea( # dcc.Textarea(
id="input-message", # id="input-message",
style={ # style={
"width": "100%", # "width": "100%",
"height": 200, # "height": 200,
"padding": "8px", # "padding": "8px",
"margin": "8px 0", # "margin": "8px 0",
}, # },
), # ),
html.Button( # html.Button(
"Envoyer ", # "Envoyer ",
id="submit-button", # id="submit-button",
n_clicks=0, # n_clicks=0,
style={"marginTop": "10px"}, # style={"marginTop": "10px"},
), # ),
html.Div( # html.Div(
id="output-message", style={"marginTop": "10px", "color": "green"} # id="output-message", style={"marginTop": "10px", "color": "green"}
), # ),
], # ],
style={ # style={
"maxWidth": "600px", # "maxWidth": "600px",
"margin": "auto", # "margin": "auto",
"padding": "20px", # "padding": "20px",
"lineHeight": "20px", # "lineHeight": "20px",
}, # },
), # ),
dcc.Markdown(""" dcc.Markdown("""
- Email : [colin+decp@maudry.com](mailto:colin+decp@maudry.com)
- Bluesky : [@col1m.bsky.social](https://bsky.app/profile/col1m.bsky.social) - Bluesky : [@col1m.bsky.social](https://bsky.app/profile/col1m.bsky.social)
- Mastodon : [col1m@mamot.fr](https://mamot.fr/@col1m) - Mastodon : [col1m@mamot.fr](https://mamot.fr/@col1m)
- LinkedIn : [colinmaudry](https://www.linkedin.com/in/colinmaudry/) - LinkedIn : [colinmaudry](https://www.linkedin.com/in/colinmaudry/)
@@ -97,74 +94,74 @@ def sanitize_email(email):
return re.match(r"[^@]+@[^@]+\.[^@]+", email) return re.match(r"[^@]+@[^@]+\.[^@]+", email)
@callback( # @callback(
Output("output-message", "children"), # Output("output-message", "children"),
Input("submit-button", "n_clicks"), # Input("submit-button", "n_clicks"),
State("input-name", "value"), # State("input-name", "value"),
State("input-email", "value"), # State("input-email", "value"),
State("input-message", "value"), # State("input-message", "value"),
prevent_initial_call=True, # prevent_initial_call=True,
) # )
def send_email(n_clicks, form_name, form_email, form_message): # def send_email(n_clicks, form_name, form_email, form_message):
if not all([form_name, form_email, form_message]): # if not all([form_name, form_email, form_message]):
return html.Div( # return html.Div(
"Veuillez s'il vous plaît remplir tous les champs.", style={"color": "red"} # "Veuillez s'il vous plaît remplir tous les champs.", style={"color": "red"}
) # )
#
client_ip = request.remote_addr # client_ip = request.remote_addr
if is_rate_limited(): # if is_rate_limited():
wait_time = int(RATE_LIMIT_WINDOW - (time.time() - rate_limit_store[client_ip])) # wait_time = int(RATE_LIMIT_WINDOW - (time.time() - rate_limit_store[client_ip]))
return html.Div( # return html.Div(
f"⏳ J'ai mis en place une protection contre le spam, et vous m'avez écrit il y a moins de 5 minutes. " # f"⏳ J'ai mis en place une protection contre le spam, et vous m'avez écrit il y a moins de 5 minutes. "
f"Veuillez s'il vous plaît attendre {wait_time} secondes avant de renvoyer un message.", # f"Veuillez s'il vous plaît attendre {wait_time} secondes avant de renvoyer un message.",
style={"color": "black"}, # style={"color": "black"},
) # )
#
try: # try:
# Configuration du serveur SMTP # # Configuration du serveur SMTP
smtp_server = os.getenv("SENDER_SERVER_DOMAIN") # smtp_server = os.getenv("SENDER_SERVER_DOMAIN")
smtp_port = 587 # smtp_port = 587
login_email = os.getenv("LOGIN_EMAIL") # login_email = os.getenv("LOGIN_EMAIL")
from_email = os.getenv("FROM_EMAIL") # from_email = os.getenv("FROM_EMAIL")
to_email = os.getenv("TO_EMAIL", from_email) # to_email = os.getenv("TO_EMAIL", from_email)
login_password = os.getenv("LOGIN_PASSWORD") # login_password = os.getenv("LOGIN_PASSWORD")
#
print( # print(
smtp_server, # smtp_server,
smtp_port, # smtp_port,
login_email, # login_email,
from_email, # from_email,
to_email, # to_email,
login_password, # login_password,
sep="\n", # sep="\n",
) # )
#
# Création de l'email # # Création de l'email
email = MIMEMultipart() # email = MIMEMultipart()
email["From"] = from_email # email["From"] = from_email
email["To"] = to_email # email["To"] = to_email
email["Subject"] = f"[decp.info] Message de {form_name}" # email["Subject"] = f"[decp.info] Message de {form_name}"
#
body = f""" # body = f"""
Nom : {form_name} # Nom : {form_name}
Email : {form_email} # Email : {form_email}
#
Message : # Message :
{form_message} # {form_message}
""" # """
email.attach(MIMEText(body, "plain")) # email.attach(MIMEText(body, "plain"))
#
# Send email # # Send email
server = smtplib.SMTP(smtp_server, smtp_port) # server = smtplib.SMTP(smtp_server, smtp_port)
server.starttls() # server.starttls()
server.login(login_email, login_password) # server.login(login_email, login_password)
server.sendmail(from_email, to_email, email.as_string()) # server.sendmail(from_email, to_email, email.as_string())
server.quit() # server.quit()
#
return html.Div("✅ Envoi réussi", style={"color": "green"}) # return html.Div("✅ Envoi réussi", style={"color": "green"})
#
except Exception as e: # except Exception as e:
print(e) # print(e)
return html.Div( # return html.Div(
f"❌ Échec de l'envoi du message : {str(e)}", style={"color": "red"} # f"❌ Échec de l'envoi du message : {str(e)}", style={"color": "red"}
) # )
+8 -12
View File
@@ -4,7 +4,7 @@ import polars as pl
from dash import Input, Output, callback, dcc, html, register_page from dash import Input, Output, callback, dcc, html, register_page
from polars import selectors as cs from polars import selectors as cs
from src.utils import data_schema, format_montant, lf, meta_content from src.utils import data_schema, df, format_montant, meta_content
register_page( register_page(
__name__, __name__,
@@ -62,23 +62,21 @@ layout = [
Output("titulaires_data", "data"), Output("titulaires_data", "data"),
Input(component_id="url", component_property="pathname"), Input(component_id="url", component_property="pathname"),
) )
def get_marche_data(url): def get_marche_data(url) -> tuple[dict, list]:
marche_uid = url.split("/")[-1] marche_uid = url.split("/")[-1]
# Récupération des données du marché à partir du lf global # Récupération des données du marché à partir du df global
lff = lf.filter(pl.col("uid") == pl.lit(marche_uid))
lff = df.lazy()
lff = lff.filter(pl.col("uid") == pl.lit(marche_uid))
# Données des titulaires du marché # Données des titulaires du marché
dff_titulaires = lff.select(cs.starts_with("titulaire")).collect(engine="streaming") dff_titulaires = lff.select(cs.starts_with("titulaire")).collect(engine="streaming")
# Données du marché # Données du marché
dff_marche = ( dff_marche = lff.unique("uid").collect(engine="streaming")
lff.select(~cs.starts_with("titulaires")).unique().collect(engine="streaming")
)
dff_marche = format_montant(dff_marche) dff_marche = format_montant(dff_marche)
assert dff_marche.height == 1
return dff_marche.to_dicts()[0], dff_titulaires.to_dicts() return dff_marche.to_dicts()[0], dff_titulaires.to_dicts()
@@ -92,7 +90,7 @@ def get_marche_data(url):
def update_marche_info(marche, titulaires): def update_marche_info(marche, titulaires):
def make_parameter(col): def make_parameter(col):
column_object = data_schema.get(col) column_object = data_schema.get(col)
column_name = column_object.get("friendly_name") if column_object else col column_name = column_object.get("title") if column_object else col
if marche[col]: if marche[col]:
if col == "acheteur_nom": if col == "acheteur_nom":
@@ -108,8 +106,6 @@ def update_marche_info(marche, titulaires):
# Dates # Dates
elif col in ["dateNotification", "datePublicationDonnees"]: elif col in ["dateNotification", "datePublicationDonnees"]:
print(marche[col])
value = datetime.fromisoformat(marche[col]).strftime("%d/%m/%Y") value = datetime.fromisoformat(marche[col]).strftime("%d/%m/%Y")
# Listes # Listes
+4 -4
View File
@@ -1,7 +1,7 @@
from dash import dcc, html, register_page from dash import dcc, html, register_page
from src.figures import get_barchart_sources, get_map_count_marches from src.figures import get_barchart_sources, get_map_count_marches
from src.utils import lf, meta_content from src.utils import df, meta_content
name = "Statistiques" name = "Statistiques"
@@ -37,13 +37,13 @@ layout = [
L'ajout de nouvelles plateformes [est en cours](https://github.com/ColinMaudry/decp-processing/issues?q=is%3Aissue%20state%3Aopen%20label%3A%22source%20de%20donn%C3%A9es%22), L'ajout de nouvelles plateformes [est en cours](https://github.com/ColinMaudry/decp-processing/issues?q=is%3Aissue%20state%3Aopen%20label%3A%22source%20de%20donn%C3%A9es%22),
toutes les [contributions](/a-propos#contribuer) sont les bienvenues pour atteindre l'exhaustivité. toutes les [contributions](/a-propos#contribuer) sont les bienvenues pour atteindre l'exhaustivité.
"""), """),
dcc.Graph(figure=get_map_count_marches(lf)), dcc.Graph(figure=get_map_count_marches(df)),
dcc.Graph( dcc.Graph(
figure=get_barchart_sources(lf, "dateNotification") figure=get_barchart_sources(df, "dateNotification")
), ),
dcc.Graph( dcc.Graph(
figure=get_barchart_sources( figure=get_barchart_sources(
lf, "datePublicationDonnees" df, "datePublicationDonnees"
) )
), ),
], ],
+12 -8
View File
@@ -7,10 +7,10 @@ from dash import Input, Output, State, callback, dash_table, dcc, html, register
from src.utils import ( from src.utils import (
add_links, add_links,
add_resource_link, add_resource_link,
df,
filter_table_data, filter_table_data,
format_montant, format_montant,
format_number, format_number,
lf,
meta_content, meta_content,
setup_table_columns, setup_table_columns,
sort_table_data, sort_table_data,
@@ -19,7 +19,7 @@ from src.utils import (
update_date = os.path.getmtime(os.getenv("DATA_FILE_PARQUET_PATH")) update_date = os.path.getmtime(os.getenv("DATA_FILE_PARQUET_PATH"))
update_date = datetime.fromtimestamp(update_date).strftime("%d/%m/%Y") update_date = datetime.fromtimestamp(update_date).strftime("%d/%m/%Y")
schema = lf.collect_schema() schema = df.collect_schema()
name = "Tableau" name = "Tableau"
register_page( register_page(
@@ -171,19 +171,17 @@ layout = [
State("table", "data_timestamp"), State("table", "data_timestamp"),
) )
def update_table(page_current, page_size, filter_query, sort_by, data_timestamp): def update_table(page_current, page_size, filter_query, sort_by, data_timestamp):
print(" + + + + + + + + + + + + + + + + + + ") if os.getenv("DEVELOPMENT").lower() == "true":
print(" + + + + + + + + + + + + + + + + + + ")
# Application des filtres # Application des filtres
lff: pl.LazyFrame = lf # start from the original data lff: pl.LazyFrame = df.lazy() # start from the original data
if filter_query: if filter_query:
lff = filter_table_data(lff, filter_query) lff = filter_table_data(lff, filter_query)
if len(sort_by) > 0: if len(sort_by) > 0:
lff = sort_table_data(lff, sort_by) lff = sort_table_data(lff, sort_by)
# Remplace les strings null par "", mais pas les numeric null
lff = lff.fill_null("")
# Matérialisation des filtres # Matérialisation des filtres
dff: pl.DataFrame = lff.collect() dff: pl.DataFrame = lff.collect()
@@ -195,6 +193,12 @@ def update_table(page_current, page_size, filter_query, sort_by, data_timestamp)
# end_row = (page_current + 1) * page_size # end_row = (page_current + 1) * page_size
dff = dff.slice(start_row, page_size) dff = dff.slice(start_row, page_size)
# Tout devient string
dff = dff.cast(pl.String)
# Remplace les strings null par "", mais pas les numeric null
dff = dff.fill_null("")
# Ajout des liens vers l'annuaire des entreprises # Ajout des liens vers l'annuaire des entreprises
dff = add_links(dff) dff = add_links(dff)
@@ -238,7 +242,7 @@ def update_table(page_current, page_size, filter_query, sort_by, data_timestamp)
prevent_initial_call=True, prevent_initial_call=True,
) )
def download_data(n_clicks, filter_query, sort_by, hidden_columns: list = None): def download_data(n_clicks, filter_query, sort_by, hidden_columns: list = None):
lff: pl.LazyFrame = lf # start from the original data lff: pl.LazyFrame = df # start from the original data
# Les colonnes masquées sont supprimées # Les colonnes masquées sont supprimées
if hidden_columns: if hidden_columns:
+12 -10
View File
@@ -6,11 +6,11 @@ from dash import Input, Output, State, callback, dash_table, dcc, html, register
from src.figures import point_on_map from src.figures import point_on_map
from src.utils import ( from src.utils import (
add_links_in_dict, add_links_in_dict,
df,
format_montant, format_montant,
format_number, format_number,
get_annuaire_data, get_annuaire_data,
get_departement_region, get_departement_region,
lf,
meta_content, meta_content,
setup_table_columns, setup_table_columns,
) )
@@ -148,22 +148,22 @@ def update_titulaire_infos(url):
Input(component_id="titulaire_data", component_property="data"), Input(component_id="titulaire_data", component_property="data"),
) )
def update_titulaire_stats(data): def update_titulaire_stats(data):
df = pl.DataFrame(data) dff = pl.DataFrame(data)
if df.height == 0: if dff.height == 0:
df = pl.DataFrame(schema=lf.collect_schema()) dff = pl.DataFrame(schema=dff.collect_schema())
df_marches = df.unique("uid") df_marches = dff.unique("uid")
nb_marches = format_number(df_marches.height) nb_marches = format_number(df_marches.height)
# somme_marches = format_number(int(df_marches.select(pl.sum("montant")).item())) # somme_marches = format_number(int(df_marches.select(pl.sum("montant")).item()))
marches_remportes = [html.Strong(nb_marches), " marchés et accord-cadres remportés"] marches_remportes = [html.Strong(nb_marches), " marchés et accord-cadres remportés"]
# + ", pour un total de ", html.Strong(somme_marches + " €")] # + ", pour un total de ", html.Strong(somme_marches + " €")]
del df_marches del df_marches
nb_acheteurs = df.unique("acheteur_id").height nb_acheteurs = dff.unique("acheteur_id").height
nb_acheteurs = [ nb_acheteurs = [
html.Strong(format_number(nb_acheteurs)), html.Strong(format_number(nb_acheteurs)),
" titulaires (SIRET) différents", " titulaires (SIRET) différents",
] ]
del df del dff
return marches_remportes, nb_acheteurs return marches_remportes, nb_acheteurs
@@ -173,13 +173,13 @@ def update_titulaire_stats(data):
Input(component_id="url", component_property="pathname"), Input(component_id="url", component_property="pathname"),
Input(component_id="titulaire_year", component_property="value"), Input(component_id="titulaire_year", component_property="value"),
) )
def get_titulaire_marches_data(url, titulaire_year: str) -> pl.LazyFrame: def get_titulaire_marches_data(url, titulaire_year: str) -> list[dict]:
titulaire_siret = url.split("/")[-1] titulaire_siret = url.split("/")[-1]
lff = lf.filter( lff = df.lazy()
lff = lff.filter(
(pl.col("titulaire_id") == titulaire_siret) (pl.col("titulaire_id") == titulaire_siret)
& (pl.col("titulaire_typeIdentifiant") == "SIRET") & (pl.col("titulaire_typeIdentifiant") == "SIRET")
) )
lff = lff.fill_null("")
lff = lff.select( lff = lff.select(
"id", "id",
"uid", "uid",
@@ -217,6 +217,8 @@ def get_last_marches_table(data) -> html.Div:
] ]
dff = pl.DataFrame(data) dff = pl.DataFrame(data)
dff = dff.cast(pl.String)
dff = dff.fill_null("")
dff = format_montant(dff) dff = format_montant(dff)
columns, tooltip = setup_table_columns( columns, tooltip = setup_table_columns(
dff, hideable=False, exclude=["acheteur_id", "id"] dff, hideable=False, exclude=["acheteur_id", "id"]
+74 -35
View File
@@ -43,9 +43,9 @@ def add_resource_link(dff: pl.DataFrame) -> pl.DataFrame:
dff = dff.with_columns( dff = dff.with_columns(
( (
'<a href="' + pl.col("sourceFile") + '">' + pl.col("sourceDataset") + "</a>" '<a href="' + pl.col("sourceFile") + '">' + pl.col("sourceDataset") + "</a>"
).alias("source") ).alias("sourceDataset")
) )
dff = dff.drop(["sourceFile", "sourceDataset"]) dff = dff.drop(["sourceFile"])
return dff return dff
@@ -126,7 +126,8 @@ def format_number(number) -> str:
def format_montant(dff: pl.DataFrame) -> pl.DataFrame: def format_montant(dff: pl.DataFrame) -> pl.DataFrame:
def format_function(expr, scale=None): def format_function(expr, scale=None):
# https://stackoverflow.com/a/78636786 # https://stackoverflow.com/a/78636786
expr = expr.cast(pl.String).str.splitn(".", 2) expr = expr.cast(pl.String)
expr = expr.str.splitn(".", 2)
num = expr.struct[0] num = expr.struct[0]
frac = expr.struct[1] frac = expr.struct[1]
@@ -145,7 +146,13 @@ def format_montant(dff: pl.DataFrame) -> pl.DataFrame:
.otherwise(pl.lit("")) .otherwise(pl.lit(""))
) )
return num + frac + pl.lit("") montant: pl.Expr = (
pl.when((num + frac) == pl.lit(""))
.then(pl.lit(""))
.otherwise(num + frac + pl.lit(""))
)
return montant
dff = dff.with_columns(pl.col("montant").pipe(format_function).alias("montant")) dff = dff.with_columns(pl.col("montant").pipe(format_function).alias("montant"))
return dff return dff
@@ -157,7 +164,7 @@ def get_annuaire_data(siret: str) -> dict:
return response.json()["results"][0] return response.json()["results"][0]
def get_decp_data() -> pl.LazyFrame: def get_decp_data() -> pl.DataFrame:
# Chargement du fichier parquet # Chargement du fichier parquet
# Le fichier est chargé en mémoire, ce qui est plus rapide qu'une base de données pour le moment. # Le fichier est chargé en mémoire, ce qui est plus rapide qu'une base de données pour le moment.
# On utilise polars pour la rapidité et la facilité de manipulation des données. # On utilise polars pour la rapidité et la facilité de manipulation des données.
@@ -186,7 +193,7 @@ def get_decp_data() -> pl.LazyFrame:
# ça génère une erreur dans la page acheteur (acheteur_data.table) : # ça génère une erreur dans la page acheteur (acheteur_data.table) :
# AttributeError: partially initialized module 'pandas' has no attribute 'NaT' (most likely due to a circular import) # AttributeError: partially initialized module 'pandas' has no attribute 'NaT' (most likely due to a circular import)
return lff return lff.collect()
def get_departements() -> dict: def get_departements() -> dict:
@@ -206,23 +213,35 @@ def get_departement_region(code_postal):
def filter_table_data(lff: pl.LazyFrame, filter_query: str) -> pl.LazyFrame: def filter_table_data(lff: pl.LazyFrame, filter_query: str) -> pl.LazyFrame:
debug = os.getenv("DEVELOPMENT", "False").lower() == "true"
schema = lff.collect_schema() schema = lff.collect_schema()
filtering_expressions = filter_query.split(" && ") filtering_expressions = filter_query.split(" && ")
for filter_part in filtering_expressions: for filter_part in filtering_expressions:
col_name, operator, filter_value = split_filter_part(filter_part) col_name, operator, filter_value = split_filter_part(filter_part)
col_type = str(schema[col_name]) col_type = str(schema[col_name])
print("filter_value:", filter_value) if debug:
print("filter_value_type:", type(filter_value)) print("filter_value:", filter_value)
print("col_type:", col_type) print("filter_value_type:", type(filter_value))
print("operator:", operator)
print("col_type:", col_type)
lff = lff.filter(pl.col(col_name).is_not_null())
if col_type == "Date": if col_type == "Date":
# Convertir la colonne en chaînes de caractères # Convertir la colonne date en chaînes de caractères
lff = dates_to_strings(lff, col_name) lff = dates_to_strings(lff, col_name)
col_type = "String"
if col_type == "String":
lff = lff.filter(pl.col(col_name) != pl.lit(""))
if operator in ("<", "<=", ">", ">="): elif col_type.startswith("Int") or col_type.startswith("Float"):
lff = lff.filter( try:
pl.col(col_name).is_not_null() & (pl.col(col_name) != pl.lit("")) filter_value = int(filter_value)
) except ValueError:
logger.error(f"Invalid numeric filter value: {filter_value}")
continue
if operator in ("contains", "<", "<=", ">", ">="):
if operator == "<": if operator == "<":
lff = lff.filter(pl.col(col_name) < filter_value) lff = lff.filter(pl.col(col_name) < filter_value)
elif operator == ">": elif operator == ">":
@@ -231,17 +250,17 @@ def filter_table_data(lff: pl.LazyFrame, filter_query: str) -> pl.LazyFrame:
lff = lff.filter(pl.col(col_name) >= filter_value) lff = lff.filter(pl.col(col_name) >= filter_value)
elif operator == "<=": elif operator == "<=":
lff = lff.filter(pl.col(col_name) <= filter_value) lff = lff.filter(pl.col(col_name) <= filter_value)
elif operator == "contains":
elif col_type.startswith("Int") or col_type.startswith("Float"): if col_type in ["String", "Date"]:
try: lff = lff.filter(
filter_value = int(filter_value) pl.col(col_name).str.contains("(?i)" + filter_value)
except ValueError: )
logger.error(f"Invalid numeric filter value: {filter_value}") elif col_type.startswith("Int") or col_type.startswith("Float"):
continue lff = lff.filter(pl.col(col_name) == filter_value)
lff = lff.filter(pl.col(col_name) == filter_value) else:
logger.error(f"Invalid column type: {col_type}")
elif operator == "contains" and col_type in ["String", "Date"]: else:
lff = lff.filter(pl.col(col_name).str.contains("(?i)" + filter_value)) logger.error(f"Invalid operator: {operator}")
# elif operator == 'datestartswith': # elif operator == 'datestartswith':
# lff = lff.filter(pl.col(col_name).str.startswith(filter_value)") # lff = lff.filter(pl.col(col_name).str.startswith(filter_value)")
@@ -268,7 +287,7 @@ def setup_table_columns(dff, hideable: bool = True, exclude: list = None) -> tup
continue continue
column_object = data_schema.get(column_id) column_object = data_schema.get(column_id)
if column_object: if column_object:
column_name = column_object.get("friendly_name", column_id) column_name = column_object.get("title", column_id)
else: else:
column_name = column_id column_name = column_id
@@ -284,7 +303,7 @@ def setup_table_columns(dff, hideable: bool = True, exclude: list = None) -> tup
if column_object: if column_object:
tooltip[column_id] = { tooltip[column_id] = {
"value": f"""**{column_object.get("friendly_name")}** ({column_id}) "value": f"""**{column_object.get("title")}** ({column_id})
""" """
+ column_object["description"], + column_object["description"],
@@ -293,7 +312,33 @@ def setup_table_columns(dff, hideable: bool = True, exclude: list = None) -> tup
return columns, tooltip return columns, tooltip
lf = get_decp_data() def get_data_schema() -> dict:
# Récupération du schéma des données tabulaires
path = os.getenv("DATA_SCHEMA_PATH")
if path.startswith("http"):
original_schema: dict = get(
os.getenv("DATA_SCHEMA_PATH"), follow_redirects=True
).json()
elif os.path.exists(path):
with open(path) as f:
original_schema: dict = json.load(f)
else:
raise Exception(f"Chemin vers le schéma invalide: {path}")
new_schema = {}
for col in original_schema["fields"]:
new_schema[col["name"]] = col
new_schema["sourceDataset"] = {
"description": "Code de la source des données, avec un lien vers le fichier Open Data dont proviennent les données de ce marché public.",
"title": "Source des données",
"short_name": "Source",
}
return new_schema
df: pl.DataFrame = get_decp_data()
departements = get_departements() departements = get_departements()
domain_name = ( domain_name = (
"test.decp.info" if os.getenv("DEVELOPMENT").lower() == "true" else "decp.info" "test.decp.info" if os.getenv("DEVELOPMENT").lower() == "true" else "decp.info"
@@ -306,10 +351,4 @@ meta_content = {
"Pour une commande publique accessible à toutes et tous." "Pour une commande publique accessible à toutes et tous."
), ),
} }
data_schema = get_data_schema()
# Récupération du schéma des données tabulaires
data_schema: dict = get(os.getenv("DATA_SCHEMA_PATH"), follow_redirects=True).json()
data_schema["source"] = {
"description": "Code de la source des données, avec un lien vers le fichier Open Data dont proviennent les données de ce marché public.",
"friendly_name": "Source des données",
}