Prévoir le CO₂ avant qu'il n'augmente : pourquoi il n'existe pas un modèle unique pour tous les espaces intérieurs

Peio García
July 2026

Mesurer la qualité de l'air intérieur (QAI) nous permet de voir l'état d'un espace à un instant donné. Cependant, lorsqu'un pic élevé de CO₂ se produit, la décision arrive trop tard. Les occupants ont déjà été exposés, et ventiler brusquement peut entraîner un coût énergétique qui aurait pu être évité.

D'où l'intérêt d'anticiper. Si nous sommes capables de savoir que, dans deux heures, une salle va atteindre des niveaux élevés, la conversation change complètement. Il devient possible d'ajuster la ventilation avant le pic, de répartir l'effort du système de climatisation dans le temps et de maintenir l'espace dans des conditions saines sans sur-ventiler.

Le problème est que, jusqu'à récemment, la littérature scientifique offrait très peu de repères méthodologiques pour aborder cette question dans le contexte de la QAI (la plupart des études menées jusqu'à présent portaient principalement sur la qualité de l'air extérieur). De nombreuses études se limitaient à un seul bâtiment, à de courtes périodes de mesure, ou comparaient des modèles sans critères homogènes. Et presque aucune ne répondait à la question la plus pratique de toutes : quelle méthodologie de prévision du CO₂ dois-je utiliser ?

Le point de départ : les salles de classe

Dans une première étude publiée dans la revue Sensors, nous avons justement abordé ce vide, en nous concentrant sur un environnement très sensible : les salles de classe scolaires. Le CO₂ a été mesuré dans quinze établissements scolaires de l'aire métropolitaine de Pampelune à l'aide de dispositifs MICA, et différentes stratégies de prévision ont été comparées sur plusieurs horizons temporels, de 10 minutes à 4 heures.

La conclusion la plus intéressante n'a pas été « ce modèle est le meilleur », mais quelque chose d'assez moins intuitif : la réponse dépend de l'horizon d'anticipation souhaité. À très court terme, les modèles les plus simples sont difficiles à battre. Le CO₂ évolue de façon graduelle, si bien que supposer que, dans dix minutes, le niveau sera à peu près le même qu'actuellement constitue, tout simplement, une bonne prévision. À mesure que l'horizon s'allonge, cette logique se rompt. C'est là que les modèles de machine learning commencent à prendre tout leur sens, car ils apprennent les schémas propres à la série de données elle-même, et leur précision se dégrade de façon beaucoup plus progressive. Le problème devient plus complexe, et le machine learning est capable d'exploiter son potentiel en apprenant des schémas plus complexes.

Et ce sont précisément les horizons longs qui présentent le plus de valeur opérationnelle : plus tôt vous savez ce qui va se passer, plus vous disposez de marge pour agir. En définitive, la prévision n'est pas un problème à solution unique, mais un problème qui dépend de la marge de réaction dont on a besoin.

La question suivante : cela vaut-il pour n'importe quel espace ?

Une salle de classe est un environnement relativement ordonné : horaires fixes, groupes stables, un schéma hebdomadaire reconnaissable. La question légitime était de savoir si ces conclusions se maintenaient en dehors de ce contexte.

Car le CO₂ intérieur est dominé, avant tout, par l'occupation. Combien de personnes sont présentes, quand elles arrivent, combien de temps elles restent et comment l'espace est ventilé pendant leur présence. Et cela change radicalement selon l'usage auquel l'espace est destiné. Un hôpital ne ressemble en rien à une salle de réunion, ni un bureau à un marché alimentaire.

Répondre à cette question est précisément l'objet de l'étude publiée dans la revue Forecasting, que la revue a mise en avant sur la bannière principale de sa page d'accueil compte tenu de l'attention qu'elle suscite. Dix-huit semaines consécutives de données réelles issues de 16 dispositifs MICA répartis dans six types d'espaces, en Norvège et à Barcelone, ont été analysées dans le cadre du projet européen K-HEALTHinAIR.

Weekly CO₂ patterns across the use cases analysed
Évolution hebdomadaire des émissions de CO₂ selon les cas d'utilisation analysés

Ces six cas d'usage se regroupent, aux fins de la prévision, en trois comportements très distincts. Il existe des espaces à occupation ponctuelle et sans horaire, comme les salles de réunion et de conseil ou les résidences étudiantes : de longues périodes à des niveaux de fond, interrompues par des épisodes qui ne suivent aucun schéma reconnaissable, qu'il s'agisse de pics brusques apparaissant et disparaissant en quelques minutes ou d'accumulations lentes dépendant du fait que quelqu'un ouvre ou non une fenêtre. Il existe des espaces à occupation cyclique et reconnaissable, comme les bureaux, les cantines et les marchés alimentaires, où existe un rythme quotidien et hebdomadaire qui se répète, l'heure du déjeuner, les horaires de travail, le samedi jour de marché, même si l'intensité varie d'un jour à l'autre. Et il existe des espaces à occupation continue, comme les hôpitaux, avec des concentrations élevées et soutenues 24 heures sur 24, où la ventilation mécanique pèse davantage que les personnes : dans l'hôpital analysé, le CO₂ augmentait la nuit, lorsque le débit était réduit, et diminuait le jour.

Trois dynamiques très différentes, et aucune raison a priori de s'attendre à ce qu'un même modèle fonctionne aussi bien dans les trois cas.

Il n'existe pas de solution universelle

Lorsque l'on compare onze modèles différents sur ces six scénarios, le schéma qui se dégage est clair et, pour la pratique, très utile : la meilleure stratégie dépend du type d'espace.

Dans les espaces à occupation sporadique (salles de réunion, résidences), les modèles simples tiennent bien la route et surpassent même des alternatives beaucoup plus complexes. Déployer des architectures sophistiquées dans ce contexte revient à dépenser des ressources de calcul sans contrepartie. Ce type d'espace appelle un axe de recherche spécifique traitant de la prévision dans les cas d'usage où l'occupation est ponctuelle.

Dans les espaces à schémas cycliques (bureaux, cantines, marchés), c'est l'inverse. Il existe suffisamment de structure temporelle pour apprendre, et le machine learning, en particulier les combinaisons de plusieurs modèles appelées ensembles, améliore de façon constante les méthodes simples sur des horizons de 2 et 4 heures.

L'hôpital s'est révélé être le cas le plus difficile pour tous les modèles, sans exception. L'occupation continue et la ventilation mécanique font que l'historique de CO₂, à lui seul, ne suffit pas. Il faudrait ici intégrer des informations externes, telles que les horaires de climatisation, les comptages d'occupation ou les conditions extérieures, capables d'apporter davantage d'information au modèle, la série temporelle de CO₂ seule n'étant pas représentative.

Ce qui est clair, en revanche, c'est que lorsque l'occupation génère des schémas complexes mais reconnaissables, le machine learning constitue une bonne solution. Mais le modèle concret change d'un cas d'usage à l'autre. Avant de déployer une solution prédictive, il faut observer le comportement de l'espace.

La partie la plus novatrice : les modèles fondationnels

C'est ici que l'étude entre en territoire réellement nouveau.

Ces dernières années ont vu apparaître ce que l'on appelle les modèles fondationnels. Des modèles entraînés sur d'immenses corpus de données qui, au lieu d'apprendre une tâche précise, apprennent à généraliser. Ce sont des proches cousins des LLM aujourd'hui utilisés pour écrire du code ou construire des agents ; ils partagent la même architecture, mais sont ici préentraînés sur des millions de séries temporelles numériques plutôt que sur du texte.

L'idée est puissante : un modèle qui n'a jamais vu votre bâtiment pourrait-il prévoir le CO₂ de votre bâtiment ?

Les résultats indiquent que oui, et ce à deux niveaux :

  • En ajustant le modèle avec l'historique local, ses performances se situent au niveau des meilleures solutions évaluées dans l'étude, sans différences statistiquement significatives par rapport à elles. Autrement dit : une nouvelle voie, compétitive dès la première tentative.
  • Avec très peu d'informations préalables (ce que l'on appelle le zero-shot), le modèle continue d'offrir des performances raisonnables, surpassant dans plusieurs scénarios des modèles pourtant entraînés avec les données de l'espace lui-même.

Ce second point est le plus pertinent d'un point de vue opérationnel. Un capteur nouvellement installé n'a pas d'historique, et jusqu'à présent, cela signifiait attendre des semaines, voire des mois, avant de pouvoir prévoir quoi que ce soit. Avec un modèle fondationnel, il est possible de disposer d'une prévision compétente dès le premier jour, puis de migrer plus tard vers un modèle ajusté localement une fois suffisamment de données accumulées.

Pour déployer la prévision dans des environnements réels, ne plus dépendre de mois d'historique pour chaque nouvel espace change la donne.

Conclusion

La surveillance nous a dit comment était l'air. La prévision nous dit où il se dirige. Le passage de l'une à l'autre est ce qui transforme les données de qualité de l'air en un véritable outil de gestion, et non plus seulement en un indicateur.

Ces deux études apportent quelque chose de concret à ce parcours. Un cadre méthodologique reproductible, des éléments montrant quelles conclusions peuvent être extrapolées d'un type d'espace à un autre et lesquelles ne le peuvent pas, ainsi qu'une première évaluation sérieuse des modèles fondationnels dans ce domaine. Elles laissent également ouvertes les questions suivantes, sur lesquelles nous travaillons déjà : un modèle entraîné dans un bureau peut-il servir pour un autre bureau ? Ou même pour une cantine aux schémas similaires ? Si la réponse est oui, le goulot d'étranglement des données historiques disparaît.

En attendant, la conclusion la plus honnête de ce travail est aussi la plus utile. Il n'existe pas de raccourcis universels, mais il existe un critère clair pour bien choisir. En résumé, tout cela se traduit en décisions pratiques comme suit :

  • Anticiper a une valeur réelle. Savoir ce qui va se passer dans deux ou quatre heures permet de ventiler avant le pic, et non après, avec un coût énergétique moindre.
  • Ne cherchez pas de modèle universel. Se demander « quel est le meilleur modèle pour prévoir le CO₂ ? » est la mauvaise question. La bonne est : « comment se comporte l'occupation de cet espace, et de quelle marge ai-je besoin ? ».
  • La complexité ne paie pas toujours. Dans les espaces à usage sporadique, la simplicité fonctionne et coûte moins cher.
  • Commencer ne nécessite plus d'attendre. Les modèles fondationnels ouvrent la voie à la prévision dès l'installation.
  • Et tout dépend de la base. Un modèle prédictif hérite de la qualité des données qu'il reçoit. Sans mesure continue, fiable et sans lacunes, aucune prévision ne tient.

Références


Partagez cet article