<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Carnet de maintenance on Mook’s Lab Chronicles</title><link>https://blog.homeblack.fr/formats/carnet/</link><description>Recent content in Carnet de maintenance on Mook’s Lab Chronicles</description><generator>Hugo -- gohugo.io</generator><language>fr-FR</language><lastBuildDate>Mon, 24 Aug 2026 15:20:00 +0200</lastBuildDate><atom:link href="https://blog.homeblack.fr/formats/carnet/index.xml" rel="self" type="application/rss+xml"/><item><title>J’ai enfin activé Hyperscan sur mes deux OPNsense</title><link>https://blog.homeblack.fr/p/hyperscan-suricata-opnsense/</link><pubDate>Mon, 24 Aug 2026 15:20:00 +0200</pubDate><guid>https://blog.homeblack.fr/p/hyperscan-suricata-opnsense/</guid><description>&lt;img src="https://blog.homeblack.fr/p/hyperscan-suricata-opnsense/cover.png" alt="Featured image of post J’ai enfin activé Hyperscan sur mes deux OPNsense" /&gt;&lt;p&gt;Tout est parti d’un article publié sur le blog de Suricata : &lt;a class="link" href="https://suricata.io/2025/10/07/faster-suricata-startups-with-hyperscan-caching/" target="_blank" rel="noopener"
&gt;&lt;em&gt;Faster Suricata startups with Hyperscan caching&lt;/em&gt;&lt;/a&gt;.&lt;/p&gt;
&lt;p&gt;Le sujet était le cache MPM (&lt;em&gt;Multi-Pattern Matching&lt;/em&gt;) introduit avec Suricata 8. Au lieu de recompiler toutes les bases de motifs Hyperscan à chaque démarrage ou rechargement des règles, Suricata peut les conserver sur disque et les réutiliser. L’article annonçait un temps de démarrage réduit jusqu’à 50 %.&lt;/p&gt;
&lt;p&gt;En le lisant, je me suis surtout posé une question beaucoup plus basique : est-ce qu’Hyperscan tournait réellement sur mes firewalls ?&lt;/p&gt;
&lt;p&gt;La réponse était non.&lt;/p&gt;
&lt;p&gt;Suricata fonctionnait déjà sur mes deux OPNsense, les événements remontaient bien dans VictoriaLogs et mon cluster HA faisait son travail. Mais le moteur de recherche de motifs capable de profiter des instructions vectorielles du processeur n’était pas actif.&lt;/p&gt;
&lt;p&gt;Le verrou ne se trouvait pas vraiment dans Suricata. Mes deux VM utilisaient encore le modèle de CPU générique &lt;code&gt;kvm64&lt;/code&gt;, pratique pour la compatibilité, mais trop conservateur pour exposer les instructions que je voulais utiliser. Avant de jouer avec le cache, il fallait donc commencer par activer le moteur lui-même.&lt;/p&gt;
&lt;h2 id="donner-le-bon-cpu-virtuel-à-suricata"&gt;Donner le bon CPU virtuel à Suricata
&lt;/h2&gt;&lt;p&gt;J’ai passé &lt;code&gt;fw-core-p1&lt;/code&gt; et &lt;code&gt;fw-core-p2&lt;/code&gt; en &lt;code&gt;x86-64-v3&lt;/code&gt;. FreeBSD voyait alors correctement AVX2, AES et FMA, et je pouvais enfin demander explicitement Hyperscan à Suricata :&lt;/p&gt;
&lt;div class="highlight"&gt;&lt;div class="chroma"&gt;
&lt;table class="lntable"&gt;&lt;tr&gt;&lt;td class="lntd"&gt;
&lt;pre tabindex="0" class="chroma"&gt;&lt;code&gt;&lt;span class="lnt"&gt;1
&lt;/span&gt;&lt;span class="lnt"&gt;2
&lt;/span&gt;&lt;span class="lnt"&gt;3
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/td&gt;
&lt;td class="lntd"&gt;
&lt;pre tabindex="0" class="chroma"&gt;&lt;code class="language-hcl" data-lang="hcl"&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;&lt;span class="k"&gt;cpu&lt;/span&gt; {
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;&lt;span class="n"&gt; type&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="s2"&gt;&amp;#34;x86-64-v3&amp;#34;&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;}
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/td&gt;&lt;/tr&gt;&lt;/table&gt;
&lt;/div&gt;
&lt;/div&gt;&lt;div class="highlight"&gt;&lt;div class="chroma"&gt;
&lt;table class="lntable"&gt;&lt;tr&gt;&lt;td class="lntd"&gt;
&lt;pre tabindex="0" class="chroma"&gt;&lt;code&gt;&lt;span class="lnt"&gt;1
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/td&gt;
&lt;td class="lntd"&gt;
&lt;pre tabindex="0" class="chroma"&gt;&lt;code class="language-yaml" data-lang="yaml"&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;&lt;span class="nt"&gt;opnsense_ids_mpm_algo&lt;/span&gt;&lt;span class="p"&gt;:&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;&lt;span class="s2"&gt;&amp;#34;hs&amp;#34;&lt;/span&gt;&lt;span class="w"&gt;
&lt;/span&gt;&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/td&gt;&lt;/tr&gt;&lt;/table&gt;
&lt;/div&gt;
&lt;/div&gt;&lt;p&gt;Le &lt;code&gt;hs&lt;/code&gt; sélectionne Hyperscan comme moteur MPM. C’est la partie de Suricata qui cherche plusieurs motifs à la fois dans le trafic et écarte rapidement les signatures qui ne peuvent pas correspondre. La &lt;a class="link" href="https://docs.opnsense.org/manual/ips.html" target="_blank" rel="noopener"
&gt;documentation OPNsense&lt;/a&gt; le présente d’ailleurs comme le meilleur choix sur les plateformes compatibles.&lt;/p&gt;
&lt;p&gt;Le changement posait tout de même une question importante : mes hôtes Proxmox mélangent des processeurs Intel et AMD. J’ai donc fait migrer une VM de test d’Intel vers AMD, puis de nouveau vers Intel, avant de considérer &lt;code&gt;x86-64-v3&lt;/code&gt; comme un socle suffisamment portable chez moi.&lt;/p&gt;
&lt;p&gt;Je n’ai pas touché aux règles de placement HA. Les deux firewalls restent volontairement séparés sur deux hôtes différents.&lt;/p&gt;
&lt;h2 id="le-test-qui-comptait-vraiment"&gt;Le test qui comptait vraiment
&lt;/h2&gt;&lt;p&gt;Voir &lt;code&gt;mpm-algo = hs&lt;/code&gt; sur les deux nœuds était une bonne nouvelle, mais cela ne disait encore rien sur le comportement du cluster pendant une vraie bascule.&lt;/p&gt;
&lt;p&gt;J’ai donc laissé &lt;code&gt;p2&lt;/code&gt; reprendre les neuf VIP CARP. Pendant qu’il était MASTER avec Hyperscan actif, la sortie Internet continuait de fonctionner. Je n’ai observé aucune perte de paquets pendant le failover, avec une latence maximale de 13 ms.&lt;/p&gt;
&lt;p&gt;Après le test, la situation normale était revenue : &lt;code&gt;p1&lt;/code&gt; MASTER, &lt;code&gt;p2&lt;/code&gt; BACKUP et neuf VIP au bon endroit. Le moteur de détection avait changé sans perturber le cluster.&lt;/p&gt;
&lt;h2 id="seize-heures-plus-tard"&gt;Seize heures plus tard
&lt;/h2&gt;&lt;p&gt;Le premier contrôle montrait déjà Suricata autour de 356 à 359 Mio de mémoire, contre environ 548 Mio auparavant. J’ai laissé tourner avant de regarder de nouveau les compteurs.&lt;/p&gt;
&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Mesure&lt;/th&gt;
&lt;th&gt;Après environ 16 heures&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;CPU Suricata&lt;/td&gt;
&lt;td&gt;0 à 0,1 % sur les deux nœuds&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Mémoire sur P1&lt;/td&gt;
&lt;td&gt;233 Mio, soit −57,5 % par rapport au repère de 548 Mio&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Mémoire sur P2&lt;/td&gt;
&lt;td&gt;356 Mio, stable depuis le premier contrôle&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Capture sur P1&lt;/td&gt;
&lt;td&gt;51 044 239 paquets, 4 669 drops, soit 0,0091 %&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Capture sur P2&lt;/td&gt;
&lt;td&gt;1 078 301 paquets, aucun drop&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Événements TLS&lt;/td&gt;
&lt;td&gt;22 056 événements centralisés dans VictoriaLogs&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;
&lt;p&gt;Les 4 669 drops de capture observés sur &lt;code&gt;p1&lt;/code&gt; n’avaient pas augmenté depuis plus de deux heures lors du dernier relevé. Aucun drop Suricata n’apparaissait dans les échantillons contrôlés et la qualité de capture restait supérieure à 99,99 %.&lt;/p&gt;
&lt;p&gt;Surtout, l’enrichissement n’avait pas disparu au passage : 926 SNI, 370 empreintes JA4, 55 empreintes de certificats et 23 émetteurs distincts remontaient toujours dans VictoriaLogs.&lt;/p&gt;
&lt;p&gt;Ce n’est pas un benchmark. &lt;code&gt;p1&lt;/code&gt; et &lt;code&gt;p2&lt;/code&gt; n’ont ni le même rôle ni le même volume de trafic, et je ne vais pas attribuer toute la baisse à une seule option. La tendance observée reste néanmoins assez nette : CPU négligeable, mémoire en baisse et aucune dégradation visible de la détection ou du failover.&lt;/p&gt;
&lt;p&gt;La configuration est maintenant décrite dans Terraform et Ansible. Le plan Terraform ne montrait aucun drift, le second passage Ansible terminait avec &lt;code&gt;changed=0&lt;/code&gt;, et les sept tests du rôle passaient avec le &lt;em&gt;syntax-check&lt;/em&gt; et &lt;code&gt;ansible-lint&lt;/code&gt;.&lt;/p&gt;
&lt;p&gt;Assez ironiquement, un article consacré au cache m’aura d’abord fait découvrir que je n’utilisais même pas le moteur. Le cache pourra venir ensuite. Pour l’instant, Hyperscan tourne enfin sur mes deux firewalls — et c’était déjà le vrai chantier.&lt;/p&gt;</description></item><item><title>Je voulais juste mettre à jour mes OPNsense</title><link>https://blog.homeblack.fr/p/revision-cluster-opnsense/</link><pubDate>Sat, 15 Aug 2026 20:00:00 +0200</pubDate><guid>https://blog.homeblack.fr/p/revision-cluster-opnsense/</guid><description>&lt;img src="https://blog.homeblack.fr/p/revision-cluster-opnsense/cover.png" alt="Featured image of post Je voulais juste mettre à jour mes OPNsense" /&gt;&lt;p&gt;J’étais parti pour une petite révision tranquille de mes deux OPNsense. Une sauvegarde, une mise à jour du premier firewall, quelques contrôles, puis la même chose sur le second.&lt;/p&gt;
&lt;p&gt;Le premier venait de terminer. J’ai lancé la mise à jour du second, puis contrôlé l’état du cluster pendant qu’elle avançait.&lt;/p&gt;
&lt;h2 id="un-cluster-qui-fonctionnait-presque"&gt;Un cluster qui fonctionnait… presque
&lt;/h2&gt;&lt;p&gt;Mon réseau repose sur deux firewalls, &lt;code&gt;fw-core-p1&lt;/code&gt; et &lt;code&gt;fw-core-p2&lt;/code&gt;, avec neuf adresses IP virtuelles CARP. En temps normal, &lt;code&gt;p1&lt;/code&gt; porte les neuf VIP et &lt;code&gt;p2&lt;/code&gt; attend sagement en secours.&lt;/p&gt;
&lt;p&gt;Après la mise à jour du premier nœud, l’état était un peu plus créatif :&lt;/p&gt;
&lt;div class="highlight"&gt;&lt;div class="chroma"&gt;
&lt;table class="lntable"&gt;&lt;tr&gt;&lt;td class="lntd"&gt;
&lt;pre tabindex="0" class="chroma"&gt;&lt;code&gt;&lt;span class="lnt"&gt;1
&lt;/span&gt;&lt;span class="lnt"&gt;2
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/td&gt;
&lt;td class="lntd"&gt;
&lt;pre tabindex="0" class="chroma"&gt;&lt;code class="language-text" data-lang="text"&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;8 VIP : p1 BACKUP / p2 MASTER
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;VIP LAN : p1 MASTER / p2 MASTER
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/td&gt;&lt;/tr&gt;&lt;/table&gt;
&lt;/div&gt;
&lt;/div&gt;&lt;p&gt;Le réseau fonctionnait encore. Les interfaces répondaient, pfsync synchronisait toujours les connexions et rien ne semblait cassé à la maison. Mais la VIP du LAN était portée par les deux firewalls en même temps.&lt;/p&gt;
&lt;p&gt;C’était le genre de problème assez discret pour passer inaperçu, jusqu’au jour où il décide de ne plus l’être.&lt;/p&gt;
&lt;p&gt;Je n’ai rien tenté au milieu de l’opération. &lt;code&gt;p1&lt;/code&gt; a repris les neuf VIP avant le redémarrage du second, puis j’ai simplement surveillé le trafic jusqu’à son retour. Quelques minutes plus tard, les deux nœuds étaient bien en OPNsense &lt;code&gt;26.7.2_2&lt;/code&gt; sur FreeBSD 15.1 et tous les services répondaient.&lt;/p&gt;
&lt;p&gt;La mise à jour était terminée. Restait à comprendre ce petit double-MASTER.&lt;/p&gt;
&lt;h2 id="p2-discutait-avec-lui-même"&gt;P2 discutait avec lui-même
&lt;/h2&gt;&lt;p&gt;Le CARP du LAN utilisait l’unicast. Chaque firewall devait envoyer ses annonces directement à l’adresse réelle de l’autre :&lt;/p&gt;
&lt;div class="highlight"&gt;&lt;div class="chroma"&gt;
&lt;table class="lntable"&gt;&lt;tr&gt;&lt;td class="lntd"&gt;
&lt;pre tabindex="0" class="chroma"&gt;&lt;code&gt;&lt;span class="lnt"&gt;1
&lt;/span&gt;&lt;span class="lnt"&gt;2
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/td&gt;
&lt;td class="lntd"&gt;
&lt;pre tabindex="0" class="chroma"&gt;&lt;code class="language-text" data-lang="text"&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;P1 devait cibler 10.0.0.3
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;P2 devait cibler 10.0.0.2
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/td&gt;&lt;/tr&gt;&lt;/table&gt;
&lt;/div&gt;
&lt;/div&gt;&lt;p&gt;Dans la configuration réelle, les deux ciblaient &lt;code&gt;10.0.0.3&lt;/code&gt;.&lt;/p&gt;
&lt;p&gt;Pour &lt;code&gt;p1&lt;/code&gt;, c’était correct. Pour &lt;code&gt;p2&lt;/code&gt;, beaucoup moins : il envoyait ses annonces CARP à sa propre adresse.&lt;/p&gt;
&lt;p&gt;Le plus amusant, c’est que la synchronisation HA faisait exactement ce que je lui demandais. &lt;code&gt;p1&lt;/code&gt; copiait sa configuration vers &lt;code&gt;p2&lt;/code&gt;, y compris ce pair unicast qui aurait justement dû être différent sur chaque machine. Corriger uniquement le second nœud n’aurait servi à rien : la synchronisation suivante aurait remis la mauvaise valeur.&lt;/p&gt;
&lt;p&gt;Mes huit autres VIP fonctionnaient déjà avec le multicast CARP classique. J’ai donc vérifié que les annonces envoyées vers &lt;code&gt;224.0.0.18&lt;/code&gt; traversaient bien le bridge Proxmox et arrivaient sur &lt;code&gt;p2&lt;/code&gt;. C’était le cas.&lt;/p&gt;
&lt;p&gt;J’ai supprimé le pair unicast du LAN et laissé CARP revenir à son fonctionnement normal :&lt;/p&gt;
&lt;div class="highlight"&gt;&lt;div class="chroma"&gt;
&lt;table class="lntable"&gt;&lt;tr&gt;&lt;td class="lntd"&gt;
&lt;pre tabindex="0" class="chroma"&gt;&lt;code&gt;&lt;span class="lnt"&gt;1
&lt;/span&gt;&lt;span class="lnt"&gt;2
&lt;/span&gt;&lt;span class="lnt"&gt;3
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/td&gt;
&lt;td class="lntd"&gt;
&lt;pre tabindex="0" class="chroma"&gt;&lt;code class="language-text" data-lang="text"&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;P1 ─┐
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt; ├── 224.0.0.18
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;P2 ─┘
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/td&gt;&lt;/tr&gt;&lt;/table&gt;
&lt;/div&gt;
&lt;/div&gt;&lt;p&gt;Cette fois, les deux firewalls pouvaient partager exactement la même configuration sans que l’un d’eux finisse par se parler à lui-même.&lt;/p&gt;
&lt;h2 id="le-petit-test-qui-évite-les-grandes-suppositions"&gt;Le petit test qui évite les grandes suppositions
&lt;/h2&gt;&lt;p&gt;Une fois la correction appliquée, j’ai placé &lt;code&gt;p1&lt;/code&gt; en maintenance. &lt;code&gt;p2&lt;/code&gt; a repris les neuf VIP, le DNS a continué de répondre et mes routes applicatives sont restées accessibles. En quittant le mode maintenance, &lt;code&gt;p1&lt;/code&gt; est redevenu MASTER par préemption et &lt;code&gt;p2&lt;/code&gt; est retourné en BACKUP.&lt;/p&gt;
&lt;div class="highlight"&gt;&lt;div class="chroma"&gt;
&lt;table class="lntable"&gt;&lt;tr&gt;&lt;td class="lntd"&gt;
&lt;pre tabindex="0" class="chroma"&gt;&lt;code&gt;&lt;span class="lnt"&gt;1
&lt;/span&gt;&lt;span class="lnt"&gt;2
&lt;/span&gt;&lt;span class="lnt"&gt;3
&lt;/span&gt;&lt;span class="lnt"&gt;4
&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/td&gt;
&lt;td class="lntd"&gt;
&lt;pre tabindex="0" class="chroma"&gt;&lt;code class="language-text" data-lang="text"&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;fw-core-p1 : MASTER 9/9
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;fw-core-p2 : BACKUP 9/9
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;demotion : 0
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;pfsync : synchronisé
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/td&gt;&lt;/tr&gt;&lt;/table&gt;
&lt;/div&gt;
&lt;/div&gt;&lt;p&gt;Au final, la mise à jour vers la &lt;a class="link" href="https://docs.opnsense.org/releases/CE_26.7.html" target="_blank" rel="noopener"
&gt;série OPNsense 26.7&lt;/a&gt; s’est passée sans incident. Elle m’a surtout donné une bonne excuse pour regarder un peu plus loin que le voyant vert.&lt;/p&gt;
&lt;p&gt;Je voulais faire une petite révision. J’ai retiré une adresse dans un champ, relancé un vrai failover et mon cluster est maintenant plus simple qu’avant.&lt;/p&gt;
&lt;p&gt;C’est déjà pas mal pour une matinée de maintenance.&lt;/p&gt;</description></item></channel></rss>