<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/">
  <channel>
    <title>Blog on Trinidad Marroquin</title>
    <link>https://trinidadmarroquin.com/posts/</link>
    <description>Recent content in Blog on Trinidad Marroquin</description>
    <generator>Hugo</generator>
    <language>en</language>
    <copyright>Trinidad Marroquin</copyright>
    <lastBuildDate>Tue, 21 Jul 2026 00:00:00 -0500</lastBuildDate>
    <atom:link href="https://trinidadmarroquin.com/posts/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>RKE2 Node Reboots When Longhorn Is Already Degraded</title>
      <link>https://trinidadmarroquin.com/posts/rke2-node-reboots-longhorn-degraded-risk/</link>
      <pubDate>Tue, 21 Jul 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/rke2-node-reboots-longhorn-degraded-risk/</guid>
      <description>A practical RKE2 maintenance pattern for rebooting control-plane and worker nodes while Longhorn storage is already degraded, including batching, drain rules, boot-ID checks, and stop criteria.</description>
    </item>
    <item>
      <title>Ubuntu Unattended Upgrades Are Kubernetes Node Changes</title>
      <link>https://trinidadmarroquin.com/posts/ubuntu-unattended-upgrades-kubernetes-node-risk/</link>
      <pubDate>Mon, 20 Jul 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/ubuntu-unattended-upgrades-kubernetes-node-risk/</guid>
      <description>A Kubernetes operations article on why Ubuntu unattended upgrades should be disabled on production nodes and replaced with controlled patch windows, especially when systemd, udev, iSCSI, multipath, and CSI storage are involved.</description>
    </item>
    <item>
      <title>Rancher RKE2 Minor Hops When UI Metadata And GitOps Plans Disagree</title>
      <link>https://trinidadmarroquin.com/posts/rancher-rke2-minor-hop-gitops-suc/</link>
      <pubDate>Thu, 16 Jul 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/rancher-rke2-minor-hop-gitops-suc/</guid>
      <description>A practical Rancher and RKE2 upgrade article covering supported minor hops, Rancher UI version metadata, GitOps-managed system-upgrade-controller plans, stale runtime shims, and post-upgrade cleanup gates.</description>
    </item>
    <item>
      <title>Rancher Management Cluster Upgrades Need More Than A Version Target</title>
      <link>https://trinidadmarroquin.com/posts/rancher-management-cluster-upgrade-preflight/</link>
      <pubDate>Wed, 15 Jul 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/rancher-management-cluster-upgrade-preflight/</guid>
      <description>A practical Rancher and RKE2 upgrade runbook pattern covering stabilization, worker replacement, backups, stale RKE1 artifacts, Helm upgrade recovery, and post-upgrade validation.</description>
    </item>
    <item>
      <title>Turning Packer Template Builds Into A Concourse Workflow</title>
      <link>https://trinidadmarroquin.com/posts/concourse-packer-template-builds-network-secrets/</link>
      <pubDate>Tue, 14 Jul 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/concourse-packer-template-builds-network-secrets/</guid>
      <description>A practical SRE article on moving multi-site Packer template builds into Concourse while handling secrets, worker placement, network reachability, ISO behavior, and log hygiene.</description>
    </item>
    <item>
      <title>Installing And Configuring Calico On RKE2 From The Ground Up</title>
      <link>https://trinidadmarroquin.com/posts/installing-configuring-calico-rke2-ground-up/</link>
      <pubDate>Thu, 02 Jul 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/installing-configuring-calico-rke2-ground-up/</guid>
      <description>A practical Calico installation and configuration guide for RKE2: CNI ownership, Tigera operator setup, IP pools, node address autodetection, validation, and related operations notes.</description>
    </item>
    <item>
      <title>When A Latent Rancher Worker Upgrade Becomes An Outage</title>
      <link>https://trinidadmarroquin.com/posts/rancher-system-upgrade-controller-latent-worker-risk/</link>
      <pubDate>Wed, 24 Jun 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/rancher-system-upgrade-controller-latent-worker-risk/</guid>
      <description>A Rancher and RKE2 incident pattern where a continuously reconciled system-upgrade-controller Plan stayed pending until worker capacity collapsed, then cordoned the last healthy worker.</description>
    </item>
    <item>
      <title>Operating A NetBox Virtualization Migration Without Losing Control</title>
      <link>https://trinidadmarroquin.com/posts/netbox-virtualization-migration-operational-pattern/</link>
      <pubDate>Thu, 18 Jun 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/netbox-virtualization-migration-operational-pattern/</guid>
      <description>A practical operating pattern for migrating NetBox VM inventory from DCIM devices to virtualization VMs while keeping Terraform state, tags, IPs, and audit boundaries under control.</description>
    </item>
    <item>
      <title>Drift Audit Report: Bringing Existing Kubernetes VMs Under Terraform And NetBox</title>
      <link>https://trinidadmarroquin.com/posts/netbox-terraform-drift-audit-existing-kubernetes-vms/</link>
      <pubDate>Wed, 17 Jun 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/netbox-terraform-drift-audit-existing-kubernetes-vms/</guid>
      <description>A drift audit report for converting VM inventory from NetBox DCIM devices to virtualization objects, importing existing vSphere and NetBox resources into Terraform state, and deciding not to apply unsafe legacy VM drift.</description>
    </item>
    <item>
      <title>Managing vSphere VM Lifecycle State With Terraform And NetBox</title>
      <link>https://trinidadmarroquin.com/posts/managing-vsphere-vm-lifecycle-state-terraform-netbox/</link>
      <pubDate>Tue, 16 Jun 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/managing-vsphere-vm-lifecycle-state-terraform-netbox/</guid>
      <description>A lifecycle runbook for managing vSphere VM CPU, memory, disk sizing, NetBox metadata, idempotency, and teardown hygiene after initial Terraform provisioning.</description>
    </item>
    <item>
      <title>Building Guardrails Around Terraform vSphere VM Lifecycle</title>
      <link>https://trinidadmarroquin.com/posts/terraform-vsphere-vm-guardrails-netbox/</link>
      <pubDate>Mon, 15 Jun 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/terraform-vsphere-vm-guardrails-netbox/</guid>
      <description>A practical walkthrough of using Terraform validation, NetBox ownership, vCenter checks, DNS checks, network liveness tests, and teardown verification around the vSphere VM lifecycle.</description>
    </item>
    <item>
      <title>When AI-Assisted Infrastructure Updates Need Guardrails</title>
      <link>https://trinidadmarroquin.com/posts/ai-assisted-netbox-inventory-guardrails/</link>
      <pubDate>Fri, 12 Jun 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/ai-assisted-netbox-inventory-guardrails/</guid>
      <description>A practical reflection on using AI assistance for NetBox inventory work, where tool access helped but evidence, validation, and import discipline mattered more than confident answers.</description>
    </item>
    <item>
      <title>When Network Saturation Looks Like Rancher Trouble</title>
      <link>https://trinidadmarroquin.com/posts/rancher-network-saturation-symptoms/</link>
      <pubDate>Thu, 11 Jun 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/rancher-network-saturation-symptoms/</guid>
      <description>An incident-style walkthrough of a Rancher traffic anomaly where control-plane symptoms pointed at remotedialer instability, but the likely trigger was backup-window network saturation.</description>
    </item>
    <item>
      <title>From Local IaC Labs To Production-Ready Patterns</title>
      <link>https://trinidadmarroquin.com/posts/local-iac-labs-to-production-patterns/</link>
      <pubDate>Wed, 10 Jun 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/local-iac-labs-to-production-patterns/</guid>
      <description>A practical SRE view of how local Terraform, Docker, Helm, Kafka, and observability labs can become production-ready infrastructure patterns without pretending the lab is production.</description>
    </item>
    <item>
      <title>Multi-Site RKE2 Operations: Lessons From The Fleet</title>
      <link>https://trinidadmarroquin.com/posts/multi-site-rke2-lessons/</link>
      <pubDate>Wed, 10 Jun 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/multi-site-rke2-lessons/</guid>
      <description>Operational lessons from running RKE2 clusters across multiple data centers: inventory design, node naming conventions, upgrade sequencing across sites, and the patterns that break first at scale.</description>
    </item>
    <item>
      <title>Operating In A GitOps Environment: Practices That Hold Up</title>
      <link>https://trinidadmarroquin.com/posts/operating-in-gitops/</link>
      <pubDate>Wed, 10 Jun 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/operating-in-gitops/</guid>
      <description>Opinionated practices for infrastructure teams working in a GitOps model: commit messages, semver for infrastructure, CI-triggered CD tradeoffs, and deployment automation patterns that survive production use.</description>
    </item>
    <item>
      <title>Removing DNS Search Domain Drift Across Multi-Site RKE2 Clusters</title>
      <link>https://trinidadmarroquin.com/posts/dns-search-domain-remediation/</link>
      <pubDate>Wed, 10 Jun 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/dns-search-domain-remediation/</guid>
      <description>A production walkthrough of auditing, diagnosing, and remediating DNS search domain drift across five RKE2 cluster sites, including netplan staging, systemd-resolved link-level debugging, and a Subiquity YAML indentation trap.</description>
    </item>
    <item>
      <title>The SRE Dirty Dozen: Common Anti-Patterns In Site Reliability Engineering</title>
      <link>https://trinidadmarroquin.com/posts/sre-dirty-dozen/</link>
      <pubDate>Wed, 10 Jun 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/sre-dirty-dozen/</guid>
      <description>Twelve common anti-patterns in SRE practice: alert fatigue disguised as paging, dashboards without decisions, SLI collection without SLO targets, incident reviews without action items, and other traps that SRE teams fall into.</description>
    </item>
    <item>
      <title>Troubleshooting Kubernetes Storage Migration To vSphere CSI</title>
      <link>https://trinidadmarroquin.com/posts/kubernetes-vsphere-csi-troubleshooting/</link>
      <pubDate>Wed, 10 Jun 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/kubernetes-vsphere-csi-troubleshooting/</guid>
      <description>A practical incident walkthrough for Kubernetes monitoring PVC failures, stale CSI storage, vSphere CSI attach and mount validation, and the disk.EnableUUID requirement.</description>
    </item>
    <item>
      <title>First-Boot Ownership Between Packer, Terraform, vSphere, Cloud-Init, And Bootstrap</title>
      <link>https://trinidadmarroquin.com/posts/first-boot-ownership-packer-terraform-cloud-init/</link>
      <pubDate>Tue, 09 Jun 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/first-boot-ownership-packer-terraform-cloud-init/</guid>
      <description>A systems note on assigning clear ownership between Packer templates, Terraform vSphere clones, guest customization, cloud-init, bootstrap scripts, and CSI storage.</description>
    </item>
    <item>
      <title>Terraform Refactor Notes: When Repo Cleanup Exposes Infrastructure Coupling</title>
      <link>https://trinidadmarroquin.com/posts/terraform-refactor-hidden-infrastructure-coupling/</link>
      <pubDate>Tue, 09 Jun 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/terraform-refactor-hidden-infrastructure-coupling/</guid>
      <description>A practical SRE note on how refactoring a vSphere Terraform repo exposed coupling between Terraform, Packer, cloud-init, vSphere customization, netplan, bootstrap scripts, and iSCSI.</description>
    </item>
    <item>
      <title>Using LLMs During Infrastructure Troubleshooting Without Turning Off Your Brain</title>
      <link>https://trinidadmarroquin.com/posts/llm-assisted-infrastructure-troubleshooting/</link>
      <pubDate>Tue, 09 Jun 2026 00:00:00 -0500</pubDate>
      <guid>https://trinidadmarroquin.com/posts/llm-assisted-infrastructure-troubleshooting/</guid>
      <description>Practical lessons for using LLMs during infrastructure troubleshooting while preserving operator judgment, validation, and evidence-based debugging.</description>
    </item>
  </channel>
</rss>
