301-350 of 10000 results (128ms)
2026-07-20 ยง
12:09 <filippo@cumin1003> START - Cookbook sre.hosts.reboot-single for host cloudcumin2001.codfw.wmnet [production]
11:17 <mvernon@cumin1003> END (PASS) - Cookbook sre.hosts.reimage (exit_code=0) for host ms-be1074.eqiad.wmnet with OS trixie [production]
11:17 <brouberol@deploy2003> helmfile [dse-k8s-eqiad] DONE helmfile.d/services/mediawiki-dumps-legacy: apply [production]
11:16 <brouberol@deploy2003> helmfile [dse-k8s-eqiad] START helmfile.d/services/mediawiki-dumps-legacy: apply [production]
11:14 <ozge@deploy2003> helmfile [ml-serve-eqiad] Ran 'sync' command on namespace 'llm' for release 'main' . [production]
11:09 <elukey@cumin1003> END (PASS) - Cookbook sre.hosts.bmc-user-mgmt (exit_code=0) for 6 hosts [production]
11:09 <elukey@cumin1003> START - Cookbook sre.hosts.bmc-user-mgmt for 6 hosts [production]
11:06 <elukey@cumin1003> END (PASS) - Cookbook sre.hosts.bmc-user-mgmt (exit_code=0) for 324 hosts [production]
10:53 <mvernon@cumin1003> END (PASS) - Cookbook sre.hosts.downtime (exit_code=0) for 2:00:00 on ms-be1074.eqiad.wmnet with reason: host reimage [production]
10:50 <mvernon@cumin2003> END (PASS) - Cookbook sre.hosts.reimage (exit_code=0) for host ms-be2069.codfw.wmnet with OS trixie [production]
10:49 <mvernon@cumin1003> START - Cookbook sre.hosts.downtime for 2:00:00 on ms-be1074.eqiad.wmnet with reason: host reimage [production]
10:30 <mvernon@cumin2003> END (PASS) - Cookbook sre.hosts.downtime (exit_code=0) for 2:00:00 on ms-be2069.codfw.wmnet with reason: host reimage [production]
10:30 <mvernon@cumin1003> START - Cookbook sre.hosts.reimage for host ms-be1074.eqiad.wmnet with OS trixie [production]
10:26 <mvernon@cumin2003> START - Cookbook sre.hosts.downtime for 2:00:00 on ms-be2069.codfw.wmnet with reason: host reimage [production]
10:06 <blake@deploy2003> Stopping before sync operations [production]
10:06 <blake@deploy2003> Started scap sync-world: Non-deployment scap run to populate new release values [production]
10:05 <mvernon@cumin2003> START - Cookbook sre.hosts.reimage for host ms-be2069.codfw.wmnet with OS trixie [production]
10:00 <mvernon@cumin1003> END (PASS) - Cookbook sre.hosts.reimage (exit_code=0) for host ms-be1073.eqiad.wmnet with OS trixie [production]
09:56 <elukey@cumin1003> START - Cookbook sre.hosts.bmc-user-mgmt for 324 hosts [production]
09:39 <kevinbazira@deploy2003> helmfile [ml-staging-codfw] 'sync' command on namespace 'tts-section-generator' for release 'main' . [production]
09:39 <elukey@cumin1003> END (PASS) - Cookbook sre.hosts.bmc-user-mgmt (exit_code=0) for 8 hosts [production]
09:38 <mvernon@cumin1003> END (PASS) - Cookbook sre.hosts.downtime (exit_code=0) for 2:00:00 on ms-be1073.eqiad.wmnet with reason: host reimage [production]
09:37 <elukey@cumin1003> START - Cookbook sre.hosts.bmc-user-mgmt for 8 hosts [production]
09:34 <mvernon@cumin1003> START - Cookbook sre.hosts.downtime for 2:00:00 on ms-be1073.eqiad.wmnet with reason: host reimage [production]
09:19 <mvernon@cumin2003> END (PASS) - Cookbook sre.hosts.reimage (exit_code=0) for host ms-be2068.codfw.wmnet with OS trixie [production]
09:16 <mvernon@cumin1003> START - Cookbook sre.hosts.reimage for host ms-be1073.eqiad.wmnet with OS trixie [production]
09:13 <blake@deploy2003> sync-world aborted: Non-deployment scap run to populate new release values (duration: 00m 02s) [production]
09:13 <blake@deploy2003> Started scap sync-world: Non-deployment scap run to populate new release values [production]
08:59 <mvernon@cumin2003> END (PASS) - Cookbook sre.hosts.downtime (exit_code=0) for 2:00:00 on ms-be2068.codfw.wmnet with reason: host reimage [production]
08:52 <mvernon@cumin2003> START - Cookbook sre.hosts.downtime for 2:00:00 on ms-be2068.codfw.wmnet with reason: host reimage [production]
08:50 <kevinbazira@deploy2003> helmfile [ml-staging-codfw] 'sync' command on namespace 'tts-section-generator' for release 'main' . [production]
08:32 <mvernon@cumin2003> START - Cookbook sre.hosts.reimage for host ms-be2068.codfw.wmnet with OS trixie [production]
08:15 <mvernon@cumin1003> END (PASS) - Cookbook sre.hosts.reimage (exit_code=0) for host ms-be1072.eqiad.wmnet with OS trixie [production]
07:59 <mvernon@cumin2003> END (PASS) - Cookbook sre.hosts.reimage (exit_code=0) for host ms-be2067.codfw.wmnet with OS trixie [production]
07:54 <mvernon@cumin1003> END (PASS) - Cookbook sre.hosts.downtime (exit_code=0) for 2:00:00 on ms-be1072.eqiad.wmnet with reason: host reimage [production]
07:49 <mvernon@cumin1003> START - Cookbook sre.hosts.downtime for 2:00:00 on ms-be1072.eqiad.wmnet with reason: host reimage [production]
07:45 <kevinbazira@deploy2003> helmfile [ml-staging-codfw] 'sync' command on namespace 'tts-section-generator' for release 'main' . [production]
07:45 <kevinbazira@deploy2003> helmfile [ml-staging-codfw] 'sync' command on namespace 'tts-section-generator' for release 'main' . [production]
07:39 <mvernon@cumin2003> END (PASS) - Cookbook sre.hosts.downtime (exit_code=0) for 2:00:00 on ms-be2067.codfw.wmnet with reason: host reimage [production]
07:35 <mvernon@cumin2003> START - Cookbook sre.hosts.downtime for 2:00:00 on ms-be2067.codfw.wmnet with reason: host reimage [production]
07:30 <brouberol@deploy2003> helmfile [dse-k8s-codfw] DONE helmfile.d/admin 'apply'. [production]
07:30 <mvernon@cumin1003> START - Cookbook sre.hosts.reimage for host ms-be1072.eqiad.wmnet with OS trixie [production]
07:30 <brouberol@deploy2003> helmfile [dse-k8s-codfw] START helmfile.d/admin 'apply'. [production]
07:17 <kevinbazira@deploy2003> helmfile [ml-staging-codfw] 'sync' command on namespace 'tts-section-generator' for release 'main' . [production]
07:15 <mvernon@cumin2003> START - Cookbook sre.hosts.reimage for host ms-be2067.codfw.wmnet with OS trixie [production]
05:51 <kevinbazira@deploy2003> helmfile [ml-staging-codfw] 'sync' command on namespace 'tts-section-generator' for release 'main' . [production]
05:50 <kevinbazira@deploy2003> helmfile [ml-staging-codfw] 'sync' command on namespace 'tts-section-generator' for release 'main' . [production]
05:25 <kevinbazira@deploy2003> helmfile [ml-staging-codfw] 'sync' command on namespace 'tts-section-generator' for release 'main' . [production]
05:25 <marostegui@cumin1003> DONE (PASS) - Cookbook sre.hosts.downtime (exit_code=0) for 5 days, 0:00:00 on db2207.codfw.wmnet with reason: Host down [production]
04:28 <kevinbazira@deploy2003> helmfile [ml-staging-codfw] 'sync' command on namespace 'tts-section-generator' for release 'main' . [production]