51-100 of 10000 results (106ms)
2026-07-20 ยง
16:21 <bking@cumin2003> END (PASS) - Cookbook sre.dns.wipe-cache (exit_code=0) wdqs2020.codfw.wmnet 85.0.192.10.in-addr.arpa 5.8.0.0.0.0.0.0.2.9.1.0.0.1.0.0.1.0.1.0.0.6.8.0.0.0.0.0.0.2.6.2.ip6.arpa on all recursors [production]
16:21 <bking@cumin2003> START - Cookbook sre.dns.wipe-cache wdqs2020.codfw.wmnet 85.0.192.10.in-addr.arpa 5.8.0.0.0.0.0.0.2.9.1.0.0.1.0.0.1.0.1.0.0.6.8.0.0.0.0.0.0.2.6.2.ip6.arpa on all recursors [production]
16:21 <bking@cumin2003> END (PASS) - Cookbook sre.dns.netbox (exit_code=0) [production]
16:21 <cwilliams@cumin1003> dbctl commit (dc=all): 'Repooling after maintenance db2242', diff saved to https://phabricator.wikimedia.org/P94913 and previous config saved to /var/cache/conftool/dbconfig/20260720-162103-cwilliams.json [production]
16:19 <btullis@deploy2003> helmfile [dse-k8s-eqiad] DONE helmfile.d/admin 'apply'. [production]
16:18 <btullis@deploy2003> helmfile [dse-k8s-eqiad] START helmfile.d/admin 'apply'. [production]
16:18 <bking@cumin2003> START - Cookbook sre.dns.netbox [production]
16:18 <bking@cumin2003> END (FAIL) - Cookbook sre.dns.netbox (exit_code=99) [production]
16:17 <jhancock@cumin2002> END (PASS) - Cookbook sre.dns.netbox (exit_code=0) [production]
16:17 <jhancock@cumin2002> END (PASS) - Cookbook sre.puppet.sync-netbox-hiera (exit_code=0) generate netbox hiera data: "Triggered by cookbooks.sre.dns.netbox: updating for netbox accounting errors - jhancock@cumin2002" [production]
16:17 <jhancock@cumin2002> START - Cookbook sre.puppet.sync-netbox-hiera generate netbox hiera data: "Triggered by cookbooks.sre.dns.netbox: updating for netbox accounting errors - jhancock@cumin2002" [production]
16:14 <sukhe@cumin1003> cookbooks.sre.cdn.roll-reboot finished rebooting cp2051.codfw.wmnet [production]
16:12 <sukhe@cumin1003> cookbooks.sre.cdn.roll-reboot finished rebooting cp2052.codfw.wmnet [production]
16:11 <jhancock@cumin2002> START - Cookbook sre.dns.netbox [production]
16:10 <cwilliams@cumin1003> dbctl commit (dc=all): 'Repooling after maintenance db2242', diff saved to https://phabricator.wikimedia.org/P94912 and previous config saved to /var/cache/conftool/dbconfig/20260720-161055-cwilliams.json [production]
16:09 <brouberol@deploy2003> helmfile [dse-k8s-eqiad] DONE helmfile.d/admin 'apply'. [production]
16:08 <brouberol@deploy2003> helmfile [dse-k8s-eqiad] START helmfile.d/admin 'apply'. [production]
16:06 <brouberol@deploy2003> helmfile [dse-k8s-codfw] DONE helmfile.d/admin 'apply'. [production]
16:06 <brouberol@deploy2003> helmfile [dse-k8s-codfw] START helmfile.d/admin 'apply'. [production]
16:06 <bking@cumin2003> START - Cookbook sre.dns.netbox [production]
16:05 <bking@cumin2003> START - Cookbook sre.hosts.move-vlan for host wdqs2020 [production]
16:05 <bking@cumin2003> START - Cookbook sre.hosts.reimage for host wdqs2020.codfw.wmnet with OS bookworm [production]
16:00 <cwilliams@cumin1003> dbctl commit (dc=all): 'Repooling after maintenance db2242 (T431660)', diff saved to https://phabricator.wikimedia.org/P94911 and previous config saved to /var/cache/conftool/dbconfig/20260720-160047-cwilliams.json [production]
15:58 <bking@cumin2003> END (PASS) - Cookbook sre.wdqs.data-transfer (exit_code=0) (T430880, restore data on newly-reimaged host) xfer wdqs-all from wdqs2022.codfw.wmnet -> wdqs2019.codfw.wmnet, repooling source-only afterwards [production]
15:53 <cwilliams@cumin1003> dbctl commit (dc=all): 'Depooling db2242 (T431660)', diff saved to https://phabricator.wikimedia.org/P94909 and previous config saved to /var/cache/conftool/dbconfig/20260720-155353-cwilliams.json [production]
15:53 <cwilliams@cumin1003> DONE (PASS) - Cookbook sre.hosts.downtime (exit_code=0) for 1 day, 0:00:00 on db2242.codfw.wmnet with reason: Maintenance [production]
15:44 <cwilliams@cumin1003> dbctl commit (dc=all): 'Repooling after maintenance db2162 (T431660)', diff saved to https://phabricator.wikimedia.org/P94908 and previous config saved to /var/cache/conftool/dbconfig/20260720-154433-cwilliams.json [production]
15:35 <sukhe@cumin1003> cookbooks.sre.cdn.roll-reboot finished rebooting cp2049.codfw.wmnet [production]
15:34 <cwilliams@cumin1003> dbctl commit (dc=all): 'Repooling after maintenance db2162', diff saved to https://phabricator.wikimedia.org/P94907 and previous config saved to /var/cache/conftool/dbconfig/20260720-153425-cwilliams.json [production]
15:33 <sukhe@cumin1003> cookbooks.sre.cdn.roll-reboot finished rebooting cp2050.codfw.wmnet [production]
15:28 <bking@cumin2003> START - Cookbook sre.elasticsearch.rolling-operation Operation.REBOOT (3 nodes at a time) for ElasticSearch cluster search_codfw: apply security updates - bking@cumin2003 - T431826 [production]
15:24 <cwilliams@cumin1003> dbctl commit (dc=all): 'Repooling after maintenance db2162', diff saved to https://phabricator.wikimedia.org/P94906 and previous config saved to /var/cache/conftool/dbconfig/20260720-152418-cwilliams.json [production]
15:14 <bking@cumin2003> END (PASS) - Cookbook sre.hosts.move-vlan (exit_code=0) for host wdqs1023 [production]
15:14 <bking@cumin2003> START - Cookbook sre.hosts.move-vlan for host wdqs1023 [production]
15:14 <bking@cumin2003> START - Cookbook sre.hosts.reimage for host wdqs1023.eqiad.wmnet with OS bookworm [production]
15:14 <cwilliams@cumin1003> dbctl commit (dc=all): 'Repooling after maintenance db2162 (T431660)', diff saved to https://phabricator.wikimedia.org/P94905 and previous config saved to /var/cache/conftool/dbconfig/20260720-151407-cwilliams.json [production]
15:13 <urbanecm@deploy2003> Finished scap sync-world: Backport for [[gerrit:1312471|postEdit experiment: enroll control users by same criteria]], [[gerrit:1312423|Modify user groups rights in English Wikiquote (T432557)]] (duration: 41m 16s) [production]
15:08 <kevinbazira@deploy2003> helmfile [ml-staging-codfw] Ran 'sync' command on namespace 'experimental' for release 'main' . [production]
15:07 <cwilliams@cumin1003> dbctl commit (dc=all): 'Depooling db2162 (T431660)', diff saved to https://phabricator.wikimedia.org/P94902 and previous config saved to /var/cache/conftool/dbconfig/20260720-150729-cwilliams.json [production]
15:07 <cwilliams@cumin1003> DONE (PASS) - Cookbook sre.hosts.downtime (exit_code=0) for 1 day, 0:00:00 on db2162.codfw.wmnet with reason: Maintenance [production]
15:05 <bking@cumin2003> END (PASS) - Cookbook sre.wdqs.data-transfer (exit_code=0) (T430880, restore data on newly-reimaged host) xfer scholarly_articles from wdqs2017.codfw.wmnet -> wdqs2027.codfw.wmnet, repooling source-only afterwards [production]
15:00 <urbanecm@deploy2003> vadymts1, migr, urbanecm: Continuing with deployment [production]
14:59 <bking@cumin2003> END (PASS) - Cookbook sre.elasticsearch.rolling-operation (exit_code=0) Operation.REBOOT (1 nodes at a time) for ElasticSearch cluster cloudelastic: apply security updates - bking@cumin2003 - T431826 [production]
14:58 <bking@deploy2003> Finished deploy [wdqs/wdqs@e8fb00c]: T430880 (duration: 00m 07s) [production]
14:58 <bking@deploy2003> Started deploy [wdqs/wdqs@e8fb00c]: T430880 [production]
14:58 <bking@deploy2003> Finished deploy [wdqs/wdqs@e8fb00c]: T430880 (duration: 00m 13s) [production]
14:58 <bking@deploy2003> Started deploy [wdqs/wdqs@e8fb00c]: T430880 [production]
14:57 <bking@cumin2003> START - Cookbook sre.wdqs.data-transfer (T430880, restore data on newly-reimaged host) xfer wdqs-all from wdqs2022.codfw.wmnet -> wdqs2019.codfw.wmnet, repooling source-only afterwards [production]
14:57 <sukhe@cumin1003> cookbooks.sre.cdn.roll-reboot finished rebooting cp2047.codfw.wmnet [production]
14:55 <sukhe@cumin1003> cookbooks.sre.cdn.roll-reboot finished rebooting cp2048.codfw.wmnet [production]