|
2026-07-27
ยง
|
| 15:53 |
<cwilliams@cumin1003> |
END (PASS) - Cookbook sre.mysql.pool (exit_code=0) pool db2177: Maintenance |
[production] |
| 15:53 |
<cwilliams@cumin1003> |
START - Cookbook sre.mysql.pool pool db2172: Maintenance |
[production] |
| 15:52 |
<andrew@cloudcumin1001> |
START - Cookbook wmcs.ceph.roll_reboot_osds |
[admin] |
| 15:51 |
<root@cumin1003> |
START - Cookbook sre.mysql.pool pool db2178: Maintenance |
[production] |
| 15:51 |
<root@cumin1003> |
END (FAIL) - Cookbook sre.mysql.pool (exit_code=99) pool db2172: Maintenance |
[production] |
| 15:51 |
<andrewbogott> |
temporarily muting ceph slow ops alerts ("ceph health mute BLUESTORE_SLOW_OP_ALERT --sticky") for T431659 |
[admin] |
| 15:46 |
<cwilliams@cumin1003> |
dbctl commit (dc=all): 'Depooling db2178 (T431660)', diff saved to https://phabricator.wikimedia.org/P95224 and previous config saved to /var/cache/conftool/dbconfig/20260727-154559-cwilliams.json |
[production] |
| 15:45 |
<root@cumin1003> |
START - Cookbook sre.mysql.pool pool db2172: Maintenance |
[production] |
| 15:45 |
<cwilliams@cumin1003> |
DONE (PASS) - Cookbook sre.hosts.downtime (exit_code=0) for 1 day, 0:00:00 on db2178.codfw.wmnet with reason: Maintenance |
[production] |
| 15:45 |
<root@cumin1003> |
END (PASS) - Cookbook sre.mysql.pool (exit_code=0) pool db2171: Maintenance |
[production] |
| 15:44 |
<root@cumin1003> |
START - Cookbook sre.mysql.pool pool db2189: Maintenance |
[production] |
| 15:43 |
<bking@cumin2003> |
START - Cookbook sre.wdqs.data-transfer (T430880, restore data on newly-reimaged host) xfer wdqs-all from wdqs1026.eqiad.wmnet -> wdqs1020.eqiad.wmnet, repooling source-only afterwards |
[production] |
| 15:41 |
<bking@cumin2003> |
END (FAIL) - Cookbook sre.wdqs.data-transfer (exit_code=99) (T430880, restore data on newly-reimaged host) xfer wdqs-all from wdqs2022.codfw.wmnet -> wdqs1020.eqiad.wmnet, repooling source-only afterwards |
[production] |
| 15:39 |
<cwilliams@cumin1003> |
dbctl commit (dc=all): 'Depooling db2172 (T431660)', diff saved to https://phabricator.wikimedia.org/P95222 and previous config saved to /var/cache/conftool/dbconfig/20260727-153927-cwilliams.json |
[production] |
| 15:39 |
<cwilliams@cumin1003> |
DONE (PASS) - Cookbook sre.hosts.downtime (exit_code=0) for 1 day, 0:00:00 on db2172.codfw.wmnet with reason: Maintenance |
[production] |
| 15:38 |
<bking@cumin2003> |
START - Cookbook sre.wdqs.data-transfer (T430880, restore data on newly-reimaged host) xfer wdqs-all from wdqs2022.codfw.wmnet -> wdqs1020.eqiad.wmnet, repooling source-only afterwards |
[production] |
| 15:38 |
<cwilliams@cumin1003> |
dbctl commit (dc=all): 'Depooling db2189 (T431660)', diff saved to https://phabricator.wikimedia.org/P95220 and previous config saved to /var/cache/conftool/dbconfig/20260727-153833-cwilliams.json |
[production] |
| 15:38 |
<cwilliams@cumin1003> |
DONE (PASS) - Cookbook sre.hosts.downtime (exit_code=0) for 1 day, 0:00:00 on db2189.codfw.wmnet with reason: Maintenance |
[production] |
| 15:34 |
<bking@cumin2003> |
END (FAIL) - Cookbook sre.wdqs.data-transfer (exit_code=99) (T430880, restore data on newly-reimaged host) xfer wdqs-all from wdqs2022.codfw.wmnet -> wdqs1020.eqiad.wmnet, repooling source-only afterwards |
[production] |
| 15:32 |
<bking@cumin2003> |
START - Cookbook sre.wdqs.data-transfer (T430880, restore data on newly-reimaged host) xfer wdqs-all from wdqs2008.codfw.wmnet -> wdqs2010.codfw.wmnet, repooling source-only afterwards |
[production] |
| 15:32 |
<bking@cumin2003> |
END (ERROR) - Cookbook sre.wdqs.data-transfer (exit_code=97) (T430880, restore data on newly-reimaged host) xfer wdqs-all from wdqs2008.codfw.wmnet -> wdqs2010.codfw.wmnet, repooling source-only afterwards |
[production] |
| 15:31 |
<bking@cumin2003> |
START - Cookbook sre.wdqs.data-transfer (T430880, restore data on newly-reimaged host) xfer wdqs-all from wdqs2022.codfw.wmnet -> wdqs1020.eqiad.wmnet, repooling source-only afterwards |
[production] |
| 15:29 |
<bking@cumin2003> |
END (ERROR) - Cookbook sre.wdqs.data-transfer (exit_code=97) (T430880, restore data on newly-reimaged host) xfer wdqs-all from wdqs2007.codfw.wmnet -> wdqs1020.eqiad.wmnet, repooling source-only afterwards |
[production] |
| 15:26 |
<bking@cumin2003> |
START - Cookbook sre.wdqs.data-transfer (T430880, restore data on newly-reimaged host) xfer wdqs-all from wdqs2008.codfw.wmnet -> wdqs2010.codfw.wmnet, repooling source-only afterwards |
[production] |
| 15:22 |
<zabe@deploy1003> |
Finished scap sync-world: Backport for [[gerrit:1318166|SpecialWantedFiles: Simplify query plan (T431518)]] (duration: 07m 00s) |
[production] |
| 15:21 |
<bking@cumin2003> |
START - Cookbook sre.wdqs.data-transfer (T430880, restore data on newly-reimaged host) xfer wdqs-all from wdqs2007.codfw.wmnet -> wdqs1020.eqiad.wmnet, repooling source-only afterwards |
[production] |
| 15:19 |
<cwilliams@cumin1003> |
END (PASS) - Cookbook sre.mysql.pool (exit_code=0) pool db2155: Maintenance |
[production] |
| 15:19 |
<cwilliams@cumin1003> |
END (PASS) - Cookbook sre.mysql.pool (exit_code=0) pool db2175: Maintenance |
[production] |
| 15:18 |
<zabe@deploy1003> |
zabe: Continuing with deployment |
[production] |
| 15:17 |
<zabe@deploy1003> |
zabe: Backport for [[gerrit:1318166|SpecialWantedFiles: Simplify query plan (T431518)]] synced to the testservers (see https://wikitech.wikimedia.org/wiki/Mwdebug). Changes can now be verified there. |
[production] |
| 15:15 |
<bking@deploy1003> |
Finished deploy [wdqs/wdqs@e8fb00c]: T430880 (duration: 00m 12s) |
[production] |
| 15:15 |
<bking@deploy1003> |
Started deploy [wdqs/wdqs@e8fb00c]: T430880 |
[production] |
| 15:15 |
<zabe@deploy1003> |
Started scap sync-world: Backport for [[gerrit:1318166|SpecialWantedFiles: Simplify query plan (T431518)]] |
[production] |
| 15:15 |
<bking@deploy1003> |
Finished deploy [wdqs/wdqs@e8fb00c]: T430880 (duration: 00m 06s) |
[production] |
| 15:15 |
<bking@deploy1003> |
Started deploy [wdqs/wdqs@e8fb00c]: T430880 |
[production] |
| 15:12 |
<bking@cumin2003> |
END (PASS) - Cookbook sre.hosts.reimage (exit_code=0) for host wdqs2010.codfw.wmnet with OS bookworm |
[production] |
| 15:08 |
<cwilliams@cumin1003> |
START - Cookbook sre.mysql.pool pool db2177: Maintenance |
[production] |
| 15:04 |
<root@cumin1003> |
END (FAIL) - Cookbook sre.mysql.pool (exit_code=99) pool db2177: Maintenance |
[production] |
| 14:58 |
<root@cumin1003> |
START - Cookbook sre.mysql.pool pool db2177: Maintenance |
[production] |
| 14:58 |
<root@cumin1003> |
START - Cookbook sre.mysql.pool pool db2171: Maintenance |
[production] |
| 14:52 |
<cwilliams@cumin1003> |
dbctl commit (dc=all): 'Depooling db2171 (T431660)', diff saved to https://phabricator.wikimedia.org/P95209 and previous config saved to /var/cache/conftool/dbconfig/20260727-145236-cwilliams.json |
[production] |
| 14:52 |
<cwilliams@cumin1003> |
DONE (PASS) - Cookbook sre.hosts.downtime (exit_code=0) for 1 day, 0:00:00 on db2171.codfw.wmnet with reason: Maintenance |
[production] |
| 14:52 |
<cwilliams@cumin1003> |
dbctl commit (dc=all): 'Depooling db2177 (T431660)', diff saved to https://phabricator.wikimedia.org/P95208 and previous config saved to /var/cache/conftool/dbconfig/20260727-145206-cwilliams.json |
[production] |
| 14:52 |
<root@cumin1003> |
END (PASS) - Cookbook sre.mysql.pool (exit_code=0) pool db2157: Maintenance |
[production] |
| 14:51 |
<cwilliams@cumin1003> |
DONE (PASS) - Cookbook sre.hosts.downtime (exit_code=0) for 1 day, 0:00:00 on db2177.codfw.wmnet with reason: Maintenance |
[production] |
| 14:51 |
<bking@cumin2003> |
END (PASS) - Cookbook sre.hosts.reimage (exit_code=0) for host wdqs1020.eqiad.wmnet with OS bookworm |
[production] |
| 14:51 |
<root@cumin1003> |
END (PASS) - Cookbook sre.mysql.pool (exit_code=0) pool db2156: Maintenance |
[production] |
| 14:48 |
<bking@cumin2003> |
END (PASS) - Cookbook sre.hosts.downtime (exit_code=0) for 2:00:00 on wdqs2010.codfw.wmnet with reason: host reimage |
[production] |
| 14:42 |
<bking@cumin2003> |
START - Cookbook sre.hosts.downtime for 2:00:00 on wdqs2010.codfw.wmnet with reason: host reimage |
[production] |
| 14:41 |
<eevans@cumin1003> |
END (PASS) - Cookbook sre.cassandra.roll-restart (exit_code=0) for nodes matching restbase[1031,2024]*: Upgrade Cassandra to 5.0.8 (canary) - eevans@cumin1003 |
[production] |