2024.10.01
自社の社内情報を未来の“ゴミ”にしないための備え 「情報量が多すぎる」時代がもたらす課題とは?
whenはいつも見ているぞというお話(全1記事)
リンクをコピー
記事をブックマーク
市田友宏氏(以下、市田):私、市田と申します。よろしくお願いします。今日は、whenです。みなさんたぶんAnsible使うと、まず一番最初に使うのではないかという構文です。whenについてのやらかし話を紹介したいと思います。
仕事は、某通信キャリアでパケットゲートウェイという、ちょっとマニアックなシステムの開発をやっています。サーバーでもないネットワーク機器でもない装置を、なんとかがんばって自動化をしようという業務をしつつ、開発もしつつ、Ansibleはもう3年ぐらい触っています。
今回のお話ですが、whenです。whenについて、ifとは微妙に違うぞというお話をしたいと思います。
まず私がやりたかったことです。そのうちの1つですが、自分が管理しているサーバーで、障害や作業でメンテナンスするためによく切り離しをします。これをAnsible使って自動で切り離しましょうと。
今までは手でポチポチやっていたのですが、Ansibleで自動で切り離して、手動オぺレーションをなくしていきましょうというのを仕事の1つとしてやっていました。
ここの処理ですが、ちょっとフローで簡単に表しています。ユーザーが使っているので、 最初にそのユーザーを追い出さないといけなくて、ユーザーを切断するというPlaybookを書きました。このサーバーは携帯などで使っているサーバーで、100万ぐらいセッションがあるので、けっこう待っていなければいけないんです。
数十分待つのですが、セッションが0になるまで数十分待っていましょうとループ処理を入れて、めでたくセッションがなくなって追い出せたら、最後にサーバーを落としましょうというPlaybookをRoleで作っていました。
やらかしは、このループのところです。ループのところでやらかしてしまいました。このループの処理は、このwith_sequenceというところで、for文みたいな感じで100回やるというループ文を書いています。
私もちょっと知識がないので、これをwhile的に書けるテクニックを持っている方がいらっしゃったら、ぜひ教えてほしいです。
今のところ、for文で100回繰り返して、セッションがなくなったら空回り処理するという動作にしています。このようなループ文を書いてみました。
これに、wait.ymlという名前をつけてみました。実際、このwait.ymlの中はどうしてるかというと、実際数十分待たなければいけないので、1分に区切って、それをひたすらループしています。途中でそのお客さんのセッション数を初期化して、 そのあとにもう1回今いくつぐらいユーザーがいるのかをincludeで取りにいくコマンドを打って、それをblockでつなげて、そのblockに対してwhen文を書いて、セッションが0でなければこのBlock文を実行して、1分待つというのをグルグルやりますと書きました。
数値で比較する時は、取り方が悪いと文字列で取ったりします。このint型でたまにハマるので注意をしましょうというところもあります。
このwhenでBlock文を書いてループして、グルグル待っていましょうというのをRoleとして作って動かしてみました。実際動かしたところ、このループで30分ぐらい待っているはずが、いきなりループ処理が終わってしまって、サーバーが落ちてしまいました。
私はもう顔面蒼白でした(笑)。なんでこのループ処理が動かなかったのかを考えました。
これも、数日かかりましたかね。けっこう時間がかかって、このset_factのところがきちんと数値で入っていないかとか、そもそもset_factされていないのではないかとか。そもそもこのwhen文の書き方が悪いのではないかとか、いろいろ考えたのですが、ちょっとわからなくて、シェルスクリプトをif文やfor文で書くとこんな感じなのかなと思い描いていました。
最初にこのBlock文でwhenの条件文を通過してしまえば、あとのタスクのpauseとかset_factとか、このincludeタスクとかが実行されると思っていたのですが、結果的に、Block文の中のwhenというのが、もうif文ではないよというところに気づきました。
ちょっと具体的に、どういう動作をしているのかなというところで、普通書かないのですが、こんな感じで動くのではないかというのをちょっと図解しています。
Block文をwhen文で仕掛けた場合に、上からすべてのタスクに対してwhenがかかるようなイメージです。途中でこのset_factで初期化した段階で、もう0になったので、あとはひたすらwhenが効いてしまって、後続の処理がまったく動かなかったというやらかしです。
私はこのwhenは最初に判断されて、あとはもうBlockの中のタスクは全部動いてくれると思っていたのですが、そうではなくて、Blockに対するタスクというのは、すべてのタスクに対してwhenが効いてしまうという動作だということを、やっと数日かけて気づきました。
ここで原因がわかったので、あとは楽です。途中ですべてが判定されるのであれば、そのBlockのwhenについては、最初は判断させずに、set_factで最後に判定文を入れることで、最初の動作は空回りせずに動くという処理をすることで、無事解決できました。
ちょうど今、このサーバーを落とすというやつを今日の夜やってきたばかりなのですが、きちんと無事動いてくれました。
まとめですが、Blockでwhenを使う時は、この条件文定義はかなり要注意です。私も、whenはifだろうと思ってずっと書いていたのですが、書き慣れた人ほどAnsibleはハマるネタがいっぱいあるのではないのかなと思ったりもしました。
あとは、whenはifだろうという勝手な思い込みですね(笑)。これでかなりハマってしまったというお話なので、やはり思い込みは厳禁だなあというのを、今振り返って反省しています。
以上です。ご清聴ありがとうございます。
2024.10.29
5〜10万円の低単価案件の受注をやめたら労働生産性が劇的に向上 相見積もり案件には提案書を出さないことで見えた“意外な効果”
2024.10.24
パワポ資料の「手戻り」が多すぎる問題の解消法 資料作成のプロが語る、修正の無限ループから抜け出す4つのコツ
2024.10.28
スキル重視の採用を続けた結果、早期離職が増え社員が1人に… 下半期の退職者ゼロを達成した「関係の質」向上の取り組み
2024.10.22
気づかぬうちに評価を下げる「ダメな口癖」3選 デキる人はやっている、上司の指摘に対する上手な返し方
2024.10.24
リスクを取らない人が多い日本は、むしろ稼ぐチャンス? 日本のGDP4位転落の今、個人に必要なマインドとは
2024.10.23
「初任給40万円時代」が、比較的早いうちにやってくる? これから淘汰される会社・生き残る会社の分かれ目
2024.10.23
「どうしてもあなたから買いたい」と言われる営業になるには 『無敗営業』著者が教える、納得感を高める商談の進め方
2024.10.28
“力を抜くこと”がリーダーにとって重要な理由 「人間の達人」タモリさんから学んだ自然体の大切さ
2024.10.29
「テスラの何がすごいのか」がわからない学生たち 起業率2年連続日本一の大学で「Appleのフレームワーク」を教えるわけ
2024.10.30
職場にいる「困った部下」への対処法 上司・部下間で生まれる“常識のズレ”を解消するには
2024.10.29
5〜10万円の低単価案件の受注をやめたら労働生産性が劇的に向上 相見積もり案件には提案書を出さないことで見えた“意外な効果”
2024.10.24
パワポ資料の「手戻り」が多すぎる問題の解消法 資料作成のプロが語る、修正の無限ループから抜け出す4つのコツ
2024.10.28
スキル重視の採用を続けた結果、早期離職が増え社員が1人に… 下半期の退職者ゼロを達成した「関係の質」向上の取り組み
2024.10.22
気づかぬうちに評価を下げる「ダメな口癖」3選 デキる人はやっている、上司の指摘に対する上手な返し方
2024.10.24
リスクを取らない人が多い日本は、むしろ稼ぐチャンス? 日本のGDP4位転落の今、個人に必要なマインドとは
2024.10.23
「初任給40万円時代」が、比較的早いうちにやってくる? これから淘汰される会社・生き残る会社の分かれ目
2024.10.23
「どうしてもあなたから買いたい」と言われる営業になるには 『無敗営業』著者が教える、納得感を高める商談の進め方
2024.10.28
“力を抜くこと”がリーダーにとって重要な理由 「人間の達人」タモリさんから学んだ自然体の大切さ
2024.10.29
「テスラの何がすごいのか」がわからない学生たち 起業率2年連続日本一の大学で「Appleのフレームワーク」を教えるわけ
2024.10.30
職場にいる「困った部下」への対処法 上司・部下間で生まれる“常識のズレ”を解消するには