JP1を運用している現場で、サーバーの予期せぬOS再起動やクラスタのフェイルオーバー(系切り替え)が発生した際、一番焦るのが「実行中だったジョブネットが『中断』ステータスになって止まってしまう」トラブルです。
「中断」になったジョブネットを慌てて「先頭から再実行」してしまうと、すでに正常終了したジョブまで二重実行されてしまい、データの整合性が崩れる二次災害に繋がりかねません。
今回は、中断してしまったJP1のジョブネットを、安全に「中断されたその場所から」再開させる正しい再実行手順について解説します!
1. なぜジョブネットは「中断」になるのか?
JP1/AJSでは、配下のジョブユニットが「実行中」であったり、ネストジョブネット(階層化されたジョブネット)が「スケジュール開始待ち」の状態で、ジョブネット全体が動き続けているときに以下のような事象が起きると、ステータスが「中断」になります。
-
ホストサーバーの突然のOS再起動
-
クラスタ環境でのアクシデントによるフェイルオーバー(系切り替え)
このとき、JP1は「どこまで正常に処理が終わっていたか」という情報(ステータス)を保持したまま、安全のために処理をストップさせています。
2. 正解はこれ!「中断」から安全に再開する手順
中断されたジョブネットの「続き」から処理を再開させたい場合は、「異常終了ジョブから再実行」の機能を使います。「中断なのに異常終了から?」と思うかもしれませんが、これがJP1の正しい仕様です。
➔ 具体的な操作手順(JP1/AJS3 – View)
-
JP1/AJS3 – View を開き、「マンスリースケジュール」(またはデイリースケジュール)画面を表示します。
-
対象のジョブネットを開き、ジョブネット全体の先頭ユニット(最上流のジョブなど)を右クリックします。
-
メニューから [再実行] ➔ [異常終了ジョブから] を選択して実行します。
これだけで、中断されたポイント(実行中だったジョブや、その後に控えていた後続ジョブ)から綺麗に処理が再開されます!
3. ここがポイント!「保留」の設定もそのまま復元される
この「異常終了ジョブから」で再実行する最大のメリットは、中断前に設定されていた「保留」のステータスもそのまま100%復元されるという点です。
例えば、トラブルが起きる前に「このジョブはメンテナンス中だから、一時的に保留属性をつけて止めておこう」と手動で設定していた箇所があったとします。 この状態でサーバーが落ちて「中断」になっても、上記の手順で再開すれば、保留されていた箇所はしっかり保留状態のまま維持されます。
わざわざ「どこを保留にしていたっけ……?」と記憶を頼りに再設定し直す必要がないため、オペレーションミスを極限まで防ぐことができます。
⚠️ 運用の注意点:実行中だったジョブの「中身」は要確認
JP1側の制御としては上記の手順で安全に再開できますが、1点だけ人間が確認しなければならないポイントがあります。
それは、「サーバーが落ちた瞬間に、まさに実行中(処理の真っ最中)だったジョブが、裏側でどこまで処理を進めていたか」です。
例えば、データベースの更新やファイルの書き込みを行うシェルスクリプトやバッチファイルが実行中だった場合、処理が中途半端な状態で強制終了している可能性があります。 再実行する前に、必要に応じて「データのロールバック(巻き戻し)」や「中途半端なファイルの削除」などのリカバリを行ってから、JP1の再実行ボタンを押すようにしてください。
まとめ
JP1のジョブネットが「中断」になったら、焦らずに「先頭を右クリック ➔ 再実行 ➔ 異常終了ジョブから」。
この手順さえ頭に叩き込んでおけば、万が一の夜間障害やサーバーダウンの際も、迅速かつ安全にシステムを復旧させることができます。インフラ運用担当者の方は、ぜひ手順書のお守りとして覚えておいてくださいね!
