操作問い合わせ #3836
openJob実行によるJobArranger Serverのハングアップ対処について
Description
Job実行中、処理が進まなくなり、ジョブネットの停止をしました。
jobarranger server導入機を再起動したところ、再起動後にも該当ジョブが実行中のままとなっており、CPU使用率が100%となりハングアップする事が分かりました。
jobnet 対象のAgent導入機(Windows Server側)を停止させ、jobarranger server導入機を再起動させると、ハングアップは収まります。
また、postgreのDBを確認すると、対象jobnetの子jobのstatusが6となっており、実行中となっています。
対処方法や原因調査の方法についてご教示願います。
jobarranger:7.2
zabbix:7.0 LTS
環境:AWS
jobarranger server導入機:RHEL9.8
jobarranger Agent導入機:Windows Server 2025, RHEL9.8
Files
Updated by 保守サポート 担当362 14 days ago
- Status changed from 新規登録 to 担当者アサイン中
- Assignee set to 保守サポート 担当362
Updated by Anonymous 10 days ago
状況を追記しますと、以下2フォルダにログが大量にたまっています。それぞれ50ファイル程度、起動中は1分にそれぞれ5ファイル程度たまる。
それぞれのフォルダに停止したはずのジョブの子プロセスの名前のログ(jsonファイル)がたまっているため、やはり、子プロセスを止めることが必要かと認識しています。
子プロセスを止める方法についてご教示いただければ幸いです。
/var/lib/jobarranger/server/dbsyncermanager/error/ (8.5GB)
/var/lib/jobarranger/server/iconresultmanager/end/ (23GB)
Updated by 保守サポート 担当373 9 days ago
- Status changed from 担当者アサイン中 to 回答中
- Assignee changed from 保守サポート 担当362 to 保守サポート 担当373
ご担当者様
お世話になっております。
ご提供いただいた情報だけでは、事象の原因の特定や子プロセスの停止方法についてご案内することが困難な状況です。
つきましては、調査を進め、適切なご案内をさせていただくため、以下の情報をご提供いただけますでしょうか。
① ご利用中の Job Arranger のバージョンをご教示ください。(例:7.2.2)
② 事象が初めて発生した時点から現在までの Job Arranger のログをご提供ください。
【Server ログ】
/var/log/jobarranger/jobarg_server.log
※「jobarg_server.log」以外にも、「jobarg_server」で始まるログファイルが存在する場合がありますので、あわせてご提供ください。
【Agent ログ】
Linuxの場合
/var/log/jobarranger/jobarg_agentd.log
Windowsの場合
C:\Program Files\Job Arranger Agent\logs\jobarg_agentd.log
※「jobarg_agentd.log」以外にも、「jobarg_agentd」で始まるログファイルが存在する場合がありますので、あわせてご提供ください。
③ お手数をおかけしますが、添付の「SQL実行に必要な情報確認.xlsx」の手順に従って管理IDをご確認いただき、その管理IDを以下の SQL の「<管理ID>」部分に設定して実行してください。
実行後、3件の SQL クエリの実行結果をご提供いただけますようお願いいたします。
SELECT
inner_jobnet_id,
inner_jobnet_main_id,
inner_job_id,
jobnet_id,
status,
ending_flag
FROM ja_2_run_jobnet_table
WHERE inner_jobnet_main_id = <管理ID>;
SELECT
inner_jobnet_id,
status,
job_status,
jobnet_abort_flag,
ending_flag
FROM ja_2_run_jobnet_summary_table
WHERE inner_jobnet_id = <管理ID>;
SELECT
inner_job_id,
inner_jobnet_id,
inner_jobnet_main_id,
job_type,
method_flag,
force_flag,
status
FROM ja_2_run_job_table
WHERE inner_jobnet_main_id = <管理ID>;
ご不明な点がございましたら、お気軽にお問い合わせください。
何卒よろしくお願いいたします。
Updated by 保守サポート 担当373 9 days ago
- File SQL実行に必要な情報確認.xlsx SQL実行に必要な情報確認.xlsx added
ご担当者様
恐れ入ります。
上記回答にて記載の添付資料をアップロードいたします。