Total number of queued jobs/tasks/slots: 219/161,106/161,127
65 users have/had running or queued jobs over the past 7 days, 89 over the past 15 days.
119 over the past 30 days.
Click on the tabs to view each section, on the plots to view larger versions.
You can view the current cluster snapshot sorted by name, no. cpu, usage, load
or memory, and
view the past load for 7, or 15, or 30 days as well as highlight a given user by
selecting the corresponding options in the drop down menus.
{}
This page was last updated on Friday, 31-Jul-2026 14:52:24 EDT
with mk-webpage.pl ver. 7.3/1 (Oct 2025/SGK) in 0:52.
Warnings
Oversubscribed Jobs
As of Fri Jul 31 14:47:19 EDT 2026 (1 oversubscribed job)
Total running (PEs/jobs) = 1664/538, 161 queued (jobs), 89 extra, showing only oversubscribed jobs (cpu% > 133% & age > 1h) for all users.
jobID name user age nPEs cpu% queue node taskID
15303654 trim.SH5206.job pradon 01:56 1 268.3% sThC.q 65-28
⇒ Equivalent to 1.7 overused CPUs: 1 CPUs used at 268.3% on average.
Inefficient Jobs
As of Fri Jul 31 14:47:22 EDT 2026 (16 inefficient jobs, showing no more than 3 per user)
Total running (PEs/jobs) = 1672/546, 161 queued (jobs), 10 extra, showing only inefficient jobs (cpu% < 33% & age > 1h) for all users.
jobID name user age nPEs cpu% queue node taskID
15298971 Isotria_cStacks mccormickm +3:23 16 9.4% mThC.q 76-14
15298976 paper_params_1 astoneew +3:22 64 15.2% mThC.q 76-12
15301742 callAllSites kistlerl +2:04 16 6.5% mThC.q 76-08
15302109 full_no-prune_1 griebenowz +1:23 16 6.2% mThC.q 65-15
15302498 blastn mcgowenm +1:05 12 8.3% mThM.q 76-05
15302719 krakenuniq johnsonsj +1:01 10 28.7% mThM.q 65-11
15303576 SOTE_angsd byerlyp 07:34 10 10.0% lThM.q 75-07
15303578 ROST_angsd byerlyp 07:25 10 10.3% lThM.q 65-02
15303580 ROST_CAR_angsd byerlyp 07:24 10 10.4% lThM.q 65-04
(more by byerlyp)
15303599 ollama_server gciccare 07:01 1 15.2% lTgpu.q 79-02
15303600 ollama_server gciccare 06:60 1 5.8% lTgpu.q 79-02
15303638 ac_dupli_sh ariasc 02:40 30 5.6% mThM.q 75-04
15303657 qdrant_build kathiresang 01:28 8 23.7% sThC.q 65-12
15303661 earthaccess_202 ggonzale 01:14 1 5.7% lTIO.sq 64-12
⇒ Equivalent to 198.9 underused CPUs: 225 CPUs used at 11.6% on average.
To see them all use:
'q+ -ineff -u byerlyp' (5)
Nodes with Excess Load
As of Fri Jul 31 14:47:35 EDT 2026 (1 node has a high load, offset=1.5)
#slots excess
node #CPUs used load load
-----------------------------------
76-03 192 64 96.2 32.2 *Total excess load = 32.2
As of Fri Jul 31 14:47:34 EDT 2026
158 jobs waiting for ggonzale (top 5):
jobID jobName user age nPEs memReqd queue taskID
--------- --------------- ---------------- ------ ---- -------- ------ -------
15303683 HCHO_pan_val_ma ggonzale 00:59 1 7.0 sThC.q 19259-20000:1
15303685 HCHO_pan_val_ma ggonzale 00:59 1 7.0 sThC.q 20001-22000:1
15303687 HCHO_pan_val_ma ggonzale 00:59 1 7.0 sThC.q 22808-24000:1
15303689 HCHO_pan_val_ma ggonzale 00:59 1 7.0 sThC.q 24001-26000:1
15303691 HCHO_pan_val_ma ggonzale 00:59 1 7.0 sThC.q 26001-28000:1
quota rule resource=value/limit %used
------------------- ------------------------------- ------
max_slots_per_user/1 slots=539/840 64.2% for ggonzale
max_hC_slots_per_user/1 slots=537/840 63.9% for ggonzale in queue sThC.q
max_mem_res_per_user/1 mem_res=3.671T/9.985T 36.8% for ggonzale in queue uThC.q
max_concurrent_jobs_per_u no_concurrent_jobs=2/8 25.0% for ggonzale in queue lTIO.sq
io_slots_per_user/1 slots=2/8 25.0% for ggonzale in queue lTIO.sq
------------------- ------------------------------- ------
3 jobs waiting for whiteae:
jobID jobName user age nPEs memReqd queue taskID
--------- --------------- ---------------- ------ ---- -------- ------ -------
15303859 disc_score whiteae 00:32 8 64.0 sThC.q
15303860 disc_score whiteae 00:32 8 64.0 sThC.q
15303861 disc_score whiteae 00:32 8 64.0 sThC.q
quota rule resource=value/limit %used
------------------- ------------------------------- ------
max_gpus_per_user/2 GPUS=1/6 16.7% for whiteae in queue mTgpu.q
total_gpus_per_user/1 GPUS=1/8 12.5% for whiteae in queue qgpu.iq
max_slots_per_user/1 slots=1/840 0.1% for whiteae
------------------- ------------------------------- ------
Overall Quota Usage
quota rule resource=value/limit %used
------------------- ------------------------------- ------
total_slots/1 slots=1721/5960 28.9% for *
total_gpus/1 GPUS=2/8 25.0% for * in queue lTgpu.q
blast2GO/1 slots=24/110 21.8% for *
total_mem_res/2 mem_res=5.316T/35.78T 14.9% for * in queue uThM.q
total_gpus/1 GPUS=1/8 12.5% for * in queue mTgpu.q
total_mem_res/1 mem_res=4.481T/39.94T 11.2% for * in queue uThC.q
Memory Usage
Reserved Memory, All High-Memory Queues
Select length:
Current Memory Quota Usage
As of Fri Jul 31 14:47:35 EDT 2026
quota rule resource=value/limit %used filter
---------------------------------------------------------------------------------------------------
total_mem_res/1 mem_res=4.495T/39.94T 11.3% for * in queue uThC.q
total_mem_res/2 mem_res=5.316T/35.78T 14.9% for * in queue uThM.q
Current Memory Usage by Compute Node, High Memory Nodes Only
Limit slots for all users together
users * to slots=5960
users * queues sThC.q,lThC.q,mThC.q,uThC.q to slots=5176
users * queues sThM.q,mThM.q,lThM.q,uThM.q to slots=4680
users * queues uTxlM.rq to slots=536
users * queues sTgpu.q,mTgpu.q,lTgpu.q to slots=104
Limit total reserved memory for all users per queue type
users * queues sThC.q,mThC.q,lThC.q,uThC.q to mem_res=40902G
users * queues sThM.q,mThM.q,lThM.q,uThM.q to mem_res=36637G
users * queues uTxlM.rq to mem_res=8063G
Limit slots/user for all queues
users {*} to slots=840
Limit slots/user for hiMem queues
users {*} queues {sThM.q} to slots=840
users {*} queues {mThM.q} to slots=585
users {*} queues {lThM.q} to slots=390
users {*} queues {uThM.q} to slots=73
Limit slots/user for xlMem restricted queue
users {*} queues {uTxlM.rq} to slots=536
Limit GPUs for all users in GPU queues to the avail no of GPUs
users * queues {sTgpu.q,mTgpu.q,lTgpu.q,qgpu.iq} to GPUS=8
Limit to set aside a slot for blast2GO
users * queues !lTb2g.q hosts {@b2g-hosts} to slots=110
users * queues lTb2g.q hosts {@b2g-hosts} to slots=1
users {*} queues lTb2g.q hosts {@b2g-hosts} to slots=1
Limit GPUs per user in all the GPU queues
users {@gpu-power-users} queues sTgpu.q,mTgpu.q,lTgpu.q,
qgpu.iq to GPUS=8
users {*} queues sTgpu.q,mTgpu.q,lTgpu.q,qgpu.iq to GPUS=4
Limit GPUs per user in each GPU queues
users {@gpu-power-users} queues {sTgpu.q} to GPUS=8
users {@gpu-power-users} queues {mTgpu.q} to GPUS=6
users {@gpu-power-users} queues {lTgpu.q} to GPUS=4
users {@gpu-power-users} queues {qgpu.iq} to GPUS=2
users {*} queues {sTgpu.q} to GPUS=4
users {*} queues {mTgpu.q} to GPUS=3
users {*} queues {lTgpu.q} to GPUS=2
users {*} queues {qgpu.iq} to GPUS=1
Limit total number of idl licenses per user
users {*} to idlrt_license=102
Limit slots for io queue per user
users {*} queues {lTIO.sq} to slots=8
Limit slots for io queue per user
users {*} queues {lTWFM.sq} to slots=2
Limit slots/user for interactive (qrsh) queues
users {*} queues {qrsh.iq} to slots=64
Limit reserved memory per user for specific queues
users {*} queues sThC.q,mThC.q,lThC.q,uThC.q to mem_res=10225G
users {*} queues sThM.q,mThM.q,lThM.q,uThM.q to mem_res=9159G
users {*} queues uTxlM.rq to mem_res=8063G
Limit slots/user in hiCPU queues
users {*} queues {sThC.q} to slots=840
users {*} queues {mThC.q} to slots=640
users {*} queues {lThC.q} to slots=431
users {*} queues {uThC.q} to slots=143
Limit the number of concurrent jobs per user for some queues
users {*} queues {uTxlM.rq} to no_concurrent_jobs=3
users {*} queues {lTIO.sq} to no_concurrent_jobs=8
users {*} queues {lTWFM.sq} to no_concurrent_jobs=1
users {*} queues {qrsh.iq} to no_concurrent_jobs=12
users {*} queues {qgpu.iq} to no_concurrent_jobs=1
You can view plots of disk use vs time, for the past 7, 30, or 120 days;
as well as
plots of disk usage by user, or
by device (for the past 90 or 240 days respectively).
Notes
Capacity shows % disk space full and % of inodes used.
When too many small files are written on a disk, the file system can become full because it is
unable to keep track of new files.
The % of inodes should be lower or comparable to the % of disk space used.
If it is much larger, the disk can become unusable before it gets full.