AI & Computingpreprint2026-08-05

Batch Inference Scheduling: Maximizing GPU Utilization for Cost-Effective Enterprise AI

Open access0 citations

Abstract

Research article: Batch Inference Scheduling: Maximizing GPU Utilization for Cost-Effective Enterprise AI

// Source

View paper (DOI)Open access versionOpenAlexZenodo (CERN European Organization for Nuclear Research)Published 2026-08-05

Authors: Олег Ивченко, Iryna Ivchenko

Institutions: Odesа Polytechnic National University