A teoria das filas é o ramo da matemática que explica por que a espera acontece e quanto ela cresce quando a demanda se aproxima da capacidade. Quem procura o termo encontra fórmulas e exercícios de pesquisa operacional. Quem gerencia uma recepção, uma agência ou uma frente de caixa precisa saber quais decisões a teoria muda.
Este guia traduz a teoria em quatro ideias aplicáveis sem decorar fórmula: a espera explode perto da ocupação máxima, a fila nasce da irregularidade e não da média, espera vira gente dentro da sala, e uma fila única atende melhor que filas paralelas. Cada ideia vem com um exemplo calculado.
O que é a teoria das filas
É um método estatístico para estimar demoras quando clientes chegam ao acaso a um ponto de serviço com capacidade limitada. Um dos primeiros trabalhos sobre o tema foi do engenheiro dinamarquês A. K. Erlang, em 1908, para dimensionar circuitos da companhia telefônica de Copenhague, como registra o artigo Elementos da teoria das filas, publicado em 1966 na Revista de Administração de Empresas da FGV.
Esse mesmo texto descreve qualquer fila por três elementos:
- Regime de chegada: quantos clientes chegam e com que irregularidade.
- Regime de serviço: quanto tempo cada atendimento leva e quantos postos atendem ao mesmo tempo.
- Disciplina da fila: a regra que decide quem é chamado primeiro.
O artigo da RAE faz a observação mais útil de toda a teoria: a fila surge da falta de programação. Se desse para organizar chegadas e serviços, a espera seria evitada. Como quase nunca dá, a gestão passa a ser decidir quanta espera aceitar e onde ela acontece.
Os quatro números que governam qualquer fila
Toda a matemática das filas se apoia em quatro medidas que você consegue levantar com um cronômetro e uma planilha:
- Taxa de chegada: quantas pessoas chegam por hora, em cada faixa de horário.
- Tempo médio de atendimento: quantos minutos um posto leva por pessoa, separado por tipo de serviço.
- Número de postos ativos: guichês, caixas, consultórios ou mesas atendendo naquela faixa.
- Ocupação: a fração do tempo em que os postos estão ocupados. É a chegada dividida pela capacidade total.
Exemplo: 40 pessoas por hora, 6 minutos por atendimento, 5 postos. A capacidade é de 50 atendimentos por hora (5 postos × 10 por hora). A ocupação é 40 ÷ 50 = 80%.
Se você já acompanha TME, TMA e os outros indicadores de atendimento presencial, tem metade desses números. O que costuma faltar é a taxa de chegada por faixa de 30 minutos, e é ela que explica os picos.
Por que a espera explode quando a equipe fica “quase” ocupada
Parece eficiente manter todo mundo ocupado 95% do tempo. Na fila, é o contrário: a espera não cresce em linha reta com a ocupação, ela dispara na reta final.
No modelo clássico de um posto com chegadas e atendimentos aleatórios, o tempo médio na fila é igual ao tempo de atendimento multiplicado por ocupação ÷ (1 − ocupação). Com atendimento médio de 5 minutos:
| Ocupação do posto | Espera média na fila |
|---|---|
| 50% | 5 minutos |
| 70% | cerca de 12 minutos |
| 80% | 20 minutos |
| 90% | 45 minutos |
| 95% | 95 minutos |
Os números são ilustrativos, calculados com o modelo teórico. Uma operação real não segue a curva ao minuto, mas segue o formato: passar de 80% para 90% de ocupação não aumenta a espera em 10%, mais que dobra.
O que fazer com isso: escolha uma ocupação-alvo por faixa de horário sabendo o preço em espera de cada ponto percentual. Equipe dimensionada para 100% de ocupação no pico é equipe dimensionada para fila longa no pico. E tirar um posto numa faixa que já roda a 85% custa muito mais espera do que a planilha de escala sugere.
A fila nasce da irregularidade, não da média
Se 40 pessoas chegassem exatamente a cada 90 segundos e cada atendimento durasse exatamente 6 minutos, cinco postos atenderiam sem fila. A fila aparece porque as pessoas chegam em grupos e alguns atendimentos levam 2 minutos e outros 20. Pela fórmula de Pollaczek-Khinchine, se o tempo de atendimento fosse perfeitamente constante, a espera média de um posto cairia pela metade em relação ao caso aleatório, com a mesma ocupação. No exemplo acima, a 90% de ocupação, seriam cerca de 22 minutos em vez de 45.
Você não controla a irregularidade por completo, mas tem duas alavancas:
- Irregularidade da chegada: agendamento e janelas de horário espalham quem chegaria junto. É a “programação” de que fala o artigo da RAE. Em clínicas, o equilíbrio entre horário marcado e encaixe é o tema do guia sobre demanda espontânea e agenda.
- Irregularidade do serviço: separar atendimentos longos dos curtos reduz a mistura que trava a fila. Um serviço de 20 minutos na frente de dez serviços de 2 minutos faz os dez esperarem.
Lei de Little: espera vira gente dentro da sala
A relação mais simples e mais robusta da teoria das filas foi demonstrada por John D. C. Little em artigo de 1961 na revista Operations Research:
número médio de pessoas no sistema = taxa de chegada × tempo médio no sistema
Ela vale para quase qualquer fila estável, sem hipótese sobre como as pessoas chegam. Com 60 chegadas por hora e 20 minutos de espera média, há em média 20 pessoas esperando (60 × 1/3 de hora). Corte a espera para 10 minutos e a média cai para 10 pessoas.
É por isso que a espera tem custo físico, não só de satisfação: cada minuto de espera vira cadeira, metro quadrado, climatização e atenção da equipe. O cálculo completo dessa conta está no guia sobre quanto custa hospedar a espera.
Fila única ou uma fila por posto?
A teoria dá uma resposta clara quando os atendimentos são parecidos: uma fila única alimentando vários postos espera menos que filas separadas diante de cada posto, com a mesma equipe e a mesma demanda.
Exemplo calculado com os modelos clássicos: dois postos com atendimento médio de 5 minutos e 20 chegadas por hora no total, ocupação de 83%.
- Duas filas separadas, cada uma recebendo 10 pessoas por hora: espera média de cerca de 25 minutos.
- Uma fila única chamando para o próximo posto livre: espera média de cerca de 11 minutos.
Com filas separadas, um posto fica ocioso enquanto a fila do lado cresce. A fila única com chamada por senha ou aviso resolve isso. Ressalva: quando os serviços são muito diferentes, separe por tipo de serviço, não por posto. O guia de tempo de espera em banco mostra como fazer essa separação com a conta de carga de trabalho.
Disciplina da fila: prioridade não cria capacidade
A regra de chamada decide quem espera, não quanto se espera no total. Quando os atendimentos têm duração parecida, trocar ordem de chegada por prioridade não muda a espera média; redistribui a espera entre os grupos. Na prática:
- Prioridade legal: os grupos da Lei 10.048 passam à frente e o restante da fila absorve essa espera. Volume prioritário grande precisa entrar no dimensionamento.
- Agendados e espontâneos na mesma porta: sem regra escrita de intercalação, quem chegou sem agendar espera sem previsão, ou o agendado perde o horário.
- Atendente escolhendo “o mais fácil”: reduz o tempo do posto e aumenta a variação da espera de quem ficou.
Onde a teoria para
Os modelos clássicos assumem condições que a operação real quebra:
- A demanda muda ao longo do dia. A média diária esconde o pico. Calcule por faixa de 30 minutos.
- As pessoas desistem. Quem vê a fila e vai embora não aparece no relatório, e a fila medida parece menor que a demanda real.
- O tempo de atendimento muda sob pressão. A equipe acelera e erra mais; um pico “bem resolvido” pode esconder retrabalho.
Esses limites não invalidam a teoria. Mostram que os números precisam vir da sua operação, medidos.
Como aplicar a teoria das filas em 5 passos
- Meça a chegada por faixa de 30 minutos durante duas semanas, separando os dias da semana.
- Meça o tempo de atendimento por tipo de serviço, com a variação (o mais rápido e o mais longo), não só a média.
- Calcule a ocupação de cada faixa com os postos que estavam ativos. Faixas acima de 85% são candidatas a fila longa.
- Escolha a alavanca certa para cada faixa: mais postos onde a ocupação é alta, agendamento onde a chegada é concentrada, separação de serviços onde a variação é grande, fila única onde há filas paralelas.
- Use a Lei de Little para verificar: se a espera caiu, o número médio de pessoas na sala tem que ter caído na mesma proporção. Se não caiu, a medição está errada.
O guia completo de gestão de filas mostra como esses passos entram na rotina de uma operação, e o passo a passo para preparar os caixas para o pico aplica a mesma conta de capacidade a uma frente de loja.
Onde a tecnologia entra
A teoria não exige software: uma planilha resolve os cinco passos em uma unidade. O problema é a escala. Medir chegada e atendimento todo dia, em várias unidades, por tipo de serviço, ninguém sustenta com prancheta.
O Filazero Core registra automaticamente cada chegada, chamada e fim de atendimento, o que alimenta os quatro números sem amostragem manual. O agendamento e o check-in digital atacam a irregularidade da chegada. E a fila virtual muda onde a espera acontece: pela Lei de Little, as pessoas continuam existindo no sistema, mas deixam de ocupar a sala, porque aguardam onde quiserem e são avisadas na hora da chamada. A previsão de atendimento em tempo real, feita por modelo estatístico sobre o histórico da própria operação, é o tema do guia de análise preditiva na gestão de filas.
Perguntas rápidas
Quem criou a teoria das filas?
Os primeiros trabalhos são atribuídos a A. K. Erlang, que estudou circuitos telefônicos em Copenhague em 1908. A teoria ganhou impulso na Segunda Guerra Mundial e depois se espalhou para aplicações civis.
Qual é a fórmula da Lei de Little?
L = λ × W: o número médio de pessoas no sistema (L) é a taxa de chegada (λ) multiplicada pelo tempo médio que cada pessoa passa no sistema (W).
Qual ocupação a equipe deve ter?
Não há número universal. Defina o alvo por faixa de horário a partir de quanto tempo o seu cliente aceita esperar e leia na tabela de ocupação o que cada escolha custa.
Conclusão
A teoria das filas não serve para calcular a espera ao segundo. Serve para evitar quatro erros caros: escalar a equipe para 100% de ocupação, tratar a média como se fosse a demanda, ignorar quanto espaço cada minuto de espera ocupa e manter filas paralelas onde uma fila única resolveria. Nenhuma correção depende de fórmula decorada, só de medir chegada e atendimento por faixa de horário.
Se a medição mostrar que a espera é o gargalo da sua operação, comece um piloto de 4 semanas em uma unidade, sem compromisso, e compare a fila de antes e depois com os mesmos quatro números.