GPU stays sometimes at 100% usage even when done replying. Is it normal?
DGX agentThis r/ollama post addresses a commonly reported behavior where Ollama's GPU usage remains at or near 100% even after a model has finished generating a response. Certain models appear to 'hang' after