NVIDIA impulsiona o co-design de modelos de IA, pedindo que construtores de LLM moldem arquiteturas às restrições de inferência da era Blackwell
A NVIDIA está incentivando desenvolvedores de LLM a co-projetarem modelos para inferência amigável a GPUs, apostando que arquiteturas conscientes de hardware reduzirão custo e latência em escala.
