Uma startup chamada WiCi está lançando uma caixa eGPU sem fio que tenta resolver o problema de armazenamento versus VRAM da inferência de IA local, colocando uma placa gráfica completa, uma pilha de rede e um SSD PCIe 5.0 de 4TB em um único gabinete de $1,999. O WiCi One, conforme detalhado pelo Tom's Hardware, usa Wi-Fi 7 em vez de um cabo PCIe para conectar uma GPU remota a uma máquina cliente, e a proposta é voltada diretamente para pessoas que querem executar LLMs localmente sem comprar uma workstation completa em torno da placa.

O mecanismo é a parte interessante. Uma máquina cliente executa um driver de GPU que faz seu sistema operacional acreditar que a placa está instalada localmente, quando na verdade toda instrução está saindo via Wi-Fi 7 para a caixa WiCi One. A comunicação padrão entre GPU e host é, nas palavras do relato, "extremamente tagarela" — o que funciona bem com a latência de sub-microssegundo do PCIe 5.0, mas, segundo a descrição do Tom's Hardware sobre a própria explicação da WiCi, essa mesma tagarelice em um link sem fio transformaria consultas básicas de status em operações de vários segundos e poderia estender cálculos grandes a horas, se tratada de forma ingênua. A resposta da WiCi, segundo o veículo, é uma camada de driver que faz cache pesado, deduplicação e compressão, e que decide quais solicitações de hardware podem ser resolvidas localmente versus quais realmente precisam atravessar a rede.

Essa camada de software também é o que faz a história de múltiplos clientes funcionar: como a GPU é abstraída atrás de um protocolo de rede em vez de um slot físico, a WiCi afirma que a mesma placa pode atender mais de uma máquina. A empresa oferece bibliotecas Python que expõem o WiCi One como uma GPU normal para frameworks de LLM, além de uma API HTTP padrão para acesso via rede — ambos sinais, segundo a leitura da documentação feita pelo Tom's Hardware, de que a WiCi espera que vários clientes compartilhem uma placa sem configuração especial.

O SSD embutido é direcionado a um padrão específico no serviço de modelos atual: arquiteturas Mixture-of-Experts que recorrem ao armazenamento quando a VRAM se esgota. A WiCi integrou um SSD PCIe 5.0 de 4TB diretamente no gabinete para que os pesos do modelo fiquem próximos da GPU, permitindo executar modelos maiores enquanto reduz transferências repetidas pelo link sem fio. A configuração base vem com uma RTX 5060 Ti com 16GB de VRAM; a WiCi afirmou que planeja uma variante RTX 5090 com 32GB, embora o Tom's Hardware relate que nenhum preço ou data foi definido para essa versão, e as placas 5090 sozinhas estão atualmente listadas bem acima de $7,000.

Em relação ao preço, o próprio detalhamento de componentes do Tom's Hardware coloca a caixa em território plausível: uma RTX 5060 Ti 16GB custa cerca de $800 na Newegg, um SSD NVMe PCIe 5.0 de 4TB cerca de $850, mais uma estimativa de $100 para uma fonte de alimentação e outros $100 para o gabinete, placa Wi-Fi e outras peças — chegando perto de $1,850 antes da margem. A WiCi está cobrando $1,999 para inscrições antecipadas e $2,599 na disponibilidade geral, o que o veículo chama de razoável se o empacotamento e a pilha de software realmente cumprirem o prometido.

O que está visivelmente ausente é qualquer número de latência de inferência. O relato do Tom's Hardware nunca apresenta uma cifra de throughput do Wi-Fi 7, um resultado de tokens por segundo, ou um atraso de ida e volta medido para comandos de GPU sob o novo driver — todo o argumento da tagarelice é descrito qualitativamente, não com benchmarks. A mesma lacuna aparece em torno dos jogos: a WiCi afirma que a placa pode executar jogos sem modificação, mas a documentação, segundo o relato, menciona apenas suporte a Vulkan e Direct3D com a ressalva de que "[nem] toda API precisa estar completa no primeiro dia", e o Tom's Hardware observa que o Wi-Fi é pouco adequado para empurrar quadros em intervalos de 16.67ms para 60 FPS. Também não há lista de compatibilidade de drivers, nenhum benchmark contra uma base de eGPU com fio, e nenhuma data de lançamento — a WiCi só se comprometeu com um preview no Q4 2026.

Para uma equipe avaliando isso como um componente de dev-rig: trate toda afirmação da WiCi sobre latência e cache como marketing não verificado até que alguém publique números de tokens por segundo ou de ida e volta contra um eGPU PCIe com fio, porque o próprio relato do fornecedor admite que a versão ingênua deste design é inutilizavelmente lenta.