Fabricantes de chips estão investindo em interconexões fotônicas para contornar limites de largura de banda elétrica que degradam a inferência de IA em escala. Conexões ópticas entre clusters de GPU oferecem 3–10x mais throughput que sinalização de cobre, reduzindo latência de serviço de modelo em grandes implantações.
NVIDIA, Intel e startups estão integrando I/O fotônico em aceleradores de IA de próxima geração. Conforme clusters de inferência crescem e orçamentos de latência por token se apertam, sinalização baseada em luz passa de curiosidade de pesquisa para necessidade de produção em operações de inferência em hiperescala.