Homus TalksTopicsCompanies

Topics / Hardware

Hardware

3 talks

Anatomy of an AI Request: Where Latency and Cost Are Really Born

Dan Fu · Together AI · 35 min

Sáu stage một AI request đi qua (routing tới decode) và sáu lever giảm latency, cost: kernels, disaggregation, parallelism, routing, speculative decoding, quantization.

AI and Video games: The Evolution

Jack McCauley · Oculus · 35 min

Từ render Terminator 2 trên 20 workstation tới GPU và AI sinh asset bằng lời: vì sao game sẽ photoreal và một người làm được việc của cả studio.

From Software Agents to Physical Devices: Inside the Agentic Hardware Stack

Michael Yuan · Second State · 35 min

Vì sao attention là nút cổ chai khi chạy nhiều agent, và cách VibeKeys dùng Wi-Fi, MQTT, vibetty để báo trạng thái agent chạy trong Docker Sandbox.