Topics / Hardware
Hardware
3 talks
Anatomy of an AI Request: Where Latency and Cost Are Really Born
Dan Fu · Together AI · 35 min
Sáu stage một AI request đi qua (routing tới decode) và sáu lever giảm latency, cost: kernels, disaggregation, parallelism, routing, speculative decoding, quantization.
AI and Video games: The Evolution
Jack McCauley · Oculus · 35 min
Từ render Terminator 2 trên 20 workstation tới GPU và AI sinh asset bằng lời: vì sao game sẽ photoreal và một người làm được việc của cả studio.
From Software Agents to Physical Devices: Inside the Agentic Hardware Stack
Michael Yuan · Second State · 35 min
Vì sao attention là nút cổ chai khi chạy nhiều agent, và cách VibeKeys dùng Wi-Fi, MQTT, vibetty để báo trạng thái agent chạy trong Docker Sandbox.