<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>LLM Inference on KAD</title>
    <link>https://www.kad8.com/tags/llm-inference/</link>
    <description>Recent content in LLM Inference on KAD</description>
    <generator>Hugo -- gohugo.io</generator>
    <language>en</language>
    <copyright>© 2026 </copyright>
    <lastBuildDate>Thu, 27 Aug 2026 14:20:36 +0800</lastBuildDate><atom:link href="https://www.kad8.com/tags/llm-inference/index.xml" rel="self" type="application/rss+xml" />
    
    <item>
      <title>Cerebras CS-4, CS-5 and CS-6: Wafer-Scale AI Roadmap</title>
      <link>https://www.kad8.com/ai/cerebras-cs-4-cs-5-and-cs-6-wafer-scale-ai-roadmap/</link>
      <pubDate>Thu, 27 Aug 2026 14:20:36 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/cerebras-cs-4-cs-5-and-cs-6-wafer-scale-ai-roadmap/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/cerebras-cs-4-cs-5-and-cs-6-wafer-scale-ai-roadmap/featured-Silicon_wafers_displaying_AI_roadmap.jpeg" />
    </item>
    
    <item>
      <title>FreeToken Lets a Single RTX 5090 Run 284B MoE Models Locally</title>
      <link>https://www.kad8.com/ai/freetoken-lets-a-single-rtx-5090-run-284b-moe-models-locally/</link>
      <pubDate>Sat, 22 Aug 2026 22:25:16 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/freetoken-lets-a-single-rtx-5090-run-284b-moe-models-locally/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/freetoken-lets-a-single-rtx-5090-run-284b-moe-models-locally/featured-FreeToken_runs_models_on_GPUs.jpeg" />
    </item>
    
    <item>
      <title>M4 Max Mac Studio Beats GB10 and Strix Halo in Local AI</title>
      <link>https://www.kad8.com/ai/m4-max-mac-studio-beats-gb10-and-strix-halo-in-local-ai/</link>
      <pubDate>Fri, 31 Jul 2026 12:37:35 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/m4-max-mac-studio-beats-gb10-and-strix-halo-in-local-ai/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/m4-max-mac-studio-beats-gb10-and-strix-halo-in-local-ai/featured-Woman_working_on_MacBook.jpeg" />
    </item>
    
    <item>
      <title>NVIDIA and ETH Zurich Push Multi-GPU Communication Latency Toward the Speed of Light</title>
      <link>https://www.kad8.com/ai/nvidia-and-eth-zurich-push-multi-gpu-communication-latency-toward-the-speed-of-light/</link>
      <pubDate>Tue, 21 Jul 2026 00:47:30 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/nvidia-and-eth-zurich-push-multi-gpu-communication-latency-toward-the-speed-of-light/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/nvidia-and-eth-zurich-push-multi-gpu-communication-latency-toward-the-speed-of-light/featured-GPU_collective_communication_latency.jpeg" />
    </item>
    
    <item>
      <title>AMD Ryzen AI Halo Launch: A DGX Spark Challenger for Local AI</title>
      <link>https://www.kad8.com/ai/amd-ryzen-ai-halo-launch-a-dgx-spark-challenger-for-local-ai/</link>
      <pubDate>Mon, 15 Jun 2026 20:39:21 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/amd-ryzen-ai-halo-launch-a-dgx-spark-challenger-for-local-ai/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/amd-ryzen-ai-halo-launch-a-dgx-spark-challenger-for-local-ai/featured-AMD_launches_Ryzen_AI_Halo.jpeg" />
    </item>
    
    <item>
      <title>D-Matrix Targets Fast AI Tokens With 3D Memory and Ultra-Low-Latency NICs</title>
      <link>https://www.kad8.com/ai/d-matrix-targets-fast-ai-tokens-with-3d-memory-and-ultra-low-latency-nics/</link>
      <pubDate>Sat, 07 Feb 2026 11:29:19 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/d-matrix-targets-fast-ai-tokens-with-3d-memory-and-ultra-low-latency-nics/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/d-matrix-targets-fast-ai-tokens-with-3d-memory-and-ultra-low-latency-nics/featured-D-Matrix-Fast-AI-Tokens.png" />
    </item>
    
  </channel>
</rss>
