<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>AI Inference on KAD</title>
    <link>https://www.kad8.com/tags/ai-inference/</link>
    <description>Recent content in AI Inference on KAD</description>
    <generator>Hugo -- gohugo.io</generator>
    <language>en</language>
    <copyright>© 2026 </copyright>
    <lastBuildDate>Sat, 19 Sep 2026 21:04:33 +0800</lastBuildDate><atom:link href="https://www.kad8.com/tags/ai-inference/index.xml" rel="self" type="application/rss+xml" />
    
    <item>
      <title>MLPerf Inference v6.1: AMD, Blackwell and Vera Rubin Tested</title>
      <link>https://www.kad8.com/ai/mlperf-inference-v6.1-amd-blackwell-and-vera-rubin-tested/</link>
      <pubDate>Sat, 19 Sep 2026 21:04:33 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/mlperf-inference-v6.1-amd-blackwell-and-vera-rubin-tested/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/mlperf-inference-v6.1-amd-blackwell-and-vera-rubin-tested/featured-Data_center_server_racks_glowing.jpeg" />
    </item>
    
    <item>
      <title>Apple May Return to Enterprise Servers With Nvidia NVLink</title>
      <link>https://www.kad8.com/server/apple-may-return-to-enterprise-servers-with-nvidia-nvlink/</link>
      <pubDate>Fri, 18 Sep 2026 23:34:45 +0800</pubDate>
      
      <guid>https://www.kad8.com/server/apple-may-return-to-enterprise-servers-with-nvidia-nvlink/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/server/apple-may-return-to-enterprise-servers-with-nvidia-nvlink/featured-Servers_processing_AI_data.jpeg" />
    </item>
    
    <item>
      <title>Cisco 2026: How AI Is Reshaping Wide Area Networks</title>
      <link>https://www.kad8.com/network/cisco-2026-how-ai-is-reshaping-wide-area-networks/</link>
      <pubDate>Tue, 15 Sep 2026 00:30:02 +0800</pubDate>
      
      <guid>https://www.kad8.com/network/cisco-2026-how-ai-is-reshaping-wide-area-networks/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/network/cisco-2026-how-ai-is-reshaping-wide-area-networks/featured-AI_optimizes_global_network_traffic.jpeg" />
    </item>
    
    <item>
      <title>OpenAI Retires GPT-5.3-Codex-Spark After 7 Months</title>
      <link>https://www.kad8.com/news/openai-retires-gpt-5.3-codex-spark-after-7-months/</link>
      <pubDate>Sun, 13 Sep 2026 00:07:44 +0800</pubDate>
      
      <guid>https://www.kad8.com/news/openai-retires-gpt-5.3-codex-spark-after-7-months/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/news/openai-retires-gpt-5.3-codex-spark-after-7-months/featured-Retiring_obsolete_AI_model.jpeg" />
    </item>
    
    <item>
      <title>HBF Reshapes AI Inference: High Bandwidth Flash Explained</title>
      <link>https://www.kad8.com/storage/hbf-reshapes-ai-inference-high-bandwidth-flash-explained/</link>
      <pubDate>Thu, 03 Sep 2026 23:55:20 +0800</pubDate>
      
      <guid>https://www.kad8.com/storage/hbf-reshapes-ai-inference-high-bandwidth-flash-explained/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/storage/hbf-reshapes-ai-inference-high-bandwidth-flash-explained/featured-Flash_memory_architecture_3D.jpeg" />
    </item>
    
    <item>
      <title>NVIDIA Boosts Local AI Inference by Up to 1.9x on RTX and DGX</title>
      <link>https://www.kad8.com/ai/nvidia-boosts-local-ai-inference-by-up-to-1.9x-on-rtx-and-dgx/</link>
      <pubDate>Thu, 03 Sep 2026 00:24:10 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/nvidia-boosts-local-ai-inference-by-up-to-1.9x-on-rtx-and-dgx/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/nvidia-boosts-local-ai-inference-by-up-to-1.9x-on-rtx-and-dgx/featured-AI_agents_deploying_on_server.jpeg" />
    </item>
    
    <item>
      <title>Intel Crescent Island: Xe3P GPU Architecture and AI Upgrades</title>
      <link>https://www.kad8.com/hardware/intel-crescent-island-xe3p-gpu-architecture-and-ai-upgrades/</link>
      <pubDate>Fri, 28 Aug 2026 22:53:34 +0800</pubDate>
      
      <guid>https://www.kad8.com/hardware/intel-crescent-island-xe3p-gpu-architecture-and-ai-upgrades/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/hardware/intel-crescent-island-xe3p-gpu-architecture-and-ai-upgrades/featured-Intel_Crescent_Island_enterprise_AI.jpeg" />
    </item>
    
    <item>
      <title>OpenAI Jalapeño ASIC: Architecture, Performance &amp; Trade-Offs</title>
      <link>https://www.kad8.com/ai/openai-jalape%C3%B1o-asic-architecture-performance-trade-offs/</link>
      <pubDate>Wed, 26 Aug 2026 12:02:16 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/openai-jalape%C3%B1o-asic-architecture-performance-trade-offs/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/openai-jalape%C3%B1o-asic-architecture-performance-trade-offs/featured-OpenAI_ASIC_architecture_visualization.jpeg" />
    </item>
    
    <item>
      <title>EnCharge AI Advances In-Memory Computing for Edge AI</title>
      <link>https://www.kad8.com/ai/encharge-ai-advances-in-memory-computing-for-edge-ai/</link>
      <pubDate>Tue, 25 Aug 2026 15:54:28 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/encharge-ai-advances-in-memory-computing-for-edge-ai/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/encharge-ai-advances-in-memory-computing-for-edge-ai/featured-AI_chip_circuit_pathways.jpeg" />
    </item>
    
    <item>
      <title>Anthropic Explores Samsung 2nm Chips for Claude AI Inference</title>
      <link>https://www.kad8.com/ai/anthropic-explores-samsung-2nm-chips-for-claude-ai-inference/</link>
      <pubDate>Tue, 25 Aug 2026 09:57:52 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/anthropic-explores-samsung-2nm-chips-for-claude-ai-inference/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/anthropic-explores-samsung-2nm-chips-for-claude-ai-inference/featured-Custom_AI_chip_development.jpeg" />
    </item>
    
    <item>
      <title>Alibaba XuanTie C950 RISC-V CPU: 5nm, 64 Cores and LLM Inference</title>
      <link>https://www.kad8.com/hardware/alibaba-xuantie-c950-risc-v-cpu-5nm-64-cores-and-llm-inference/</link>
      <pubDate>Mon, 24 Aug 2026 22:57:54 +0800</pubDate>
      
      <guid>https://www.kad8.com/hardware/alibaba-xuantie-c950-risc-v-cpu-5nm-64-cores-and-llm-inference/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/hardware/alibaba-xuantie-c950-risc-v-cpu-5nm-64-cores-and-llm-inference/featured-Alibaba_XuanTie_C950_CPU_visualization.jpeg" />
    </item>
    
    <item>
      <title>Alibaba XuanTie C950 Runs 27B Qwen Model at 30 Tokens/s</title>
      <link>https://www.kad8.com/ai/alibaba-xuantie-c950-runs-27b-qwen-model-at-30-tokens-per-second/</link>
      <pubDate>Wed, 19 Aug 2026 22:24:58 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/alibaba-xuantie-c950-runs-27b-qwen-model-at-30-tokens-per-second/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/alibaba-xuantie-c950-runs-27b-qwen-model-at-30-tokens-per-second/featured-XuanTie_C950_CPU_processing_data.jpeg" />
    </item>
    
    <item>
      <title>NVIDIA Rubin GPU Architecture: A Deep Technical Breakdown</title>
      <link>https://www.kad8.com/ai/nvidia-rubin-gpu-architecture-a-deep-technical-breakdown/</link>
      <pubDate>Tue, 21 Jul 2026 22:45:26 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/nvidia-rubin-gpu-architecture-a-deep-technical-breakdown/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/nvidia-rubin-gpu-architecture-a-deep-technical-breakdown/featured-NVIDIA_Rubin_processor_architecture.jpeg" />
    </item>
    
    <item>
      <title>AMD Instinct MI350P: 141GB HBM PCIe AI Accelerator Gains Momentum</title>
      <link>https://www.kad8.com/hardware/amd-instinct-mi350p-141gb-hbm-pcie-ai-accelerator-gains-momentum/</link>
      <pubDate>Tue, 21 Jul 2026 00:38:03 +0800</pubDate>
      
      <guid>https://www.kad8.com/hardware/amd-instinct-mi350p-141gb-hbm-pcie-ai-accelerator-gains-momentum/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/hardware/amd-instinct-mi350p-141gb-hbm-pcie-ai-accelerator-gains-momentum/featured-AMD_Instinct_MI350P_AI_accelerator.jpeg" />
    </item>
    
    <item>
      <title>Intel Arc Pro B70 Beats RTX 5090D in High-Concurrency AI Benchmark</title>
      <link>https://www.kad8.com/ai/intel-arc-pro-b70-beats-rtx-5090d-in-high-concurrency-ai-benchmark/</link>
      <pubDate>Fri, 10 Jul 2026 18:20:53 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/intel-arc-pro-b70-beats-rtx-5090d-in-high-concurrency-ai-benchmark/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/intel-arc-pro-b70-beats-rtx-5090d-in-high-concurrency-ai-benchmark/featured-Intel_Arc_Pro_GPU_visualization.jpeg" />
    </item>
    
    <item>
      <title>DSpark Explained: Semi-Autoregressive Speculative Decoding for Faster LLM Inference</title>
      <link>https://www.kad8.com/ai/dspark-explained-semi-autoregressive-speculative-decoding-for-faster-llm-inference/</link>
      <pubDate>Sat, 04 Jul 2026 17:56:37 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/dspark-explained-semi-autoregressive-speculative-decoding-for-faster-llm-inference/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/dspark-explained-semi-autoregressive-speculative-decoding-for-faster-llm-inference/featured-AI_inference_pipeline_DSpark.jpeg" />
    </item>
    
    <item>
      <title>AWS Explores Qualcomm AI200 Chips with 768GB Memory for AI Inference</title>
      <link>https://www.kad8.com/ai/aws-explores-qualcomm-ai200-chips-with-768gb-memory-for-ai-inference/</link>
      <pubDate>Sat, 13 Jun 2026 22:57:19 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/aws-explores-qualcomm-ai200-chips-with-768gb-memory-for-ai-inference/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/aws-explores-qualcomm-ai200-chips-with-768gb-memory-for-ai-inference/featured-AWS_adopts_Qualcomm_AI_chips.jpeg" />
    </item>
    
    <item>
      <title>FuriosaAI and Broadcom Unveil 2nm AI Inference Accelerator</title>
      <link>https://www.kad8.com/ai/furiosaai-and-broadcom-unveil-2nm-ai-inference-accelerator/</link>
      <pubDate>Sat, 30 May 2026 00:28:14 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/furiosaai-and-broadcom-unveil-2nm-ai-inference-accelerator/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/furiosaai-and-broadcom-unveil-2nm-ai-inference-accelerator/featured-FuriosaAI_Broadcom_2nm_AI_accelerator.jpeg" />
    </item>
    
    <item>
      <title>Intel and SambaNova Redefine AI Inference Architecture in 2026</title>
      <link>https://www.kad8.com/ai/intel-and-sambanova-redefine-ai-inference-architecture-in-2026/</link>
      <pubDate>Thu, 09 Apr 2026 13:46:31 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/intel-and-sambanova-redefine-ai-inference-architecture-in-2026/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/intel-and-sambanova-redefine-ai-inference-architecture-in-2026/featured-Intel_SambaNova_modular.jpeg" />
    </item>
    
    <item>
      <title>Reducing KV Cache Bottlenecks with NVIDIA Dynamo</title>
      <link>https://www.kad8.com/ai/reducing-kv-cache-bottlenecks-with-nvidia-dynamo/</link>
      <pubDate>Wed, 07 Jan 2026 12:15:49 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/reducing-kv-cache-bottlenecks-with-nvidia-dynamo/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/reducing-kv-cache-bottlenecks-with-nvidia-dynamo/featured-Reduce-KV-Cache-Bottlenecks.png" />
    </item>
    
    <item>
      <title>NVIDIA’s $20B Groq Acqui-hire: Securing the Future of AI Inference</title>
      <link>https://www.kad8.com/ai/nvidias-20b-groq-acqui-hire-securing-the-future-of-ai-inference/</link>
      <pubDate>Thu, 25 Dec 2025 23:15:10 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/nvidias-20b-groq-acqui-hire-securing-the-future-of-ai-inference/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/nvidias-20b-groq-acqui-hire-securing-the-future-of-ai-inference/featured-NVIDIA-Acqui-Hire-Groq.png" />
    </item>
    
    <item>
      <title>NVIDIA Strikes $20B Groq Deal to Reinforce AI Inference Dominance</title>
      <link>https://www.kad8.com/news/nvidia-strikes-20b-groq-deal-to-reinforce-ai-inference-dominance/</link>
      <pubDate>Thu, 25 Dec 2025 21:38:06 +0800</pubDate>
      
      <guid>https://www.kad8.com/news/nvidia-strikes-20b-groq-deal-to-reinforce-ai-inference-dominance/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/news/nvidia-strikes-20b-groq-deal-to-reinforce-ai-inference-dominance/featured-NVIDIA-Strikes-20B-Groq-Deal.png" />
    </item>
    
    <item>
      <title>Intel Xe3P Architecture Debuts with Crescent Island GPU</title>
      <link>https://www.kad8.com/hardware/intel-xe3p-architecture-debuts-with-crescent-island-gpu/</link>
      <pubDate>Thu, 16 Oct 2025 23:13:09 +0800</pubDate>
      
      <guid>https://www.kad8.com/hardware/intel-xe3p-architecture-debuts-with-crescent-island-gpu/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/hardware/intel-xe3p-architecture-debuts-with-crescent-island-gpu/featured-Intel-Xe3P-GPU.png" />
    </item>
    
    <item>
      <title>Intel Launches Three New Xeon 6 Processors</title>
      <link>https://www.kad8.com/ai/intel-launches-three-new-xeon-6-processors/</link>
      <pubDate>Sat, 24 May 2025 23:10:23 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/intel-launches-three-new-xeon-6-processors/</guid>
      <description></description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/intel-launches-three-new-xeon-6-processors/featured-intel-xeon-6-processors.png" />
    </item>
    
  </channel>
</rss>
