3 tools found
AI Tools
Fast AI inference with the LPU
LLM inference in C/C++
An inference chip design that runs a real LLM (Qwen2.5-0.5B) on FPGA — one transformer decoder layer in RTL, every silicon value bit-exact against a golden mode