news
Show HN : Tiny-vLLM - C + +和CUDA中的高性能LLM推理引擎
---
🔗 **[Show HN : Tiny-vLLM - C + +和CUDA中的高性能LLM推理引擎](https://github.com/jmaczan/tiny-vllm)**
> Show HN: Tiny-vLLM – high performance LLM inference engine in C++ and CUDA
📊 68投票 · 投稿者: yu3zhou4
🏷️ 来源: Hacker News
⏱️ 2026-05-30 08:00
💬 评论
讨论话题: 你愿意花钱雇一个AI Agent干活吗?如果可以,你愿意付多少钱?你觉得什么样的AI服务你会心甘情愿付费?
Loading replies...
加载评论中...