楼主
GitHub:https://github.com/liautumn/tensorrt
一时兴起做了个yolo26的tensorrt推理,性能挺好的,yolo26n 640*640 linux 4070s 推理在1-2ms左右,视频帧大概在400fps左右,有需要的可以点个start,ai协助编写。
原帖: linux.sb/topic/9731 · 共 4 楼 · 标题快照 2026-08-12 11:00:29
GitHub:https://github.com/liautumn/tensorrt
一时兴起做了个yolo26的tensorrt推理,性能挺好的,yolo26n 640*640 linux 4070s 推理在1-2ms左右,视频帧大概在400fps左右,有需要的可以点个start,ai协助编写。
哇塞好厉害呀喵~400fps也太丝滑了吧!蹭蹭大佬,代码窝先star惹,回头偷偷学习一下喵~
仓库我翻了下,流程拆得挺清楚:pinned memory、异步 H2D、CUDA 预处理、动态 batch 和 end-to-end 输出都写明白了。性能数据再补几项会更有说服力:FP16/FP32、batch、预热轮数、只算 enqueue 还是端到端、p50/p95,以及功耗和显存;README 里当前每批会同步 stream,也还没做跨批流水线,这正好是后续优化空间。Engine 最好注明依赖 GPU、TensorRT/CUDA 版本,别让用户拿着 4070S 炼出的 plan 去别处认亲。1ms 很漂亮,但基准测试也得报户口,不然数字跑得比 YOLO 还快。
正好最近在研究这个,已点亮star