[Triton课程笔记] 1.1.3 Triton的辅助工具及特性
1.[Triton课程笔记] 1.1.1 框架介绍2.[Triton课程笔记] 1.1.2 Triton的设计
3.[Triton课程笔记] 1.1.3 Triton的辅助工具及特性
4.[Triton课程笔记] 1.2.1 编程实战-准备模型仓库5.[Triton课程笔记] 1.2.2 编程实战-如何编写模型配置6.[Triton课程笔记] 1.2.3 编程实战-启动Triton Server7.[Triton课程笔记] 1.2.4 编程实战-配置ensemble model8.[Triton课程笔记] 1.2.5 编程实战-请求Triton Server9.[Triton课程笔记] 2.1.1 Backend-大纲10.[Triton课程笔记] 2.1.2-2.1.3 Backend-接口实现11.[Triton课程笔记] 2.1.4 Backend-build12.[Triton课程笔记] 2.2.1 Python Backend13.[Triton课程笔记] 2.2.2 Python Backend及BLS14.[Triton课程笔记] 2.2.3 BLS续
一、性能分析工具

Model analyzer:

是一套性能分析工具,提供性能分析,内存分析,为推理的优化提供性能数据信息。
二、学习资源
文档,代码仓库,NGC。

样本代码。
demo。

不同场景,Triton的部署和分析教程。

博客资源。
三、自研推理服务 VS Triton

- 开源,bsd协议。
- 社区方式管理,重构风险低;
- 核心团队来自NV,对NVGPU的适配好;
- 来自不同公司贡献的backend;
- 可以促进新特性,提需求;
- 支持多框架;
- 使用的公司多;
- 通过customer backend解耦定制模型;
- 基于多实例支持,GRPC和CUDA基于内存的优化,实现更好的性能;
- 驾驶舱(监控)支持

监控项目细节。
客户,吹水用的。
本文版权归作者(https://www.cnblogs.com/harrymore/)和博客园共有,欢迎转载,但未经作者同意必须保留此段声明,且在文章页面明显位置给出原文链接,如有问题, 可邮件(harrymore@126.com)咨询.
合集:
Triton课程笔记
标签:
triton
【推荐】国内首个AI IDE,深度理解中文开发场景,立即下载体验Trae
【推荐】编程新体验,更懂你的AI,立即体验豆包MarsCode编程助手
【推荐】抖音旗下AI助手豆包,你的智能百科全书,全免费不限次数
【推荐】轻量又高性能的 SSH 工具 IShell:AI 加持,快人一步
· 全程不用写代码,我用AI程序员写了一个飞机大战
· DeepSeek 开源周回顾「GitHub 热点速览」
· 记一次.NET内存居高不下排查解决与启示
· MongoDB 8.0这个新功能碉堡了,比商业数据库还牛
· .NET10 - 预览版1新功能体验(一)