课程6-笔记-书生浦语大模型实战营-6

大模型评测概述

评测目的:了解模型能力,指导模型迭代,监控模型风险,把握模型应用

大模型评测方法

客观评测:问答题、多选题、判断题等 主观评测:主观题(人类评价、模型评价)

OpenCompass评测平台

image.png image.png

posted @   russellwang  阅读(4)  评论(0编辑  收藏  举报
编辑推荐:
· Linux系列:如何用 C#调用 C方法造成内存泄露
· AI与.NET技术实操系列(二):开始使用ML.NET
· 记一次.NET内存居高不下排查解决与启示
· 探究高空视频全景AR技术的实现原理
· 理解Rust引用及其生命周期标识(上)
阅读排行:
· 阿里最新开源QwQ-32B,效果媲美deepseek-r1满血版,部署成本又又又降低了!
· 单线程的Redis速度为什么快?
· SQL Server 2025 AI相关能力初探
· 展开说说关于C#中ORM框架的用法!
· AI编程工具终极对决:字节Trae VS Cursor,谁才是开发者新宠?
点击右上角即可分享
微信分享提示