0

0

人工智能如何评估模型准确率_人工智能计算PrecisionRecall指标教程

絕刀狂花

絕刀狂花

发布时间:2026-03-04 19:21:19

|

751人浏览过

|

来源于php中文网

原创

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

人工智能如何评估模型准确率_人工智能计算precisionrecall指标教程

如果您在训练或部署人工智能分类模型后,需要量化其预测能力,则必须依赖标准化的评估指标。Precision(精确率)与Recall(召回率)是刻画模型在正类识别上偏重不同维度的核心指标,二者不可相互替代。以下是计算这两项指标的具体方法:

一、基于混淆矩阵的手动计算

该方法不依赖第三方库,直接从预测结果与真实标签中统计四类基本计数,适用于教学理解、轻量级部署或调试场景。需先明确TP(真正例)、FP(假正例)、FN(假负例)的定义与统计逻辑。

1、遍历预测标签与真实标签的每一对值,逐个比对;

2、若预测为1且真实为1,计数器TP加1;

3、若预测为1但真实为0,计数器FP加1;

4、若预测为0但真实为1,计数器FN加1;

5、代入公式:Precision = TP / (TP + FP),Recall = TP / (TP + FN);

6、当分母为0时,按惯例将对应指标设为0.0(如无正类预测则Precision无定义,取0)。

二、使用scikit-learn库批量计算

该方法适用于Python工程环境,支持多分类、宏平均/微平均等扩展模式,具备高鲁棒性与可复现性,是工业级评估的标准实践。

1、导入模块:from sklearn.metrics import precision_score, recall_score;

2、确保真实标签y_true与预测标签y_pred为一维数组且长度一致;

3、调用precision_score(y_true, y_pred, average='binary')获取二分类Precision;

4、调用recall_score(y_true, y_pred, average='binary')获取二分类Recall;

5、对多分类任务,可指定average='macro'或average='weighted'以适配业务需求;

6、若标签含字符串类别,需提前通过LabelEncoder统一编码为整数,否则会触发ValueError: Target is multiclass but average='binary'

三、在PyTorch训练循环中实时输出

该方法嵌入模型训练流程,在每个epoch结束时动态计算并打印指标,便于监控收敛趋势与过拟合信号,尤其适用于长周期训练任务。

1、在验证阶段禁用梯度:with torch.no_grad():;

奇布塔
奇布塔

基于AI生成技术的一站式有声绘本创作平台

下载

2、获取模型输出logits,执行torch.argmax(logits, dim=1)得到预测类别;

3、将预测结果与真实标签转为CPU上的NumPy数组;

4、调用sklearn.metrics.precision_score和recall_score进行计算;

5、使用print()或logger.info()输出格式化字符串,例如:f"Val Precision: {p:.4f}, Recall: {r:.4f}";

6、注意避免在GPU张量上直接调用sklearn函数,否则将引发TypeError: can't convert cuda:0 device type tensor to numpy

四、通过TensorFlow/Keras内置评估器计算

该方法适用于Keras Sequential或Functional API构建的模型,利用compile时声明的metrics参数自动累积统计量,无需手动提取中间结果,适合快速验证。

1、在model.compile()中加入metrics=['precision', 'recall'](需TensorFlow ≥ 2.12);

2、调用model.evaluate()后,返回的列表中按顺序包含loss、precision、recall;

3、若使用自定义指标,需注册tf.keras.metrics.Precision()与tf.keras.metrics.Recall()实例;

4、注意默认precision为'micro'模式,若需二分类特异性结果,应显式传入class_id=1;

5、当数据集极度不平衡时,未加权的micro-average可能掩盖正类性能缺陷,此时应检查per-class recall values而非仅看汇总值。

五、使用命令行工具ml-metrics离线分析

该方法面向无Python运行环境的生产系统或CI/CD流水线,支持CSV格式输入,可生成带置信区间的指标报告,适合自动化质量门禁。

1、准备两列CSV文件:第一列为真实标签,第二列为预测标签,无表头;

2、执行命令:ml-metrics --precision --recall input.csv;

3、输出结果中Precision与Recall值保留四位小数,并附标准误(SE);

4、若输入含空行或非数字字符,工具将跳过该行并打印警告,但不中断执行;

5、当正类样本数少于5时,工具自动添加Laplace平滑并标注[smoothed]提示。

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

通义千问
通义千问

阿里巴巴推出的全能AI助手

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
数据分析的方法
数据分析的方法

数据分析的方法有:对比分析法,分组分析法,预测分析法,漏斗分析法,AB测试分析法,象限分析法,公式拆解法,可行域分析法,二八分析法,假设性分析法。php中文网为大家带来了数据分析的相关知识、以及相关文章等内容。

500

2023.07.04

数据分析方法有哪几种
数据分析方法有哪几种

数据分析方法有:1、描述性统计分析;2、探索性数据分析;3、假设检验;4、回归分析;5、聚类分析。本专题为大家提供数据分析方法的相关的文章、下载、课程内容,供大家免费下载体验。

291

2023.08.07

网站建设功能有哪些
网站建设功能有哪些

网站建设功能包括信息发布、内容管理、用户管理、搜索引擎优化、网站安全、数据分析、网站推广、响应式设计、社交媒体整合和电子商务等功能。这些功能可以帮助网站管理员创建一个具有吸引力、可用性和商业价值的网站,实现网站的目标。

756

2023.10.16

数据分析网站推荐
数据分析网站推荐

数据分析网站推荐:1、商业数据分析论坛;2、人大经济论坛-计量经济学与统计区;3、中国统计论坛;4、数据挖掘学习交流论坛;5、数据分析论坛;6、网站数据分析;7、数据分析;8、数据挖掘研究院;9、S-PLUS、R统计论坛。想了解更多数据分析的相关内容,可以阅读本专题下面的文章。

531

2024.03.13

Python 数据分析处理
Python 数据分析处理

本专题聚焦 Python 在数据分析领域的应用,系统讲解 Pandas、NumPy 的数据清洗、处理、分析与统计方法,并结合数据可视化、销售分析、科研数据处理等实战案例,帮助学员掌握使用 Python 高效进行数据分析与决策支持的核心技能。

80

2025.09.08

Python 数据分析与可视化
Python 数据分析与可视化

本专题聚焦 Python 在数据分析与可视化领域的核心应用,系统讲解数据清洗、数据统计、Pandas 数据操作、NumPy 数组处理、Matplotlib 与 Seaborn 可视化技巧等内容。通过实战案例(如销售数据分析、用户行为可视化、趋势图与热力图绘制),帮助学习者掌握 从原始数据到可视化报告的完整分析能力。

58

2025.10.14

PHP高性能API设计与Laravel服务架构实践
PHP高性能API设计与Laravel服务架构实践

本专题围绕 PHP 在现代 Web 后端开发中的高性能实践展开,重点讲解基于 Laravel 框架构建可扩展 API 服务的核心方法。内容涵盖路由与中间件机制、服务容器与依赖注入、接口版本管理、缓存策略设计以及队列异步处理方案。同时结合高并发场景,深入分析性能瓶颈定位与优化思路,帮助开发者构建稳定、高效、易维护的 PHP 后端服务体系。

4

2026.03.04

AI安装教程大全
AI安装教程大全

2026最全AI工具安装教程专题:包含各版本AI绘图、AI视频、智能办公软件的本地化部署手册。全篇零基础友好,附带最新模型下载地址、一键安装脚本及常见报错修复方案。每日更新,收藏这一篇就够了,让AI安装不再报错!

7

2026.03.04

Swift iOS架构设计与MVVM模式实战
Swift iOS架构设计与MVVM模式实战

本专题聚焦 Swift 在 iOS 应用架构设计中的实践,系统讲解 MVVM 模式的核心思想、数据绑定机制、模块拆分策略以及组件化开发方法。内容涵盖网络层封装、状态管理、依赖注入与性能优化技巧。通过完整项目案例,帮助开发者构建结构清晰、可维护性强的 iOS 应用架构体系。

32

2026.03.03

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
麻省理工大佬Python课程
麻省理工大佬Python课程

共34课时 | 5.4万人学习

国外Web开发全栈课程全集
国外Web开发全栈课程全集

共12课时 | 1万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号