汽车燃料效率预测

简介: 本教程的目的是要预测汽车的燃料效率,相比于之前的分类,这是一个回归问题,回归是针对连续变量的,分类是针对离散变量的用的数据集是 Auto MPG ,包含有 MPG、Cylinders、Displacement、Horsepower、Weight、Acceleration、Model Year、Origin 这么 8 个特征,我们的目的是根据其它 7 个特征去预测 MPG ,数据如下图所示

本教程的目的是要预测汽车的燃料效率,相比于之前的分类,这是一个回归问题,回归是针对连续变量的,分类是针对离散变量的

用的数据集是 Auto MPG ,包含有 MPG、Cylinders、Displacement、Horsepower、Weight、Acceleration、Model Year、Origin 这么 8 个特征,我们的目的是根据其它 7 个特征去预测 MPG ,数据如下图所示

由于本教程篇幅过长,我们这里就不粘贴过多代码了,如果需要查看代码,文末有提供链接地址

第一步我们需要加载数据,然后对数据进行清理,把一些 unknown values 去除,如下图所示,我们可以发现 Horsepower 这一列有 6 个需要清除的值

我们仔细观察下数据可以发现,Origin 这一列的值,其实是类别,不是数值,所以需要转化成 one-hot ,处理结果如下图所示

接下来我们需要进行数据集的划分,执行如下代码

train_dataset = dataset.sample(frac=0.8, random_state=0)
test_dataset = dataset.drop(train_dataset.index)

我们再来查看下各个特征的一些统计结果

我们可以发现一些特征的数值特别大,比如 Weight ,一些特征的数值特别小,比如 Cylinders ,所以我们需要对数据进行标准化

Linear Regression

用一个变量预测 MPG

horsepower = np.array(train_features['Horsepower'])

horsepower_normalizer = preprocessing.Normalization(input_shape=[1,], axis=None)
horsepower_normalizer.adapt(horsepower)

horsepower_model = tf.keras.Sequential([
    horsepower_normalizer,
    layers.Dense(units=1)
])

horsepower_model.summary()

上面是核心代码,其中输入的一个变量指 Horsepower ,预测的目标是 MPG

用多个变量预测 MPG

normalizer = preprocessing.Normalization(axis=-1)
normalizer.adapt(np.array(train_features))

linear_model = tf.keras.Sequential([
    normalizer,
    layers.Dense(units=1)
])

上面是核心代码,其中输入的多个变量指 Cylinders、Displacement、Horsepower、Weight、Acceleration、Model Year、Origin 这么 7 个特征,预测的目标是MPG

DNN regression

def build_and_compile_model(norm):
  model = keras.Sequential([
      norm,
      layers.Dense(64, activation='relu'),
      layers.Dense(64, activation='relu'),
      layers.Dense(1)
  ])

  model.compile(loss='mean_absolute_error',
                optimizer=tf.keras.optimizers.Adam(0.001))
  return model

上面是 DNN 的模型搭建代码

dnn_horsepower_model = build_and_compile_model(horsepower_normalizer)

上面是用一个变量去预测 MPG

上图是 dnn_horsepower_model.summary() 的结果

dnn_model = build_and_compile_model(normalizer)
dnn_model.summary()

上面是用所有特征去预测 MPG

上图是 dnn_model.summary() 的结果

针对 4 个方案,我们可以进行对比,如上图所示,我们发现 dnn_model 的 MAE 最低,也就是该模型效果最好

代码地址: https://codechina.csdn.net/csdn_codechina/enterprise_technology/-/blob/master/basic_regression_fuel_efficiency.ipynb

目录
相关文章
|
机器学习/深度学习 并行计算 PyTorch
CUDA驱动深度学习发展 - 技术全解与实战
CUDA驱动深度学习发展 - 技术全解与实战
954 1
|
2月前
|
人工智能 弹性计算 关系型数据库
2026阿里云优惠活动整理:38元与99元服务器、企业迁云补贴、AI大模型、云产品组合购活动汇总
2026年,阿里云针对个人开发者、初创企业以及AI创新团队推出了一系列极具竞争力的优惠活动。从“38元”的入门级秒杀到“5亿”的企业迁云补贴,再到前沿的AI大模型折扣,阿里云正在通过全方位的降本措施助力用户上云。本文为您详细梳理当前最值得关注的四大类优惠活动。
|
3月前
|
XML 监控 供应链
taobao.item.get(淘宝天猫商品详情 TOP API)全业务场景手册
淘宝TOP核心接口taobao.item.get,通过商品ID(num_iid)获取结构化全量数据,支持铺货、ERP、竞品监控、跨境供应链等八大场景。HTTPS协议,返回JSON/XML,限流QPS=2,需按需传fields字段并规范签名。
|
10月前
|
传感器 人工智能 供应链
商业服务机器人的技术演进:咖啡机器人深度解析与主流产品评测
本文解析咖啡机器人三大核心技术:高精度双臂协作、AI视觉复刻与闭环反馈、智能操作系统与多模态交互,深入剖析猎户星空、ABB、越疆、川崎等主流产品的技术优势与适用场景,为商业选型提供科学依据。(238字)
690 0
|
10月前
|
存储 安全
HTTP协议中常见的状态码?
HTTP状态码分为1xx到5xx五类,常见如200(成功)、302(重定向)、401(未认证)、404(资源未找到)、500(服务器错误)等。转发是服务器内部跳转,客户端无感;重定向由浏览器发起新请求。Cookie通过Set-Cookie和Cookie头实现会话跟踪,但数据存于客户端,安全性较低。
|
12月前
|
人工智能 文字识别 安全
2025年企业防范员工向第三方人工智能工具泄露数据的全面防护方案
随着生成式人工智能工具的普及,企业员工在日常工作中越来越依赖ChatGPT、DeepSeek等第三方AI服务提升效率。然而,这种便利背后隐藏着严重的数据泄露风险。调查显示,近六成企业发生过敏感数据提交事件,其中三成导致实际泄露。传统防护手段在面对AI数据泄露场景时效果有限,企业急需建立针对性的防护体系。
|
11月前
|
机器学习/深度学习 人工智能 供应链
从“识图”到“购得”:图片搜索商品如何重构消费与供应链逻辑?
图片搜索正重塑电商:从“看到”到“买到”,只需一张图。它以AI解析视觉特征,精准匹配商品,打通C端购物与B端供应链,让找货、比价、溯源高效直达,成为连接视觉信息与交易的核心纽带。
|
机器学习/深度学习 人工智能 自然语言处理
与阿里合作的《人工智能(导论)》出版
《人工智能导论——深度学习大模型基础》由赵卫东编著,清华大学出版社出版。本书旨在帮助读者理解深度学习与大模型技术的底层逻辑,通过机器视觉、语音处理及自然语言处理等章节,结合实际应用场景,深入浅出地讲解相关理论。书中引入低代码开发平台和云端实验室资源,助力读者实践所学。无论专业背景如何,本书都能成为进入AI领域的理想入门书籍。特别感谢阿里云及参与编校工作的同学们的支持。
441 0
与阿里合作的《人工智能(导论)》出版
|
SQL 人工智能 程序员
AI狂飙,程序员饭碗要丢?
AI 编程工具正大幅提升程序员的效率:生成重复性代码(如 CRUD 接口)、解读报错信息加速 Debug、快速生成文档/注释、自动化测试和脚本编写。它们像效率倍增器,让新手更快上手,让老手省去大量“体力活”。 核心冲击在于:​ 单纯编写基础业务逻辑代码(尤其是模式化任务)的价值被稀释,能被 AI 有效替代。 出路是能力跃升,工作重心转移,掌握关键新技能,构筑护城河 本质:​ AI 如同强大新“实习生”。程序员需成为高效“指挥者”——善用 AI 者解决高阶问题腾飞,仅依赖基础编码能力者面临挤压。未来属于驾驭 AI 的程序员。
581 1
C#学习virtual(虚拟的)和abstract(抽象的)的区别
C#学习virtual(虚拟的)和abstract(抽象的)的区别
581 0

热门文章

最新文章