大数据面试SQL题-笔记02【查询、连接、聚合函数】

  1. 大数据面试SQL题复习思路一网打尽!(文档见评论区)_哔哩哔哩_bilibili
  2. Hive SQL 大厂必考常用窗口函数及相关面试题

  1. 大数据面试SQL题-笔记01【运算符、条件查询、语法顺序、表连接】
  2. 大数据面试SQL题-笔记02【查询、连接、聚合函数】​​​​​​​

目录

01、查询

01-1757. 可回收且低脂的产品

02-0584. 寻找用户推荐人

03-0595. 大的国家

04-1148. 文章浏览 I

05-1683. 无效的推文

02、连接

06-1378. 使用唯一标识码替换员工ID

07-1068. 产品销售分析 I

08-1581. 进店却未进行过交易的顾客

09-0197. 上升的温度

10-1661. 每台机器的进程平均运行时间

11-0577. 员工奖金

12-1280. 学生们参加各科测试的次数

13-0570. 至少有5名直接下属的经理

14-1934. 确认率

03、聚合函数

15-0620. 有趣的电影

16-1251. 平均售价

17-1075. 项目员工 I


01、查询

01-1757. 可回收且低脂的产品

# Write your MySQL query statement below
select product_id from Products where low_fats = 'Y' and recyclable = 'Y';

02-0584. 寻找用户推荐人

!= 与 <> 都是 不等于。

# Write your MySQL query statement below
select name from Customer where referee_id is null or referee_id != 2;
select name from Customer where referee_id is null or referee_id <> 2;

03-0595. 大的国家

# Write your MySQL query statement below
select name, population, area from World where area >=3000000 or population >= 25000000;

04-1148. 文章浏览 I

# Write your MySQL query statement below
select distinct author_id as id from Views where author_id = viewer_id order by author_id;

05-1683. 无效的推文

在MySQL中,你可以使用LENGTH()函数来获取字符串的长度。

SELECT LENGTH('Hello, world!') AS string_length;

# Write your MySQL query statement below
select tweet_id from Tweets where length(content) > 15;

02、连接

06-1378. 使用唯一标识码替换员工ID

LEFT JOIN ... ON ...

# Write your MySQL query statement below
# select EmployeeUNI.unique_id, Employees.name from Employees join EmployeeUNI where Employees.id = EmployeeUNI.id;
SELECT EmployeeUNI.unique_id, Employees.name
FROM Employees
LEFT JOIN EmployeeUNI 
ON Employees.id = EmployeeUNI.id;

07-1068. 产品销售分析 I

在 SQL 中,INNER JOINJOIN 是相同的,它们都用于连接两个或多个表,只返回满足连接条件的行。在实践中,它们通常可以互换使用,因为大多数 SQL 数据库都将它们视为等效的。INNER JOINJOIN 的默认形式,因此在大多数情况下,简单地写 JOIN 就足够了。

# Write your MySQL query statement below
select Product.product_name, Sales.year, Sales.price from Sales join Product on Sales.product_id = Product.product_id;/* Write your T-SQL query statement below */
--写法一:
select p.product_name, s.year, s.price 
from Sales s
inner join Product p on s.product_id = p.product_id --写法二:
select p.product_name, s.year, s.price 
from Sales s
join Product p 
using (product_id)

08-1581. 进店却未进行过交易的顾客

GROUP BY 语句将会按照 customer_id 列进行分组,然后 COUNT(*) 函数会计算每个分组中的行数,即每个客户ID的访问次数。

# Write your MySQL query statement below
select Visits.customer_id, count(Visits.customer_id) as count_no_trans
from Visits left join Transactions on Visits.visit_id = Transactions.visit_id
where Transactions.transaction_id is null -- where Transactions.amount is null
group by(Visits.customer_id)
-- order by count_no_trans desc

09-0197. 上升的温度

DATEDIFF() 是 MySQL 中用来计算两个日期之间的差异的函数。基本语法如下:

DATEDIFF(date1, date2)

  • date1date2 是你想要计算差异的两个日期。
  • 结果是 date1date2 之间的天数差。

例如:

SELECT DATEDIFF('2024-04-15', '2024-04-10');

这个查询将返回 5,因为 2024 年 4 月 10 日和 2024 年 4 月 15 日之间有 5 天。

你也可以在表中使用列:

SELECT DATEDIFF(end_date, start_date) AS days_difference FROM orders;

这将计算 orders 表中每一行的 end_datestart_date 列之间的天数差,并将结果别名为 days_difference

# Write your MySQL query statement below
select a.id from Weather as a, Weather as b where datediff(a.recordDate, b.recordDate) = 1 and a.Temperature >b.Temperature;select a.id from Weather as a inner join Weather as b where datediff(a.recordDate, b.recordDate) = 1 and a.Temperature >b.Temperature;

10-1661. 每台机器的进程平均运行时间

# Write your MySQL query statement belowselect a1.machine_id, round(avg(a2.timestamp -a1.timestamp ), 3) as processing_time from Activity as a1 join Activity as a2 on a1.machine_id = a2.machine_id and a1.process_id = a2.process_id and a1.activity_type = 'start' and a2.activity_type = 'end' group by machine_id;

CAST() 是 MySQL 中用于将一个表达式转换为指定数据类型的函数。它的基本语法如下:

CAST(expression AS data_type)

  • expression 是你要转换的表达式或值。
  • data_type 是你希望将表达式转换为的目标数据类型。

例如,如果你有一个字符串类型的列,并且想将它转换为整数类型,你可以使用 CAST() 函数:

SELECT CAST('123' AS SIGNED);

这将返回整数 123

或者,你可以将一个整数转换为字符串类型:

SELECT CAST(456 AS CHAR);

这将返回字符串 '456'

CAST() 函数可以用于多种数据类型之间的转换,包括整数、浮点数、日期等。

DECIMAL(10, 3) 是 MySQL 中用于定义精确数字数据类型的方式之一。在这个数据类型中,数字被存储为十进制数,并且允许指定总共有多少位数(包括小数点前后的数字)以及小数点后有多少位数。

具体来说,DECIMAL(10, 3) 定义了一个包含 10 位数字的数字,其中 3 位是小数位。这意味着这个数字可以存储从 -9999999.999 到 9999999.999 之间的数值,其中整数部分最多可以有 7 位数字,小数部分最多可以有 3 位数字。

例如,12345.678 是一个符合 DECIMAL(10, 3) 定义的数字,而 123456789.0123 则不符合,因为它的整数部分有 10 位数字,超出了限制。

-- 分为两层计算,第一层先按照machine_id和process_id分组,再计算组内最大值和最小值的差,就等同于end-start.
-- 第二层再按照machine_id分组,求平均.
select t2.machine_id, cast(avg(t2.tieminterval) as decimal(10, 3)) as processing_time 
from(selectmachine_id, process_id, (max(Timestamp) - min(Timestamp)) as tiemintervalfromActivitygroup bymachine_id,process_id) as t2
group byt2.machine_id;

11-0577. 员工奖金

在 MySQL 中,可以使用以下几种表连接方式:

  1. INNER JOIN:

    • INNER JOIN 返回两个表中共有的匹配行。
  2. LEFT JOIN (或 LEFT OUTER JOIN):

    • LEFT JOIN 返回左表中的所有行,以及右表中与左表中的行匹配的行。
  3. RIGHT JOIN (或 RIGHT OUTER JOIN):

    • RIGHT JOIN 返回右表中的所有行,以及左表中与右表中的行匹配的行。
  4. FULL JOIN (或 FULL OUTER JOIN):

    • FULL JOIN 返回左右两个表中的所有行,并且对于不匹配的行,会在结果集中填充 NULL 值。
  5. CROSS JOIN(JOIN):

    • CROSS JOIN 返回两个表的笛卡尔积,即左表中的每一行与右表中的每一行的组合。
  6. SELF JOIN:

    • SELF JOIN 是指对同一表进行连接操作,即连接表中的行与表中其他行进行比较。

以上是 MySQL 中常见的表连接方式,可以根据需要选择合适的连接方式来检索数据。

# Write your MySQL query statement below
select Employee.name, Bonus.bonus from Employee left join Bonus on Employee.empId = Bonus.empId 
where Bonus.bonus < 1000 or Bonus.bonus is null;

12-1280. 学生们参加各科测试的次数

解题思路:

  1. Student表和Subjects表进行笛卡尔积连接(Student JOIN Subjects)
  2. 在第一点的基础上拼接Examinations中的每个学生参加每门科目的数量。
  3. 根据案例可以看出,学生名单必须完整,在Examinations表中不存在则为0。所以使用左连接LEFT JOIN进行连接(Student JOIN Subjects LEFT JOIN Examinations)
  4. 注意排序不是按Examinations表进行排序的,因为存在NULL,下图就是第四个字段就是Examinations的student_id。

# Write your MySQL query statement below
SELECTs.student_id,s.student_name,su.subject_name,COUNT(e.subject_name) AS attended_exams
FROMStudents AS s
JOINSubjects AS su
LEFT JOINExaminations AS e
ONe.student_id = s.student_id
ANDe.subject_name = su.subject_name
GROUP BYs.student_id,su.subject_name
ORDER BYs.student_id,su.subject_name;

13-0570. 至少有5名直接下属的经理

在 MySQL 中,HAVING 子句通常与 GROUP BY 子句一起使用,用于对分组后的结果进行筛选。HAVING 子句允许你基于聚合函数的结果来过滤结果集。

例如,假设你有一个名为 sales 的表,其中包含销售数据,你想要找出每个销售人员的总销售额,并且只显示销售额大于 1000 的销售人员。你可以这样查询:

SELECT salesperson, SUM(amount) AS total_sales FROM sales GROUP BY salesperson HAVING total_sales > 1000;

在这个查询中,SUM(amount) 是一个聚合函数,它计算每个销售人员的总销售额。然后,HAVING total_sales > 1000 筛选出总销售额大于 1000 的销售人员。

总的来说,HAVING 子句与 WHERE 子句类似,但是 HAVING 用于过滤分组后的结果,而 WHERE 用于过滤未分组的原始数据。

# Write your MySQL query statement below
select Name
from (select Manager.Name as Name, count(Report.Id) as cntfrom Employee as Manager join Employee as Reporton Manager.Id = Report.ManagerIdgroup by Manager.Id
) as ReportCount
where cnt >= 5;select Manager.Name as Name
from Employee as Manager join Employee as Report
on Manager.Id = Report.ManagerId
group by Manager.Id
having count(Report.Id) >= 5;select Employee.Name as Name
from (select ManagerId as Idfrom Employeegroup by ManagerIdhaving count(Id) >= 5
) as Manager join Employee
on Manager.Id = Employee.Id;

14-1934. 确认率

if、ifnull

# Write your MySQL query statement below
select s.user_id, round(count(if(c.action='confirmed', 1, null))/count(*), 2) as confirmation_rate
from Signups s left join Confirmations c
on s.user_id = c.user_id
group by s.user_id;SELECTs.user_id,ROUND(IFNULL(AVG(c.action='confirmed'), 0), 2) AS confirmation_rate
FROMSignups AS s
LEFT JOINConfirmations AS c
ONs.user_id = c.user_id
GROUP BYs.user_id;

03、聚合函数

15-0620. 有趣的电影

mod(id,2)=1 来确定奇数 id

MySQL 中判断奇数的 6 种方法:

  1. mod(x, 2) = 1 ,如果余数是 1 就是奇数。
  2. power(-1, x) = -1 , 如果结果是 -1 就是奇数
  3. x % 2 = 1 ,如果余数是 1 就是奇数。
  4. x & 1 = 1 ,如果是 1 就是奇数
  5. x regexp '[1, 3, 5, 7, 9]$' = 1 如果为 1 就是奇数
  6. x>>1<<1 != x 如果右移一位在左移一位不等于原值,就是奇数。
# Write your MySQL query statement below
select * from cinema where description != "boring" and id%2 != 0 order by rating desc;

16-1251. 平均售价

在 MySQL 中,ROUND() 函数用于将数字值四舍五入到指定的小数位数。它的语法如下:ROUND(number, decimals)

  • number 是要四舍五入的数字。
  • decimals 是保留的小数位数,可以是负数来指定要四舍五入的位置。
# Write your MySQL query statement below
SELECTproduct_id,IFNULL(Round(SUM(sales) / SUM(units), 2), 0) AS average_price
FROM (SELECTPrices.product_id AS product_id,Prices.price * UnitsSold.units AS sales,UnitsSold.units AS unitsFROM Prices LEFT JOIN UnitsSold ON Prices.product_id = UnitsSold.product_idAND (UnitsSold.purchase_date BETWEEN Prices.start_date AND Prices.end_date)
) T
GROUP BY product_id;

17-1075. 项目员工 I

MySQL是一种流行的关系型数据库管理系统,它提供了许多函数来执行各种操作。以下是你提到的几个函数的用法:

  1. ROUND():

    • 用途:ROUND函数用于将数值四舍五入到指定的小数位数。
    • 语法:ROUND(number, decimals)
      • number: 要四舍五入的数值。
      • decimals: 指定的小数位数。
    • 示例:

      SELECT ROUND(123.456, 2); -- 返回 123.46 SELECT ROUND(123.456); -- 返回 123

  2. AVG():

    • 用途:AVG函数用于计算某列的平均值。
    • 语法:AVG(expression)
      • expression: 要计算平均值的列或表达式。
    • 示例:

      SELECT AVG(column_name) FROM table_name; -- 计算列的平均值 SELECT AVG(5 + 5) FROM table_name; -- 计算表达式的平均值

  3. SUM():

    • 用途:SUM函数用于计算某列中所有值的总和。
    • 语法:SUM(expression)
      • expression: 要计算总和的列或表达式。
    • 示例:

      SELECT SUM(column_name) FROM table_name; -- 计算列值的总和 SELECT SUM(5 + 5) FROM table_name; -- 计算表达式值的总和

# Write your MySQL query statement below
SELECTproject_id,ROUND(AVG(e.experience_years), 2) AS average_years
FROMProject as p 
LEFT JOINEmployee as e
ONp.employee_id = e.employee_id
GROUP BYp.project_id;

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.mzph.cn/diannao/62062.shtml

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

Unity类银河战士恶魔城学习总结(P145 Save Skill Tree 保存技能树)

【Unity教程】从0编程制作类银河恶魔城游戏_哔哩哔哩_bilibili 教程源地址&#xff1a;https://www.udemy.com/course/2d-rpg-alexdev/ 本章节实现了技能树的保存 警告&#xff01;&#xff01;&#xff01; 如果有LoadData&#xff08;&#xff09;和SaveData(&#xff09;…

redmi 12c 刷机

刷机历程 一个多月前网购了redmi 12c这款手机, 价格只有550,用来搞机再适合不过了, 拆快递后就开始倒腾,网上有人说需要等7天才能解锁,我绑定了账号过了几天又忍不住倒腾,最后发现这块手机不用等7天解锁成功了,开始我为了获取root权限, 刷入了很火的magisk,但是某一天仍然发现/…

YOLO系列论文综述(从YOLOv1到YOLOv11)【第1篇:概述物体检测算法发展史、YOLO应用领域、评价指标和NMS】

目录 1 前言2 YOLO在不同领域的应用3 物体检测指标和NMS3.1 mAP和IOU3.2 mAP计算流程3.2.1 VOC 数据集3.2.2 微软 COCO 数据集 3.3 NMS 1 前言 最近在做目标检测模型相关的优化&#xff0c;重新看了一些新的论文&#xff0c;发现了几篇写得比较好的YOLO系列论文综述&#xff0…

【通俗理解】步长和学习率在神经网络中是一回事吗?

【通俗理解】步长和学习率在神经网络中是一回事吗&#xff1f; 【核心结论】 步长&#xff08;Step Size&#xff09;和学习率&#xff08;Learning Rate, LR&#xff09;在神经网络中并不是同一个概念&#xff0c;但它们都关乎模型训练过程中的参数更新。 【通俗解释&#x…

STL之算法概览

目录 算法概览 算法分析与复杂度标识O() STL算法总览 质变算法mutating algorithms----会改变操作对象之值 非质变算法nonmutating algorithms----不改变操作对象之值 STL算法的一般形式 算法的泛化过程 算法概览 算法&#xff0c;问题之解法也。 以有限的步骤&#xff0…

华为IPD流程管理体系L1至L5最佳实践-解读

该文档主要介绍了华为IPD流程管理体系&#xff0c;包括流程体系架构、流程框架实施方法、各业务流程框架示例以及相关案例等内容&#xff0c;旨在帮助企业建立高效、规范的流程管理体系&#xff0c;实现业务的持续优化和发展。具体内容如下&#xff1a; 1. 华为流程体系概述 -…

【青牛科技】 D2822M 双通道音频功率放大电路芯片介绍,用于便携式录音机和收音机作音频功率放大器

概述&#xff1a; D2822M 用于便携式录音机和收音机作音频功率放大器。D2822M 采用 DIP8 和 SOP8 封装形式。 特点&#xff1a;  电源电压降到 1.8V 时仍能正常工作  交越失真小  静态电流小  可作桥式或立体声式功放应用  外围元件少  通道分离度高  开机和关机…

【Python中while循环】

一、深拷贝、浅拷贝 1、需求 1&#xff09;拷贝原列表产生一个新列表 2&#xff09;想让两个列表完全独立开&#xff08;针对改操作&#xff0c;读的操作不改变&#xff09; 要满足上述的条件&#xff0c;只能使用深拷贝 2、如何拷贝列表 1&#xff09;直接赋值 # 定义一个…

抖音短视频矩阵源代码部署搭建流程

抖音短视频矩阵源代码部署搭建流程 1. 硬件准备 需确保具备一台性能足够的服务器或云主机。这些硬件设施应当拥有充足的计算和存储能力&#xff0c;以便支持抖音短视频矩阵系统的稳定运行。 2. 操作系统安装 在选定的服务器或云主机上安装适合的操作系统是关键步骤之一。推…

kmeans 最佳聚类个数 | 轮廓系数(越大越好)

轮廓系数越大&#xff0c;表示簇内实例之间紧凑&#xff0c;簇间距离大&#xff0c;这正是聚类的标准概念。 簇内的样本应该尽可能相似。不同簇之间应该尽可能不相似。 目的&#xff1a;鸢尾花数据进行kmeans聚类&#xff0c;最佳聚类个数是多少&#xff1f; plot(iris[,1:4…

day04 企业级Linux安装及远程连接知识实践

1. 使用传统的网卡命名方式 在启动虚拟机时&#xff0c;按tab键进入编辑模式 添加命令&#xff1a; net.ifnames0 biosdevname0 这样linux系统会使用传统的网卡命名&#xff0c;例如eth0、eth1…… 2. 快照 做系统关键操作时&#xff0c;一定要使用快照(先将系统关机) 3.…

STM32C011开发(2)----nBOOT_SEL设置

STM32C011开发----2.nBOOT_SEL设置 概述硬件准备视频教学样品申请源码下载参考程序自举模式BOOT0设置配置 nBOOT_SEL生成STM32CUBEMX串口配置LED配置堆栈设置串口重定向主循环演示 概述 STM32CubeProgrammer (STM32CubeProg) 是一款用于编程STM32产品的全功能多操作系统软件工…

onvif协议相关:3.1.5 Digest方式获取预置位

背景 关于onvif的其实很早之前我已经在专栏中写了不少了, 使用onvif协议操作设备 但最近有陆陆续续的粉丝问我, 希望我在写一些关于 onvif的设备自动发现、预置位跳转、云台操作的博客。 满足粉丝的需求,安排。 今天我们来实现 获取预置位 准备工作 我们这里的话选择Diges…

docker 通过Dockerfile自定义的镜像部署Springboot项目

一、镜像结构介绍&#xff1a; 镜像&#xff1a;层&#xff08;Layer&#xff09;添加安装包、依赖、配置等&#xff0c;每一次操作都形成新的一层&#xff1b;基础镜像&#xff08;BaseImage&#xff09;应用依赖的系统函数库、环境、配置、文件等&#xff1b;入口&#xff0…

【Canvas与图标】GUI图标

【成图】 120*120的png图标 各种大小图&#xff1a; 【代码】 <!DOCTYPE html> <html lang"utf-8"> <meta http-equiv"Content-Type" content"text/html; charsetutf-8"/> <head><title>GUI图标 Draft1</titl…

CCF GESP C++ 一级上机题(十六道题及其思路详解合集)

#include <iostream> using namespace std;int main() {// 定义起始年份、结束年份、循环变量以及用于累加的变量&#xff0c;并初始化累加变量为0int start, end, i, sum 0;// 从标准输入读取起始年份和结束年份cin >> start >> end;// 循环遍历从起始年份…

Opencv+ROS实现颜色识别应用

目录 一、工具 二、原理 概念 本质 三、实践 添加发布话题 主要代码 四、成果 五、总结 一、工具 opencvros ubuntu18.04 摄像头 二、原理 概念 彩色图像&#xff1a;RGB&#xff08;红&#xff0c;绿&#xff0c;蓝&#xff09; HSV图像&#xff1a;H&#xff0…

scala模式匹配

object test47 {def main(args: Array[String]): Unit {val id"445646546548858548648"//取出id前两位val provinceid.substring(0,2) // println(province) // if (province"42"){ // println("湖北") // }else if(province&quo…

AI加持,华为全屋智能品牌升级为“鸿蒙智家”

1.传统智能家居的困境&#xff1a;从便利到繁琐 近年来&#xff0c;智能家居因其便捷性和科技感受到消费者的青睐。然而&#xff0c;随着用户需求的多样化&#xff0c;传统智能家居的弊端逐渐显现&#xff1a; 设备连接复杂&#xff0c;品牌间兼容性不足&#xff0c;用户不得不…

string类部分(C++)

目录 1. string类 1.1 auto和范围for auto关键词&#xff1a; 范围for&#xff1a; 1.2 string类的常用接口说明 a&#xff09;string类对象的常见构造 b&#xff09; string类对象的容量操作 size与length&#xff1a; capacity: empty: clear: reserve: 1.reserve&am…