当前位置: 开发笔记 > 编程语言 > 正文

Rpurrr（二）

作者：mobiledu2502927267 | 来源：互联网 | 2023-09-17 19:31

在接下来，我们将学习和使用purrr包，它提供的很多函数可以替代很多常见的for循环的应用。R基础包的应用函数组（apply，lapply，tapply等）也可以完成类似的任务，但

在接下来，我们将学习和使用purrr包，它提供的很多函数可以替代很多常见的for循环的应用。R基础包的应用函数组（apply， lapply， tapply等）也可以完成类似的任务，但是purrr包的函数更一致，也更利于学习。

使用purrr函数代替for循环的目的是将常见的列表的处理问题分解为独立的几个部分

1 对于列表中的单个元素，你能找到解决问题的方法吗？如果找到了解决方法，那么你就可以使用purrr将这种方法拓展到列表中的所有元素
2 如果你面临着非常复杂的问题，那么如何将它们几个可行的子问题，然后循序渐进的解决，直至完成最终的解决方案？使用purrr，你可以解决很多子问题，然后通过管道操作将这些问题的结果组合起来。

映射函数

我们在R里面的进行的for循环，通常是先对向量进行循环，然后对其每个元素进行一番处理，最后保存结果。，这种模式太普遍，purrr包提供了一系列的函数来完成这种操作。每种类型的输出都有一个相应的函数。

map（）输出列表 list
map_lgl（）输出逻辑型向量 vector
map_int() 输出整型向量 vector
map_dbl() 输出双精度型向量 vector
map_chr() 输出字符型向量 vector
每个函数都使用一个向量作为输入，并对向量的每个元素应用一个函数，然后返回和输入向量相同的长度的一个新向量。向量的类型由映射函数的后缀决定。

一旦掌握了这些函数，你就会发现可以在解决迭代问题时节省大量时间。但你无须因为使用了for循环，没有使用映射函数而感到内疚。映射函数是一个高度抽象，需要花费很长时间才能理解其工作原理。重要的事情的是解决遇到的问题，而不是写出最优雅的代码（尽管肯定也要为之努力）
可能有些人会说，不要使用for循环，因为它们很慢，这些人完全错了！（因为for循环已经很多年都不慢了）。使用map（）函数的主要优势不是速度，而是简洁：它们可以让你的代码更易编写，也更易读。

因此，我们可以改写for循环的操作。因为那些函数返回的为双精度数，所以我们需要使用map_dbl()函数.

map_dbl(df, mean)
map_dbl(df, median)
map_dbl(df, sd)
映射函数的重点是需要map匹配的函数，该函数也就是我们需要进行的操作。

如果使用管道工具，这一点就更加明显

df %>% map_dbl(mean)
df %>% map_dbl(median)
df %>% map_dbl(sd)
map_*系列函数与for循环函数具有以下区别：
所有的purrr函数均是用C实现的，这使得他们的速度非常快。
第二个参数（.f ,是要应用的函数），可以是一个公式、一个字符向量或一个整型向量
map_*() 使用&＃8230;向.f传递一些附加参数，供其每次调用时使用。

插播体会group_by函数和split函数区别
split函数返回的对象为各个分类对象组成的list对象,而purrr通常要求输入对象为list。因此，split分组函数常和purrr函数搭配

切分变量函数中，必须加上`mtcars$`或者用`.$`，否则会报错

mtcars%>% split(mtcars$cyl) # 切分变量函数中，必须加上mtcars，否则会报错

《R purrr（二）》 image.png

如下：该结果必须要由list来接受output

mtcars%>% split(.$cyl) %>% map(function(df) lm(mpg~wt, data=df))

《R purrr（二）》 image.png

因为R中创建匿名函数的语法比较繁琐，所以purrr提供了一种更加方便的快捷方式——单侧公式：

mtcars%>% split(.$cyl) %>% map(~lm(mpg~wt, data=.))

我们在上面使用了.作为一个代词：它表示当前的列表元素（与for循环中用i表示当前索引是一样的）

当检查多个模型时，有时你会需要提取出像R方这样的摘要统计量。要想完成这个任务，需要先运行summary()函数，然后提取结果中r.squared. 我们可以使用匿名函数的快捷方式来完成这个操作.

models=mtcars%>% split(.$cyl) %>% purrr::map(~lm(wt~mpg,data=.)) models%>% purrr::map(summary)%>% purrr::map_dbl(~.$r.squared)

因为提取命名成分的这种操作十分常见，所以purrr提供了一种更为简洁的快捷方式：使用字符串

models%>% purrr::map(summary)%>% purrr::map_dbl("r.squared")

当输入对象为data.frame时，每一列为一个变量，相当于`for`循环中的i

例如：计算iris中每列唯一值的数量

iris%>% map(function(df) length(unique(df))) iris%>% map_df(~length(unique(.)))

To generate 10 random normals for each of μ=−10, 0, 10, and 100: The result is a list of numeric vectors.
使用单侧函数，前面一定要加~,每次输入的数据集用.

map(c(-10,0,10,100),~rnorm(n=10,mean = .)) map(c(-10,0,10,100),function(x) rnorm(n=10,mean = x))

判断类型 map_lgl

判断每一列是否为因子型变量

map_lgl(iris ,is.factor) iris%>%map_lgl(is.factor)

《R purrr（二）》 image.png

映射函数可以处理任何向量，而不仅仅是列表。与列表一样，映射函数将对向量的每个元素应用该函数。通常选择输入对象为list
The expression map(1:5, runif) is equivalent to running runif(1), runif(2), …, runif(5), and collecting the results in a list. The result is a length five list with numeric vectors of sizes one through five。

What does map(-2:2, rnorm, n = 5) do? Why?
What does map_dbl(-2:2, rnorm, n = 5) do? Why?

《R purrr（二）》 image.png

这是因为map_dbl希望应用于每个元素的函数返回长度为1的数字向量。而我们这个函数输入为一个元素的时候返回的为5个元素，必须要用list来接受，用其他的必须保证输出的为长度为一的对象。所以，下面的就可以了

《R purrr（二）》 image.png

如果我们想要一个数值向量，可以使用map()，然后使用flatten_dbl()

flatten_dbl(map(-2:2, rnorm, n = 5))

推荐阅读

io
Java并发编程：LinkedBlockingQueue的实际应用

本文介绍了Java并发库中的阻塞队列（BlockingQueue）及其典型应用场景。通过具体实例，展示了如何利用LinkedBlockingQueue实现线程间高效、安全的数据传递，并结合线程池和原子类优化性能。 ... [详细]

蜡笔小新 2024-12-27 18:51:49
io
Python 实现字符串双拆分并转换为矩阵

本文介绍如何使用 Python 将一个字符串按照指定的行和元素分隔符进行两次拆分，最终将字符串转换为矩阵形式。通过两种不同的方法实现这一功能：一种是使用循环与 split() 方法，另一种是利用列表推导式。 ... [详细]

蜡笔小新 2024-12-28 12:15:45
io
深入理解KMP算法中的next数组：北大OJ 2406题解

本文详细探讨了KMP算法中next数组的构建及其应用，重点分析了未改良和改良后的next数组在字符串匹配中的作用。通过具体实例和代码实现，帮助读者更好地理解KMP算法的核心原理。 ... [详细]

蜡笔小新 2024-12-28 11:30:01
post
深入解析Android自定义View面试题

本文探讨了Android Launcher开发中自定义View的重要性，并通过一道经典的面试题，帮助开发者更好地理解自定义View的实现细节。文章不仅涵盖了基础知识，还提供了实际操作建议。 ... [详细]

蜡笔小新 2024-12-28 11:15:04
php
优化ListView性能

本文深入探讨了如何通过多种技术手段优化ListView的性能，包括视图复用、ViewHolder模式、分批加载数据、图片优化及内存管理等。这些方法能够显著提升应用的响应速度和用户体验。 ... [详细]

蜡笔小新 2024-12-28 10:36:30
php
Python - 检查列表中是否存在交替峰值

本文介绍如何使用 Python 编写程序，检查给定列表中的元素是否形成交替峰值模式。我们将探讨两种不同的方法来实现这一目标，并提供详细的代码示例。 ... [详细]

蜡笔小新 2024-12-27 15:40:11
replace
Java面试题解析

本文详细介绍了Java编程语言中的核心概念和常见面试问题，包括集合类、数据结构、线程处理、Java虚拟机（JVM）、HTTP协议以及Git操作等方面的内容。通过深入分析每个主题，帮助读者更好地理解Java的关键特性和最佳实践。 ... [详细]

蜡笔小新 2024-12-27 13:55:14
replace
C语言实现小写金额转换为大写金额

在金融和会计领域，准确无误地填写票据和结算凭证至关重要。这些文件不仅是支付结算和现金收付的重要依据，还直接关系到交易的安全性和准确性。本文介绍了一种使用C语言实现小写金额转换为大写金额的方法，确保数据的标准化和规范化。 ... [详细]

蜡笔小新 2024-12-27 12:39:06
php
新浪笔试题

1:有如下一段程序：packagea.b.c;publicclassTest{privatestaticinti0;publicintgetNext(){return ... [详细]

蜡笔小新 2024-12-27 19:32:17
php
深入理解设计模式与七大原则

本文详细探讨了Java中的24种设计模式及其应用，并介绍了七大面向对象设计原则。通过创建型、结构型和行为型模式的分类，帮助开发者更好地理解和应用这些模式，提升代码质量和可维护性。 ... [详细]

蜡笔小新 2024-12-27 19:10:10
php
USACO 2014 Jan - Moolympics区间记录优化算法

题目描述：给定n个半开区间[a, b)，要求使用两个互不重叠的记录器，求最多可以记录多少个区间。解决方案采用贪心算法，通过排序和遍历实现最优解。 ... [详细]

蜡笔小新 2024-12-27 18:14:31
email
MyBatis 动态 SQL 详解与应用

本文深入探讨 MyBatis 中动态 SQL 的使用方法，包括 if/where、trim 自定义字符串截取规则、choose 分支选择、封装查询和修改条件的 where/set 标签、批量处理的 foreach 标签以及内置参数和 bind 的用法。 ... [详细]

蜡笔小新 2024-12-27 16:20:10
tree
深入解析ExpandableComposite.addExpansionListener()方法及其应用

本文详细介绍了Java中org.eclipse.ui.forms.widgets.ExpandableComposite类的addExpansionListener()方法，并提供了多个实际代码示例，帮助开发者更好地理解和使用该方法。这些示例来源于多个知名开源项目，具有很高的参考价值。 ... [详细]

蜡笔小新 2024-12-27 16:11:49
tree
深入解析Spring Cloud Ribbon负载均衡机制

本文详细介绍了Spring Cloud中的Ribbon组件如何实现服务调用的负载均衡。通过分析其工作原理、源码结构及配置方式，帮助读者理解Ribbon在分布式系统中的重要作用。 ... [详细]

蜡笔小新 2024-12-27 16:01:25
tree
LeetCode 991：故障计算器的最优解法

探讨一个显示数字的故障计算器，它支持两种操作：将当前数字乘以2或减去1。本文将详细介绍如何用最少的操作次数将初始值X转换为目标值Y。 ... [详细]

蜡笔小新 2024-12-27 14:34:44

mobiledu2502927267

这个家伙很懒，什么也没留下！

Tags | 热门标签

RankList | 热门文章

Rpurrr（二）

映射函数

切分变量函数中， 必须加上mtcars$或者用.$，否则会报错

因为R中创建匿名函数的语法比较繁琐，所以purrr提供了一种更加方便的快捷方式——单侧公式：

当输入对象为data.frame时，每一列为一个变量，相当于for循环中的i

判断类型 map_lgl

切分变量函数中，必须加上`mtcars$`或者用`.$`，否则会报错

当输入对象为data.frame时，每一列为一个变量，相当于`for`循环中的i