腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
数据
集中
的
row_number
。
Row_number
apis
正在
生成
数据
帧
。
scala
、
apache-spark
、
dataset
谁能告诉我如何在
数据
集中
获取
row_number
。
Row_number
apis
正在
生成
数据
帧
。我不想将
数据
集转换为
数据
框,然后再转换回仅用于
row_number
计算
的
数据
集。
浏览 17
提问于2018-12-16
得票数 0
回答已采纳
2
回答
SPARK :失败:应为`` ``union'‘,但找到了`(’
sql
、
scala
、
apache-spark
、
dataframe
、
apache-spark-sql
我有一个名为df
的
数据
帧
和一个名为employee_id
的
列。我
正在
做:val query = """SELECT *,
ROW_NUMBER
() OVER (ORDER BY employee_id)
row_number
FROM d_f""" val result = Spark.getSqlContext().sql(quer
浏览 1
提问于2015-08-03
得票数 10
1
回答
在shell脚本或大型查询中创建多个视图
python
、
google-bigquery
、
sh
当我将
数据
从MySQL导出到BigQuery时,某些
数据
被复制。为了解决这个问题,我想到了使用行号创建这个表
的
视图。执行此操作
的
查询如下所示。问题是我
的
数据
集中
有很多表是重复
的
,可能当我添加新表并将它们导出到大型查询时,它们会有重复
的
数据
,我不想每次在我
的
数据
集中
添加新表时都创建这种类型
的
查询(我希望在导出新表时创建这个表
的
视图
浏览 1
提问于2018-04-27
得票数 0
1
回答
使用PySpark将\filter流
数据
简化为具有最常用特性
的
正常
数据
的
最佳实践是什么?
python
、
pyspark
、
filter
、
sampling
、
normal-distribution
我
正在
使用PySpark实时处理流式web服务器记录,我希望将某个时间段(假设1周,即10M条记录)
的
数据
过滤为1M条记录,以达到代表最常用特征
的
正常
数据
的
采样
数据
。我在Python中尝试了以下策略: 查找访问最多
的
Ali ('].v
浏览 6
提问于2022-08-08
得票数 1
回答已采纳
3
回答
dplyr:
row_number
()不使用sql表(SQLite)
sql
、
r
、
sqlite
、
dplyr
、
tidyverse
如果我想创建一个新
的
列,其中包含我可以使用
的
数据
帧
的
观察编号,但是
row_number
()不适用于sql表。(RSQLite::SQLite(), "")mt.sql=tbl(mydb, "mt") mt.sql %>% mutate(i=
row_numb
浏览 4
提问于2017-09-07
得票数 2
3
回答
块查询中
的
全局行号
sql
、
postgresql
、
pagination
、
row-number
、
postgresql-9.4
我希望在我
的
结果
集中
包含一个列
row_number
,其中1是最新
的
条目,没有间隙。这样做是可行
的
:FROM mytable现在,我想查询相同
的
数据
块,每个
数据
块1000,这样在内存上更容易: SELECT id,
row_numb
浏览 4
提问于2016-05-02
得票数 2
回答已采纳
1
回答
如何处理SAS中
的
子集
merge
、
dataset
、
sas
、
analytics
、
subset
我是SAS
的
新手,我非常渴望学习它。我
的
问题是关于子集。我有两个
数据
集;a和b,即分别由两列a和b组成:3 4 6 set a; data b;merge a b; proc print data=merged(firstobs= a[1] obs=a[1] keep= b);在这段代码中,我得到了无效
的
转换类型错误,并且我不知道为什么会得到这个错误,因为当我写下这样
的</e
浏览 1
提问于2015-05-28
得票数 0
2
回答
引用列名和行号更新dataframe
的
元素
python
、
python-3.x
、
pandas
、
dataframe
我来自一个R背景,并且习惯于通过使用如下语法从
数据
帧
中检索值:我可以用下面的语法给
数据
帧
赋值:或者不使用箭头:employ.data$employ
浏览 3
提问于2020-08-24
得票数 3
7
回答
informix中查询
的
行号
database
、
informix
、
row-number
我
正在
使用informix
数据
库,我想要一个查询,您还可以
生成
与查询一起
的
行号select
row_number
(),firstName,lastName 1 john mathew3 sachin tendulkar 这里
的
firstName、lastName来自<
浏览 4
提问于2008-09-23
得票数 5
2
回答
如何在Spark
数据
帧
中获取窗口中
的
最大
row_number
dataframe
、
apache-spark
、
pyspark
、
apache-spark-sql
我有一个
数据
帧
,如下所示,我使用下面提到
的
代码获取它 +---+----------+--------+----------+ df.withColumn("
row_number
",
row_numbe
浏览 39
提问于2021-06-25
得票数 0
回答已采纳
2
回答
SQL表
的
行号列?
sql
、
sql-server
、
row
我
正在
用SQL编写程序,但每次我用MSSMS执行程序时,在最左边有一列包含行号。我想在同一个程序中使用
的
while语句中调用此列中
的
行号,但我不确定如何在代码中引用它。这个列
的
名称是什么,这样我就可以调用它并获得行号?
浏览 23
提问于2019-02-18
得票数 1
回答已采纳
1
回答
KQL/Kusto -如何
生成
类似于SQL
的
row_number
azure-data-explorer
、
kql
这里是以kusto为单位
的
数据
集,我
正在
尝试根据release值
生成
"releaseRank“列。输入
数据
集:["22.04", 40,"22.01", 560T期望产出: 发现存在序列化和
row_number</em
浏览 4
提问于2022-06-13
得票数 1
回答已采纳
4
回答
将一行插入R中
的
data.frame中
r
、
dataframe
、
rbind
In `[<-.factor`(`*tmp*`, ri, value = "All") :当我尝试插入一个包含值"All"
的
新行时
浏览 0
提问于2018-07-31
得票数 0
回答已采纳
2
回答
如何在匹配条件
的
第一行之后获得N行?
postgresql
、
pagination
我
正在
实现一个基于游标的分页。 idORDER BY description ASC假设这个查询返回ID 4, 5, 2, 1, 3,那么下一个查询必须在id 3之后从相同
的
查询中
生成
我唯一能想到
的
解决这个问题
的
方法是:
浏览 0
提问于2019-03-03
得票数 1
回答已采纳
2
回答
在laravel中同步多个in
php
、
laravel
、
eloquent
、
orm
、
laravel-8
我
正在
做一个牙科功能,我想同步many-to-many关系中
的
数据
。tooth_id获得
的
数据
,我有这样一个数组 0 => [ 2 => ["
row_number
" => 1] 4 => ["<e
浏览 16
提问于2022-11-09
得票数 -1
回答已采纳
1
回答
查找并合并组中
的
最后一行
r
、
dplyr
我可以使用dplyr找到
数据
集中
的
最后一行,并将该行
的
特定值合并回整个
数据
集。,
row_number
()==n())$A) 如何找到每个组
的
最后一行并将其合并回对应组。,
row_number
()==n())$A)
浏览 1
提问于2018-02-14
得票数 0
1
回答
如何使用spark从大
数据
集中
选择n行
apache-spark
、
apache-spark-sql
我需要从拥有数百万行
的
非常大
的
数据
集中
选择n行。假设1500万行中有400万行。目前,我
正在
将
row_number
添加到每个分区中
的
记录中,并从每个分区中选择所需
的
记录百分比。例如,400万人占1500万人
的
26.66 %。但是,当我试图从每个分区中选择26 %时,由于缺少0.6 %,总数
正在
下降。如下所示,当
row_number
小于百分比时,将选择行。有更好
的
方法吗?
浏览 1
提问于2019-11-16
得票数 1
2
回答
如何获取dplyr中包含某些x/y值组合
的
所有行号
r
、
dplyr
假设一个绘图选择函数给了我一个x和y坐标(值)
的
数据
框,我们可以用以下命令人工
生成
它:rownamesnewData) <- c('x', 'y') 1 21.0 63 18.7 85 19.2 6如何找出原始mtcars中
的
哪些行我知道我可以加入他们两
浏览 35
提问于2019-06-06
得票数 2
回答已采纳
2
回答
使用MYSQL从子查询SELECT中每隔n行选择一次
php
、
mysql
、
database
我有一个超过300,000行
的
表,我想在图上呈现这个
数据
,但是300,000行并不是一次就必须
的
。例如,即使给定一天可能有100行
数据
,如果我要显示一整年
的
数据
,我也不需要显示所有
数据
。因此,我希望对
数据
进行“粒度”处理。这就是我到目前为止所掌握
的
。SET @
row_number<
浏览 0
提问于2018-04-21
得票数 1
6
回答
选择在Server中连接行号
的
列
sql
、
sql-server
、
tsql
我
正在
使用Server 2014,并希望在表中选择行号连接到结果
集中
的
列值
的
列。DemoFieldAppleCatDemoFieldRow1 AppleRow3 Cat 我在使用
ROW_NUMBER
()
的
地方遇到了一些类似的问题,但我发现它被选择为一个单独
的
列,而不是连接到
正在
返回
的
现有列。当我试图将
ROW_NUMBER</em
浏览 7
提问于2017-09-06
得票数 2
回答已采纳
点击加载更多
相关
资讯
MySQL 8与MariaDB:两者窗口函数和CTE的比较
SQL:数据与运算的融合体
Hive数据分析实战演练
大数据有道之spark筛选去重
大数据有道之spark选择去重
热门
标签
更多标签
云服务器
ICP备案
对象存储
实时音视频
云点播
活动推荐
运营活动
广告
关闭
领券