Python Context.count示例

编程语言: Python

命名空间/包名称: fast_pyspark_tester

类/类型: Context

方法/功能: count

hotexamples.com的示例: 3

Python Context.count - 已找到3个示例。这些是从开源项目中提取的最受好评的fast_pyspark_tester.Context.count现实Python示例。您可以评价示例，以帮助我们提高示例质量。

常用方法

显示隐藏

Context(26)

collect(10)

count(3)

saveAsTextFile(3)

filter(1)

lookup(1)

map(1)

parallelize(1)

startswith(1)

takeSample(1)

top(1)

示例#1

显示文件

文件： test_textFile.py 项目： svaningelgem/fast_pyspark_tester

def test_s3_textFile_loop():
    random.seed()

    fn = '{}/pysparkling_test_{:d}.txt'.format(S3_TEST_PATH, random.random() * 999999.0)

    rdd = Context().parallelize('Line {0}'.format(n) for n in range(200))
    rdd.saveAsTextFile(fn)
    rdd_check = Context().textFile(fn)

    assert rdd.count() == rdd_check.count() and all(e1 == e2 for e1, e2 in zip(rdd.collect(), rdd_check.collect()))

示例#2

显示文件

文件： test_textFile.py 项目： svaningelgem/fast_pyspark_tester

def test_hdfs_textFile_loop():
    random.seed()

    fn = '{}/pysparkling_test_{:d}.txt'.format(HDFS_TEST_PATH, random.random() * 999999.0)
    print('HDFS test file: {0}'.format(fn))

    rdd = Context().parallelize('Hello World {0}'.format(x) for x in range(10))
    rdd.saveAsTextFile(fn)
    read_rdd = Context().textFile(fn)
    print(rdd.collect())
    print(read_rdd.collect())
    assert rdd.count() == read_rdd.count() and all(r1 == r2 for r1, r2 in zip(rdd.collect(), read_rdd.collect()))

示例#3

显示文件

文件： readme_example.py 项目： svaningelgem/fast_pyspark_tester

from __future__ import print_function

from fast_pyspark_tester import Context

my_rdd = Context().textFile('tests/*.py')
print('In tests/*.py: all lines={0}, with import={1}'.format(
    my_rdd.count(),
    my_rdd.filter(lambda l: l.startswith('import ')).count(),
))