搜索关键字：Spark Mllib，搜索到7026个结果！码迷,mamicode.com！

Spark 1.0.1源码安装

apache 网站上面已经有了已经构建好了的版本，我这里还是自己利用午休时间重新构建一下（jdk,python,scala的安装就省略了，自己可以去安装） http://www.apache.org/dist/spark/spark-1.0.1/ 具体官网的下载链接可...

分类：其他好文时间：2014-07-23 17:40:11 阅读次数：273

鸡肋的JdbcRDD

今天准备将mysql的数据倒腾到RDD，很早以前就知道有一个JdbcRDD，就想着使用一下，结果发现却是鸡肋一个。首先，看看JdbcRDD的定义： * An RDD that executes an SQL query on a JDBC connection and reads results. * For usage example, see test case ...

分类：数据库时间：2014-07-23 16:36:21 阅读次数：408

Spark Core源代码分析: Spark任务模型

概述一个Spark的Job分为多个stage，最后一个stage会包含一个或多个ResultTask，前面的stages会包含一个或多个ShuffleMapTasks。ResultTask运行并将结果返回给driver application。ShuffleMapTask将task的output依据...

分类：其他好文时间：2014-07-23 12:43:36 阅读次数：376

“大数据讲师”、“Hadoop讲师”、“Spark讲师”、“云计算讲师”、“Android讲师”

王家林简介Spark亚太研究院院长和首席专家，中国目前唯一的移动互联网和云计算大数据集大成者。在Spark、Hadoop、Android等方面有丰富的源码、实务和性能优化经验。彻底研究了Spark从0.5.0到0.9.1共13个版本的Spark源码，并已完成2014年5月31日发布的Spark1.0...

分类：移动开发时间：2014-07-22 23:29:47 阅读次数：241

Apache Spark源码走读之19 -- standalone cluster模式下资源的申请与释放

本文主要讲述在standalone cluster部署模式下，应用(Driver Application)所需要的资源是如何获得，在应用退出时又是如何释放的。

分类：其他好文时间：2014-07-22 22:48:15 阅读次数：243

Spark-Dependency

1、Spark中采用依赖关系(Dependency)表示rdd之间的生成关系。Spark可利用Dependency计算出失效的RDD。在每个RDD中都存在一个依赖关系的列表 private var dependencies_ : Seq[Dependency[_]] = null 用以记录各rdd中各partition的parent partition。 2、Spark中存在两类Depe...

分类：其他好文时间：2014-07-22 22:34:15 阅读次数：264

Spark SQL Catalyst源码分析之Analyzer

本文详细介绍了Spark SQL的Catalyst里，Analyzer是如何Sql parser的解析的UnResolved逻辑计划，进行resolve的。...

分类：数据库时间：2014-07-22 14:49:52 阅读次数：396

Spark快速上手之交互式分析

1.1 Spark交互式分析运行Spark脚本前，启动Hadoop的HDFS和YARN。Spark的shell提供了简单方式去识别API，同样也有一个强大的工具去交互式地分析数据。两种语言有这样的交换能力，分别是Scala 和 Python。下面将演示如何使用Python来分析数据文件。进入Spark安装主目录，输入下面的命令，python命令行模式将会启动。 ./bin/pysp...

分类：其他好文时间：2014-07-22 00:29:38 阅读次数：239

Spark学习体系

1：Spark生态和安装部署 Spark生态 Spark（内存计算框架） SparkSteaming（流式计算框架） Spark SQL（ad-hoc） Mllib（Machine Learning） GraphX（bagel将被取代）安装部署 Spark安装简介 Spark的源码编译 Spark Standalone安装 Spark Standalone H...

分类：其他好文时间：2014-07-22 00:27:35 阅读次数：317

Spark1.0.0伪分布安装指南

?一、下载须知软件准备： spark-1.0.0-bin-hadoop1.tgz? ?下载地址：spark1.0.0 scala-2.10.4.tgz ? ?下载下载：Scala 2.10.4 hadoop-1.2.1-bin.tar.gz ? 下载地址：hadoop-1.2.1-bin.tar.gz jdk-7u60-li...

分类：其他好文时间：2014-07-21 23:30:01 阅读次数：525

共7026条上一页 1 ... 686 687 688 689 690 ... 703 下一页

分享档案

更多>

2021年07月29日 (22)
2021年07月28日 (40)
2021年07月27日 (32)
2021年07月26日 (79)
2021年07月23日 (29)
2021年07月22日 (30)
2021年07月21日 (42)
2021年07月20日 (16)
2021年07月19日 (90)
2021年07月16日 (35)