Spark上的大数据平台都能做什么？

Paxata是一家应用机器学习技术处理大数据难题的初创公司。公司致力于将数据科学家和业务分析师从数据准备工作中解放出来，使他们能够专注于数据分析工作。

最新发布的Paxata平台将能为后端工具准备更大规模的种类更多的数据。该软件搭配无模型、内存管道处理器和基于Spark的分布式处理引擎HDFS使用。

为了提高数据准备工作的自动化能力，Paxata采用了机器学习和语义检索能力。这能帮助数据科学家和业务分析师处理数据转换等相关工作。

Paxata联合创始人、副总裁Nenshad Bardoliwalla表示，软件的任务是帮助人解决难题，对数据科学家而言，我们的软件可以帮助实现前端数据准备和大数据集成。不过Bardoliwalla也指出希望在后端的虚拟化软件有所作为，现在主要的供应商是Tableau，但产品要完善的地方还很多。

Bardoliwalla表示，Paxata的Spring 15平台支持使用RESTAPI工具集的数据提取。“如果使用可视化工具之前还要花大量时间准备数据，那也太不友好了。”

Paxata还提供机器学习界面。Bardoliwalla表示：“数据分析最困难的部分就是录入很多数据源。在这方面，Tableau采用了可视化的方式，而我们希望采用另一种新的方式进行数据准备。”

我们一直都在努力坚持原创.......请不要一声不吭，就悄悄拿走。

我原创，你原创，我们的内容世界才会更加精彩！

【所有原创内容版权均属TechTarget，欢迎大家转发分享。但未经授权，严禁任何媒体（平面媒体、网络媒体、自媒体等）以及微信公众号复制、转载、摘编或以其他方式进行使用。】

微信公众号

TechTarget

官方微博

TechTarget中国

要发表评论，您必须先登录。

TechTarget新闻记者和网站编辑，主要关注数据管理领域的技术趋势和动态。