首页
学习
活动
专区
圈层
工具
发布
    • 综合排序
    • 最热优先
    • 最新优先
    时间不限
  • 来自专栏火星娃统计

    GEO数据挖掘7

    GEO数据挖掘7 sunqi 2020/7/13 概述 GSVA分析,gene Set Variation Analysis,被称为基因集变异分析,是一种非参数的无监督分析方法,用来评估芯片核转录组的基因集富集结果 分组情况 table(group_list) ## group_list ## Control Vemurafenib ## 3 3 ##导入MigDB数据集名 "c7.all.v6.2.symbols.gmt" "h.all.v6.2.symbols.gmt" # 安装GSVA包 # BiocManager::install('GSVA') library es_max) df=df[df$P.Value<0.01 & abs(df$logFC) > 0.5,] write.csv(df,file = 'GSVA_DEG.csv') 结束语 至此,GEO数据分析的基础基本介绍完毕 ,后面计划解读一些geo数据挖掘的文章 love&peace

    1.9K30发布于 2020-09-15
  • 数据挖掘企业服务平台典型合作案例都有哪些

    数据挖掘企业服务平台典型合作案例1. 中国电科院:电力大数据分析平台电力大数据平台拥有数据采集、数据存储、数据加工处理、数据分析挖掘数据管控、平台管控、安装部署等功能,但是平台在组件融合、权限控制、对外接口封装等方面还存在不足, 不能够满足企业未来不同类型的大数据应用 运用大数据挖掘算法完善数据分析挖掘模块,实现对 Mahout、Rhadoop 等分析挖掘工具中的算法封装,通过企业数据挖掘应用流程化的模式,使得数据应用开发速度更快,成本更低, 让企业数据挖掘应用更简单 公路院:道路运输安全大数据分析平台面向道路运输行业和运输企业多层面应用的道路运输安全管理大数据平台,汇聚车辆运行 动态监控数据、新车技术参数、运输企业安全生产管理信息、运政管理信息、气象信息等多源 数据 泰迪大数据挖掘企业服务平台是一款通用的、企业级、智能化的数据分析模型构建与数据应用场景设计工具,能够一体化地完成数据集成、模型构建、模型发布,为数据分析、探索、服务流程提供支撑,提供完整的数据探索、多数据源接入

    71010编辑于 2024-06-26
  • 企业为什么需要数据挖掘平台?哪个比较好用呢?

    数据挖掘平台功能:助力企业数据挖掘 1、数据抓取 挖掘平台企业挖掘数据的重要工具。 4、机器学习 数据挖掘平台还具备机器学习,可以自动识别和分析数据,发现其中的规律和模式,提供预测模型,帮助企业做出更准确的商业决策。 5、数据挖掘平台可以应用于多个应用场景 数据挖掘平台广泛应用于企业的各个领域,如市场营销、风险管理、人力资源管理、医疗健康等,可实现精准营销、风险分析、员工管理、疾病诊断等。 数据挖掘平台不仅适用于大企业也适用于普通人 企业:分布式云计算,线性扩展,保证性能,与BI平台无缝整合,一键发布挖掘模型,模型库提高知识复用,减少重复投入,支持跨库查询,统一控制数据访问权限,训练自动化 泰迪智能科技企业数据挖掘平台由泰迪智能科技自主研发,面向企业级用户的大数据挖掘建模平台

    94310编辑于 2024-06-20
  • 来自专栏数据STUDIO

    一个企业数据挖掘实战项目|教育数据挖掘

    自从分享了一篇能够写在简历里的企业数据挖掘实战项目,深受读者朋友们青睐,许多读者私信云朵君,希望多一些类似的数据挖掘实际案例。这就来了。 本项目旨在探讨影响学生学业表现的人口统计学和家庭特征。 了解更多:Python数据分析之数据探索分析(EDA) 从数据集特点来看,13个字段可以分为四大类。 不平衡数据集处理方法 从上一步的探索性数据分析结果,本次学生成绩数据集为不平衡数据集,那么处理不平衡数据集处理方法都有哪些呢。这里可以参考云朵君之前的一篇机器学习中样本不平衡,怎么办? 数据重采样 这里主要介绍下数据预处理层面的数据重采样方法。数据重采样主要分为上采样和下采样。 本文后续工作可以是通过正文中得到的结果,选择几个合适的模型,通过适当的模型调参方法选择恰当的参数,以确定本次数据挖掘的最终模型。

    2.3K31发布于 2021-09-26
  • 来自专栏人工智能

    数据挖掘7个重要技术

    数据挖掘技术 数据挖掘是查看大型信息库以生成新信息的过程。直觉上,你可能认为数据挖掘是指提取新的数据,但事实并非如此; 相反的,数据挖掘是从已经收集的数据中推断出新的模式和知识。 回答是:”数据挖掘技术” 只要利用以下技术中的一种或多种,数据挖掘则会变得非常有效: 1.跟踪模式。数据挖掘中最基本的技术之一就是学习识别数据集中的模式。 更具体地说,回归的主要焦点是帮助您揭示指定数据集中两个(或更多)变量之间的确切关系。 7.预测。预测是最有价值的数据挖掘技术之一,因为它用于投影将来会看到的数据类型。 如何用好数据挖掘工具 那么你是否需要最新最好的机器学习工具来应用这些技术呢?不一定。实际上,您可以用相对适中的数据库系统和一些简单直接可对接的大数据工具来完成一些尖端的数据挖掘工作。 只要你运用正确的逻辑,尝试不同的思路,从而得出不同的结论,这些结论有可能彻底改变你的企业。 2018,是新时代大数据的黄金时间,也是企业发展的分水岭,如何用好大数据技术,是每一个企业必须面对的问题。

    1.2K60发布于 2018-01-09
  • day 7-8 GEO数据挖掘

    有什么类型数据? 2.GEO背景介绍+分析思路 表达数据实验设计:分组需要有意义 分组为病变组织VS 健康组织 如果公共数据库没有,需要自己测 2.1数据挖掘:有差异的材料→差异基因→找功能/找关联→解释差异,缩小基因范围 ##3.1 查找数据并提取数据信息 下载 Series Materix.txt并放在工作目录下 基因表达芯片的数据大小500k以下说明基因太少或者样本不正常 两种数据:常规转录组;单细胞/基因表达芯片 p) { s = intersect(rownames(pd),colnames(exp)) exp = exp[,s] pd = pd[s,] } #(4)提取芯片平台编号,后面要根据它来找探针注释 /机器学习/热图) 4、没取过log且有负值:提示错误数据(建议换一个数据或处理原始数据) 5、取过1og,有少量的负数,但是4<中位数<15 这种数据正常 3、优先找靠谱正常数据 降低难度 4、代码需要修代的地方

    50310编辑于 2025-08-15
  • 来自专栏人生代码

    数据挖掘实践指南读书笔记7

    写在之前 本书涉及的源程序和数据都可以在以下网站中找到: http://guidetodatamining.com/ 这本书理论比较简单,书中错误较少,动手锻炼较多,如果每个代码都自己写出来,收获不少。 学习 # 从队列中获得数据的最小值 from Queue import PriorityQueue singersQueue = PriorityQueue() singersQueue.put((16 members = [self.memberOf.count(i) for i in range(len(self.centroids))]#计数列表 #对centroid类的数据的第 k列数据 第i个中心点求和,计算平均 self.centroids = [[sum([self.data[k][i] for 选择初始中心点的步骤: 从数据点中随机选择第一个中心点 重复以下过程,直到选出k个中心点 计算每个数据点dp到其最近的中心点的距离D(dp) 以正比D(dp)的概率,随机选择一个数据点作为新中心点加入到中心点集合

    58710发布于 2019-11-05
  • 来自专栏CDA数据分析师

    成为“大数据企业”,献给不懂数据挖掘的你!

    在这种策略下,大规模多源异构数据的采集、清洗和整合方法,将成为大数据管理的核心支撑。 如何挖掘企业数据的价值 企业数据的价值开发高度依赖于深度数据分析能力。 对于这一平台所积累的大量数据的价值开发,首先体现在对其信息内容的提炼上。 平台上与工作相关的博文内容,如客服案例、经验分享等,经自动筛选分类、主题识别、关键词索引之后,被构建成企业知识库,为业务及管理工作提供快速有效的知识支撑,同时成为员工培训和自学的有力工具。 通过对这些关系结构的深度分析和挖掘,G公司获得了对员工及团队的影响力、凝聚力、创造力的更为准确而深入的评估手段。 例如,当G公司试图整合博客平台、业务系统、人力资源系统中的数据以全方位分析员工、团队特质以及绩效信息时,大量的数据属性之间所构成的复杂潜在关联网络,就需要强有力的关联发现技术来加以处理。

    1.1K60发布于 2018-02-11
  • 来自专栏灯塔大数据

    成为“大数据企业”,献给不懂数据挖掘的你

    在这种策略下,大规模多源异构数据的采集、清洗和整合方法,将成为大数据管理的核心支撑。 如何挖掘企业数据的价值 企业数据的价值开发高度依赖于深度数据分析能力。 对于这一平台所积累的大量数据的价值开发,首先体现在对其信息内容的提炼上。 平台上与工作相关的博文内容,如客服案例、经验分享等,经自动筛选分类、主题识别、关键词索引之后,被构建成企业知识库,为业务及管理工作提供快速有效的知识支撑,同时成为员工培训和自学的有力工具。 通过对这些关系结构的深度分析和挖掘,G公司获得了对员工及团队的影响力、凝聚力、创造力的更为准确而深入的评估手段。 例如,当G公司试图整合博客平台、业务系统、人力资源系统中的数据以全方位分析员工、团队特质以及绩效信息时,大量的数据属性之间所构成的复杂潜在关联网络,就需要强有力的关联发现技术来加以处理。

    75170发布于 2018-04-04
  • 来自专栏搜狗测试

    软件品质评测系统- 数据挖掘处理平台

    软件品质评测体系建立之后,在进行评测之前首先要确定评测使用的数据,这就需要数据挖掘平台发挥作用了,本文将以输入法评测语料制作为例介绍我们的评测数据挖掘处理平台。 1 数据挖掘处理原则 全面性 使用场景 依照不同用户需要的打字环境的差别,结合当前使用频率较高的几种应用,尽可能全面地覆盖用户使用的打字场景,主要分为以下两个类别: 聊天场景:用户聊天的打字内容,例如 因此我们在挖掘用户打字行为时,除了满足普通打字需求的同时也设计了多种用户可能的行为,包括联想、组词、纠错、退格等。 清洗前的数据: ? 清洗后的数据: ? 数据分词 经过清洗后的数据,仍然是以大段的文章形式存储的,还不能直接拿来使用,需要使用特定的工具对其进行分词处理。 expect_cand": ""} //表示退格 {"pinyin": "#", "expect_cand": ""} //表示换行 ], "键盘类型":26 } 4结语 评测数据挖掘不是一成不变的

    93020发布于 2020-07-16
  • 来自专栏韩曙亮的移动开发专栏

    数据挖掘数据挖掘总结 ( 数据挖掘相关概念 ) ★★

    用于挖掘的数数据源 必须 真实 : ① 存在的真实数据 : 数据挖掘处理的数据一般是存在的真实数据 , 不是专门收集的数据 ; ② 数据收集 : 该工作不属于数据挖掘范畴 , 属于统计任务 ; 2 . 数据必须海量 : ① 少量数据处理 : 少量数据使用统计方法分析 , 不必使用数据挖掘 ; ② 海量数据 : 处理海量数据时 , 才使用数据挖掘 , 涉及到 有效存储 , 快速访问 , 合理表示 等方面的问题 未知结果 : ① 挖掘结果 : 数据挖掘 挖掘出的知识是未知的 , 目的是为了发掘潜在的知识 , 模式 ; 这些知识只能在特定环境下可以接收 , 可以理解 , 可以运用 ; ② 知识使用 : 数据挖掘出的知识只能在特定领域使用 , 如金融领域数据挖掘结果 , 只能在金融领域及相关领域使用 ; 参考博客 : 【数据挖掘数据挖掘简介 ( 数据挖掘引入 | KDD 流程 | 数据源要求 | 技术特点 ) 二、 数据挖掘组件化思想 数据挖掘任务分类 : 根据数据挖掘的目标 , 可以将数据挖掘任务分为以下几类 : ① 模式挖掘 , ② 描述建模 , ③ 预测建模 ; 描述建模 和 预测建模 又称为 模型挖掘 ; ① 模式挖掘 : 如

    5.3K00编辑于 2023-03-28
  • 来自专栏CDA数据分析师

    测试:你是否具备企业数据挖掘能力?

    1.某超市研究销售纪录数据后发现,买啤酒的人很大概率也会购买尿布,这种属于数据挖掘的哪类问题? A. 关联规则发现 B. 聚类 C. 分类 D. Recall, ROC 3.将原始数据进行集成、变换、维度规约、数值规约是在以下哪个步骤的任务? A. 频繁模式挖掘 B. 分类和预测 C. 数据预处理 D. 数据挖掘与知识发现 B. 领域知识发现 C. 文档知识发现 D. 动态知识发现 6.使用交互式的和可视化的技术,对数据进行探索属于数据挖掘的哪一类任务? A. 探索性数据分析 B. 建模描述 C. 寻找模式和规则 7.为数据的总体分布建模;把多维空间划分成组等问题属于数据挖掘的哪一类任务? A. 探索性数据分析 B. 建模描述 C. 预测建模 D. 关于基本数据的元数据是指: A.基本元数据数据源,数据仓库,数据集市和应用程序等结构相关的信息; B.基本元数据包括与企业相关的管理方面的数据和信息; C.基本元数据包括日志文件和简历执行处理的时序调度信息

    1.2K60发布于 2018-02-11
  • 来自专栏数据科学与人工智能

    数据挖掘】图数据挖掘

    那么图数据挖掘是干什么的呢?难道是开着挖掘机来进行挖掘?还是扛着锄头?下面讲讲什么是图数据挖掘。 一、什么是图数据挖掘 这个话题感觉比较沉重,以至于我敲打每个字都要犹豫半天,这里我说说我对图数据挖掘的理解。数据是一个不可数名字,那么说明数据是一个没有边界的东西。 那么不难理解,数据挖掘就是挖掘数据里面的“宝贝”,图数据挖掘,就是以图的结构来存储、展示、思考数据,以达到挖掘出其中的“宝贝”。那这个“宝贝”是什么? 那么对这个图进行关系挖掘,那么会产生很多有用的数据,比如可以推荐你可能认识的人,那就是朋友的朋友,甚至更深,这就形成了某空间好友推荐的功能。比如某宝的你可能喜欢的宝贝,可以通过图数据挖掘来实现。 这就是我认为的图数据挖掘。 从学术上讲,图数据挖掘分为数据图,模式图两种。至于这两个类型的区别,由于很久没有关注这块,所以只能给出一个字面意义上的区别。

    3.3K81发布于 2018-02-27
  • 来自专栏PPV课数据科学社区

    ☞【观点】成为“大数据企业”,献给不懂数据挖掘的你

    在这种策略下,大规模多源异构数据的采集、清洗和整合方法,将成为大数据管理的核心支撑。 如何挖掘企业数据的价值 企业数据的价值开发高度依赖于深度数据分析能力。 对于这一平台所积累的大量数据的价值开发,首先体现在对其信息内容的提炼上。 平台上与工作相关的博文内容,如客服案例、经验分享等,经自动筛选分类、主题识别、关键词索引之后,被构建成企业知识库,为业务及管理工作提供快速有效的知识支撑,同时成为员工培训和自学的有力工具。 通过对这些关系结构的深度分析和挖掘,G公司获得了对员工及团队的影响力、凝聚力、创造力的更为准确而深入的评估手段。 知识无极限 6、回复“啤酒”查看数据挖掘关联注明案例-啤酒喝尿布 7、回复“栋察”查看大数据栋察——大数据时代的历史机遇连载 8、回复“数据咖”查看数据咖——PPV课数据爱好者俱乐部省分会会长招募 9、

    73970发布于 2018-04-20
  • 来自专栏华章科技

    如何成为大数据企业?献给不懂数据挖掘的你

    在这种策略下,大规模多源异构数据的采集、清洗和整合方法,将成为大数据管理的核心支撑。 如何挖掘企业数据的价值 企业数据的价值开发高度依赖于深度数据分析能力。 对于这一平台所积累的大量数据的价值开发,首先体现在对其信息内容的提炼上。 平台上与工作相关的博文内容,如客服案例、经验分享等,经自动筛选分类、主题识别、关键词索引之后,被构建成企业知识库,为业务及管理工作提供快速有效的知识支撑,同时成为员工培训和自学的有力工具。 通过对这些关系结构的深度分析和挖掘,G公司获得了对员工及团队的影响力、凝聚力、创造力的更为准确而深入的评估手段。 例如,当G公司试图整合博客平台、业务系统、人力资源系统中的数据以全方位分析员工、团队特质以及绩效信息时,大量的数据属性之间所构成的复杂潜在关联网络,就需要强有力的关联发现技术来加以处理。

    38820发布于 2018-08-14
  • 来自专栏NLPIR

    NLPIR中文数据挖掘帮助企业执行最佳商业决策

    数据在生活中应用增加,数据仓库,数据安全,数据分析,数据挖掘这些技术的热度居高不下。其中,数据挖掘能够对企业的业务数据进行抽取,转换和分析,促成企业执行最佳商业决策。 同时,在企业进行营销方面,从海量数据挖掘信息,将复杂数据设置成量化数据进行分析,是企业实行数字化营销的重要方面,对数据的准确分析能够实现最佳商业决策。 灵玖软件NLPIR大数据语义智能分析平台针对中文数据挖掘的综合需求,融合了网络精准采集、自然语言理解、文本挖掘和语义搜索的研究成果,先后历时十八年,服务了全球四十万家机构用户,是大时代语义智能分析的一大利器 NLPIR-Parser大数据语义分析平台企业提供了一体式全链条服务,包括分词词性、情感分析、实体识别、关键词提取,实现对语法、词法和语义的综合应用。 NLPIR大数据语义智能分析平台是根据中文数据挖掘的综合需求,融合了网络精准采集、自然语言理解、文本挖掘和语义搜索的研究成果,并针对互联网内容处理的全技术链条的共享开发平台

    99640发布于 2019-09-24
  • 来自专栏PPV课数据科学社区

    【R应用】R 语言企业数据挖掘应用

    有奖转发活动 回复“抽奖”参与《2015年数据分析/数据挖掘工具大调查》有奖活动。 三月底参加了中国人民大学统计学院海峡两岸数据挖掘研讨会,和大家简单聊了聊R语言在京东商城的数据挖掘应用。 但我个人觉得这可能还不是最主要的原因,对于互联网企业来说,数据虽然获取更容易,但环境更为复杂。开源软件可以根据业务的变化 进行调整,但商业的闭源软件则很难做到。 R并不是通吃所有的数据场景,它只是在出现在该出现的分析建模环节。 R的位置在哪里?先让我们看看所谓的大数据是如何从企业中传递的(摘自本次人大的演讲材料) ? 当然,这里还有很多问题没有展开,比如: R语言的数据挖掘应该在并行化环境完成还是在单台机器的计算环境完成? 抽样可否解决大数据挖掘问题? 生产中直接实施R环境是否可行? 6、回复“答案”查看hadoop面试题题目及答案 7、回复“爱情”查看大数据与爱情的故事 8、回复“笑话”查看大数据系列笑话 9、回复“大数据1、大数据2、大数据3、大数据4”查看大数据历史机遇连载

    1.2K60发布于 2018-04-23
  • 来自专栏CDA数据分析师

    科普 | 数据挖掘最常用的7种常方法

    利用数据挖掘进行数据分析常用的方法主要有分类、回归分析、聚类、关联规则、特征、变化和偏差分析、Web页挖掘等, 它们分别从不同的角度对数据进行挖掘。 在客户关系管理中,通过对企业的客户数据库里的大量数据进行挖掘,可以从大量的记录中发现有趣的关联关系,找出影响市场营销效果的关键因素,为产品定位、定价与定制客户群,客户寻求、细分与保持,市场营销与推销,营销风险评估和诈骗预测等决策支持提供参考依据 在企业危机管理及其预警中,管理者更感兴趣的是那些意外规则。意外规则的挖掘可以应用到各种异常信息的发现、分析、识别、评价和预警等方面。 Web页挖掘 随着Internet的迅速发展及Web 的全球普及, 使得Web上的信息量无比丰富,通过对Web的挖掘,可以利用Web 的海量数据进行分析,收集政治、经济、政策、科技、金融、各种市场、竞争对手 数据挖掘是一种决策支持过程,它通过高度自动化地分析企业数据,做出归纳性的推理,从中挖掘出潜在的模式,帮助决策者调整市场策略,减少风险,做出正确的决策。这对于一个企业的发展十分重要。

    86180发布于 2018-02-11
  • 来自专栏韩曙亮的移动开发专栏

    数据挖掘数据挖掘简介 ( 6 个常用功能 | 数据挖掘结果判断 | 数据挖掘学习框架 | 数据挖掘分类 )

    数据挖掘 功能 II . 数据挖掘 结果判断 III . 数据挖掘 学习框架 IV . 数据挖掘 分类 I . 数据挖掘 功能 ---- 1 . 数据挖掘 结果判断 ---- 数据挖掘结果判断 : 数据挖掘得出的 知识 / 模式 , 如何判断得出的结果是否有效 ; ① 客观判断方法 : 通过科学计算进行判断是否正确 , 该计算基于 模式 的t 统计和结构 数据挖掘 学习框架 ---- 1 . 数据挖掘技术 ( 重点 ) : 聚类分析 , 异常检测 , 分类 , 关联规则分析 , 序列模式分析 , 数据方体与数据仓库 ; 2 . 数据挖掘应用 : CRM , 搜索分析 , 网络安全 , 生物信息分析 … IV . 数据挖掘 分类 ---- 1 . : 时间数据 , 空间数据 , 文本数据 , 音视频多媒体数据 , WEB 数据 等类型的数据挖掘 ; 2 .

    1.6K20编辑于 2023-03-27
  • 来自专栏大大的小数据

    泰迪TIPM开源数据挖掘建模平台测试2021.9.14

    1、http://python.tipdm.org/ 2、 3、 4、 5、 6、 7、看不到数据 8、 查看报告

    29630编辑于 2022-09-22
领券