188宝金博页面版

  • 图案背景
  • 纯色背景
视图
标记
批注
批注本地保存成功,开通会员云端永久保存 去开通
vrldkro

上传于:2015-04-27

粉丝量:0

该文档贡献者很忙,什么也没留下。


  • 相关
  • 目录
  • 笔记
  • 书签

188宝金博页面版:更多相关文档

  • 2013-中国科学-机器学习面临的挑战_张长水

    星级: 12 页

  • 机器学习面临的挑战_张长水

    星级: 12 页

  • 探究机器学习面临的挑战

    星级: 1 页

  • 机器学习面临的挑战

    星级: 12 页

  • 机器学习研究及面临的挑战探索

    星级: 1 页

  • 演化数据的学习_张长水

    星级: 7 页

  • 机器学习及其挑战

    星级: 23 页

  • 机器学习及其挑战

    星级: 23 页

  • 机器学习及其挑战

    星级: 23 页

  • 机器学习及其挑战

    星级: 23 页

  • 机器学习及其挑战

    星级: 23 页

  • 机器学习及其挑战

    星级: 23 页

  • 机器学习及其挑战

    星级: 23 页

  • 机器学习及其挑战

    星级: 23 页

  • 机器学习及其挑战

    星级: 23 页

暂无目录

点击鼠标右键菜单,创建目录

暂无笔记

选择文本,点击鼠标右键菜单,添加笔记

暂无书签

在左侧文档中,点击鼠标右键,添加书签

188宝金博页面版: 2013-机器学习面临的挑战(张长水)

下载积分: 800

内容提示: 评 述中国科学院学部科学与技术前沿论坛信号与信息处理专刊引用格式: 张长水. 机器学习面临的挑战. 中国科学: 信息科学, 2013, 43: 1612–1623, doi: 10.1360/N112013-00074中国科学: 信息科学2013年第43卷第12期: 1612–1623www.scichina.cominfo.scichina.com机器学习面临的挑战张长水清华大学自动化系, 智能科学与技术国家重点实验室, 清华信息科学与技术国家实验室 (筹), 北京 100084E-mail: zcs@mail.tsinghua.edu.cn收稿日期: 2013–06–20; 接受日期: 2013–11–13国家重点基础研究发展计划 (批准号: 2013CB329503) 和国家自然科学基金 (批准...

文档格式:PDF | 页数:12 | 浏览次数:101 | 上传日期:2015-04-27 23:29:53 | 文档星级:
评 述中国科学院学部科学与技术前沿论坛信号与信息处理专刊引用格式: 张长水. 机器学习面临的挑战. 中国科学: 信息科学, 2013, 43: 1612–1623, doi: 10.1360/N112013-00074中国科学: 信息科学2013年第43卷第12期: 1612–1623www.scichina.cominfo.scichina.com机器学习面临的挑战张长水清华大学自动化系, 智能科学与技术国家重点实验室, 清华信息科学与技术国家实验室 (筹), 北京 100084E-mail: zcs@mail.tsinghua.edu.cn收稿日期: 2013–06–20; 接受日期: 2013–11–13国家重点基础研究发展计划 (批准号: 2013CB329503) 和国家自然科学基金 (批准号: 91120301, 61075004) 资助项目摘要计算困难, 寻求最优解的困难和可解释性差等问题. 然后针对当前很多人关心的几个重要问题, 例如大数据问题, 深度学习, 概率图模型等做了分析, 以引起深入思考.该文讨论了机器学习目前面临的几个挑战, 包括: 高维特征空间和数据量问题, 大数据量的关键词机器学习 深度学习 概率图模型 大数据 优化问题1引言过去的二十多年的时间里, 机器学习的研究得到了快速发展, 取得了一系列令人瞩目的研究成果,同时也面临很多的挑战. 我们需要对机器学习的现状和面临的挑战进行探讨和梳理, 以引起更深入的思考.2机器学习面临的挑战虽然机器学习取得了令人瞩目的成果, 但是仍然面临很多困难和问题. 下面列举其中的一些问题.2.1高维特征空间与样本数的不足在很多实际应用问题中, 得到的特征维数是比较高的, 有的甚至是非常高的. 例如, 在图像识别中如果提取 SIFT 特征, 特征维数是 128 维, 如果提取其他特征, 维数也往往是几十维, 或者几百维. 还有, 在文本分类问题中, 如果把每一个单词当作一个特征, 特征的维数可能是几千维, 或者上万维, 这依赖于所使用的字典大小.下面以概率密度函数的估计为例讨论特征维数和所需要的样本之间的关系. 对于一维的概率密度函数估计来说, 通常在具有几十个以上的样本时可以得到一个比较好的函数估计, 这是因为在每一个点附近应该有一定量的样本 (也就是说, 数据要具有一定的密度) 才能得到好的估计结果. 我们假设至少需要 10 个样本, 这是一个保守的数字. 如果要估计的是一个二维概率密度函数, 就需要把二维空间等分成一些小网格, 需要每一个小网格中有足够多的样本. 因此, 可能需要 102= 100 个样本. 当维数增加的时候, 空间中小的格子的数量随维数的增加而指数上升. 假设维数为 d, 需要的样本数是 10d.

188宝金博页面版:关注我们

  • 新浪微博

关注188宝金博页面版公众号

188宝金博页面版
阅读
APP
阅读
返回
顶部
188宝金博页面版官网登录在线平台入口(2026已更新)—江苏协昌电子科技股份有限公司