楼主: Alice007
跳转到指定楼层
上一主题 下一主题
收起左侧

回报地里,总结自己如何cracking the Data Challenge

   
🔗
Batistuta 2019-1-20 02:57:43 | 只看该作者
全局:
谢谢lz的分享,像请教一下,我看kaggle 里一般用xg boost 和light boost 的比较多,一方面有好的预测率,另一方面也能有feature importance,想问一下,lz为什么不用这个,而用random forest,rm的好处在哪里呢,谢谢
回复

使用道具 举报

🔗
eejustin 2019-1-20 13:36:57 | 只看该作者
全局:
很有用的信息!
回复

使用道具 举报

🔗
zhuzaizai 2019-1-20 14:03:15 | 只看该作者
全局:
刚做了个data challenge,问题学得很general,就问你要怎么去outlier,从而present给stakeholder。但问他们到底present的objective是啥,公司也不回复。就说直接想。dataset里也15个不同metrics,也看不出到底哪个更重要。后来我就简单概括了两个方法,选了两个比较highly correlate的说了一下,画了2个图,想着不过拉倒。没想到却过了
回复

使用道具 举报

全局:
谢谢楼主分享~~
回复

使用道具 举报

本楼:
全局:
感谢!!
回复

使用道具 举报

🔗
missxxl 2019-1-21 06:32:44 | 只看该作者
全局:
谢谢分享,学到很多
回复

使用道具 举报

🔗
larry0317 2019-1-23 01:38:03 | 只看该作者
全局:
关于ab test一直不太理解要求是怎样的呢?比如做完了model需要test,但是因为没有实际的data,无法分析lz提到的影响和结果,就只需要写出怎么决定size和用什么test就可以了?
回复

使用道具 举报

🔗
PanTAFSM 2019-1-24 13:36:20 | 只看该作者
全局:
感谢楼主的分享,满满的干货
回复

使用道具 举报

🔗
intern2015 2019-1-24 13:48:23 | 只看该作者
全局:
感谢lz分享~总结得非常棒
回复

使用道具 举报

🔗
wwendywang 2019-1-26 08:00:26 | 只看该作者
全局:
Alice007 发表于 2018-2-23 11:37
谢谢大家的支持,收到不少站内信。这里统一回答。关于如何联系sql, python这种, 如果是入门的话,sql可以 ...

楼主请问你说的刷了三遍是什么题库啊?leetcode?
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 注册账号
隐私提醒:
  • ☑ 禁止发布广告,拉群,贴个人联系方式:找人请去🔗同学同事飞友,拉群请去🔗拉群结伴,广告请去🔗跳蚤市场,和 🔗租房广告|找室友
  • ☑ 论坛内容在发帖 30 分钟内可以编辑,过后则不能删帖。为防止被骚扰甚至人肉,不要公开留微信等联系方式,如有需求请以论坛私信方式发送。
  • ☑ 干货版块可免费使用 🔗超级匿名:面经(美国面经、中国面经、数科面经、PM面经),抖包袱(美国、中国)和录取汇报、定位选校版
  • ☑ 查阅全站 🔗各种匿名方法

本版积分规则

>
快速回复 返回顶部 返回列表