0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

一个Github Star值多少钱?

dyquk4xk2p3d 来源:良许Linux 2023-09-11 16:57 次阅读

大家好,我卡颂。

当我们看一个开源项目时,基本都会看下他有多少star。虽然Github Star是一个虚荣指标,但却有实际意义,比如:

很多开发者会关注Github Star增长趋势,更多的star会获得更多关注

star数量往往是技术选型的一个依据。即使你的团队最终没有使用一个star很多的开源库,但通常也不会使用一个star很少的库

换个思路来看也许更能体现Github Star的价值 ——「软件开源」并不意味着不赚钱,这只是一种产品开发策略。star数一定程度上反映了这种策略执行的是否成功。

而「策略执行是否成功」又会影响投资人的投资决策,以及团队能否以更低成本(甚至白嫖)招募优秀的开发人员。

有利益驱动就会有刷量、造假行为出现。既然微博僵尸粉都能影响广告主的投放决策,那Github Star造假就不足为奇了。

那么,一个Github Star值多少钱?

Star的售价

网上已经有公开渠道购买Github Star,比如:GitHub24或Baddhi Shop[1](在这个网站,你能花钱刷各种网站的行为数据,甚至能刷IMDb电影评分)。

2136d6c2-5033-11ee-a25d-92fbcf53809c.png

Star的售价差异很大,比如:

64刀可以买到1000个三无账号的star

要买到100颗有活跃行为账号的star,可能得85刀

215216bc-5033-11ee-a25d-92fbcf53809c.png

如何识别刷Star

之所以两者差异巨大,是因为鉴别难度不同。

对于这个zadahmed/music_recommender[2]仓库,可以明显看到有部分点赞者的账号是同一天注册的:

21642ca8-5033-11ee-a25d-92fbcf53809c.png

再深究的话,会发现这些点赞账号还有很多共性,比如:

Followers < 1

Following < 1

个人公开仓库数量 < 4

很多个人信息(比如邮箱、简介)为空

这类共性让这些假账号很容易被识别,Github官方会定期清理这些账号。所以,如果你花钱刷了1000star,可能过一个月就都消失了。

除了Github官方以外,还有些工具可以识别假账号,比如:

astronomer[3]

fake-star-detector[4]

想想,如果自己的项目好不容易做出点名气,但被人扒出曾经刷star,那就尴尬了。

识别高端造假

但对于那些高价刷的star,这类检测机制就不太好用了。因为这类账号会模仿正常开发者的行为,光从行为数据上,很难将他们和正常开发者区分。

这里开源编排平台dagster[5]提供了一个检测思路 —— 他们使用一种被称为unsupervised clustering(无监督聚类)的机器学习技术。简单来讲,我们可以用一组行为特征来描述一个Github账号,比如:

提交代码

给其他仓库提PR

star某个项目

修改个人简介

这样就能将这个Github账号表示为高维向量空间中的一个点。那些向量空间中相近的点对应的Github账号,可以被归类为同类账号。

基于以上原理,dagster成员新建了个仓库,并高价刷了star:

2186c6aa-5033-11ee-a25d-92fbcf53809c.png

这么做的目的是用那些点star的Github账号做聚类分析,标记出一个类。当完成聚类后,如果发现某个Github账号也属于这个类,那就可以怀疑这个账号也是假账号。

那么,为什么假账号能够聚类呢?这是因为这些账号虽然在模仿正常开发者,但他们之间也有很多类似行为,比如:

他们的行为可能都是同一个脚本在操作,那么在行为逻辑、行为执行的时间上比较类似

他们都会给同一批仓库(服务的买主)点star

举个例子,有两个Github账号,虽然他们之间并无交集(仓库的编程语言不同、开发者国籍不同...),但他们都在某几天做着同类的事(比如先浏览一些仓库,再发表评论,最后给某个仓库star),那么他们会被划分为同类。

如果他们的同类中有实锤的假账号,那么他们大概率也是假账号。

在下面的图表中,衡量了上述刷star的仓库(100% star都是刷的)中,点了star的那些Github账号的行为,其中:

横轴是日期跨度

纵轴是账号交互的仓库总数

蓝色部分是所有用户

红色部分是明确的假Github账号

黄色部分是根据聚类,被怀疑的假账号

21ad84e8-5033-11ee-a25d-92fbcf53809c.png

由于已知这个仓库的所有star都是刷的,所以其实黄色部分的账号也都是假账号,通过聚类的方式他们被很好的识别出来了(和红色部分同类)。

而对于完全没有刷star的项目(这里以dagster[6]为例),点star的用户行为基本不会与假账号有交集:

221ce6da-5033-11ee-a25d-92fbcf53809c.png

对于一个刷了star,同时又有实际参与者的项目,分析结果如下图:

22e70640-5033-11ee-a25d-92fbcf53809c.png

总结

虽然star数是虚荣指标,但由于他是很多决策的参考依据,这就诞生了「刷star」的需求。

比如,okcash[7]是一款开源的加密货币,有578star。

23306f60-5033-11ee-a25d-92fbcf53809c.png

但是,经过上述dagster的方式检测后会发现,所有为okcash点star的账号中,疑似虚假刷star的账号占比达到97% 。相信这一结果会对这款加密货币的市场信心造成一定影响。

如果你也想用dagster的方式检测其他开源库,可以参考这里[8]。

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 机器学习
    +关注

    关注

    66

    文章

    8127

    浏览量

    130571
  • STAR
    +关注

    关注

    1

    文章

    14

    浏览量

    9087
  • GitHub
    +关注

    关注

    3

    文章

    457

    浏览量

    15926

原文标题:一个 Github Star 值多少钱?

文章出处:【微信号:良许Linux,微信公众号:良许Linux】欢迎添加关注!文章转载请注明出处。

收藏 人收藏

    评论

    相关推荐

    59.Github 被黑了?No Access?Why?

    GitHub
    充八万
    发布于 :2023年07月11日 23:15:16

    关于PCB设计中关于star point的问题

    大家好,最近在设计过程中,同事有提到关于star point这个技术点,使用在PCB布线的过程中,好像车企用的较多,常规行业应该很少,请问有谁了解这个么?例如过孔的孔径怎么设置,走线长度大致为多少?
    发表于 04-01 09:45

    RV-STAR开发板上的DAC的基础用法

    /模拟转换器)。这期内容我们将通过用旋钮控制LED亮度的小实验带领大家了解RV-STAR开发板上的DAC的基础用法。 系统环境 Windows 10-64bit 软件平台 NucleiStudio
    发表于 08-16 08:24

    阿里妈妈技术团队对Euler的详细解读

    AI 科技评论消息,继去年 11 月开源面向高维稀疏数据场景的深度优化工具 X-Deep Learning(截至发稿,GitHub Star 数已达到 1972)之后,阿里妈妈团队于今日正式开源大规模分布式图表征学习框架 Euler。
    的头像 发表于 01-22 14:02 8075次阅读
    阿里妈妈技术团队对Euler的详细解读

    Leap Motion公布了一款开源AR头显原型设计Project North Star

    Leap Motion公司的Florian Maurer写道,该项目的最新更新版本“Release 3”在本周发布,提供了一项重大的设计更新,汇集了“数月的研究和洞察新的3D文件和图纸” 。更新后的设计可以在Project North Star GitHub上找到。
    的头像 发表于 01-26 10:08 4049次阅读

    程序员如何以合规手段快速获得GitHub上千Star

    除此之外,这个 repo 和代码毫无关系吗?好像也不是的。网站是代码写出来的,issue 里也有对 GitHub Pages、webp 文件格式支持、自动去除 EXIF、使用 lazy load 等的讨论。就算真的没有代码,问题有那么大么?不要忘了,GitHub 除了是代
    的头像 发表于 01-29 10:18 2652次阅读

    GitHub五万星登顶 程序员命令行最全技巧宝典!

    最近两天,「The Art of Command Line(命令行的艺术)」这个开源项目雄踞了 GitHub TOP 榜,直接以 51,727 Star 登上榜首。
    的头像 发表于 06-06 14:02 2206次阅读

    CV大牛沈春华新算法获GitHub 1400多颗Star

    凭一己之力将澳大利亚机器学习研究院拉至全球排名第四;GitHub 1400 多颗 Star、并用于 Top 级手机厂商的视觉处理;这就是程序员口中的CV 大牛 沈春华团队的战绩。 目前,沈春华
    的头像 发表于 11-04 15:20 1653次阅读

    10月份GitHub上最热门的Python开源项目上榜详情

    10月份GitHub上最热门的Python开源项目排行已经出炉啦,一起来看看上榜详情吧: 1 GHunt https://github.com/mxrch/GHunt Star 4.8K 这是
    的头像 发表于 11-05 15:29 1614次阅读

    DCloud崔红保:uni-app和HBuilder背后的男人

    MUI,国内⾸个接近原⽣App体验的⾼性能前端库,github star数过万;流应⽤,国内⼩程序应用形态的最早原型;HBuilder,拥有数百万前端开...
    的头像 发表于 12-08 23:33 873次阅读

    国产开源软件 “有偿刷星”遭热议,GitHub 刷星乱象仍存在

    GitHub刷星”再度被推至舆论的风口浪尖。 近日,某开发者平台在其官网挂出了“你点Star,我送豪礼”宣传活动。据活动规则显示,用户在GitHub上为某知名开源项目点击“Star
    的头像 发表于 12-28 13:41 1550次阅读

    GitHub 40K Star工程师求职记分享

      本文作者是牛客网知名大佬 CyC2018,在他的 GitHub 有一个高达 40K Star 的技术仓库(在所有仓库中排名前五十),可以说在开源项目方面是一骑绝尘的牛人。今天我们分享一下他的求职
    的头像 发表于 12-30 10:15 1611次阅读

    百度战略赞助 GOTC 2021,详解最活跃的自动驾驶开源平台Apollo

    项目、拥有 10000+ 社区贡献者、30万+ GitHub Star,多个项目已经广泛应用于实际业务生产。 值得注意的是,在百度开源版图之下,Apollo 自动驾驶平台已开源运营 4 年,成为全球
    发表于 08-05 15:37 735次阅读
    百度战略赞助 GOTC 2021,详解最活跃的自动驾驶开源平台Apollo

    如何解决Spring Cloud下测试环境路由问题

    Spring Cloud Tencent 微服务开发框架自六月底正式对外宣发后,受到了许多开发者非常火热的关注。不到一个月时间, Github Star 数就已突破 2000,超过 1000
    的头像 发表于 10-21 09:22 619次阅读

    GTC 2023|Colossal-AI系统的数据并行优化方案

    从Colossal-AI的GitHub star数量中看出,这是衡量其开源社区的指标。与其它非常流行的开源系统(如Spark、 MongoDB等)相比,在相同时间内Colossal-AI使用增长速度是最快的。
    的头像 发表于 03-23 17:00 1274次阅读
    GTC 2023|Colossal-AI系统的数据并行优化方案