Muyun99的杂谈
134 subscribers
734 photos
13 videos
16 files
435 links
Download Telegram
惊了,今晚演出结束在和我们的指挥学姐讨论感情问题,晚上九点多同门一个电话过来说是老板让我们研一的三个同学出去吃饭。然后在百家湖这边找了家酒吧,点了瓶红酒小吃和几个科罗娜就喝起来了

喝酒的时候也是侃天侃地,聊一些现实问题和未来规划,学习上的东西倒是聊的不多。我之前知道我老板能喝酒,但是和他出来喝是第一回

总的来说我觉得组里的氛围在变好,老板的性子也没以前急了,研二的师兄也能放去实习,研一的同门昨天和他说不想发论文他说那你就搞竞赛吧,然后说暑假我们也能回家一个月,真有意思,误打误撞地好像周围的状态都在慢慢变好
不过说实话,老板学术水平这个事还是一如既往的不太行,不过现在人在慢慢变好和容易理解和沟通这是我觉得很高兴的事情了,好耶,今晚针布戳,酒喝得值了
现在的比赛真的越发说明数据的重要性,身边的师兄也是不断地提及,也让我更加重视数据中的二八法则:80%数据+20%算法,实际情况中这一比例可能更加夸张。

图中的第一名和第二名的核心获胜关键:使用TF-Hub中的CropNet,是一个木薯叶数据集训练好的分类模型。
???
忘记是保存的哪位同学的校园四景了,总之,毕业一周年也能和朋友们拍合照真是无比的快乐!
最近摸了几场CV主流的竞赛,发现现在框架都封装的太好了,想跑个啥模型啥任务都是有的,基本在模型上不用做啥改动了(改模型我也不擅长)。推荐方向和结构化数据还能做特征工程,现在有点迷茫,不知道CV竞赛往哪方面做了😭

仔细想想,接下来的方向是准备学习kaggle方案,把经典模型逐一理解,找一些即插即用的模块改模型试试之后,还是往样本方面多考虑考虑,噪声样本,长尾分布等等。然后在暑假仿照大厂的风格搭一个自己的竞赛codebase好了(图像分类的基本搭的差不多了,其实也就是个缝合怪,检测和分割框架会稍微复杂些),再去摸一些比赛充实一下
最近最大的感受是,不管搞论文还是竞赛,都是缝合怪的天下,90%往上都是缝合怪,但是缝的工具和手法还是非常依赖经验的,手速够快并且能缝出东西那就是牛逼
Channel name was changed to «Muyun99的杂谈»
好耶,第一次进录音棚,虽然很复古但是还蛮好看的!后天要去团中央组织的演出,和一些科研工作者一起唱《在灿烂的阳光下》,然后全国直播

为了保证录制效果,就提前来录音棚录制然后后天假唱🌝。本来一共30个人唱,录制女生就来了五个,男生来了三个,我们就重复录了五次,唱出男生十五个人的效果,五段音轨叠加还真像专业选手了
真离谱,现在改模型真的是个无底洞了,现在改模型就是抄 NLP 领域的idea,目前的 Transformer 纯粹是看谁手快,希望过两年能够量变引起质变吧,从 AlexNet 过渡到 ResNet,真的挖掘出高效的点才是关键。不如多看看最近又火起来的 MLP,这种结构落地部署又方便,性能也不赖,问了实习的师兄他们真实的业务线已经用上了

还是搞我的弱监督和 Label Noise 去了,改模型高校还是卷不过大厂,他们卡太多了,手速也太快了
原来余震会间隔这么久的,10多年前的汶川地震印象还是十分深刻。2点多我正走在去学校的路上,突然旁边的房子开始摇晃,像被撕扯开一样,旁边的大人叫嚷着说房子要塌了,我在马路中央本能地蹲下(记得当时并没有什么害怕的情绪)。

我们当地的震感比较强烈但是没有持续太久,我起身继续去学校。学校通知放假了,同学们欢呼雀跃。我和一个小伙伴就去隔壁中学打乒乓球了,打完回家被爸妈好生数落了一阵,说到处找我都没找到。接着大家就都不住楼房了,我记得我和姐姐在老爸的大货车里睡觉,租了碟片看电视剧,是与霍去病有关的战争题材的古装剧,老爸的货车停在广场里,旁边都是大家的帐篷。

就这样睡了几天之后,我们回了老家,晚上就把床搬到大姑家的院坝里歇息,中途通知复课了好几次,去了好几次又通知继续放假,就这样大段无聊的时光过去,终于复课了,小学的教学楼成了危房,我们转移到了操场的棚子里上课,暑天的太阳格外毒辣,数学老师都中暑了,我记得语文课讲了文成公主进藏,松赞干布之类的课文。

以上是我个人的汶川地震的经历,平淡乏味。但无数的人在那个时间倒下,再也不能继续前行。到现在 B 站依然还会给我推这些视频:播报汶川地震的主持人的专业素养抑不住泪流和哽咽;凭着对家人的强烈信念坚持了70多小时的老朽被救出后仍然不治身亡;

能够普普通通过完一生本就极度幸运了,如果有机会做一些事情当然更好。这次余震很多人的电视和手机上都收到了地震预警,有效地减少了人员伤亡,致敬背后的科研人员!是真正的将论文落到实处,写在祖国大地上。
Muyun99的杂谈
之前是看到这个模型能“在人类的纠正下”创作出短篇小说的。昨天去考试前还在讨论GPT-3能不能给他段红楼梦的原话,把红楼梦直接补出来一章,感觉这个模型过拟合会很严重,只是由于他模型参数太大了,训练数据量又很多,所以看起来很牛逼的样子。就好像一个人的创新能力很差,但是他看了很多很多书并且记住了相当比例的内容,所以外人听不出来他说的话都是抄袭的。 这又是信息安全的一个坑了hhh,人工智能的信息安全问题。之前看到一个网站 thispersondoesnotexist.com 。是通过GAN生成一个世界上不存在的…
最近看到很多人在讨论 GitHub 的copilot,在去年我也想过 AI 模型的安全隐私问题,图像领域很多真实场景的数据集都是通过摄像头去采集的,大部分人像是没有经过授权的。还有著名的 Google 的 JFM-300M数据集,从互联网上爬了 300M (3亿)图像来预训练模型,这类大力出奇迹的工作避免不了对隐私数据的侵害。

而 GitHub 这波操作是不管公有私有,不论开源 LICENSE 直接薅代码过来训的做法确实问题很大
基于猴子打字机原理的人工智能补全工具:给我一个函数名和足够的试错时间,我就能再写出一个 linux 系统