Post AbGVT4z9r96idCWqcS by Camus@bgme.me
 (DIR) More posts by Camus@bgme.me
 (DIR) Post #AbGVT4z9r96idCWqcS by Camus@bgme.me
       0 likes, 0 repeats
       
       #关于AI诶,我真是不想再看到用AI的了为毛象上的广大创意行业有良知的香油再次发声---------首先是原理部分,也就是生成式AI是如何诞生的(简略)首先科技公司先用各种手段获得大量ai需要的数据,图像类ai(Stable Diffusion、novelai、MJ)就需要图片,文字类AI(chatgpt)就是文字,音乐类AI就是音乐balabala获取手段包括但不限于全网爬虫,盗取海盗网网站资源(D站...)、把专供研究的数据用于开发商业AI,直接盗取声纹信息等等【这一步就是所谓的“训练集侵权”】openai是通过非法收集了无数互联网创作者的产出,获得了他们的数据,然后通过训练海量的数据才能得到了chatgpt(这些数据并不能直接复现,而是被提取特征之后以特殊的方式被记录进了潜空间,因此可以存储海量的数据,当然其也必然会有失真)这也是为啥美国的作家工会和编剧一起罢工数月(WGA罢工成功),最终取得了胜利。同样受到侵害的还有画家、音乐家、程序员、歌手、设计师等等至于使用生成式AI进一步进行洗稿操作,那是另外的恶行。比如图片侧I2I的直接洗稿or私炉(收集单个作者的大量作品训练一个小型AI,专门生成这个作者风格的AI图像),chatgpt的学习使用者给予的文稿进行仿写,非法虚假声纹(AI孙燕姿),设计侧通过mj进行洗稿抄袭------当然我们知道AI是没有理解能力的(请参阅其中的论文,生成式AI只是函数拟合器而已)https://bgme.me/@Camus/110724391166816815那这些AI是如何通过提示词或者使用者的问句来反馈的呢,答案是人工打标(是的毫无科技可言~)面对海量的重复数据,正常人肯定是毫无工作体验的,而且那些费用也难以支付,除了低人权国家的广大劳工。现在中国有大学甚至通过完成打标任务来限制学生毕业(工劳日报的一些相关新闻(finance.sina.cn/blockchain/2023-09-26/detail-imznzpkc1197867.d.html)(https://at.laborinfocn2.com/search?origin%5B%5D=tg&origin%5B%5D=crawler&q=%E6%A0%87%E6%B3%A8&range=all&order=_text_match&start_date=&end_date=)D站(Danbooru)是个特殊情况,作为一个老牌海盗湾网站,D站的每一张图片都是D站运营人员完全用爱发电手动打标来的,因此很多图像类AI完全越过了打标这座高山电费的事情比较公开,大家可以随便搜搜,对环境的压力还是不小的(https://www.hk01.com/%E5%8D%B3%E6%99%82%E5%9C%8B%E9%9A%9B/888087/chatgpt%E5%8B%81%E9%A3%9F%E9%9B%BB-1%E5%80%8B%E6%9C%88%E7%94%A8%E9%9B%BB%E7%AD%89%E6%96%BC17%E8%90%AC%E5%AE%B6%E5%BA%AD1%E5%B9%B4%E7%94%A8%E9%9B%BB%E9%87%8F-%E5%9A%B4%E9%87%8D%E8%80%97%E8%B2%BB%E8%B3%87%E6%BA%90)同为创意行业的工作者,我们是受害者,作为广大的普罗大众更是潜在的受害者,因为伪造数据的门槛变低了,更不要提AI因为原理上的不准确造成非主观伪信息带来的破坏(比如AI因为训练集偏差带来的歧视,把黑人照片美化为白人..) 鉴别ai的软件把非母语学习者的论文当成AI导致ta们失去学业https://bgme.me/@phyllisluna/111259494886525201好在广大创作者们并没有坐以待毙,自由程序员们率先向copilot发起了诉讼,编剧群体罢工成功击倒了好莱坞的资本势力,绘画侧更有人卖掉房子来帮助筹款与图像AI打官司也许此刻战况胶着,但是我们会一直战斗下去 :blobcat_MUDAMUDAMUDA: