主頁 >  其他 > 警惕AI,我搭建了一個“槍槍爆頭”的視覺AI自瞄程式,卻引發了一場“山雨欲來”

警惕AI,我搭建了一個“槍槍爆頭”的視覺AI自瞄程式,卻引發了一場“山雨欲來”

2021-09-10 07:17:27 其他

前言

前段時間在網上看到《警惕AI外掛!我寫了一個槍槍爆頭的視覺AI,又親手“殺死”了它》 這個視頻,引起了我極大的興趣,

視頻中提到,在國外有人給使命召喚做了個AI程式來實作自動瞄準功能,它跟傳統外掛不一樣,該程式不需要用游戲記憶體資料,也不往服務器發送作弊指令,只是通過計算機視覺來分析游戲畫面,定位敵人,把準星移動過去,跟人類玩家操作一模一樣,因此反外掛程式無法檢測到它,而且更恐怖的是這AI程式全平臺通用,不管是X-box,PS4還是手機,只要能把畫面接出來,把操作送進去,就可以實作“槍槍爆頭”,

外網的那個開發者用的是基于方框的目標檢測,但是像射擊游戲需要定位人體的場景,其實有比方框檢測更好的演算法,up主就利用了幾個小時的時間就寫出來了一個效果更好,功能更夸張的AI程式,也就是利用人體關節點檢測技術,通過大量真人圖片訓練出來的視覺AI,可以把視頻和圖片里人物的關節資訊提取出來 并給出每個部位中心點的精確像素坐標,而且雖然訓練的是是真人圖片,但是給它游戲里的人物,他也一樣能把人體關節定位出來,

可以說由于這類AI程式的出現,現在fps游戲的形式就是山雨欲來風滿樓,十分嚴峻啊!

下面,我們先開始介紹這個視覺AI自動瞄準的制作思路,然后再談談這個問題帶來的影響以及如何解決這個問題

一、核心功能設計

總體來說,我們首先需要訓練好一個人體關節點檢測的AI視覺模型,然后將游戲畫面實時送入AI視覺模型中,再反饋出游戲人物各個部位的像素位置,然后確定瞄準點,并將滑鼠移動到瞄準點位置,

拆解需求后,整理出核心功能如下:

  • 訓練人體關節點檢測模型
  • 輸入視頻或圖片到AI視覺模型,并輸出瞄準點位置
  • 自動操作滑鼠移動到對應瞄準位置

最終想要實作的效果如下圖所示:

二、核心實作步驟

1.訓練人體關節點檢測模型

在這一部分,我打算使用由微軟亞洲研究院和中科大提出High-Resoultion Net(HRNet)來進行人體關節點檢測,該模型通過在高解析度特征圖主網路逐漸并行加入低解析度特征圖子網路,不同網路實作多尺度融合與特征提取實作的,所以在目前的通用資料集上取得了較好的結果,

1.1 HRNet代碼庫安裝

按照官方的install指導命令,安裝十分簡單,我是采用本地源代碼安裝方式,

git clone https://github.com/leoxiaobin/deep-high-resolution-net.pytorch.git
python -m pip install -e deep-high-resolution-ne.pytorch

1.2 人體關鍵點資料集下載

首先打開COCO資料集官方下載鏈接,

對于Images一欄的綠色框需要下載三個大的檔案,分別對應的是訓練集,驗證集和測驗集:

2017 Train images [118K/18GB]
2017 Val images [5K/1GB]
2017 Test images [41K/6GB]

對于Annotations一欄綠色框需要下載一個標注檔案:

2017 Train/Val annotations [241MB]

將檔案解壓后,可以得到如下目錄結構:

其中的 person_keypoints_train2017.jsonperson_keypoints_val2017.json 分別對應的人體關鍵點檢測對應的訓練集和驗證集標注,

annotations
├── captions_train2017.json
├── captions_val2017.json
├── instances_train2017.json
├── instances_val2017.json
├── person_keypoints_train2017.json 人體關鍵點檢測對應的訓練集標注檔案
└── person_keypoints_val2017.json 人體關鍵點檢測對應的驗證集標注檔案

在本地代碼庫datasets目錄下面新建立coco目錄,將上面的訓練集,驗證集以及標注檔案放到本地代碼的coco目錄下面

datasets
├── coco
│ ├── annotations
│ ├── test2017
│ ├── train2017
│ └── val2017

1.3 環境配置與模型訓練

核心訓練代碼如下:

def train(config, train_loader, model, criterion, optimizer, epoch,
          output_dir, tb_log_dir, writer_dict):
    batch_time = AverageMeter()
    data_time = AverageMeter()
    losses = AverageMeter()
    acc = AverageMeter()
    # switch to train mode
    model.train()
    end = time.time()
    for i, (input, target, target_weight, meta) in enumerate(train_loader):
        data_time.update(time.time() - end)
        outputs = model(input)
        target = target.cuda(non_blocking=True)
        target_weight = target_weight.cuda(non_blocking=True)
        if isinstance(outputs, list):
            loss = criterion(outputs[0], target, target_weight)
            for output in outputs[1:]:
                loss += criterion(output, target, target_weight)
        else:
            output = outputs
            loss = criterion(output, target, target_weight)
        optimizer.zero_grad()
        loss.backward()
        optimizer.step()
        # measure accuracy and record loss
        losses.update(loss.item(), input.size(0))
        _, avg_acc, cnt, pred = accuracy(output.detach().cpu().numpy(),
                                         target.detach().cpu().numpy())
        acc.update(avg_acc, cnt)
        batch_time.update(time.time() - end)
        end = time.time()
        if i % config.PRINT_FREQ == 0:
            msg = 'Epoch: [{0}][{1}/{2}]\t' \
                  'Time {batch_time.val:.3f}s ({batch_time.avg:.3f}s)\t' \
                  'Speed {speed:.1f} samples/s\t' \
                  'Data {data_time.val:.3f}s ({data_time.avg:.3f}s)\t' \
                  'Loss {loss.val:.5f} ({loss.avg:.5f})\t' \
                  'Accuracy {acc.val:.3f} ({acc.avg:.3f})'.format(
                      epoch, i, len(train_loader), batch_time=batch_time,
                      speed=input.size(0)/batch_time.val,
                      data_time=data_time, loss=losses, acc=acc)
            logger.info(msg)
            writer = writer_dict['writer']
            global_steps = writer_dict['train_global_steps']
            writer.add_scalar('train_loss', losses.val, global_steps)
            writer.add_scalar('train_acc', acc.val, global_steps)
            writer_dict['train_global_steps'] = global_steps + 1
            prefix = '{}_{}'.format(os.path.join(output_dir, 'train'), i)
            save_debug_images(config, input, meta, target, pred*4, output,
                              prefix)

訓練結果:

2.輸入視頻或圖片實時反饋瞄準點坐標

2.1 實時讀取螢屏畫面

import pyautogui
img = pyautogui.screenshot()

在一個 1920×1080 的螢屏上,screenshot()函式要消耗100微秒,基本達到實時傳入游戲畫面要求,

如果不需要截取整個螢屏,還有一個可選的region引數,你可以把截取區域的左上角XY坐標值和寬度、高度傳入截取,

im = pyautogui.screenshot(region=(0, 0, 300 ,400))

2.2 讀取圖片反饋坐標

parser.add_argument('--keypoints', help='f:full body 17 keypoints,h:half body 11 keypoints,sh:small half body 6 keypotins')
hp = PoseEstimation(config=args.keypoints, device="cuda:0")

可以選擇人體關節點檢測數目,包括上半身6個關鍵點、上半身11個關鍵點以及全身17個關鍵點,然后構建探測器,

人體關節點對應序號:

"keypoints": { 0: "nose", 1: "left_eye", 2: "right_eye", 3: "left_ear", 4: "right_ear", 5: "left_shoulder", 6: "right_shoulder", 7: "left_elbow", 8: "right_elbow", 9: "left_wrist", 10: "right_wrist", 11: "left_hip", 12: "right_hip", 13: "left_knee", 14: "right_knee", 15: "left_ankle", 16: "right_ankle" }

因此如果為了自動瞄準頭部實作“槍槍爆頭”,僅需要反饋 0: "nose"的坐標點就行了,

代碼如下:

location=hp.detect_head(img_path, detect_person=True, waitKey=0)

def detect_head(self, image_path, detect_person=True, waitKey=0):
        
    bgr_image = cv2.imread(image_path)
    kp_points, kp_scores, boxes = self.detect_image(bgr_image,
                                                    threshhold=self.threshhold,
                                                    detect_person=detect_person)
    return kp_points[0][0]

輸出結果:[701.179 493.55]

可以看到雖然訓練的是真人圖片,但是給它游戲里的人物,它也一樣能把人體關節定位出來,

深度神經網路之所以厲害,就是因為它有一定的演繹推廣能力,沒見過的東西,他也能靠著層次線索分析一波,結果往往也挺準,而且游戲場景是現實場景的簡化之后的結果,環境和光影都要簡單的多,能把現實世界分析明白的視覺AI,對付個3D游戲更是小菜一碟了,

3.自動移動滑鼠到對應的坐標點

3.1 移動滑鼠

移動到指定位置:

pyautogui.moveTo(100,300,duration=1)

將滑鼠移動到指定的坐標;duration 的作用是設定移動時間,所有的gui函式都有這個引數,而且都是可選引數,

獲取滑鼠位置:

print(pyautogui.position())   # 得到當前滑鼠位置;輸出:Point(x=200, y=800)

3.2 控制滑鼠點擊

單擊滑鼠:

# 點擊滑鼠
pyautogui.click(10,10)   # 滑鼠點擊指定位置,默認左鍵
pyautogui.click(10,10,button='left')  # 單擊左鍵
pyautogui.click(1000,300,button='right')  # 單擊右鍵
pyautogui.click(1000,300,button='middle')  # 單擊中間

雙擊滑鼠:

pyautogui.doubleClick(10,10)  # 指定位置,雙擊左鍵
pyautogui.rightClick(10,10)   # 指定位置,雙擊右鍵
pyautogui.middleClick(10,10)  # 指定位置,雙擊中鍵

點擊 & 釋放:

pyautogui.mouseDown()   # 滑鼠按下
pyautogui.mouseUp()    # 滑鼠釋放

至此,視覺AI自瞄程式已經基本設計完成,最終實作效果可以參見這個up主的視頻,

<iframe id="qlVVzGU7-1631081544423" src="https://player.bilibili.com/player.html?aid=547395814&page=1" allowfullscreen="true" data-mediaembed="bilibili"></iframe>

【亦】警惕AI外掛!我寫了一個槍槍爆頭的視覺AI,又親手“殺死”了它

三、引發的思考

也正如up主所說,視覺AI給FPS游戲帶來的這一輪重大危機!

這類視覺AI程式目前存在三個威脅:

  • 準確性
  • 隱蔽性
  • 通用性

第一個威脅就是超越人類的準確性,雖然人腦的高層次演繹歸納能力是遠勝于AI的,但是在低級資訊處理速度和精確度上,人類就很難比得過專精某個功能的AI了,比如在人體關節定位這件事上,給出人體每個部位的中心位置只需要幾毫秒,而且精確到像素點,而同樣一張圖片給人類看個幾毫秒,都不一定能夠看清人在哪,更別說定位關節移動滑鼠了,

第二個威脅就是無法被外掛程式檢測的隱蔽性,和傳統外掛不一樣,傳統外掛要操作游戲的記憶體資料或者檔案資料,從而獲取游戲世界的資訊,讓開掛的人打出一些正常玩家不可能實作的作弊操作,而視覺AI是完全獨立于游戲資料之外的,和人一樣,也是通過實時觀察畫面發送滑鼠和鍵盤指令,所以傳統的反外掛程式只能反個寂寞,

第三個威脅就是適用全平臺的通用性,首先這個AI視覺模型是通過大量真人照片訓練出來的,但是能夠識別游戲中的人物,這意味著可以攻陷大部分FPS游戲,AI操作游戲和人操作游戲互動方式是沒區別的,所以衍生出更大的問題,只要能把畫面接入到這個模型中,就可以攻陷任意一種游戲平臺,包括電腦、主機、手機等,無論你做的多封閉,生態維護的多好,在視覺AI面前眾生平等,

那么我們該如何解決這個問題呢

up主提到可以通過演算法檢測游戲例外操作,這也是一種思路,但是實作起來還是比較困難,畢竟可以讓AI更像人類的操作,

而我想到之前比較火的deepfake,那么我們是不是可以通過對抗樣本來解決這個問題呢,使得視覺AI識別錯誤?

說了那么多,其實也沒有什么好的結論,只能說技術的發展是在不斷對抗中前進以及規范

參考:

《Deep High-Resolution Representation Learning for Human Pose Estimation》https://github.com/leoxiaobin/deep-high-resolution-net.pytorch

2D Pose人體關鍵點實時檢測(Python/Android /C++ Demo)

實戰Detectron2— 訓練人體關鍵點檢測

PyQt5 實時獲取螢屏界面影像,python3使用matplotlib

警惕AI外掛!我寫了一個槍槍爆頭的視覺AI,又親手“殺死”了它


今天我們就到這里,明天繼續努力!

如果該文章對您有所幫助,麻煩點贊,關注,收藏三連支持下!

創作不易,白嫖不好,各位的支持和認可,是我創作的最大動力!

如果本篇博客有任何錯誤,請批評指教,不勝感激 !!!

轉載請註明出處,本文鏈接:https://www.uj5u.com/qita/298875.html

標籤:AI

上一篇:OpenAI 以 10 億美元出售「靈魂」,網友熱評不再「Open」

下一篇:【計組】求海明碼(保證您看懂)

標籤雲
其他(157675) Python(38076) JavaScript(25376) Java(17977) C(15215) 區塊鏈(8255) C#(7972) AI(7469) 爪哇(7425) MySQL(7132) html(6777) 基礎類(6313) sql(6102) 熊猫(6058) PHP(5869) 数组(5741) R(5409) Linux(5327) 反应(5209) 腳本語言(PerlPython)(5129) 非技術區(4971) Android(4554) 数据框(4311) css(4259) 节点.js(4032) C語言(3288) json(3245) 列表(3129) 扑(3119) C++語言(3117) 安卓(2998) 打字稿(2995) VBA(2789) Java相關(2746) 疑難問題(2699) 细绳(2522) 單片機工控(2479) iOS(2429) ASP.NET(2402) MongoDB(2323) 麻木的(2285) 正则表达式(2254) 字典(2211) 循环(2198) 迅速(2185) 擅长(2169) 镖(2155) 功能(1967) .NET技术(1958) Web開發(1951) python-3.x(1918) HtmlCss(1915) 弹簧靴(1913) C++(1909) xml(1889) PostgreSQL(1872) .NETCore(1853) 谷歌表格(1846) Unity3D(1843) for循环(1842)

熱門瀏覽
  • 網閘典型架構簡述

    網閘架構一般分為兩種:三主機的三系統架構網閘和雙主機的2+1架構網閘。 三主機架構分別為內端機、外端機和仲裁機。三機無論從軟體和硬體上均各自獨立。首先從硬體上來看,三機都用各自獨立的主板、記憶體及存盤設備。從軟體上來看,三機有各自獨立的作業系統。這樣能達到完全的三機獨立。對于“2+1”系統,“2”分為 ......

    uj5u.com 2020-09-10 02:00:44 more
  • 如何從xshell上傳檔案到centos linux虛擬機里

    如何從xshell上傳檔案到centos linux虛擬機里及:虛擬機CentOs下執行 yum -y install lrzsz命令,出現錯誤:鏡像無法找到軟體包 前言 一、安裝lrzsz步驟 二、上傳檔案 三、遇到的問題及解決方案 總結 前言 提示:其實很簡單,往虛擬機上安裝一個上傳檔案的工具 ......

    uj5u.com 2020-09-10 02:00:47 more
  • 一、SQLMAP入門

    一、SQLMAP入門 1、判斷是否存在注入 sqlmap.py -u 網址/id=1 id=1不可缺少。當注入點后面的引數大于兩個時。需要加雙引號, sqlmap.py -u "網址/id=1&uid=1" 2、判斷文本中的請求是否存在注入 從文本中加載http請求,SQLMAP可以從一個文本檔案中 ......

    uj5u.com 2020-09-10 02:00:50 more
  • Metasploit 簡單使用教程

    metasploit 簡單使用教程 浩先生, 2020-08-28 16:18:25 分類專欄: kail 網路安全 linux 文章標簽: linux資訊安全 編輯 著作權 metasploit 使用教程 前言 一、Metasploit是什么? 二、準備作業 三、具體步驟 前言 Msfconsole ......

    uj5u.com 2020-09-10 02:00:53 more
  • 游戲逆向之驅動層與用戶層通訊

    驅動層代碼: #pragma once #include <ntifs.h> #define add_code CTL_CODE(FILE_DEVICE_UNKNOWN,0x800,METHOD_BUFFERED,FILE_ANY_ACCESS) /* 更多游戲逆向視頻www.yxfzedu.com ......

    uj5u.com 2020-09-10 02:00:56 more
  • 北斗電力時鐘(北斗授時服務器)讓網路資料更精準

    北斗電力時鐘(北斗授時服務器)讓網路資料更精準 北斗電力時鐘(北斗授時服務器)讓網路資料更精準 京準電子科技官微——ahjzsz 近幾年,資訊技術的得了快速發展,互聯網在逐漸普及,其在人們生活和生產中都得到了廣泛應用,并且取得了不錯的應用效果。計算機網路資訊在電力系統中的應用,一方面使電力系統的運行 ......

    uj5u.com 2020-09-10 02:01:03 more
  • 【CTF】CTFHub 技能樹 彩蛋 writeup

    ?碎碎念 CTFHub:https://www.ctfhub.com/ 筆者入門CTF時時剛開始刷的是bugku的舊平臺,后來才有了CTFHub。 感覺不論是網頁UI設計,還是題目質量,賽事跟蹤,工具軟體都做得很不錯。 而且因為獨到的金幣制度的確讓人有一種想去刷題賺金幣的感覺。 個人還是非常喜歡這個 ......

    uj5u.com 2020-09-10 02:04:05 more
  • 02windows基礎操作

    我學到了一下幾點 Windows系統目錄結構與滲透的作用 常見Windows的服務詳解 Windows埠詳解 常用的Windows注冊表詳解 hacker DOS命令詳解(net user / type /md /rd/ dir /cd /net use copy、批處理 等) 利用dos命令制作 ......

    uj5u.com 2020-09-10 02:04:18 more
  • 03.Linux基礎操作

    我學到了以下幾點 01Linux系統介紹02系統安裝,密碼啊破解03Linux常用命令04LAMP 01LINUX windows: win03 8 12 16 19 配置不繁瑣 Linux:redhat,centos(紅帽社區版),Ubuntu server,suse unix:金融機構,證券,銀 ......

    uj5u.com 2020-09-10 02:04:30 more
  • 05HTML

    01HTML介紹 02頭部標簽講解03基礎標簽講解04表單標簽講解 HTML前段語言 js1.了解代碼2.根據代碼 懂得挖掘漏洞 (POST注入/XSS漏洞上傳)3.黑帽seo 白帽seo 客戶網站被黑帽植入劫持代碼如何處理4.熟悉html表單 <html><head><title>TDK標題,描述 ......

    uj5u.com 2020-09-10 02:04:36 more
最新发布
  • 2023年最新微信小程式抓包教程

    01 開門見山 隔一個月發一篇文章,不過分。 首先回顧一下《微信系結手機號資料庫被脫庫事件》,我也是第一時間得知了這個訊息,然后跟蹤了整件事情的經過。下面是這起事件的相關截圖以及近日流出的一萬條資料樣本: 個人認為這件事也沒什么,還不如關注一下之前45億快遞資料查詢渠道疑似在近日復活的訊息。 訊息是 ......

    uj5u.com 2023-04-20 08:48:24 more
  • web3 產品介紹:metamask 錢包 使用最多的瀏覽器插件錢包

    Metamask錢包是一種基于區塊鏈技術的數字貨幣錢包,它允許用戶在安全、便捷的環境下管理自己的加密資產。Metamask錢包是以太坊生態系統中最流行的錢包之一,它具有易于使用、安全性高和功能強大等優點。 本文將詳細介紹Metamask錢包的功能和使用方法。 一、 Metamask錢包的功能 數字資 ......

    uj5u.com 2023-04-20 08:47:46 more
  • vulnhub_Earth

    前言 靶機地址->>>vulnhub_Earth 攻擊機ip:192.168.20.121 靶機ip:192.168.20.122 參考文章 https://www.cnblogs.com/Jing-X/archive/2022/04/03/16097695.html https://www.cnb ......

    uj5u.com 2023-04-20 07:46:20 more
  • 從4k到42k,軟體測驗工程師的漲薪史,給我看哭了

    清明節一過,盲猜大家已經無心上班,在數著日子準備過五一,但一想到銀行卡里的余額……瞬間心情就不美麗了。最近,2023年高校畢業生就業調查顯示,本科畢業月平均起薪為5825元。調查一出,便有很多同學表示自己又被平均了。看著這一資料,不免讓人想到前不久中國青年報的一項調查:近六成大學生認為畢業10年內會 ......

    uj5u.com 2023-04-20 07:44:00 more
  • 最新版本 Stable Diffusion 開源 AI 繪畫工具之中文自動提詞篇

    🎈 標簽生成器 由于輸入正向提示詞 prompt 和反向提示詞 negative prompt 都是使用英文,所以對學習母語的我們非常不友好 使用網址:https://tinygeeker.github.io/p/ai-prompt-generator 這個網址是為了讓大家在使用 AI 繪畫的時候 ......

    uj5u.com 2023-04-20 07:43:36 more
  • 漫談前端自動化測驗演進之路及測驗工具分析

    隨著前端技術的不斷發展和應用程式的日益復雜,前端自動化測驗也在不斷演進。隨著 Web 應用程式變得越來越復雜,自動化測驗的需求也越來越高。如今,自動化測驗已經成為 Web 應用程式開發程序中不可或缺的一部分,它們可以幫助開發人員更快地發現和修復錯誤,提高應用程式的性能和可靠性。 ......

    uj5u.com 2023-04-20 07:43:16 more
  • CANN開發實踐:4個DVPP記憶體問題的典型案例解讀

    摘要:由于DVPP媒體資料處理功能對存放輸入、輸出資料的記憶體有更高的要求(例如,記憶體首地址128位元組對齊),因此需呼叫專用的記憶體申請介面,那么本期就分享幾個關于DVPP記憶體問題的典型案例,并給出原因分析及解決方法。 本文分享自華為云社區《FAQ_DVPP記憶體問題案例》,作者:昇騰CANN。 DVPP ......

    uj5u.com 2023-04-20 07:43:03 more
  • msf學習

    msf學習 以kali自帶的msf為例 一、msf核心模塊與功能 msf模塊都放在/usr/share/metasploit-framework/modules目錄下 1、auxiliary 輔助模塊,輔助滲透(埠掃描、登錄密碼爆破、漏洞驗證等) 2、encoders 編碼器模塊,主要包含各種編碼 ......

    uj5u.com 2023-04-20 07:42:59 more
  • Halcon軟體安裝與界面簡介

    1. 下載Halcon17版本到到本地 2. 雙擊安裝包后 3. 步驟如下 1.2 Halcon軟體安裝 界面分為四大塊 1. Halcon的五個助手 1) 影像采集助手:與相機連接,設定相機引數,采集影像 2) 標定助手:九點標定或是其它的標定,生成標定檔案及內參外參,可以將像素單位轉換為長度單位 ......

    uj5u.com 2023-04-20 07:42:17 more
  • 在MacOS下使用Unity3D開發游戲

    第一次發博客,先發一下我的游戲開發環境吧。 去年2月份買了一臺MacBookPro2021 M1pro(以下簡稱mbp),這一年來一直在用mbp開發游戲。我大致分享一下我的開發工具以及使用體驗。 1、Unity 官網鏈接: https://unity.cn/releases 我一般使用的Apple ......

    uj5u.com 2023-04-20 07:40:19 more