AI-For-Beginners/translations/mo/lessons/1-Intro
leestott 1689a2fdf9 🌐 Update translations via Co-op Translator 2025-08-26 12:09:18 +00:00
..
README.md 🌐 Update translations via Co-op Translator 2025-08-26 12:09:18 +00:00
assignment.md 🌐 Update translations via Co-op Translator 2025-08-26 12:09:18 +00:00

README.md

人工智慧簡介

AI 簡介內容的手繪圖

手繪筆記由 Tomomi Imura 提供

課前測驗

人工智慧是一門令人興奮的科學學科,研究如何讓電腦展現出智能行為,例如執行人類擅長的事情。

最初,電腦是由查爾斯·巴貝奇發明的用於按照明確定義的程序即算法處理數字。現代電腦雖然比19世紀提出的原始模型先進得多但仍然遵循受控計算的基本理念。因此如果我們知道實現目標所需的確切步驟序列就可以編程讓電腦執行某些任務。

一個人的照片

照片由 Vickie Soshnikova 提供

從一張照片中判斷一個人的年齡是一項無法明確編程的任務,因為我們無法解釋當我們做出判斷時,腦海中是如何得出這個數字的。


然而,有些任務我們並不知道如何明確解決。例如,從一張照片中判斷一個人的年齡。我們能夠學會這樣做,是因為我們見過許多年齡不同的人的例子,但我們無法明確解釋我們是如何做到的,也無法編程讓電腦完成這項任務。這正是人工智慧(簡稱 AI感興趣的任務類型。

想一想有哪些任務可以交給電腦處理,並且能從 AI 中受益。考慮金融、醫療和藝術領域——這些領域今天是如何從 AI 中受益的?

弱人工智慧與強人工智慧

弱人工智慧 強人工智慧
弱人工智慧指的是為特定任務或一組狹窄任務設計和訓練的 AI 系統。 強人工智慧或稱人工通用智慧AGI指的是具有與人類相當的智能和理解能力的 AI 系統。
這些 AI 系統並非通用智能;它們在執行預定義任務方面表現出色,但缺乏真正的理解或意識。 這些 AI 系統能夠執行人類可以完成的任何智力任務,適應不同的領域,並擁有某種形式的意識或自我認知。
弱人工智慧的例子包括虛擬助手(如 Siri 或 Alexa、流媒體服務使用的推薦算法以及專為特定客戶服務任務設計的聊天機器人。 實現強人工智慧是 AI 研究的長期目標,這需要開發能夠在廣泛任務和情境中進行推理、學習、理解和適應的 AI 系統。
弱人工智慧高度專業化,缺乏人類般的認知能力或超出其狹窄領域的通用問題解決能力。 強人工智慧目前仍是一個理論概念,尚無 AI 系統達到這種通用智能的水平。

更多資訊請參考 人工通用智慧 (AGI)。

智能的定義與圖靈測試

在討論**智能這個術語時,問題之一是我們對這個術語沒有明確的定義。有人認為智能與抽象思維自我意識**有關,但我們無法準確地定義它。

一隻貓的照片

照片Amber Kipp 提供,來自 Unsplash

為了體會“智能”這個術語的模糊性,試著回答這個問題:“貓是智能的嗎?”不同的人往往會給出不同的答案,因為沒有普遍接受的測試來證明這一說法的真偽。如果你認為有,那就試著讓你的貓參加智商測試吧……

想一分鐘,如何定義智能。一隻能解迷宮並獲得食物的烏鴉算智能嗎?一個小孩算智能嗎?


在討論 AGI 時,我們需要某種方法來判斷我們是否創造了一個真正智能的系統。艾倫·圖靈提出了一種方法,稱為**圖靈測試**,這也可以作為智能的定義。該測試將給定系統與某種固有智能的東西(即真人)進行比較,並且由於任何自動化比較都可能被電腦程序繞過,我們使用人類審查員。因此,如果一個人無法在基於文本的對話中區分真人和電腦系統,那麼該系統就被認為是智能的。

一個名為 Eugene Goostman 的聊天機器人在 2014 年接近通過圖靈測試,該機器人由聖彼得堡的團隊開發,並使用了一個巧妙的個性設計。它一開始就聲稱自己是一個 13 歲的烏克蘭男孩,這解釋了知識的缺乏和文本中的一些不一致性。該機器人在 5 分鐘的對話後說服了 30% 的評審員相信它是人類,這是一個圖靈認為機器應該在 2000 年之前能夠通過的指標。然而,我們應該明白,這並不意味著我們創造了一個智能系統,或者電腦系統欺騙了人類審查員——實際上是機器人的創作者欺騙了人類!

你是否曾經被聊天機器人誤導,以為自己在與真人對話?它是如何說服你的?

不同的 AI 方法

如果我們希望電腦像人類一樣行為,我們需要以某種方式在電腦中模擬我們的思維方式。因此,我們需要試圖理解是什麼讓人類具有智能。

為了能夠將智能編程到機器中,我們需要理解我們自己的決策過程是如何運作的。如果你進行一些自我反思,你會意識到有些過程是潛意識進行的——例如,我們可以在不經思考的情況下區分貓和狗——而另一些則涉及推理。

解決這個問題有兩種可能的方法:

自上而下方法(符號推理) 自下而上方法(神經網絡)
自上而下的方法模擬人類解決問題的推理方式。它涉及從人類中提取知識,並以電腦可讀的形式表示。我們還需要開發一種方法來在電腦中模擬推理 自下而上的方法模擬人腦的結構,由大量簡單單元(稱為神經元)組成。每個神經元的作用類似於其輸入的加權平均值,我們可以通過提供訓練數據來訓練神經網絡解決有用的問題。

此外,還有一些其他可能的智能方法:

  • 湧現式協同式多代理方法基於這樣一個事實,即通過大量簡單代理的交互可以獲得複雜的智能行為。根據進化控制論,智能可以在元系統轉變的過程中從更簡單的反應行為中湧現

  • 進化方法遺傳算法是一種基於進化原則的優化過程。

我們將在課程後續部分探討這些方法,但現在我們將重點放在兩個主要方向:自上而下和自下而上。

自上而下方法

自上而下方法中,我們試圖模擬我們的推理過程。由於我們在推理時可以跟隨自己的思路,我們可以嘗試將這一過程形式化並編程到電腦中。這被稱為符號推理

人們往往在頭腦中有一些指導決策過程的規則。例如,當醫生診斷病人時,他或她可能意識到病人有發燒症狀,因此可能存在某種炎症。通過將大量規則應用於特定問題,醫生可能最終得出診斷結論。

這種方法在很大程度上依賴於知識表示推理。從人類專家那裡提取知識可能是最困難的部分,因為醫生在許多情況下可能不知道自己為什麼得出某個診斷。有時解決方案只是突然出現在他的腦海中,沒有經過明確的思考。有些任務,例如從照片中判斷一個人的年齡,根本無法簡化為知識操作。

自下而上方法

或者,我們可以嘗試模擬我們大腦中的最簡單元素——神經元。我們可以在電腦中構建所謂的人工神經網絡,然後通過提供示例來教它解決問題。這個過程類似於新生兒通過觀察學習周圍環境的方式。

做一些研究,了解嬰兒是如何學習的。嬰兒大腦的基本元素是什麼?

那麼機器學習呢?
基於電腦通過數據學習解決問題的人工智慧部分被稱為機器學習。我們不會在本課程中討論傳統的機器學習——我們建議參考單獨的機器學習初學者課程 機器學習初學者課程

AI 的簡史

人工智慧作為一個領域始於20世紀中期。最初符號推理是一種流行的方法並且它帶來了一些重要的成功例如專家系統——能夠在某些有限問題領域中充當專家的電腦程序。然而很快就發現這種方法的可擴展性不佳。從專家那裡提取知識、將其表示為電腦可讀形式並保持知識庫的準確性事實證明這是一項非常複雜的任務在許多情況下成本過高而不切實際。這導致了1970年代所謂的AI 冬天

圖片由 Dmitry Soshnikov 提供

隨著時間的推移,計算資源變得更便宜,數據也變得更加豐富,神經網絡方法開始在許多領域(如計算機視覺或語音理解)中展現出與人類競爭的卓越性能。在過去十年中,“人工智慧”這個術語大多被用作神經網絡的同義詞,因為我們聽到的大多數 AI 成功案例都基於神經網絡。

我們可以觀察到這些方法的變化,例如在創建下棋電腦程序時:

  • 早期的下棋程序基於搜索——程序明確嘗試估計對手在給定數步內的可能走法,並根據幾步內可以達到的最佳位置選擇最佳走法。這導致了所謂的alpha-beta 剪枝搜索算法的發展。
  • 搜索策略在遊戲結束時效果很好,因為搜索空間受到少量可能走法的限制。然而,在遊戲開始時,搜索空間非常龐大,算法可以通過學習人類玩家之間的現有對局來改進。隨後的實驗採用了所謂的基於案例的推理,程序在知識庫中尋找與當前棋局非常相似的案例。
  • 現代能夠擊敗人類玩家的程序基於神經網絡和強化學習,程序通過長時間與自己對弈並從自己的錯誤中學習來學會下棋——這與人類學習下棋的方式非常相似。然而,電腦程序可以在更短的時間內進行更多的對局,因此學習速度更快。

做一些研究,了解其他由 AI 玩過的遊戲。

同樣,我們可以看到創建“會說話的程序”(可能通過圖靈測試)的方法如何改變:

  • 這類早期程序(如 Eliza)基於非常簡單的語法規則,並將輸入句子重新表述為問題。
  • 現代助手(如 Cortana、Siri 或 Google Assistant都是混合系統使用神經網絡將語音轉換為文本並識別我們的意圖然後使用一些推理或明確的算法執行所需操作。
  • 未來,我們可能會期待一個完全基於神經網絡的模型能夠自行處理對話。最近的 GPT 和 Turing-NLG 系列神經網絡在這方面表現出色。

圖片由 Dmitry Soshnikov 提供,照片Marina Abrosimova 提供Unsplash

最近的人工智慧研究

神經網路研究的快速增長始於 2010 年左右,當時大型公共數據集開始變得可用。一個名為 ImageNet 的龐大圖像集合包含約 1400 萬張帶註解的圖像,催生了 ImageNet 大規模視覺識別挑戰賽

ILSVRC 準確率

圖片由 Dmitry Soshnikov 提供

2012 年,卷積神經網路 首次被用於圖像分類,這導致分類錯誤率顯著下降(從接近 30% 降至 16.4%。2015 年,微軟研究院的 ResNet 架構達到了人類級別的準確率

自那時以來,神經網路在許多任務中展現了非常成功的表現:


年份 達成人類水平
2015 圖像分類
2016 對話式語音識別
2018 自動機器翻譯(中譯英)
2020 圖像描述生成

在過去幾年中,我們見證了大型語言模型的巨大成功,例如 BERT 和 GPT-3。這主要是因為有大量的通用文本數據可用這使得我們能夠訓練模型來捕捉文本的結構和意義先在通用文本集合上進行預訓練然後再將這些模型專門化用於更具體的任務。我們將在本課程稍後學習更多關於自然語言處理的內容。

🚀 挑戰

瀏覽互聯網,找出你認為人工智慧最有效的應用場景。是地圖應用程式、語音轉文字服務還是某款電子遊戲?研究該系統是如何構建的。

課後測驗

回顧與自學

通過閱讀這一課程來回顧人工智慧和機器學習的歷史。從該課程或本課程頂部的手繪筆記中選取一個元素,深入研究以了解其演變背後的文化背景。

作業遊戲開發馬拉松

免責聲明
本文件使用 AI 翻譯服務 Co-op Translator 進行翻譯。我們致力於提供準確的翻譯,但請注意,自動翻譯可能包含錯誤或不準確之處。應以原始語言的文件作為權威來源。對於關鍵資訊,建議尋求專業人工翻譯。我們對因使用此翻譯而引起的任何誤解或錯誤解讀概不負責。