浙東匹夫提示您:看后求收藏(詩(shī)鼎小說網(wǎng)網(wǎng)m.gzstf.cn),接著再看更方便。
“你和對(duì)方打心理戰(zhàn),一開始就錯(cuò)了,肯定是被顧莫杰的計(jì)策坑了。”
“咱阿爾法GO,也能做到120手之后全放手——如果中間雙方?jīng)]有大規(guī)模打劫、換子、被吃等導(dǎo)致盤面過于空下來(lái)的情況——而初音比我們谷歌的團(tuán)隊(duì)更懂圍棋,起步也早半年,價(jià)值取舍算法肯定也有優(yōu)勢(shì),估計(jì)顧莫杰下到100手之后就徹底雙放手了,后面的苦思冥想都是假裝給你看的!”
“顧莫杰那套機(jī)器肯定也和我們的阿爾法GO一樣,有‘告訴使用者當(dāng)前所走的步驟是否是權(quán)衡利弊之后為了節(jié)約時(shí)間而拿出的權(quán)宜之計(jì)’這個(gè)功能,所以顧莫杰也絕對(duì)不可能每一步都在那兒思考的。所以那些你覺得一個(gè)專業(yè)棋手應(yīng)該馬上做出判斷的步數(shù),他肯定也是裝給你看思考的。”
一群連夜被李世石接見的谷歌工程師,趁著飯桌上的功夫,嘰嘰喳喳給李世石科普了不少東西,聽得人心煩意亂。
在李世石想暴躁之前,還是跟他來(lái)觀戰(zhàn)的韓國(guó)棋院梁院長(zhǎng)開口打圓場(chǎng):
“好了,黃教授,這種事兒就長(zhǎng)話短說吧。畢竟李九段還要休息,今天下了一天棋已經(jīng)很累了,9點(diǎn)之后就必須放空大腦。你們只有兩個(gè)小時(shí),沒用的就別說了。”
谷歌那名來(lái)自灣灣的價(jià)值權(quán)衡算法負(fù)責(zé)人,被稱作“黃教授”的,立刻住口了,也讓手下的講解員住口。
“不好意思,剛才這些也就是隨口一說。充分了解對(duì)手,也是在幫助李九段贏得勝利么。后面,我們今晚還是重點(diǎn)講講阿爾法GO明天能夠帶來(lái)什么好處、如何與李九段合作吧。”
黃教授說著,示意李世石別耽誤時(shí)間,一邊吃一邊聽就好了。
李世石也不和他客氣,其他人在那兒圍著他聊,他抓緊時(shí)間吃晚飯。
江南會(huì)提供的伙食,那也絕對(duì)是華夏料理的巔峰,為了不落口實(shí),這幾天對(duì)李世石的招待可謂是極盡奢華。但龍肝鳳髓吃在嘴里,李世石都覺得沒什么味兒。
還不如贏比賽的時(shí)候灌兩口辣泡菜痛快。
黃教授和他的助手依次給李世石講解:
“阿爾法GO雖然不如初行完善,但是官子肯定是沒問題的。想你們今天這盤棋下到220手才分勝負(fù)。實(shí)際上170手之后的最后50手,如果雙方都是機(jī)器人,結(jié)果肯定是下多少遍都不會(huì)變的,而且只要15分鐘就能下完那50步。”
正常人類下圍棋,最后50手雙方加起來(lái)怎么也要1個(gè)多小時(shí),而機(jī)器人15分鐘搞定,相當(dāng)于起碼可以比人類下棋節(jié)約1個(gè)鐘頭的總比賽時(shí)間。
這些時(shí)間就可以更好地分配到前面的步驟中去,每人多半小時(shí)思考。
至于第二天具體李世石走到多少步之后徹底雙放手交給阿爾法GO,李世石準(zhǔn)備吃完飯稍微和阿爾法狗試幾個(gè)150手左右的中盤殘局——從他本人歷史上和對(duì)手下的比較膠著的棋局中挑——來(lái)試試看阿爾法GO的水準(zhǔn)。
“另外,阿爾法GO在布局階段也談不上什么能力,只能是給你一些參考定式,你看了之后挑出其中最好的一個(gè)結(jié)果就行——我們只能保證,最好的結(jié)果肯定在那個(gè)八屏選項(xiàng)之內(nèi),但是具體是哪一個(gè),阿爾法GO判斷不出。”
“阿爾法GO也有做‘價(jià)值判斷網(wǎng)絡(luò)’這個(gè)工具,到時(shí)候在給出機(jī)器意見之后,會(huì)在屏幕上打出一個(gè)判斷,告訴你‘這一步是絕對(duì)不可能有更好的解法’了,還是‘機(jī)器也不知道誰(shuí)最好,只是沒時(shí)間想暫時(shí)覺得這個(gè)最好’。所以那些機(jī)器肯拍胸脯告訴你這就是最佳答案的步驟,你也可以省掉一些思考時(shí)間。”
李世石聽到這兒,停下了筷子,親口向黃教授確認(rèn)了這玩意兒的運(yùn)作法則。
黃教授也不藏私,坦蕩地告訴他:阿爾法GO里面其實(shí)是有兩套走子算法的,第一套是絕對(duì)窮盡最佳可能性的算法,但是耗時(shí)非常巨大。哪怕以如今谷歌的云端服務(wù)器群和積累的棋局大數(shù)據(jù),也要很久才能算一步棋。
畢竟,圍棋是如今人類傳統(tǒng)棋類運(yùn)動(dòng)中,計(jì)算量最大的。圍棋的可能性相比于國(guó)際象棋和象棋,根本就是一個(gè)天文數(shù)字。
所以,阿爾法GO的深度學(xué)習(xí),主要還體現(xiàn)在一點(diǎn)上:發(fā)現(xiàn)算法一會(huì)嚴(yán)重超時(shí)的時(shí)候,它會(huì)做出一個(gè)省時(shí)的判斷,下一個(gè)不算太差的子。而這種猴版省時(shí)算法只要第一類窮盡算法的數(shù)百分之一時(shí)間就夠了。
李世石吃完飯,用了點(diǎn)茶水,略作休息,就和黃教授的團(tuán)隊(duì)鉆研起磨合之法。
不過,他終究是沒辦法和顧莫杰那樣的人工智能本領(lǐng)域大能,比試對(duì)人工智能的理解程度和配合程度的。
多年形成的習(xí)慣,更不是幾個(gè)晚上可以扭轉(zhuǎn)。
臨陣磨槍一番,最后也不過是讓李世石在第二天的比賽中省出大約1個(gè)小時(shí)的思考時(shí)間、節(jié)省了不少腦力。
就像一個(gè)考高數(shù)的考生,被允許帶計(jì)算器。但是計(jì)算器并不會(huì)解高數(shù)題,只能幫答題者省點(diǎn)時(shí)間,減少些低級(jí)錯(cuò)誤。
……
全世界的目光,繼續(xù)凝望在江南會(huì)這一片池館雅閣之間。
數(shù)十億人次的曝光量,形成了比世界杯決賽還強(qiáng)的高光時(shí)刻。
谷歌出手了!終于不是人機(jī)打真人,而是人機(jī)打人機(jī)!
雙方都是最終完全體的終極對(duì)決!
12月23日,第三戰(zhàn)!
顧莫杰執(zhí)黑,回到了古力流的“對(duì)李先行大勝率”模式。開局一陣天馬行空的猛烈布局,把李世石的發(fā)揮空間驟然限縮了二三十手,也讓顧莫杰微微松了口氣。
隨后便是激烈的搏殺。
顧莫杰可以發(fā)揮作用的時(shí)候越來(lái)越少,大部分都是交給初行在下。唯有某些初行給出“高危”耗時(shí)的步驟時(shí),顧莫杰才乾綱獨(dú)斷作出處置——而且這種處置基本上每出現(xiàn)一次,就會(huì)平均讓顧莫杰的盤面預(yù)估分降低半目左右。
但他沒有辦法。
唯有當(dāng)局面看上去很像此前幾個(gè)月古力給他特訓(xùn)的那幾千局開局中的定式,或者很像古李對(duì)戰(zhàn)的歷史記錄時(shí),顧莫杰才會(huì)徹底親自發(fā)揮。
“谷歌的工程師可以教會(huì)李世石怎么初步應(yīng)用人工智能助手、怎么和人工智能配合分配時(shí)間。但是谷歌的人肯定不怎么懂圍棋圈子。美國(guó)人沒有第一手的古力和李世石對(duì)抗的具體心路歷程——所以,阿爾法GO在布局上的幫助,就等于是一個(gè)廢物!”
顧莫杰反復(fù)深呼吸,把這個(gè)印象烙在自己腦子里。
60手,顧莫杰盤面預(yù)估居然已經(jīng)劣勢(shì)了2目!
勉強(qiáng)撐到80手,預(yù)估劣勢(shì)4目!
顧莫杰的額頭,已經(jīng)見汗。