神靈八百萬提示您:看后求收藏(詩鼎小說網網m.gzstf.cn),接著再看更方便。
“小說網站模型失敗的原因就在于面對所有用戶,它都只有一個接入口,所有人來到站點都只能看編輯大人事先準備好的內容,所有人!所有人!所有人!重要的事情說三遍,所有人看到的都是同一個內容,來來去去都是一些符合編輯口味的作品在首頁上大行其道。因為只有一條路,這條路上能走通的方向自然也是基本固定的了,這就是為什么小說庫的訪問范圍不超過01%的原因。
某易云音樂能達到整個曲庫訪問量的5%,這是因為它給每個用戶都開啟了一扇隨機門,每個用戶的推薦內容都是不同的,一千萬個用戶就意味著有一千萬個接入口,這么多條路,自然能夠讓整個曲庫的訪問范圍擴展到極大的一個范圍。
同樣作為數據管理系統,某易云音樂顯然是要強過小說網站的,強就強在它的自動推薦機制,現在的小說站點還不能有效的為用戶提供個性化的推薦服務。
我去質問小說站點:你們為何遲遲不推出高質量的推薦系統?
小說站點回復說:我也不想這樣呀!我們也有花錢投入,也有嘗試做出讓用戶滿意的東西呀!可是做不出來怎么辦嘛,投入資金沒有回報我有什么辦法嘛。
搞個推薦系統有這么難嗎?
于是我開始研究這個東西,發現確實挺難的,不過卻也沒有難到做不出來的程度。他們之所以沒有成功做出高質量的推薦系統,這是因為他們挖掘數據的方法不對。
問題的重點歸根結底只有一個,那就是如何讓程序來評判一部作品的好壞。
程序可沒有我們人類的大腦可以通過閱讀作品來評判作品的好壞,所以程序想要實現評判作品好壞只能從作品和讀者的行為來辨別作品的好壞。
我是個喜歡使用帶入思維的程序員,因為這個方式比較好使,于是我嘗試著帶入了程序,我問了我這樣一個問題:我應該如何在不看書本內容的情況下推斷出兩部作品的哪一部作品的質量更高呢
要去看看作品的點擊量嗎?但是啊,點擊量這個東西真的能衡量兩部作品誰好誰壞嗎?前面也說過了,因為小說站點只給讀者預留了一條路,所以基本上只要能上首頁,點擊量必定能上去,就算作品內容就是一坨屎,它在荼毒了大量讀者之后點擊量依然能夠超越大多數作品。這不是作品質量的勝利,而是能夠登錄首頁的勝利。
就算拋除首頁這個因素,兩部作品中其中一部是人氣作家的作品,作者本來就有觀看群體,他開的新書點擊量也肯定比新手作家的點擊量更高吧,這依然不是作品質量的勝利,而是人氣的勝利。
所以我認為點擊量這項數據不靠譜,它不能成為衡量作品好壞的關鍵數據。
那么要去看看作品的收藏數據嗎?
想了想還是不靠譜,因為小說站點上允許游客訪問,這些游客看作品是不會點擊收藏的,賬號都沒有收藏個屁啊。只看收藏數據豈不是對這些游客的意見不管不顧?來自游客的數據難道不作為參考依據了嗎?大數據之所以叫大數據,自然是需要足夠多的數據才能深挖出寶貴的數據,不僅不多收集數據,還要屏蔽大部分人的瀏覽數據這樣做顯然是不對的。
于是我得出結論,無論是點擊量還是收藏數據,都不能真正評判出一部作品的好壞。
得到這個結論的我當時驚了個呆,難道就沒有一種能夠真正評判作品好壞的參考數據嗎?
有,我想到了一個數據能夠評判作品的好壞。
這個思路有點奇葩,我把采集數據的重點從作品的身上轉移到了讀者的身上。
既然作品的數據不太靠譜的話,那么也只能從讀者的身上入手了呀!畢竟作品好不好還得靠讀者來評判不是?那么應該如何從讀者身上采集數據呢?點擊量是讀者貢獻的,收藏也是讀者貢獻的,我還能從讀者身上采集到怎樣的數據呢?