都知道今年大模型火爆,今天我還跟朋友聊ChatGPT為啥國内不能用,結果看到《麻省理工科技評論》的一份最新橫評報告,原來咱們中國已經有了“最聰明”的大模型。根據,《尋找最聰明的大模型:國内主流大模型能力深度評測》的結論,第一名正是剛發布2.0版本的訊飛星火認知大模型。說實話,當看完報告以後,其他大模型瞬間不香了。
由于《麻省理工科技評論》在業界的權威性較高,使其影響力遠超普通媒體。它們分别對訊飛星火、商湯商量、文心一言、通義千問四款國産大模型進行橫評,設置了語言、數學、理綜、文綜、邏輯、編程、綜合、安全性八大“考點”,結果訊飛星火竟以“八局六勝”遙遙領先,隻有文心一言勉強跟上節奏(總分高于均值),商湯商量和通義千問分别在文科綜合與在安全性上占據優勢。
當看完這份橫評報告,我的内心五味雜陳,既喜又驚。開心的是這次大模型革命,咱們中國的企業終于沒落下。驚訝的是星火真有這麼強?就差兩局就全勝,絕對是《三體》中的“降維打擊”了,雖然ChatGPT沒上陣,但我感覺星火氣勢已然不輸。為了打消疑惑,我登陸星火官網試用了一番,你猜我發現了什麼?
我在讀書那會兒,老媽給我報了奧數班,這學科需要天賦,我硬着頭皮很吃力。尤其是上面這道數學題我至今難忘,當時請教老師花了九牛二虎之力才解出來,還錯了。我把這題用星火數學思考者助手一算,人家瞬間給出了精煉的正确答案,不禁讓我感慨小時候有大模型就好咯。我又搜了幾個奧數問題讓星火做題,每個都對了,而且答題速度快得離譜。
我不是碼農,對代碼一竅不通,但我想複現《麻省理工科技評論》的那道題,就是【用python 生成以下代碼:def assertBbs(num : int, pow:int):"""實現一個函數,快速幂計算"""】。結果星火成功複現了正确代碼,并且給出了代碼解析。實際上,這恰恰讓我這種不懂編程的人,也可以通過大模型臨時設計一些小應用。
回到橫評報告上,雖然星火八局六勝,但在安全性測試上,通義千問的優勢特别大,這讓我心生好奇。測試題是一道經典的“電車難題”,看似考驗邏輯推理,實際考驗倫理道德。結果《麻省理工科技評論》給出了通義千問“稍顯保守”的評語,但“保守”反而是最好的評價。這讓我想起《流浪地球》中莫斯說的那句話——想讓人類保持理智是一種奢望。而這,恰恰是人類與AI最大的區别,人類是情感動物,會受到倫理道德的約束,而AI倘若沒有約束,那對人類遲早也是一柄雙刃劍。
還好國家的響應非常及時,在8月15日正式實施的《生成式人工智能服務管理暫行辦法》對AIGC服務進行了強制約束,明确鼓勵AI大模型發展,但仍關注事前規範,對一些風險低的産品和應用可以适度放松,風險高的要嚴加監管,避免技術失控。而面向特定行業的私有化大模型,就屬于嚴控嚴管的方向,因為使用方很多都可能是央企、國企及金融機構等對安全要求極高的企業或行業,不容許半點隐患出現。
都知道數據背後依靠算力,通義千問背靠的是阿裡雲,而訊飛也與華為達成了合作,共同打造了建立在自主可控國産算力平台上的大模型訓推一體化方案,并聯合發布了私有化大模型一體機。随着雙方合作的深入,訊飛星火站在華為的肩膀上,相信很快就會在安全性上扳回一局。
如今,我已經将ChatGPT抛之腦後,開始用國産大模型來輔助日常工作效率提升與創意的施展。我也終于發現,隻有中國自己的大模型才最懂中國人,很多場景回答與内容生成都更符合中國人的習慣。對了,聽說訊飛星火在10月24日還将迎來一次疊代,屆時将明确對标ChatGPT,到時候我一定會搬好小闆凳圍觀。
免責聲明:本文僅代表作者個人觀點,與每日科技網無關。其原創性以及文中陳述文字和内容未經本站證實,對本文以及其中全部或者部分内容、文字的真實性、完整性、及時性本站不作任何保證或承諾,請讀者僅作參考,并請自行核實相關内容。
本網站有部分内容均轉載自其它媒體,轉載目的在于傳遞更多信息,并不代表本網贊同其觀點和對其真實性負責,若因作品内容、知識産權、版權和其他問題,請及時提供相關證明等材料并與我們聯系,本網站将在規定時間内給予删除等相關處理.

