距離發佈不到1天:DeepSeek V4正式版能力堪比核彈

明天就是20號了,這一天對別人來說稀鬆平常,但對DeepSeek來說異常重要——此前官方就明確7月中旬發佈DeepSeek V4正式版,現在就剩一天時間了。

這幾天AI圈最火的新聞是Kimi K3的發佈,這款2.8兆參數量的大模型不僅是國內最大的,也是開源領域最大規模的大模型,GPT-5.6、Fable 5這樣的美國頂級大模型參數量沒公佈,馬斯克之前說是5-10兆參數,但業界合理猜測是3-5兆規模的。

正因為此,不論是Kimi K3還是GPT-5.6、Fable 5,價格都不便宜,K3大約是後兩者的1/3-1/2價格,用多了也一樣肉疼。

這個時候DeepSeek V4正式版就更值得期待的了,那怕是官方明確了會在高峰期翻倍漲價,DeepSeek的整體價格依然便宜很多,而且快取命中率超高,API不需要套餐,用多少買多少。

網上有個彙總各家大模型API價格的,V4差不多是O、A兩家費用的1/30-1/70之間,平均下來便宜四五十倍不是吹的。

但是相比價格,V4正式版的能力水平才是最讓人關注的,此前的V4預覽版雖然被認為是開源領域綜合NO.1,但在程式設計能力上算不上頂流,官方自評也就是接近Opus 4.6,但這三個月中國內外AI都更新一輪了。

好消息是洩露的各種V4正式版測試讓人眼前一亮,目前主要集中在B站平台,測試的差不多都是一句話生成遊戲的內容,這是Fabel 5這種大模型最擅長也是公認最強的地方。

看了這麼多測試,V4正式版表現出來的能力絕對讓人震驚,超過Opus 4.8問題不大,可能略微低於Fable 5,畢竟V4在多模態上是有缺失的,正式版是否多模態都不一定保證。

用AI圈的一個名梗來說,V4正式版的問世就好像原子彈爆炸,梁文鋒看到了也要整個人眩暈並癱坐在椅子上。

當然,話也不能說的這麼慢,V4正式版洩露出來的能力太好,反而讓很多人懷疑不真實,一方面目前灰測的管道多是B站使用者,其他管道也是有的,但非常少。

其次是有人懷疑V4正式版實際上是DeepSeek路由到了Fable 5大模型上,所以性能表現其實是Fable 5的。

不過這個說法非常不符合邏輯,DeepSeek的風格也不像如此,這樣造假非常容易戳穿,對品牌形象傷害極大,又沒什麼收益,梁文鋒那怕被大家封為梁聖,也不需要自己收1毛錢去給大家用100塊錢的Fable 5。

況且很多B站使用者的測試都放出了OpenCode對話連結或者全程錄影視訊,梁聖用Fable 5給大家造假這事就說不通。

雖然現在也不能保證V4正式版的性能真的如此炸裂,但懷疑V4正式版造假這事就能解釋很多人的心理——認為美國領先、中國落後是必然的,如果國內企業做到了最強水平,首先要做的不是慶幸,而是一定要懷疑國內是在造假。

正如K3這幾天在外網上遭遇的那樣,有人祝賀、慶幸中國開源AI做到了頂級水平,但很多美國帳號也明顯破防了,說K3是在蒸餾Fable 5,抄襲美國AI,而美國公司有底線有道德,不會去蒸餾別人的大模型。

沒錯,AMD前企業副總裁就是這樣的人。

此外近日同方知網數字科技有限公司發佈聲明,針對近期部分期刊刊發將DeepSeek、Gemini等人工智慧(AI)列為作者的論文,知網已進行下架處理。

聲明指出,根據《中華人民共和國民法典》和《中華人民共和國著作權法》等法律規定,AI作為非民事主體,不具備著作權權利,其生成內容的著作權應歸屬於進行實質性智力創作的研究者。

此外,從出版倫理層面看,AI無法承擔學術核查、整改、追責等相關義務,將AI列為作者會導致責任主體模糊,違背科研誠信與出版倫理規範。

知網明確表示,不接受AI工具被列為論文署名作者,所有作者必須為自然人、法人或非法人組織,並對論文內容的真實性、原創性、學術規範及AI工具使用的合規性承擔責任。

作者在使用AI工具輔助寫作時,必須在論文的研究方法或致謝段落中明確說明,以保證使用AI的透明性和可溯源性。

對於違反上述原則的論文,知網有權不予上線傳播。

(硬體世界)