3月25日消息,DeepSeek在開源平臺上線了升級后的DeepSeek-V3模型。新模型的版本號為DeepSeek-V3-0324,模型參數(shù)為6850億,其早期版本參數(shù)為6710億,相比有小幅增長。
開源地址:https://huggingface.co/deepseek-ai/DeepSeek-V3-0324
同時DeepSeek也將DeepSeek-V3模型的開源協(xié)議更新為與DeepSeek-R1一致的MIT協(xié)議,這一協(xié)議允許模型蒸餾、商用等行為,給了開發(fā)者更多的自主權。
DeepSeek在其官方交流群中稱,DeepSeek V3模型已完成小版本升級,歡迎前往官方網(wǎng)頁、App、小程序試用體驗(關閉深度思考),API接口和使用方式保持不變。
從網(wǎng)友初步反饋的實測效果來看,V3編碼能力已經(jīng)接近 Claude3.7,在網(wǎng)站開發(fā)能力、UI設計方面展現(xiàn)出巨大的進步,數(shù)學能力也有提升,能像推理模型一樣解題。
DeepSeek于2024年12月26日發(fā)布了DeepSeek-V3 首個版本,當時,該版本的DeepSeek-V3 多項評測成績超越了 Qwen2.5-72B 和 Llama-3.1-405B 等其他開源模型,并在性能上和世界頂尖的閉源模型 GPT-4o 以及 Claude-3.5-Sonnet 不分伯仲。(宜月)
(免責聲明:本網(wǎng)站內(nèi)容主要來自原創(chuàng)、合作伙伴供稿和第三方自媒體作者投稿,凡在本網(wǎng)站出現(xiàn)的信息,均僅供參考。本網(wǎng)站將盡力確保所提供信息的準確性及可靠性,但不保證有關資料的準確性及可靠性,讀者在使用前請進一步核實,并對任何自主決定的行為負責。本網(wǎng)站對有關資料所引致的錯誤、不確或遺漏,概不負任何法律責任。
任何單位或個人認為本網(wǎng)站中的網(wǎng)頁或鏈接內(nèi)容可能涉嫌侵犯其知識產(chǎn)權或存在不實內(nèi)容時,應及時向本網(wǎng)站提出書面權利通知或不實情況說明,并提供身份證明、權屬證明及詳細侵權或不實情況證明。本網(wǎng)站在收到上述法律文件后,將會依法盡快聯(lián)系相關文章源頭核實,溝通刪除相關內(nèi)容或斷開相關鏈接。 )