升級版DeepSeek-V3模型開源!DeepSeek上可試用體驗快訊
DeepSeek在開源平臺上線了升級后的DeepSeek-V3模型,//huggingface.co/deepseek-ai/DeepSeek-V3-0324 同時DeepSeek也將DeepSeek-V3模型的開源協議更新為與DeepSeek-R1一致的MIT協議,DeepSeek于2024年12月26日發布了DeepSeek-V3 首個版本。
【TechWeb】3月25日消息,DeepSeek在開源平臺上線了升級后的DeepSeek-V3模型。新模型的版本號為DeepSeek-V3-0324,模型參數為6850億,其早期版本參數為6710億,相比有小幅增長。
開源地址:https://huggingface.co/deepseek-ai/DeepSeek-V3-0324
同時DeepSeek也將DeepSeek-V3模型的開源協議更新為與DeepSeek-R1一致的MIT協議,這一協議允許模型蒸餾、商用等行為,給了開發者更多的自主權。
DeepSeek在其官方交流群中稱,DeepSeek V3模型已完成小版本升級,歡迎前往官方網頁、App、小程序試用體驗(關閉深度思考),API接口和使用方式保持不變。
從網友初步反饋的實測效果來看,V3編碼能力已經接近 Claude3.7,在網站開發能力、UI設計方面展現出巨大的進步,數學能力也有提升,能像推理模型一樣解題。
DeepSeek于2024年12月26日發布了DeepSeek-V3 首個版本,當時,該版本的DeepSeek-V3 多項評測成績超越了 Qwen2.5-72B 和 Llama-3.1-405B 等其他開源模型,并在性能上和世界頂尖的閉源模型 GPT-4o 以及 Claude-3.5-Sonnet 不分伯仲。(宜月)
1.TMT觀察網遵循行業規范,任何轉載的稿件都會明確標注作者和來源;
2.TMT觀察網的原創文章,請轉載時務必注明文章作者和"來源:TMT觀察網",不尊重原創的行為TMT觀察網或將追究責任;
3.作者投稿可能會經TMT觀察網編輯修改或補充。