国产大模型混战进入深水区,在Kimi、MiniMax接连用新模型“炸场”后,7月31日,“国产大模型风向标”DeepSeek宣布,DeepSeek-V4-Flash正式版API上线公测。
这也是外界期待已久的DeepSeek正式版官宣上线,据了解,DeepSeek-V4-Flash-0731的模型结构、尺寸和DeepSeek-V4-Flash-preview保持一致,仅重新进行后训练。
DeepSeek-V4-Flash 正式版 API 上线公测(网站截图)
不过,据DeepSeek特别说明,目前公测仅限API(接口端),大家常用的App和网页端暂无法体验最新能力,DeepSeek-V4-Pro正式版将会尽快发布。
据官方更新日志显示,V4-Flash正式版在Agent能力上大幅增强,基准测试远超Preview版本。
多项评测数据显示,V4-Flash正式版成绩突出:TerminalBench2.1(终端操作测试)得分82.7;Cybergym(网络安全攻防模拟)得分76.7;ToolathlonVerified(工具调用综合测试)得分70.3;内部全栈开发测试DSBench-FullStack达到68.7,而高难度编码专项测试DSBench-Hard也拿下59.6。
值得注意的是,DeepSeek Harness能力也在此次更新中首次亮相,据DeepSeek披露,本次公开基准测试中的CodeAgent任务,使用了DeepSeek Harness极简模式作为框架进行测试,这也是DeepSeek在Harness团队公开招聘后,首次在官方公告中披露Harness相关能力。
公开资料显示,DeepSeek的Agent Harness团队组建于今年3月,负责人崔添翼是90后,浙大计算机出身,拥有6枚ACM亚洲区域赛金牌,曾在顶级量化机构JaneStreet任职九年,今年3月加入DeepSeek,此后其在5月大力招兵买马。
DeepSeek成立于2023年,由量化私募幻方量化孵化,凭借V3、R1等模型以极低成本达到国际第一梯队性能,被硅谷称为“来自东方的神秘力量”。今年以来,DeepSeek完成首轮外部融资。
此前6月16日,据披露,DeepSeek完成首轮融资,募资总额超过74亿美元(约合人民币500亿元),采用特殊交易架构,估值超过500亿美元。这也是中国AI行业至今为止规模最大的单轮融资,也是中国估值最高的未上市AI初创企业。
据媒体报道,DeepSeek创始人梁文锋是最大出资方,个人出资约30亿美元(人民币200亿元);腾讯出资100亿元;宁德时代出资50亿元;京东、网易、风投机构IDG资本各出资30亿元。
此后DeepSeek发布“英雄帖”广泛招募人才,据DeepSeek官方招聘信息表示,当今人类正处于AGI的前夜,随着技术演进,正努力将所有部门的规模扩大至少一倍。
根据DeepSeek发布的揽才计划,招聘范围囊括全栈开发、算法、AI 底层系统、算力运维、产品、数据策略、深度学习研究等技术岗位,同时招收 AGI 管培生、HR、法务、财务、采购、行政职能人员,办公地点分布杭州、北京与内蒙古乌兰察布市,同时,所有岗位均面向实习生开放。