跳转到内容
主菜单
主菜单
移至侧栏
隐藏
导航
首页
最近更改
随机页面
MediaWiki帮助
特殊页面
石头百科-维基百科
搜索
搜索
外观
创建账号
登录
个人工具
创建账号
登录
未登录编辑者的页面
了解详情
贡献
讨论
编辑“︁
深度求索(DeepSeek)
”︁(章节)
页面
讨论
大陆简体
阅读
编辑
编辑源代码
查看历史
工具
工具
移至侧栏
隐藏
操作
阅读
编辑
编辑源代码
查看历史
常规
链入页面
相关更改
页面信息
外观
移至侧栏
隐藏
警告:
您没有登录。如果您进行任何编辑,您的IP地址会公开展示。如果您
登录
或
创建账号
,您的编辑会以您的用户名署名,此外还有其他益处。
反垃圾检查。
不要
加入这个!
== 发展历程 == 2023年7月,DeepSeek由中国对冲基金幻方量化创立,其创始人和CEO为梁文锋,公司的总部位于中国浙江省杭州市,公司专注于AI大模型的研究和开发<ref>[https://finance.sina.com.cn/jjxw/2025-01-22/doc-inefuxsi7314244.shtml 量化巨头幻方创始人梁文锋参加总理座谈会并发言,他还创办了“AI界拼多多”]|AI_新浪财经_新浪网</ref>。 2024年5月,DeepSeek发布并开源了旗下MoE大模型DeepSeek-V2,因其模型架构与经济性而脱颖而出,DeepSeek-V2的API定价为每百万tokens输入1元、输出2元,价格仅为GPT-4 Turbo的百分之一。 2024年12月,DeepSeek发布并开源了DeepSeek-V3,DeepSeek表示该大模型的训练系基于2,048块英伟达H800型GPU(针对中国市场的低配版GPU)集群上运行55天完成,训练耗资557.6万美元;DeepSeek-V3的评测成绩超越Qwen2.5-72B(阿里自研大模型)和Llama 3.1-405B(Meta自研大模型)等开源模型,能与GPT-4o、Claude 3.5-Sonnet(Anthropic自研大模型)等闭源模型相抗衡。 2025年1月20日, DeepSeek发布并开源了DeepSeek-R1模型,该模型在数学、代码、自然语言推理等任务上,性能超越OpenAI o1正式版<ref>GitHub - [https://github.com/deepseek-ai/DeepSeek-R1 deepseek-ai/DeepSeek-R1]</ref>。
摘要:
请注意,所有对石头百科-维基百科的贡献均可能会被其他贡献者编辑、修改或删除。如果您不希望您的文字作品被随意编辑,请不要在此提交。
您同时也向我们承诺,您提交的内容为您自己所创作,或是复制自公共领域或类似自由来源(详情请见
石头百科-维基百科:著作权
)。
未经许可,请勿提交受著作权保护的作品!
取消
编辑帮助
(在新窗口中打开)
搜索
搜索
编辑“︁
深度求索(DeepSeek)
”︁(章节)
添加话题