DeepSeek这种模式,在《三体》中早有预言!
刘慈欣吧
全部回复
仅看楼主
level 15
流浪地球
楼主
好吧,我在玩儿梗,但也不完全是玩梗
低光速就是低算力。
DeepSeek其实就是用低算力达到Chatgpt的效果,只要体系模式是对的,算力低也一样能产生智能。
然后再通过优化体系模式,低成本达到同等效果。
东方智慧
2025年02月07日 16点02分
1
level 14
贴吧用户_0E9Mt6b
类比不恰当,deepseek没有降低大模型运行成本,降低的是训练成本,本地部署同等参数量的主流模型和deepseek r1消耗的显存资源几乎相当,回答质量和响应速度几乎没有差异,实际商业运营还是得部署大量显卡,正确的类比是人类在科技死锁的情况下榨干核聚变技术制造出恒星际飞船,长期来看ds降低大模型厂商的准入门槛,会有更多玩家涌入ai领域,算力需求还是会继续上升
2025年02月08日 03点02分
2
流浪地球
你知道你在说什么吗?
你本地部署的主流模型能跟chatgpt和DS比么?没活别硬杠
2025年02月08日 03点02分
贴吧用户_0E9Mt6b
@流浪地球
ds开源出来的代码针对cuda底层中间语言针对性优化,整套系统高强度依赖英伟达,算力不足算法来凑,没法玩力大飞砖只好玩花活
2025年02月08日 03点02分
贴吧用户_0E9Mt6b
@流浪地球
你在说啥驴唇不对马嘴的话,这不暴露了自己其实啥都不懂,chatgpt和ds都可以本地部署,官方发布gguf格式的模型,我当然是拿chatgpt和ds r1对比,要不你以为我对你的是啥
2025年02月08日 03点02分
流浪地球
@贴吧用户_0E9Mt6b
服
chatgpt可以本地部署,今年听过最沙雕的笑话了
2025年02月08日 04点02分
level 14
贴吧用户_0E9Mt6b
7b版本ds r1资源占用,6g显存吃满,回答这种时间相关的事实问题就开始胡说了,和7b的llama半斤八两,网页版则ds可以完美回答这没问题
2025年02月08日 04点02分
4
1