常州网 | 微博
收藏本站

体验deepseek 中国学科技卷AI册创新篇

安文 最后编辑于 2025-02-26 10:23:21
2852 1 1

体验deepseek

中国学科技卷AI册创新篇

安  文

国产大模型deepseek一夜爆火,引发国内外媒体集体高潮,纷纷盛赞deepseek拳打ChatGPT,脚踏英伟达,“来自东方的神秘力量”让美国“陷入集体恐慌”。近日和一位人工智能方向的博士学生吃饭,在饭桌上第一时间下载注册deepseek体验,使用交流下来,感觉如下:

一、它是迄今最好的中文大模型平台,从理解能力和答案输出能力来看,远超此前百度文心一言和抖音豆包。说掀翻ChatGPT尚显夸张,但确实掀翻了国内的BAT和字节跳动,比起美国科技巨头,更应陷入恐慌的是国内互联网大厂。

二、根据这位博士说法,deepseek基于开源的Transformer模型,而Transformer模型由谷歌开发。所以国内媒体宣传deepseek“纯自研”、“纯国产”不准确。而且deepseek的算力基础仍源于英伟达显卡。他还透露deepseek团队非常有钱,提前囤了1万多张英伟达高端显卡,而华科大和中科大的实验室搞显卡如今都不太容易。从网上公开信息看,DeepSeek拥有1万张老的A100卡和3000张禁令之前的H800卡。按H800显卡20万一片的价格,deepseek购买这3000张显卡就花费了超6亿元。也就是说,deepseek的软硬件基础仍然基于美国产品之上。

三、目前使用下来最大缺点是慢,我输出一句“你好”,它的“深度思考”时间就花费8秒,基本一个问题想得到答案,需要等待几十秒甚至几分钟时间,这和ChatGPT的“秒回”能力形成了鲜明对比。但deepseek差异之处在于,它把原本置于后台的机器人“深度思考”程序,转为前台公开化显示,你可理解为能部分掩盖输出答案的缓慢,也能理解为展现其“深度思考”功能的精妙和“人性化”。

四、此前ChatGPT被诟病简中能力低下,一个原因是简中用户较少,导致抓取样本数据少,但deepseek拥有的先天优势是海量的中文数据抓取基础,也能够学习模拟不同的中文语气和风格,比如可以生成“贴吧老哥体”、“小红书体”,你也可通过输入指令“言辞激烈或温和”,来改变其文风。deepseek的写作能力,已大大降低了“AI味”。毫不夸张的说,deepseek未来肯定可以取代大部分的公文写作甚至社论写作,这对笔杆子们是不小挑战,文科毕业生就业更难。

五、和所有国产大模型一样,deepseek绕不开的是审核,特别是应对政治类历史类问题。但令人诧异的是,deepseek尺度远超BAT和字节大模型,一些敏感信息也被抓取,如询问其对当前仿制药问题的看法,它可以生出一篇言辞尖锐的批评性文章。再如我尝试让deepseek写一篇嘲讽某名记者的文章,deepseek生成的是这样的:xxx:舆论场上的“万能胶”,结论是:xxx先生是中国舆论场上一位“不可多得”的人物。他既是官方的“传声筒”,又是民间的“调和剂”;既是“理性”的代言人,又是“情绪”的煽动者。他的存在,仿佛就是为了证明一点:在舆论场上,只要你足够“圆滑”,就能永远立于不败之地。只是,这种“圆滑”背后,究竟有多少真诚,恐怕只有他自己知道了。看来,官方强调规范监管大模型,确实很有必要。


收 藏
分 享
表态的人
  • 泉水涓涓
发送

1条评论

  • 35089
    积分
  • 4120
    博文
  • 11735
    被赞

个人介绍

河海大学退休教师

未成年人举报专码
苏ICP备2025216299号-1  苏公网安备32041102000012号 互联网新闻信息服务许可证:32120250002号 信息网络传播视听节目许可证号:1008248
本站不良内容举报信箱:bbs_cz001@163.com  举报电话:0519-82000682  业务联系: 0519-86636892
未成年人举报信箱:a82000682@163.com   举报电话:0519-82000682