大语言模型的深度思考究竟是什么鬼?
发表于|更新于|大语言模型
|浏览量:
大家知道大语言模型的深度思考模式是怎么工作的吗? 这两天deepseek 不是发布了3.2正式版本嘛,在以前的化,我们开启深度思考,事实上会切换另外一个叫做R1的模型,而现在。据说用的是同一个模型,只是打开了深度思考模式而已…
相关推荐
2025-12-03
DeepSeek杀回来了!V3.2 吊打GPT 5!
DeepSeek 又杀回来了!DeepSeek 有段时间没有什么动静了,最近几天却动作频频,意欲何为呢?上几天才出了个 DeepSeek Math V2,今天 DeepSeek V3.2 又来了… 访问入口
2025-12-12
DeepSeek特别版测评!硬刚GPT-5?
测评下可以硬刚GPT 5的DeepSeek 3.2 Special版本。据说主要是在推理和数学上做了提升。所以准备测几道推理题,顺便也测两道编程题看看。因为这个版本只能通过API访问,所以我们直接到OpenRouter中测评…
2025-12-03
拳打GPT-5?DeepSeek V3.2测评报告!
DeepSeek憋了这么久,终于憋出了个V 3.2, 看benchmarks的话是拳打GPT 5, 脚踢 Gemini 3.0。但是不是真的能打,我们还是得亲自测评下。来到DeepSeek, 打开思考模式吧。我这里打开思考模式的话,不知道是否会切换到他们推出的号称超过GPT 5的special特别版,但愿是吧。好,开始… 访问入口

2025-01-28
梁文锋:DeepSeek背后的扫地僧
揭秘AI界“扫地僧”:他靠数学和代码,打造出中国最牛量化私募,如今又要颠覆AI行业! 参考维基百科

2025-03-08
Lightning AI:免费微调DeepSeek r1
这可能是最简单的用自己数据微调出自己的DeepSeek r1的方法了。今天淘到的这个AI工具叫做lightning ai,它让我们只需要简单几步就能微调出自己的DeepSeek r1. 而它每月提供免费的GPU额度给我们用,足够我们一般人玩耍了。废话不多说,我们立刻看Demo… 访问入口
2025-09-25
超乎想象!首个端到端全模态大模型!全面测评报告
阿里发布并开源首个端到端全模态 Qwen3-Omni 模型,据说性能出色且功能强大,既然说得这么厉害,还是首个端到端的全模态,那当然要去测评下了。最终结果超乎你想象! 访问入口
公告





