CoD:大模型推理思维链CoT升级版!
发表于|更新于|大语言模型
|浏览量:
大语言模型推理思维链CoT升级版,推理草稿链,Chain of Draft,aka CoD啊!我们试过高级prompting或者用过deepseek r1和Gpt o3都知道,里面用的就是推理思维链。你问他就算一个很简单的问题,它都会做一大堆的思考,速度和tokens的消耗确实令人堪忧!最新一篇海外著名视频会议大厂Zoom论文出来,提出CoD的prompting技术,让大语言模型输出的质量接近CoT,但是速度飞快…
相关推荐

2025-03-01
Mercury Coder:自回归大语言模型终结者?
第一个Diffusion LLM 大语言模型啊,号称闪电级别的生成速度啊!今天淘到个inceptionlabs出品很有意思的大模型交错Mercury的,它提供playground给我们免费用,这里最有意思的事它和我们常见的LLM不一样,他是个diffusion LLM,什么意思呢,我们知道生成图片的Diffusion Model,你给他一个prompt,它会先从一个满是噪音的图片,然后一步步去降噪,直到出来一张清晰的图片。而diffusion LLM类似,你给他一个prompt… 访问入口
2025-11-24
手动RAG已死!凶手是谷歌!
这两天都在谈微调和RAG,其实一个好的RAG搭建起来还是需要点技术的,比如你首先要去对文档分片,然后要找到好的word embeddings词向量数据库来将你文档分片进行向量化,好进行检索。 然而,正是这些对分片策略、向量模型选择以及高昂数据库运维的持续投入,让许多希望快速部署知识问答系统的开发者望而却步。Google 文件搜索 API 的推出,正是为了终结这种复杂性。这项集成在 Gemini API 中的托管式 RAG 解决方案,将所有繁琐的底层工程——包括智能分块、高性能向量嵌入和索引管理——全部自动化封装,让您无需再为此耗费精力。它不仅提供了企业级的 RAG 能力,更以颠覆性的成本结构改变了游戏规则:文档存储完全免费,您只需为计算嵌入和模型使用检索到的上下文付费,极大地降低了应用的边际成本…展开更多 文档入口

2025-02-17
AskManyAI:DeepSeek r1满血版免费用.
.DeepSeek R1满血版免费用啊!我们知道国产之光DeepSeek r1火遍全球,奈何官方托管访问量过大及其他原因导致老是出现服务繁忙,自家部署的话有只能部署个蒸馏小参数版本。今天跟大家介绍一个可以免费用DeepSeek r1满血版的方式… 访问入口
2025-06-10
如何做古诗朗读视频?AI视频人物一致性技巧!
这种视频现在很流行,关键技术用到的是文生图,但是有很多小技巧,比如人物一致性等方面。下面快速走一遍我是怎么做的

2025-03-26
DeepSeek V3.1 + Cline:最强AI编程组合?
今天早上被DeepSeek v3.1的数学能力和编程能力惊艳到了,所以今天赶紧在cline上用起来!如果大家已经用上的,可以忽略这个视频。我们首先打开vscode,去到插件扩展这里找到cline,没有安装的安装上…
2025-05-18
OpenAI Codex:我们不一样!
兄弟们,今天OpenAI搞了个大新闻啊,发布了个叫Codex的云端软件工程助手,这东西有点意思,赶紧跟你们唠唠… Github入口 ChatGPT入口
公告





