Kimi 1.5推理模型:差评!
发表于|更新于|大语言模型
|浏览量:
国产月之暗面 Kimi 1.5 推理模型测评报告啊!我们知道DeepSeek的推理模型r1轰动全球,而Moonshot同时间推出的Kimi 1.5推理模型号称打败GPT-4o等,还有一帮人网上鼓吹其和DeepSeek r1齐名,看benchmarks的话也确实表现不俗。如此厉害的模型,那我们得赶紧去拿出我们往常的测试用例来测评下了。 来到官网,下面这里选择上K1.5长思考,这样就用上了Kimi 1.5推理模型了…
相关推荐

2024-12-22
Kimi视觉推理大模型:差评!
看网上都在吹Kimi的视觉推理大模型,说得神乎其技,可以取代OpnAI 200刀每月的专业版之类的,真有这么厉害吗?这里我们也来快速测试下。 首先,我们来个简单都英语填空题,这种题一般的大模型都能做对,本来就是大语言模型的强项,仅作为最基本验证,它也是没有问题的。 再看第二道题,来个脑筋急转弯,分析推理确实是一大堆的,答案也和预期一样,但是它是实打实的脑筋不转弯都从语言学等角度得出的答案,其实这里在中文语境中用脑筋急转弯思路就能很快得出答案,太阳公公嘛,那太阳肯定是男都啰。况且太阳叫做sun,儿子也读作son,也能得到印证。所以我推定它是不适合做脑筋急转弯的,起码不适合做中文的脑筋急转弯。 下一道数学题,“一口井7米深,有只蜗牛从井底往上爬,白片爬3米,晚上下坠2米。问蜗牛几天能从井里爬出来?”这里要注意解题的关键点是最后一天可能它不会滑下来了。我们看它分析,前几天都没有问题,第四天,白天爬3米,就是到了6米,晚上滑下来2米,到了第4米,第五天,白片爬3米,4+3刚好7米,所以就爬出来了,就不用考虑晚上往下滑了。所以答案是5天就能爬出去。我们看它最终做了一大堆装模作样的推理...

2025-02-25
腾讯元宝DeepSeek r1:不是满血版?
这两天分享了不同平台接入的deepseek r1,避开官方deepseek访问经常服务不可用的问题,但是用起来总感觉不顺手,比如知乎接入的太卡顿,AskManyAI界面又太杂,今天我们看下腾讯元宝的这个介入效果如何… 访问入口

2025-03-26
Gemini 2.5 Pro 测评:最强推理大语言模型!
昨天测评了下最新的DeepSeek V3.1,着实惊艳!有粉丝留言说希望我测试下最新的Gemin 2.5 Pro,义不容辞啊!首先大家要知道这是个推理模型,所以我今天的测试加了几道粉丝提供的推理题,然后它在lmarena上多个benchmarks上打败了o3-mini, gpt-4.5, claude 3.7,deepseek r1等模型… 访问入口

2025-02-08
OpenAI终于免费开放搜索和推理功能
OpenAI 给免费用户开放搜索和推理功能,直接取代掉Perplexity啊!我知道搜索功能推出有段时间了,但是一直没有全部覆盖到免费用户,但今天我用我一个免费账号试了下,已经可以用上了。 而推理功能是最新的,估计是迫于DeepSeek R1的压力才推出的。这两个功能就算你不登录,只是临时聊天也是可以用上的。快速去Demo下… 访问入口
2024-11-30
kimi数学模型:妈妈再也不怕你问我数学题了
再也不怕小孩问我数学题了!月之暗面的Kimi最近推出了个Kimi数学模型,我喜欢他的原因不是因为它能给出答案,而是他一步步把解题过程给出来了!为什么我会找到这个kimi数学模型呢,起因是小孩问了我个鸡兔同笼的问题,我自己也没搞出来,所以上网搜,一看到处都是广告,有对口的,不是只给了个答案,就是要你付费看题库的,我也真是服了。 后来就找到这个Kimi数学模型的消息了。我试了下,效果真心不错,我找了击倒奥数题及答案,测试了下,首先答案全部都做对了,流程的话我看了第一道题,没有问题,其他几道题流程我没看,我估计答案既然正确,流程估计也不会有多大问题。 大家家里有娃或者想找数学家教的,可以先去Kimi上面玩下,看是否满足自己要求,也许会省掉很多烦心事,特别是现在严打私教,你想找个好的辅导老师真心不容易。 访问入口

2025-02-16
腾讯ima知识库:接入满血DeepSeek r1
腾讯ima知识库接入满血DeepSeek r1啊。这几天腾讯的ima可谓是当红炸子鸡啊,通过它你可以直接将公众号文章和聊天中的文档以及本地文档加入知识库,然后和这些内容进行对话啊。废话不多说,赶紧Demo下,首先去小程序里搜索到这个ima…
公告





