文心5.1!真的能打吗?快速测评报告!
发表于|更新于|大语言模型
|浏览量:
百度文心一言5.1的快速测评报告!文心5.1是百度最新的大语言模型版本,本视频通过快速的基准测试和实际任务验证其在语言理解、知识问答、中文创作和逻辑推理等方面的能力。并与文心4.0以及竞品模型进行对比,帮助用户判断这一版本是否值得升级使用。对于那些关心国产大模型进展的读者来说,这是一份及时的评测参考。
相关推荐

2026-05-18
百度文心5.1思考模型能打吗?实测报告!
百度文心5.1思考模型的实测报告——这是百度新加入”深度思考”能力的模型版本。与标准版文心5.1不同,思考模型会在给出最终答案前进行内部推理和验证,类似于OpenAI o1的”慢思考”模式。本视频测试其在复杂推理、数学题和编程任务上的表现,并与o1、Claude的思考模式进行对比。 访问入口

2026-04-27
Deepseek V4!你想知道的都在这了!
Deepseek-V4是一款实用的AI工具,本文介绍它的核心功能和使用体验,帮你快速了解这款产品。

2024-12-07
Grok:马斯克大语言模型免费用
兄弟们,马斯克x ai 的grok免费用啊!再也不用充会员了!听到这个消息后我当然第一时间去推特,哦不是,早改名了,去x上试下,我自己是没有充Premium的 点开这个Grok,随便问几个我做大语言模型评测的问题,strawberry有多少个r,回答两个;9.11和9.8谁大,可惜,答案都错了,所以这水平感觉有点水啊 还是试下它的文生图功能的,接入的是顶尖的Flux 1.1,随便生成几张图吧, 大家看下,效果还可以吧。 大家想尝鲜的可以去玩下,但是不要抱太高的希望,文字回答我感觉就是1年前的chatgpt 3.5的水平,文生图倒是值得关注。 访问入口
2024-11-30
Agent.exe:手把手教你快速搭建AI控制电脑环境
AI Agent(智能体)是当前AI领域最热门的概念,它代表了大语言模型从”对话工具”到”行动者”的进化。一个AI Agent不仅能理解和生成文本,还能自主规划任务、使用工具、执行操作、从反馈中学习。Agent通常由三个核心组件构成:大脑(LLM负责推理决策)、感知(获取环境信息)和行动(调用工具API)。本视频全面解读AI Agent的概念、架构类型和实际应用场景。 官方博客

2024-12-13
Gemini 2.0 + Cline:VScode最强AI编程助手
兄弟们早啊。上一个视频我们介绍了 Gemini 2.0 的 6 个炸裂功能,这么牛逼的模型,我们作为程序员当然也要装备上了。这一集呢,快速跟大家说下怎么在 VSCode 的 Cline 上用上这个 Gemini 2.0。 Cline 在之前的视频中已经介绍过了,它能让我们的 VSCode 瞬间变成有 AI 加持的 Cursor,AI 编程助手。详情大家可以翻看一下我相关的视频。 言归正传,首先我们去 OpenRouter 上注册个账号,也是免费的。然后登录进去,创建一个新的 API key。接着我们回到 VSCode Cline 插件,配置 API provider,这次选择 Open Router,然后把刚才生成的 key 保存到这里。这样我们就可以列出相关的所有模型了。这里我们选择 Gemini 2.0 experimental 的免费模型。
2025-08-20
重大更新!Gemini终于有记忆了!
即梦偷偷上线了智能多帧功能!即梦实战第26集!刚刚本来先去即梦生成个视频的,偶然间发现即梦竟然出了个智能多帧功能,赶紧去查下相关信息,据说这共能可以一镜到底生成连贯长镜头。最多可以上传十张关键帧图像,每两帧之间的时长可自由设置,成片最长达54秒。如此厉害,那当然要demo下 访问入口
公告





