本地跑大模型神器!终于出原生WebUI了!
发表于|更新于|大语言模型
|浏览量:
lama.cpp出自己的原生Web UI啦!玩开源大语言模型的应该没有不知道Llama.cpp的,事实上Ollama背后用的就是Llama.cpp。Llama.cpp一直以来都是本地跑模型的基础核心,现在它终于有了官方的Web UI,主打极简、高效和高性能。这个新界面彻底解决了之前大家依赖第三方工具来操作Llama.cpp的痛点,用起来特别顺手,能清晰展示模型信息,还能直接上传PDF或文本文档作为上下文来喂给模型…
相关推荐

2026-05-25
llama.cpp 正式支持MTP!本地推理速度大幅提升!
llama.cpp(最流行的本地大模型推理框架)正式支持MTP(Multi-Token Prediction,多Token预测)技术!MTP让模型在推理时一次预测多个Token,而不是逐个Token生成,从而显著提升推理速度(预计提升2-3倍)。对于在本地运行大模型的用户来说,这是一个重要的性能升级。本视频介绍MTP的原理、配置方法和实际速度提升测试。 访问入口
2025-12-17
GPT-Image 1.5测评!Nanobanan杀手?
上一个视频跟大家介绍了OpenAI刚刚推出来硬刚谷歌nano banana的GPT-Image 1.5,承诺会跟大家测评下。那就来吧… 访问入口
2024-11-29
n-grams:大语言模型的起源
N-grams(N元语法模型)是大语言模型发展的”始祖”技术,理解它是理解现代LLM演进的重要基础。N-grams是一种基于统计的语言模型,它通过计算文本中连续的N个词出现的概率来预测下一个词。例如,2-gram(二元模型)会统计”我→爱”这个组合出现的频率。虽然N-grams模型简单、资源消耗大,但它奠定了现代语言模型的核心思想——根据上文预测下文。从N-grams到基于Transformer的GPT模型,本视频带你追溯语言模型的发展历程。

2025-01-17
Minimax 01:国产最新开源大模型测评.mp4
支持400万Tokens的免费开源够产大语言模型啊!今天我们要测评下的是minimax最新的01模型,这是个MoE模型,也就是Mixture of Expert,混个专家模型了,大家不清楚的可以翻下我以前视频有专门介绍这些概念的。然后它的总参数是456亿,最牛逼的是他一个开源模型竟然支持400万个tokens,这基本就是其他模型的20到32倍啊。不过今天我们不会测试这么大的tokens输入,我们还是循例问下一些其他大语言模型经常做错的题目… 访问入口
2026-01-06
Claude Code 入门(二)!正确打开方式!
上一集我们学习了claude code的安装以及怎么切换到国内模型,这一集开始,准备说下我claude code究竟应该怎么用?很多人认为claude code是个命令行工具,代码编辑也太麻烦了!用它不是编程领域的退步吗?事实上,我们可以…
!免登陆控制浏览器!.png)
2026-05-18
Codex入门(五)!免登陆控制浏览器!
Codex入门系列第五集!本教程教你如何利用Codex实现”免登陆控制浏览器”。通过Codex的自动化能力,结合浏览器工具,你可以让AI自动打开网页、填写表单、提取数据——而且整个过程不需要手动登录和验证。这对于需要自动化Web操作的场景(如数据采集、批量操作)非常有用。视频提供完整的配置步骤和代码示例。 访问入口
公告





