avatar
文章
1468
标签
1019
分类
17
AI工具严选
LLM评测
AI今日新闻
搜索
AI产品狙击手Qwen 2.5-vl + Browser Use:打造本地Operator 返回首页
AI工具严选
LLM评测
AI今日新闻
搜索

Qwen 2.5-vl + Browser Use:打造本地Operator

发表于2025-01-31|更新于2026-07-18|大语言模型
|浏览量:

通义千问版Operator啊!我们知道OpenAI推出的Operator震撼全球,可以像真人般操作浏览器去完成不同的任务。今天我们说下怎么用通义千问最新推出的开源免费的Qwen2.5-VL视觉大模型加上我们之前分享过的Browser Use来搭建本地跑的Operator…

  • “Qwen2.5-vl API Server” github 入口
  • “Browser Use web-ui” github 入口
该工具已收录于 AI工具严选
Browser Use
Browser Use
AI浏览器自动化操作智能体
查看入口和详情
浏览全部AI工具 →
请我喝杯咖啡
  • 微信赞赏
    微信赞赏
cover of previous post
上一篇
O3-Mini:OpenAI推出免费版应对DeepSeek挑战
OpenAI推出O3-Mini硬扛国产DeepSeek的挑战啊!我这段时间分享了不少我们国产之光DeepSeek R1推理大语言模型的视频,以其强大的性能和低廉的API价格直接冲击OpenAI的O系列的地位。OpenAI应该也是迫于这种压力,今天赶紧推出O3-Mini来应战,无论付费用户还是免费用户,都将会逐渐用上O3-Mini,而O3-Mini呢又分为三个版本low,medium和high,并且开始支持上函数调用等各种高级功能… 访问入口
cover of next post
下一篇
OpenAI证明DeepSeek抄袭?
OpenAI声称证明DeepSeek抄袭他们?今天逛海外科技网站的时候看到个新闻,说OpenAI提出证据证明DeepSeek如此成功是因为DeepSeek团队用了OpenAI的模型来蒸馏出的DeepSeek…
相关推荐
cover
2025-08-13
GLM 4.5V:AI视觉革命!开源即巅峰!
太炸裂了!上两周我才分享了智普AI的GLM 4.5表现不俗,这两天它们又发布了全新的开源视觉语言大模型GLM 4.5V。这款模型并非等闲之辈,它基于GLM 4.5 Air架构,拥有高达1060亿的庞大参数量,并激活120亿参数进行推理。在MMBench、MathVista及OCRBench等多项权威视觉基准测试中,GLM-4.5V均取得了接近90分的顶尖成绩,全面展示了其技术硬实力展开更多 访问入口
cover
2024-12-26
QVQ-72B:世上唯一开源免费视觉推理大模型
这应该是当今世上唯一一个完全开源免费的视觉推理大模型,相比海外如OpenAI等贵的要命的o3模型,阿里巴巴最新推出的这个QVQ-72B视觉推理大模型遵循都是Apache 2.0的协议,也就是说权重等完全开源,如果我没有搞错的话,这应该是当今世上唯一一个完全开源免费的视觉推理大模型,它只有72B的参数量,但是它在MMLU多模态测试集和MathVision等数学视觉等测试集上的benchmarks得分却不容小觑。下面我们快速的去魔撘上玩下… 访问入口
cover
2025-01-06
Browser Use Webui:AI自动操作浏览器
可以像真人般操作你的浏览器帮你完成任务的免费Agent啊!今天要跟大家分享的这个叫做browser-use-webui的agent就牛逼了,通过它我们可以给它一个指令,然后它就能操作浏览器来完成我们的人物。它后面可以介入免费的Gemini2.0,也可以介入价格便宜的几乎免费的最近风头正盛的国产deepseek v3模型。今天我们就Demo下deepseek的… 项目入口
cover
2026-05-19
MiniCPM V4.6:端侧开源视觉大模型!一键手机上直接跑!
MiniCPM-V4.6是面壁智能(OpenBMB)推出的端侧开源视觉大模型,最大的亮点是可以在手机上直接运行!虽然只有几B参数,但通过精心设计的模型架构和量化优化,它在视觉理解任务上的表现可以匹敌更大的模型。你可以在手机上安装后直接拍照提问——AI会实时分析图片内容并回答。对于移动端AI应用和离线视觉识别场景来说,这是一个重要的技术突破。 访问入口
cover
2026-05-18
NVIDIA NVLM:比看视频还快十倍!开源视觉模型天花板!
NVIDIA NVLM(NVIDIA Vision Language Model)是英伟达推出的开源视觉语言模型,号称”比看视频还快十倍”!它在视频理解和分析方面达到了惊人的速度——可以在极短的时间内分析整段视频的内容、识别物体和动作。被评价为”开源视觉模型天花板”。本视频测评NVLM在视频理解、图像分析和多模态任务上的表现。 访问入口
cover
2025-02-10
DeepSeek Browser Use:OpenAI Deep Research免费平替
DeepSeek版Deep Research啊!上两天我才分享了个视频介绍OpenAI最新推出的Deep Research,可以自动搜索上百个网页来帮我们生成专业的报告,可惜需要价值200刀每月的Pro账号才能用。今天我想给大家介绍一个免费的使用方案,就是DeepSeek加我之前介绍过的Browser Use,如果大家不清楚Browser Use的,可以先去翻看下我这个视频。而DeepSeek呢,我们只需要用免费的蒸馏模型就能达到想要的效果…
avatar
Kevin Zhu
专注于大语言模型LLM,文生图模型Stable Diffusion, 视频生成模型等免费AI工具的分享和应用
文章
1468
标签
1019
分类
17
请我喝咖啡
公告
进群或商务合作请加我微信
最新文章
Minimax M3 测试报告!全军覆没啊!
Minimax M3 测试报告!全军覆没啊!2026-07-20
Deepseek V4 Pro 最新测试!最新benchmarks!
Deepseek V4 Pro 最新测试!最新benchmarks!2026-07-20
雾象AI!一键生成科普演示视频!每天可白嫖!
雾象AI!一键生成科普演示视频!每天可白嫖!2026-07-20
Qwen 3.8 预览版测评报告,打得过Kimi K3吗?
Qwen 3.8 预览版测评报告,打得过Kimi K3吗?2026-07-19
MD2Card!一键Markdown转小红书卡片!
MD2Card!一键Markdown转小红书卡片!2026-07-19
© 2024 - 2026 By Kevin Zhu框架 Hexo|主题 Butterfly
专注于大语言模型LLM,文生图模型Stable Diffusion, 视频生成模型等免费AI工具的分享和应用
粤ICP备17146211号-1
搜索
数据加载中