Flux 3 模型测评报告!真的能打吗?
这一集测的是黑森林(Black Forest Labs)最新的 Flux 3 文生图模型。用的还是同一套 6 题 Benchmark,逐题实测,模型直接在 OpenRouter 的 Playground 上跑。 Q1 中文长文本排版支持(水彩风珠海 5 天行程插画):整体布局没有什么问题,但错别字错得相当密集。第一天「渔民佬鹈鹕海鲜」里的「渔」和「鹈鹕」写错;第二天「鲸鲨馆」的「鲨」错了,「企鹅」的「鹅」也错了;第三天「外伶仃」的「仃」和「渔」写错;第四天「荔枝园农家乐」的「荔」错了,「农家乐」的「家」位置不对,「农」和「乐」两个字也不对;第五天「励骏庞都」的「励」和「庞」都错了,「手撕鸡」的「撕」还少了提手旁。这一题错得挺多,估计它对中文的支持不大好。 Q2 推理和中文支持(桂林手绘三日行程图):这一题同样不给具体行程,要求模型自己推理。桂林、漓江、遇龙河这三天的安排没有问题,说明它是有推理能力的;但中文错别字也是一大堆,这里就不一个个指出来了,毕竟本题主要考察的是推理能力。 Q3 同一角色多视角一致性(女孩四宫格不同角度):这一题实现得没有问题,四个角度都没看出什么毛病...
千问办公实战(30)!一键总结钉钉群聊消息!
钉钉群聊的消息实在太多了,工作一忙起来,根本没有时间一条条往上翻。比如视频里这个产品需求群,随手一划就是一堆没读的消息,重要的决策和待办就这样被淹没在闲聊里。 这个时候可以试试千问办公上的「群聊内容摘要」skill。它能够针对指定的群聊、指定的时间段做消息总结,把这一段时间里大家聊了什么一次性理清楚,对效率的提升相当明显。需要注意的是,使用的前提是你已经启用了钉钉连接器 —— 如果还没有配置过,可以翻一下这个合集前面的入门视频,先把连接器接通。 启用这个 skill 之后,打开一个新任务、唤起它,然后输入提示词即可,比如直接让它「总结一下这三天的聊天内容」。接下来它就会自己开始干活,最终把群消息整理好交给你。 更值得说的是,它并不是那种三言两语的敷衍总结,而是会分门别类地归纳 —— 决策方面的、行动方面的、风险方面的各自成条,一眼就能看清群里到底推进了什么、还欠着什么。更实用的是,它还会把详细内容写进钉钉文档,随时可以回溯原文。建议先收藏起来,这类能力迟早用得上。 访问入口
Gemini Pro 18 个月领取免费指南!无需学生证明!
花几块钱就能拿到 18 个月的 Google AI Pro,这件事作者亲自试过了,是真的。拿到的方式是通过 Jio 渠道激活,而且全程不需要学生证明。不过在动手之前,有一个前提必须先确认,否则很容易白折腾一场。 这个前提是:如果你打算在 Google Antigravity 里用这套订阅,就要先确认账号在 Antigravity 上能够正常打开、正常授权。作者实测了两个账号,其中一个的 region 是中国区,就无法正常使用 Antigravity —— 这种情况下即使已经拿到了 Google AI Pro,也只能在 Gemini 官网上用,Antigravity 里是进不去的。 这个前提确认完毕,就可以去海鲜市场(闲鱼)找一家商家,直接搜「Jio」,商家会告诉你怎么操作。还没上车的,可以赶紧去试一下。 访问入口
Fledge Alpha 测评报告!真的能打吗?
本期的测试对象是 OpenCode 上线的匿名免费模型 Fledge Alpha,思考模式拉到最高的 Max。用这套 6 题测试跑下来,它的表现呈现出很明显的两极分化:结构清晰、有对错可言的题做得还行,一旦涉及界面审美和交互细节就全线露短。 Q1 强约束指令遵循句子生成:失败。题目要求写出 10 个以汉字数字一到十结尾、且语句通顺有意义的句子,但认真读完之后,没有一个是通顺的——每句最后都缺了一个单位,硬生生把数字凑到结尾。 Q2 鹈鹕土星环骑自行车 SVG:完成度不错。整个环形骑行的转弯没有看到什么问题,动作挺连贯顺畅,唯一美中不足的是鹈鹕没有扶着自行车。 Q3 复合弓射箭 SVG:翻车。一是弓箭手画得很猥琐、根本没有脖子;二是拉弓的时候手都不用碰到箭就能把弓拉开,像会吸星大法一样。除这两点外没有更严重的问题。 Q4 浏览器内操作系统:能用,但简陋。整体 UI 一般、桌面背景也太单一;右上角弹窗只有一个 Wi-Fi 信息弹窗,点日期没有任何反应,而且这个弹窗本身也很简陋;Dock 栏应用功能没有问题,UI 同样简陋;压轴的太空射击游戏上下左右控制正常,可画面实在寒酸——“...
Seedream 5.0 Flash测评报告!几近全军覆没!
AI产品狙击手此前用一套「祖传测试用例」测过不少大语言模型,但文生图模型一直没有做过 Benchmark。这次补上:同样是 6 道题、每题 10 分,分别考察中文文字生成、物理规律理解、AI 修图等能力。第一位上场的,是字节跳动的 Seedream 5.0 Flash。 Q1 中文长文本排版支持(水彩风珠海 5 天行程插画,6 分):整体生成的大方向没有问题,画面和五日行程安排也都正常,主要问题出在错别字,一共错了三处——第一天的「日月贝鹈鹕歌剧院」把「鹈鹕」写错,第二天「鲸鲨馆」的「鲨」字写错,第三天「外伶仃」的「仃」字写错。算它刚及格。 Q2 推理和中文支持(桂林手绘三日行程图,7 分):这一题不给任何具体行程描述,要求模型自己推理。三日行程的安排它能正常推理出来,整个画面也比较讨喜,核心能力是达成的。但错别字依然存在:某处「船……夜游」有个字认不出来,「土鸡」后面接的「等」字不对,「世外桃源」的「世」字写得很别扭,乍一看像个「山」字。因为本题主要考察推理能力,给 7 分。 Q3 同一角色多视角一致性(女孩四宫格不同角度,4 分):三个问题——右边不该多出一个人物来,说...
Pi Agent!如何接入文生图AI模型?
老粉都知道,我做的大语言模型测评基本都是用 Pi Agent 接各种模型跑出来的。今天换个方向——讲讲怎么把文生图模型接进 Pi Agent,让它除了聊天、写代码,还能直接出图。 第一步是装插件。执行 pi install npm:@amaster.ai/pi-image-gen,给 Pi 装上图片生成的扩展。装好之后再启动 Pi,加载信息里就会多出一个 image-gen 技能和 @amaster.ai/pi-image-gen 扩展。 接着接入文生图模型的 API。比如要接 OpenRouter 上新出的 Seedream 5.0 Flash,就打开用户主目录下的 ~/.pi/agent/settings.json,填入下面这些设置:packages 里列出刚装的插件;pi-image-gen 段里指定 defaultModel 为 openrouter/bytedance-seed/seedream-5-0-flash、outputDir 指定图片输出目录;providers.openrouter.apiKey 这里要填你自己的 OpenRouter API...
每天一个15秒短视频!SD和H3免费用!
有段时间没玩 Manus 了,假期无聊上去看了一眼,突然发现每天白送的 300 积分基本都在浪费——日常哪有那么多东西需要调研。转念一想,它现在不是支持生成视频了吗?那这每天 300 的免费积分,完全够用来做一条 15 秒的短视频。 你现在看到的这条短片,就是刚用 H3 生成的。做法不复杂:进 Manus 的创作入口,选好视频模型、写好画面描述,剩下的交给它跑。视频模型这块,界面上能看到 Seedance 2.5 Pro 这样的选项,SD 和 H3 都在这条免费链路里。 成片规格也算够用:约 15.1 秒、16:9、1344×768,含背景音乐与环境声,而且没有水印。整个生成跑完,300 积分还剩 77 个。 算下来就是一天一条 15 秒短视频、成本为零。如果你也是 Manus 用户、每天那 300 积分常年用不完,不妨试试这个用法,羊毛党可以考虑下。 访问入口
Agent Reach!拆除平台信息孤岛!给AI装上眼睛!
AI Agent 现在写代码、改文档、管项目都没问题,可一旦让它「自己去网上查点事」就立刻卡壳——不是能力不够,是路被堵死了。小红书要登录、雪球要登录、BOSS 直聘要登录,B站的内容 AI 又不知道该从哪儿拿。想让 Agent 把国内这几个平台一个个配通,光是配置过程就能配到怀疑人生。Agent Reach 就是冲着这件事来的:一个开源项目,专门拆除国内平台的信息孤岛,给你的 AI Agent 装上眼睛。 项目在 GitHub 上已经攒了 8 万多颗星。它的定位挺有意思——不是又一个爬虫框架,而是一套「脚手架」:负责帮你把选型和配置这些脏活干完,装完之后 Agent 直接调用上游工具,不经过中间层。 安装方式也很省事,不用自己照着文档一步步敲命令,直接跟你的 Agent 说一句「帮我装 Agent Reach」,它自己就去装好了。之后想看什么张嘴说就行——比如让它把 B站上一整套教程的要点扒下来做成总结,翻翻小红书上某款产品大家到底怎么评价,或者看看雪球上某只票最近都在聊什么。 覆盖面是它最实在的地方。一共能接 16 个平台,其中 6 个渠道装完就能用,不用登录也不用配 ...
千问办公实战(29)!一键钉钉群聊变待办!
这一集讲一个很实用的功能:怎么通过千问办公访问钉钉里的聊天群,并把和自己相关的事情建成待办任务。场景很典型——我在钉钉上有个产品需求群,一帮人一大堆讨论,我实在没时间一条条翻出来做成待办,这时候就可以交给千问办公来做。 当然有个前提:你得先按之前的视频,把钉钉这个连接器接入到千问办公。接入之后,我们去到「技能」这里,找到「聊天消息提取待办」这个 skill。它能帮我们定位到对应的聊天群,然后自动在钉钉上生成待办。 装好这个 skill 之后,开一个新的任务会话,把需求输进去就行。比如直接说:找到我钉钉上的产品需求这个群,看一下这一周的聊天记录,帮我生成和我相关的待办。然后就能看到千问办公调用这个 skill 去分析聊天内容,把和我相关的部分提取出来,一共帮我生成了 7 个待办。 回到钉钉这边,点左边的待办菜单,右边就能看到刚才千问办公分析群聊记录后帮我建立的 7 个新待办任务。整个过程不用自己翻聊天记录、不用手动抄要点,群里的讨论直接落成了可执行的清单。 这个功能对我来说相当实用,可以大大提升工作效率。大家感兴趣的可以去试一下。 访问入口
Jev Chat Jarvis!聊天界的开源贾维斯!
当前大火的 Jev 决策模型,撞上我们日常用的手机聊天工具,会擦出什么样的火花?这个开源项目直接把火花烧进了聊天框——它就是 Jev Chat Jarvis,GitHub 上已经攒了七千多颗星。用起来很简单:装上 APK,开好无障碍和悬浮窗权限,填上自己的模型 API key 就能跑。 它的工作方式是先读屏再递话。它会读出屏幕上正在聊的这一屏对话,先判断对方真实意图和危险等级、这消息该不该马上回,然后给出 3 条排好序的候选回复。你点一下就能填进输入框——但发不发永远你说了算,它不会替你按发送。QQ、飞书等常用聊天软件都能跑。 落到具体场景就很实用:客户半夜发来一句「在吗」、相亲对象突然冷淡、老板在群里点你名,它都能先帮你掂量一下再递话,把该怎么接的台阶先铺好。 比较难得的是它在隐私上的克制。它不碰你的账号密码,也不篡改聊天软件本身,工作原理跟手机自带的读屏功能一样,只看屏幕上显示的这一屏;转账、红包一概不碰,截图也只在本机识别、不上传。它还能给联系人存档案、写备注,让生成的回复贴合你的实际情况,不会跟真实处境打架。 模型接口自己配就行,OpenRouter、DeepSee...









