Coucou!AI编程神器!桌面悬浮卡通助手!
这个 GitHub 上开源的小工具叫 Coucou,能把 Claude Code 和 Codex 这些 AI 编程 Agent 的一举一动搬进你 Mac 和 iPhone 的刘海和灵动岛,甚至可以在你离开电脑时通过手机一键审批各种授权。开源仅一周,GitHub 上已经攒了 3800 多颗星。 有了这个小工具之后,Claude Code 等每读一个文件、每改一行代码,刘海上都实时看得见:动了哪个文件、加了几行、删了几行都标着,点开就是完整的 diff。权限请求弹出来就是 Allow / Deny / Always 三个按钮,随手一点就完了,不用来回切终端。想知道是哪个会话在等你,一下就能跳到那个终端。 人走开也不耽误:Mac 一锁,它就跟到 iPhone 的锁屏和灵动岛上,权限在锁屏上就能点头;人在外面用语音就能把下一条指令发回 Mac。 它现在盯着 Claude Code、Cursor、Codex、Gemini CLI、Antigravity 这些 Agent;CI 跑没跑过、部署上没上线,刘海里瞄一眼就知道。 天天挂在 Codex 和 Claude C...
Ideogram 4.5 测评报告!是否真的能打?
应粉丝要求,这一集用祖传测试用例测评一下最新的 Ideogram 4.5 模型,直接在官网上测。 Q1 中文长文本排版支持(水彩风珠海 5 天行程插画):几个问题。首先第一天的渔女形象就不符合真实情况,搞得像个自由女神一样——估计这个模型并不知道珠海渔女长什么样子;第二,每一天下面都是一大堆乱七八糟的文字,我数都数不过来。 Q2 文生图综合能力测试(左撇子咖啡馆写信):第一,提示词要求左手拿笔、右手拿烟斗,它反过来了,而且拿烟斗的方式很奇怪;第二,杯子里的清水应该是满到快溢出来的;第三,拿铁应该是半杯;第四,大家看一下墙上的时钟,要求时间是 3:45,时针和分针都没有指对地方;第五,提示词要求写的字「亲爱的阿珍:见字如面」清晰可见,但这张 2K 的图片我放到最大了,都看不清楚里面写了啥。 Q3 同一角色多视角一致性(女孩四宫格不同角度):首先这很明显不是四宫格布局;第二看站位,正面的有了、侧对着的有了,背对着的没有,3/4 视角的半身照也没有;第三,提示词要求左手抱着猫咪,这里没有一个是对的。 Q4 物理常识(女孩落地镜自拍 + 水杯筷子折射):问题有点多。第一,...
SenseNova U1 Pro 测评报告!结果有点意外!
这一集测评的是商汤最新的文生图模型 SenseNova U1 Pro,这次直接在官网上测。同时我们的祖传测试用例也做了一次升级,升级到 V1.1:原来的第二题推理题换成了「文生图综合能力测试」,第四题物理常识题则明确了自拍用的是后置摄像头。 Q1 中文长文本排版支持(水彩风珠海 5 天行程插画):这个模型的生成时间明显比之前测试过的模型都慢,大概要 5–10 分钟。但效果是真的可以——整张图只有第一天「鹈鹕海鲜餐厅」的「鹈鹕」两个字,以及第五天「庞都」的「庞」字写错,这应该是所有测评过的模型中错得最少的一次。 Q2 文生图综合能力测试(左撇子咖啡馆写信):这一题有两个问题。第一,提示词要求左手拿笔、右手拿烟斗,它给反过来了;第二,明信片上写的文字是面向镜头的,而不是面向人物自己的。其他条件看了一下,应该都是满足的。 Q3 同一角色多视角一致性(女孩四宫格不同角度):四宫格的排列是对的,四张图的站位也是对的;唯一有问题的是左下角的第三张图,抱着猫咪的手变成右手了。 Q4 物理常识(女孩落地镜自拍 + 水杯筷子折射):这一题错得有点离谱。第一,镜子里面的女孩拿着手机,而镜子外面...
GPT Image 2.5 Sunburst 测评报告!真的能打吗?
这一集测评的是 OpenAI 最新的图像模型 GPT-Image-2.5-Sunburst,测试依然直接在 OpenRouter 的 Playground 上进行,用的还是那套 6 题的文生图 Benchmark。测下来的整体感觉是相当不错。 Q1 中文长文本排版支持(水彩风珠海 5 天行程插画):第一天「渔民岛鹈鹕海鲜」里的「鹈鹕」两个字错了;第二天「鲨」字的上半部分写错;第四天墙上博物馆的「博物」两个字错;第五天「横琴」的「琴」字错。整体感觉已经比之前测的几个模型好了很多。 Q2 推理和中文支持(桂林手绘三日行程图):这一题不给具体的行程描述,要求模型自己推理。三天行程的安排没有问题,说明它是有推理能力的;而且这次的中文文字仔细看了一下,好像没有找到什么错别字——它的中文能力比我们之前测的几个国产模型还要好。 Q3 同一角色多视角一致性(女孩四宫格不同角度):四宫格的排列是对的,图二没有问题;但图一和图三都画成了右手抱着猫咪(题面指定的是左手抱一只白猫),图四的方向也没做对——应该是 45 度角稍微侧身对着我们。总体来说已经不错了。(更正:视频里说的是「图一和图二没有问...
Hy Image 3.5 Preview测评报告!真的能打吗?
这一集测评的是腾讯新出的图像模型 Hy Image 3.5 Preview,测试依然直接在 OpenRouter 的 Playground 上进行,用的还是那套 6 题的文生图 Benchmark。先给个提醒:答案也许不是你想要的,观看需谨慎。 Q1 中文长文本排版支持(水彩风珠海 5 天行程插画):这一题错得挺多。第一天渔女的形象就不对,「渔民老鹈鹕」和「海鲜」里的「鹈鹕」两个字写错;第二天「鲸鲨馆」三个字明显错;第四天「农家乐」的「农家」两个字错;第五天「励骏庞都」的「骏」和「庞」都错,「手撕鸡」的「撕」还少了提手旁。估计它对中文的支持还是不大好。 Q2 推理和中文支持(桂林手绘三日行程图):这一题不给具体的行程描述,要求模型自己推理。三天行程的安排没有问题,说明它是有推理能力的;但中文错别字同样不少,这里就不一个个指出来了,毕竟本题主要考察的是推理能力。 Q3 同一角色多视角一致性(女孩四宫格不同角度):很明显不是四宫格排列,而且没有看到 3/4 视角的半身照,这一题没做到。 Q4 物理常识(女孩落地镜自拍 + 水杯筷子折射):一共挑出四处问题。第一,镜子里...
Flux 3 模型测评报告!真的能打吗?
这一集测的是黑森林(Black Forest Labs)最新的 Flux 3 文生图模型。用的还是同一套 6 题 Benchmark,逐题实测,模型直接在 OpenRouter 的 Playground 上跑。 Q1 中文长文本排版支持(水彩风珠海 5 天行程插画):整体布局没有什么问题,但错别字错得相当密集。第一天「渔民佬鹈鹕海鲜」里的「渔」和「鹈鹕」写错;第二天「鲸鲨馆」的「鲨」错了,「企鹅」的「鹅」也错了;第三天「外伶仃」的「仃」和「渔」写错;第四天「荔枝园农家乐」的「荔」错了,「农家乐」的「家」位置不对,「农」和「乐」两个字也不对;第五天「励骏庞都」的「励」和「庞」都错了,「手撕鸡」的「撕」还少了提手旁。这一题错得挺多,估计它对中文的支持不大好。 Q2 推理和中文支持(桂林手绘三日行程图):这一题同样不给具体行程,要求模型自己推理。桂林、漓江、遇龙河这三天的安排没有问题,说明它是有推理能力的;但中文错别字也是一大堆,这里就不一个个指出来了,毕竟本题主要考察的是推理能力。 Q3 同一角色多视角一致性(女孩四宫格不同角度):这一题实现得没有问题,四个角度都没看出什么毛病...
千问办公实战(30)!一键总结钉钉群聊消息!
钉钉群聊的消息实在太多了,工作一忙起来,根本没有时间一条条往上翻。比如视频里这个产品需求群,随手一划就是一堆没读的消息,重要的决策和待办就这样被淹没在闲聊里。 这个时候可以试试千问办公上的「群聊内容摘要」skill。它能够针对指定的群聊、指定的时间段做消息总结,把这一段时间里大家聊了什么一次性理清楚,对效率的提升相当明显。需要注意的是,使用的前提是你已经启用了钉钉连接器 —— 如果还没有配置过,可以翻一下这个合集前面的入门视频,先把连接器接通。 启用这个 skill 之后,打开一个新任务、唤起它,然后输入提示词即可,比如直接让它「总结一下这三天的聊天内容」。接下来它就会自己开始干活,最终把群消息整理好交给你。 更值得说的是,它并不是那种三言两语的敷衍总结,而是会分门别类地归纳 —— 决策方面的、行动方面的、风险方面的各自成条,一眼就能看清群里到底推进了什么、还欠着什么。更实用的是,它还会把详细内容写进钉钉文档,随时可以回溯原文。建议先收藏起来,这类能力迟早用得上。 访问入口
Gemini Pro 18 个月领取免费指南!无需学生证明!
花几块钱就能拿到 18 个月的 Google AI Pro,这件事作者亲自试过了,是真的。拿到的方式是通过 Jio 渠道激活,而且全程不需要学生证明。不过在动手之前,有一个前提必须先确认,否则很容易白折腾一场。 这个前提是:如果你打算在 Google Antigravity 里用这套订阅,就要先确认账号在 Antigravity 上能够正常打开、正常授权。作者实测了两个账号,其中一个的 region 是中国区,就无法正常使用 Antigravity —— 这种情况下即使已经拿到了 Google AI Pro,也只能在 Gemini 官网上用,Antigravity 里是进不去的。 这个前提确认完毕,就可以去海鲜市场(闲鱼)找一家商家,直接搜「Jio」,商家会告诉你怎么操作。还没上车的,可以赶紧去试一下。 访问入口
Fledge Alpha 测评报告!真的能打吗?
本期的测试对象是 OpenCode 上线的匿名免费模型 Fledge Alpha,思考模式拉到最高的 Max。用这套 6 题测试跑下来,它的表现呈现出很明显的两极分化:结构清晰、有对错可言的题做得还行,一旦涉及界面审美和交互细节就全线露短。 Q1 强约束指令遵循句子生成:失败。题目要求写出 10 个以汉字数字一到十结尾、且语句通顺有意义的句子,但认真读完之后,没有一个是通顺的——每句最后都缺了一个单位,硬生生把数字凑到结尾。 Q2 鹈鹕土星环骑自行车 SVG:完成度不错。整个环形骑行的转弯没有看到什么问题,动作挺连贯顺畅,唯一美中不足的是鹈鹕没有扶着自行车。 Q3 复合弓射箭 SVG:翻车。一是弓箭手画得很猥琐、根本没有脖子;二是拉弓的时候手都不用碰到箭就能把弓拉开,像会吸星大法一样。除这两点外没有更严重的问题。 Q4 浏览器内操作系统:能用,但简陋。整体 UI 一般、桌面背景也太单一;右上角弹窗只有一个 Wi-Fi 信息弹窗,点日期没有任何反应,而且这个弹窗本身也很简陋;Dock 栏应用功能没有问题,UI 同样简陋;压轴的太空射击游戏上下左右控制正常,可画面实在寒酸——“...
Seedream 5.0 Flash测评报告!几近全军覆没!
AI产品狙击手此前用一套「祖传测试用例」测过不少大语言模型,但文生图模型一直没有做过 Benchmark。这次补上:同样是 6 道题、每题 10 分,分别考察中文文字生成、物理规律理解、AI 修图等能力。第一位上场的,是字节跳动的 Seedream 5.0 Flash。 Q1 中文长文本排版支持(水彩风珠海 5 天行程插画,6 分):整体生成的大方向没有问题,画面和五日行程安排也都正常,主要问题出在错别字,一共错了三处——第一天的「日月贝鹈鹕歌剧院」把「鹈鹕」写错,第二天「鲸鲨馆」的「鲨」字写错,第三天「外伶仃」的「仃」字写错。算它刚及格。 Q2 推理和中文支持(桂林手绘三日行程图,7 分):这一题不给任何具体行程描述,要求模型自己推理。三日行程的安排它能正常推理出来,整个画面也比较讨喜,核心能力是达成的。但错别字依然存在:某处「船……夜游」有个字认不出来,「土鸡」后面接的「等」字不对,「世外桃源」的「世」字写得很别扭,乍一看像个「山」字。因为本题主要考察推理能力,给 7 分。 Q3 同一角色多视角一致性(女孩四宫格不同角度,4 分):三个问题——右边不该多出一个人物来,说...









