YouTube Video Zoomer:给 YouTube 全屏视频加一个顺手的放大功能
我做 YouTube Video Zoomer 的原因很简单:看 YouTube 教程时,经常会遇到小字看不清的场景。 尤其是软件教程。讲师录的是整个屏幕,视频里又有时间轴、参数面板、代码窗口、按钮和下拉菜单。视频本身是 1080p,但真正想看的那块内容可能只占屏幕的一小角。这个时候浏览器全屏并不够,还需要把画面里的某个区域临时放大。 Chrome Web Store 页面: YouTube Video Zoomer 我想解决的不是播放器大小,而是画面里的细节最开始我只是想在全屏视频里按住 Ctrl,再滚动鼠标滚轮,把鼠标所在的位置放大。听起来很小,但真的做起来并不只是给 video 加一个 transform: scale()。 麻烦的地方在于焦点。 如果鼠标指着一个参数、一个按钮、一个人的眼睛,放大时那个位置应该尽量留在鼠标附近。不能放着放着,焦点跑到画面外,也不能缩小到 1x 以后继续触发页面滚动,把下面的推荐视频滑上来。这个细节不处理,工具看起来能用,实际用起来会很烦。 最常用的操作只有几个现在的用法很直接: 全屏播放 YouTube 视频。 按住 Ctrl,滚动...
把 Codex 从聊天框调成工作流:12 条我验证后留下的使用技巧
这两天我又系统看了一遍 Codex 的官方手册,也顺手搜了英文教程、中文博客、GitHub 讨论和一些公开模板仓库。最后我没有把网上所有“技巧”都照单全收,而是按一个标准筛选:能不能被官方文档或真实工作流印证,能不能在日常项目里降低返工,能不能让 Codex 更稳定地理解你的习惯。 我的结论很简单:高效使用 Codex 的重点不是写一条神级提示词,而是把它从“聊天框”调成“工作流”。 我怎么验证这些建议这篇文章主要参考了几类来源: OpenAI Codex 官方文档:Best practices、Prompting、AGENTS.md、Skills、MCP、Subagents、Automations、Memories。 GitHub 上 openai/codex 的公开讨论,尤其是 Plan / Spec Mode、Plan Mode、不同模式模型配置等讨论。 独立开发者和团队写的 Codex 使用文章,例如 Codex CLI guide、可靠工作流实践、中文配置体系文章。 GitHub 上一些 AGENTS.md / Skills ...
Coursera Plus 年费折扣指南:2026 年怎样更省钱拿在线证书
如果你打算在一年内完成多门课程或多个职业证书,Coursera Plus 会比单独购买课程更省心。但它的官方年费对不少学习者来说并不便宜,所以很多人会想找更稳妥的方式降低成本。 这篇文章整理一下 Coursera Plus 包含什么、年费大概怎样变化、购买折扣服务前应该检查哪些问题,以及如果需要代激活或协助开通,怎样尽量保护自己的账号和支付信息。 Coursera Plus 是什么?Coursera Plus 是 Coursera 面向个人学习者的订阅计划。开通后,可以学习平台上大量课程、项目、专项课程,以及不少来自 Google、IBM、Meta、Microsoft 等机构的职业证书项目。 它更适合那种一年内会持续学习的人,比如你准备学: 数据分析 网络安全 人工智能 项目管理 数字营销 UX 设计 IT 支持 Python、SQL、Excel 如果你只想学一门短课,单独购买或免费旁听可能就够了。但如果目标是连续完成几个证书,年费订阅通常更好管理,也更容易控制总成本。 Coursera Plus 官方年费大概是多少?Coursera Plus 年费常见标价是每年 399...
Coursera Subtitle Tuner:把课程字幕调到真正舒服的位置和大小
我做 Coursera Subtitle Tuner 的原因,来自一个很具体的学习痛点:看 Coursera / DeepLearning.AI 课程时,原生字幕有时候太大、太占屏幕空间,而且位置和样式不能按自己的习惯精细调整。 学习视频不是普通娱乐视频。我需要一边看老师讲解,一边看画面里的图示、代码或公式,再一边读字幕。如果字幕占据了太多画面,或者一直压在关键内容上,就会很影响注意力。这个扩展就是为了解决这个问题:给课程视频加一个 CC+ 面板,让我能调整字幕大小、位置、行高、透明度和背景。 Chrome Web Store 页面: Coursera Subtitle Tuner 没有扩展之前:原生字幕太抢注意力,而且不好控制下面这张图是在关闭 Coursera Subtitle Tuner 后重新加载 DeepLearning.AI 课程页截到的原生字幕状态。字幕当然能用,但在实际学习时,我会觉得它有几个问题: 字幕区域占用屏幕空间,容易遮挡视频内容。 字幕样式比较固定,不够美观。 字幕大小、位置、透明度不能按当前课程画面灵活调整。 看久了之后,注意力会被字幕...
Hide Scrollbar:把网页滚动条藏起来,但保留正常滚动
我做 Hide Scrollbar 的原因很直接:网页滚动条当然有用,但在截图、录屏、阅读和展示页面时,它经常会破坏画面边缘的干净感。尤其是写博客或做教程截图时,右侧那条滚动条会让页面看起来像一张还没整理过的浏览器截图。 这个扩展做的事情很克制:隐藏网页上的滚动条,但不影响页面正常滚动。鼠标滚轮、触控板、键盘滚动都照常工作,只是视觉上更安静。 Chrome Web Store 页面: Hide Scrollbar 没有扩展之前:滚动条会一直占据画面边缘平时浏览网页时,滚动条可以告诉我页面有多长、当前滚到哪里。但在一些场景里,我其实不想看到它: 给网页、文章、后台界面截图。 录制一个更干净的网页演示。 展示 landing page 或 dashboard。 阅读长文时减少边缘干扰。 没有扩展时,右侧滚动条会一直出现在页面边缘。浅色页面里它尤其明显,会让画面多出一条不必要的视觉元素。 安装扩展之后:滚动还在,滚动条不再打扰画面安装 Hide Scrollbar 后,页面仍然可以正常滚动,但滚动条被隐藏了。它不是阅读模式,也不会重排网页内容,只是把滚动条这个视觉元素拿掉。 ...
用 Quote Extension for Gemini 给 Gemini 对话加上“引用上下文”
我做 Quote Extension for Gemini 的起点很简单:Gemini 的回答经常很长,而我想继续追问的往往只是其中一句话。没有引用能力时,我需要自己复制那一句,再手动解释“我指的是刚才哪一段”。这件事看起来不大,但在长对话里非常容易打断思路。 这个扩展解决的就是这个问题:选中 Gemini 回答中的一段文字,点击 Quote,它会把这段内容作为引用卡片放进输入区。接下来我再继续提问时,Gemini 能更明确地知道我追问的是哪一段。 Chrome Web Store 页面: Quote Extension for Gemini 没有扩展之前:选中了文字,但下一步只能手动复制在 Gemini 里做资料整理时,我经常会遇到这种场景:回答里有一段话很关键,我想顺着它继续问,比如“这个判断有没有反例?”或者“能不能展开讲一下这里的逻辑?” 没有扩展时,即使我已经选中了那句话,页面也不会给我一个“把它作为引用继续提问”的入口。下一步只能自己复制、回到输入框、粘贴、加引号,再补一句“关于你刚才说的……”。如果回答很长,我还要担心自己复制错了范围,或者把引用内容和我的问题混...
用 Codex 做了一个 Windows 右键菜单小工具:一键把文件日期改为当前时间
用 Codex 做了一个 Windows 右键菜单小工具:一键把文件日期改为当前时间今天遇到一个很实际的小需求:一批渲染图已经修改完成,但 Windows 资源管理器里显示的日期还是旧时间。普通地改文件“创建时间/修改时间”还不够,因为图片内部的“拍摄日期”也会影响资源管理器的“日期”列。于是我和 Codex 一起把这个流程做成了一个可复用的小工具。 这个工具的初衷其实很朴素:有些工作并不是“什么时候完成”就必须“什么时候交付”。很多时候我们会提前把文件做完,但选择在更合适的时间统一发送。如果接收方只看文件最后修改时间,就可能推断出真实完成时间,从而对工作节奏产生不必要的联想。与其每次手动处理文件时间,不如把这件小事工具化,让交付文件的时间信息和实际发送节奏保持一致。 最终成品是一个 Windows 右键菜单工具:在目标文件夹里右键,点击“更新当前文件夹日期为现在”,就能把当前文件夹里的文件时间批量更新到当前时间;如果是图片,还会尽量同步更新 EXIF/XMP 里的日期字段。项目源码和安装包已经放到 GitHub,方便在不同电脑上复用。 1. 起因:为什...
从 WAN、LAN 到 DHCP、NAT:家庭网络基础概念一次讲清楚
我们每天都在用网络:手机连 Wi-Fi,电脑接网线,电视投屏,NAS 存文件,路由器接光猫。但真正打开路由器后台时,很多名词会突然冒出来:WAN 口、LAN 口、交换机、网关、DHCP、NAT。它们看起来都和“上网”有关,但分工其实并不一样。 这篇文章用家庭网络作为例子,把这些基础概念串起来讲清楚。理解之后,再看路由器后台里的各种设置,就不会只觉得是一堆陌生缩写了。 先看一张典型家庭网络图一个常见的家庭网络大概是这样: 12345678910111213互联网 |运营商光纤 |光猫 |路由器 WAN 口 |路由器 / 网关 |路由器 LAN 口 / Wi-Fi |交换机、电脑、手机、电视、NAS、打印机 如果家里有很多有线设备,可能会变成这样: 1234567891011光猫 |路由器 WAN 口 |路由器 LAN 口 —— 交换机 —— 电脑 —— NAS —— 摄像头 —— 打印机路由器 Wi-Fi —— 手机 ...
人生的奥德赛时期
最近一个词频繁出现在我的视野里,便是”奥德赛时期”。 什么是奥德赛时期? 大致的说法是:一个人在二十多岁到三十五岁之间,会经历一段比较混乱的岁月。工作换了好几份,方向始终不明确,感觉同龄人好像都知道自己要什么,而自己还在原地打转。明明没有停止努力,却总觉得自己在原地踏步。 这个词最早来自古希腊史诗《奥德赛》。奥德修斯打完特洛伊战争之后,满心只想回家。结果他回家的路一走就是十年。海上漂泊,遭遇风暴、怪物、诱惑,每一步都是意外。 后来有人借这个词来形容人生中那段”知道不能停下来、但也不知道该往哪走”的阶段。它不是一个贬义词,也不是什么成功学概念。它只是说:你在路上,只是这条路暂时没有路标。 我为什么突然对这个词产生共鸣? 因为最近的状态确实很像。 三十好几了。工作做着还行,但也说不上热爱。想让自己更进一步,却发现不知道下一步该迈到哪一块砖上。想学点东西,打开一看入门资料就几千页;想尝试新方向,又怕自己只是三分钟热度,最后还是回到原地。 这种感觉很难跟别人描述。你说”我迷茫吧”,好像也没到那种完全不知道该怎么办的程度;你说”我还好吧”,可每天醒来确实提不起什么劲。 最让我困惑的是:我明...
从 Prompt 到 Harness:让 AI Agent 变成可靠工作系统
最近聊到一个很有意思的概念:harness engineering,或者说 harness agent。相比单纯研究 prompt,它更关心如何给 AI agent 搭建一个可靠的运行环境:工具、权限、验证、记忆、任务流、失败恢复和多 agent 协作。 我的理解是:prompt engineering 是告诉模型怎么想;harness engineering 是设计模型能做什么、怎么做、做错了怎么发现和纠正。 什么是 Harness?在 AI agent 语境里,harness 可以理解为 agent 外面的一层执行框架,也可以理解为 agent 的运行时环境。 它通常负责这些事情: 提供工具:读写文件、运行测试、查网页、操作浏览器、调用 API。 控制权限:哪些命令可以自动执行,哪些操作必须让用户确认。 管理上下文:任务列表、长期记忆、历史压缩、计划状态。 约束行为:不能随便删文件,不能跳过测试,不能强推代码。 观察结果:测试是否通过,页面是否真的可用,日志是否报错。 失败恢复:命令失败后如何诊断、重试、换路径。 多 agent 协作:主 agent 负责决策,子 ag...