Freak.
奇奇怪怪的小博客
最新文章
-
Do ≠ See:当 Agent 看见成功,却仍然不该行动
我们研究的不是“AI Agent 会不会犯错”这样宽泛的问题,而是一个更具体、更危险的瞬间: Agent 刚刚执行了一个动作,工具返回成功,但受保护目标可能已经失效。仅凭这条成功回执,Agent 是否会继续批准一个不可逆操作? 这就是 Do ≠ See 的核心命题: 执行成功,不等于目标仍然成立;看见成功,也不等于获得授权。 从一个直觉开始 在工具型 Agent 中,常见的工作流是: Agent 调用工具执行动作; 工具返回成功; Agent 根据成功回执判断任务已经完成; Agent 继续执行提交、发布、删除或其他不可逆操作。 这种流程在正常情况下非常自然。但问题在于,工具返回的成功通常只说
-
OpenRouter:一个 API 调用几乎所有主流大模型
写这篇博客的原因是:现在各家的 Token Plan 老是在变化,我老是得给我的 OpenClaw 和其他 Agent 切换提供商。所以我想找一个一劳永逸的 API 来支持我的 OpenClaw。所以我就看到了 OpenRouter。 你可以把它理解成一个统一的大模型 API 网关 + 路由器。正常情况下,OpenAI、Claude、Gemini、DeepSeek、Qwen 等模型都有自己的 API、Key 和计费方式。 使用 OpenRouter 后,只需要一套 API: 再通过修改模型名称切换模型: 因此你的应用不需要针对每家模型重新开发一套接口。OpenRouter 目前接入了数百个模型
-
dsh-catgirl-plugin:DSH 猫娘插件
在 DeepSeek Harness 刚出的那几天,我就火速做了一个猫娘插件,准确说是「猫娘风味插件」 你看到的"喵",实际上模型一个字都没生成,猫娘是本地代码补上的。 为什么这么做? 一般的做法是,把一大段人设塞进每次请求,让模型每次回复前把这段读完。 这种方式可以达到让模型变成猫娘的效果,但上下文会变得越来越重。 所以,我换了个思路:模型只留一条短约束,猫娘交给本地渲染——「模型负责干活,界面负责卖萌」 实际上,日志里存的是依旧原文,没有任何关于猫娘的内容。只是界面上再把猫娘补回来。这样下来,模型的上下文并没有被改变,而你看到的还是猫娘。 实测数据 这是我用真实 DeepSeek API
-
视频生产先别急着剪:一条 HyperFrames-first 路由
用 AI 做视频时,最容易失控的地方往往不在剪辑本身,而在项目一开始就混用了渲染框架、画幅、内容类型和素材标准。 一条稳定的视频生产流程,应当先完成路由,再进入制作: 这正是 video-production 技能解决的问题。 一、先确定生产框架 所有新项目和重大修改,统一使用 HyperFrames。 HyperFrames 的 HTML composition 和 source builder 是生产源文件,负责: 画面布局 素材时序 字幕 动效 音频 生成的 index.html 只是产物,不能作为主要编辑对象。修改应当回到源 builder,再重新生成。 Remotion 只保留为历史