分类导航

发现更多优质 AI 工具

全部 编程代码 创作写作 视频音频 图像视觉 学习辅导 办公效率 设计创意 大模型 提示词 Skills 自动化 知识库 开源&免费 副业
Paperless图标

Paperless

Paperless-ngx 使用指南Paperless-ngx 是一个开源且完全免费的无纸化个人/家庭/小企业文档管理系统(DMS)。它具备强大的功能,能够自动索引、识别、归档纸质或电子文档,将扫描件和 PDF 转换为可快速搜索、分类和检索的数字化档案库。主要功能自动 OCR 识别与索引: 内置Tesseract OCR引擎,上传扫描件或图片后可自动提取文本(支持多语言),生成带有可选择文字的 PDF 文件。智能自动分类(机器学习): 根据历史文档和学习模型,自动为你上传的文档打标签(Tags)、匹配联系人/发行方(Correspondents)和文档类型(Document Types)。全文检索与高级筛选: 支持类似于搜索引擎的全文搜索、自动补全以及按时间、标签、类型、联系人等维度的多条件筛选。自动化抓取 (Consume Folder): 监控指定文件夹或扫描仪共享路径,新放入的 PDF/图片会立刻自动扫描并导入系统。电子邮件集成: 可直接连接你的邮箱(IMAP),自动从指定邮箱中提取发票或附件并导入系统。多用户与权限管理: 支持多账户配置、角色的细粒度权限管控与多租户隔离。适用人群家庭与个人用户: 用于归档家庭发票、医疗单据、合同证书、保修卡、税单等日常纸质文件。小微企业与自由职业者: 替代传统的文件夹归档模式,快速管理业务进销存单据、对账单与客户合同。自建服务(Self-hosted)与隐私敏感爱好者: 拒绝将敏感财务/法律文档上传到第三方云盘,追求数据自主控权的用户。免费与付费情况平台属性: 100% 免费且完全开源(基于GPL-3.0协议)。无论个人或商业使用均无需购买许可证,没有任何功能限制。服务成本: 软件本身没有任何官方付费方案。如果你选择自行部署(Self-Host)(如安装在本地 NAS、旧电脑或家用服务器上),费用为 $0。第三方云部署(可选): 如果你不想自己搭建硬件,可以使用第三方云托管平台(如 Elestio 等云服务商一键托管),此时需付云服务器费用(通常在 $6 - $16/月 左右,由第三方收取而非官方)。项目主页与文档: 可以随时前往 Paperless-ngx 官方 GitHub 仓库 或 官方文档首页 查看最新动态与开发者社区支持。如何使用官方推荐使用 Docker Compose 进行一键部署:环境准备: 准备好已安装Docker和Docker Compose的Linux 服务器、NAS(如群晖、威联通、Unraid)或树莓派。下载示例配置: 官方提供一键脚本或基础配置文件 docker-compose.env 与 docker-compose.yml:bash# 使用官方安装脚本交互式配置 bash -c "$(curl -L https://raw.githubusercontent.com/paperless-ngx/paperless-ngx/main/install-paperless-ngx.sh)" 启动容器:bashdocker compose up -d 访问与配置: 在浏览器中输入 http://<你的 IP>:8000 进入 Web UI,使用部署过程中创建的管理员账号登录即可开始使用。注意事项磁盘空间与性能消耗: OCR 解析(尤其处理数百页大文件或高分辨率图片时)需要消耗一定的CPU和内存算力。如在低配设备(如老旧树莓派)上运行,建议限制并发 OCR 任务数。原始文件安全与备份: Paperless-ngx 默认会保留原始文件(Originals)和处理后的文件(Archive)。请务必定期备份其存储目录(Data & Media 目录)和PostgreSQL 数据库。扫描文件命名规范: 如果配合物理扫描仪使用,建议将扫描件输出格式设为PDF或高清晰度PNG/TIFF,这会显著提高OCR 识别的准确率。

Recordly图标

Recordly

Recordly:开源屏幕录制与剪辑工具官方网站:recordly.devRecordly 是一个开源、跨平台(支持 Mac/Windows/Linux)的桌面级屏幕录制与演示视频剪辑工具。其被定位为 Screen Studio 的开源免费替代品。该工具旨在解决“录屏后再找专业剪辑师添加放缩、画中画、游标平滑与背景边框”的痛点,帮助用户在极短时间内直接生成高质量的产品 Demo、操作教程和宣传短视频。1. 主要功能自动/手动镜头放大:根据鼠标点击与轨迹自动捕捉焦点并平滑放大,也支持在时间轴上手动添加放大区域。光标美化与动态平滑:自动隐藏/替换原始鼠标指针,提供轨迹平滑、运动模糊、点击波纹(Click Bounce)、摆动及 macOS 风格游标样式。摄像头动态画中画:支持插入摄像头浮窗,可自定义形状、阴影、镜像及比例,且摄像头能随画面放缩自动动态调整比例。专业背景与外框样式:支持为录屏画面添加渐变背景、预设/自定义壁纸、背景高斯模糊、圆角、内边距与阴影效果。时间轴剪辑与标注:支持在时间轴上裁切片段、调节局部播放速度(变速)、叠加文本/图片/形状标注、添加额外音频轨等。多格式导出与项目保存:支持导出为高清 MP4 或 GIF 动图(可设循环、帧率);工程可保存为 .recordly 文件以便后续修改。扩展与组件插件:提供 Marketplace 插件市场,可加载社区开发的点击音效、浏览器外框 mockup、壁纸等。2. 适用人群产品经理与开发者:快速录制产品 Demo、功能更新演示视频或提交 Bug 演示。独立开发者与创作者:为 App、SaaS 工具制作吸引眼球的宣传短片和社交媒体展示 GIF,无需掌握复杂剪辑软件(如 PR、AE)。技术文档与教程作者:录制高清晰度、重点突出的操作指南与步骤说明。3. 免费与付费情况许可与价格:100% 免费且完全开源(基于 AGPL-3.0 协议)。所有本地功能均可无限制免费使用。官方资源与更新:官方项目不包含任何商业付费版本。如需随时了解项目更新或赞助作者,可直接前往:https://github.com/webadderallorg/Recordly 或其官网查看最新动态。4. 如何使用安装下载:直接前往 GitHub 的 Releases 页面下载适合您系统(macOS、Windows、Linux)的安装包;Arch Linux 用户可通过 AUR 安装 yay -S recordly-bin。录制步骤:打开应用 ➔ 选择需要录制的屏幕或应用窗口 ➔ 开启/关闭系统声音与麦克风 ➔ 点击录制 ➔ 停止录制后直接进入编辑界面。编辑与导出:在编辑界面调节自动放缩强度、美化鼠标样式、调整背景外框 ➔ 满意后点击导出为 MP4 或 GIF 格式。5. 注意事项macOS 系统要求:需 macOS 14.0 (Sonoma) 及以上版本,以利用 native ScreenCaptureKit 实现完美的系统声音捕获与原生鼠标隐藏。Windows 系统要求:建议 Windows 10 Build 19041 (20H1) 及以上版本。旧版本由于降级到 Electron 捕获 API,录屏中可能会残留系统的真实鼠标指针。Linux 系统要求:目前由于 Electron 限制,暂不支持原生隐藏鼠标指针(若同时开启软件自带的光标美化,可能出现“双鼠标”现象);系统声音捕获通常依赖 PipeWire。Mac 本地构建提示:如果自行拉取源码打包,在 macOS 上首次打开可能会被系统隔离提示打不开,需在终端运行 xattr -rd com.apple.quarantine /Applications/Recordly.app 清除隔离标记。

Inkos图标

Inkos

InkOS 使用指南1. 平台概述InkOS 是一个面向文本与长文创作的开源 AI Agent 系统与写作工作台。它专为解决 AI 写作“长文易崩乱、上下文失控、越写越偏”等痛点设计,通过分层上下文组织、原子化指令与统一控制内核,管理长篇故事的状态、角色、世界观和剧情线。同时提供可视化 Web UI (Studio)、命令行 CLI以及与 OpenClaw/Claude Code 等外部 Agent 集成的 Agent Skill 接口。2. 主要功能长篇小说与剧本创作:自动建立大纲、世界观、角色卡、卷纲与章节意图。内置“计划 → 构思 → 草稿 → 审稿 → 修订”治理链,保障上下文与正史逻辑不越界。剧情多线推演 (Branching):基于当前正史推出 2-5 条彼此隔离的未来剧情分支,预览章节节拍、风险与意图匹配度,确认后才保存并切入正史。InkOS Short(商业短篇与短剧):支持一键生成独立短篇小说、短剧剧本、卖点简介、审稿记录及封面 Prompt(配置服务后可直接生成封面图)。InkOS Play(互动剧情与开放世界):允许指定世界契约、时间推进机制、角色 Agent 和物品/证据链规则,自动维护动态世界状态与选择树。专业 Skill 扩展机制:直接兼容标准 SKILL.md 格式,内置涵盖长文写作、商业短视频、剧本、分镜、长文档翻译、语义去 AI 味(Semantic De-slopping)等 15 个专业技能包。多模型灵活路由 (BYOK Multi-LLM):支持为写作(Writer)、审稿(Auditor)等不同角色单独指定模型,最大化平衡生成质量与 API 成本。3. 适用人群网文 / 长篇小说作家与编剧:需要维持庞大世界观、多角色关系及数十万字上下文逻辑一致性。短剧与影视策划:快速生成短剧脚本、分镜大纲及方案卖点。互动游戏与 RPG 制作人:涉及分支选择、世界状态维护及证据链驱动的互动游戏设计。AI Agent 开发者:寻找可集成在 OpenClaw、Claude Code 或本地自动化流水线中的长文本创作引擎。4. 免费与付费情况许可与价格:100% 免费且开源(开源许可为 AGPL-3.0)。项目本身不收取任何费用。API 成本由用户自理 (BYOK):采用自带密钥模式(Bring Your Own Key)。模型服务接入第三方 API(如 Google Gemini、Moonshot/Kimi、MiniMax、智谱、百炼、DeepSeek、OpenRouter 或 OpenAI 兼容格式等),产生的 API 消耗费用直接按对应平台标准结算。5. 如何使用5.1 安装方式全局 NPM 安装(推荐):bashnpm i -g @actalk/inkos 作为 OpenClaw / Agent Skill 使用:bashclawhub install inkos 5.2 交互模式选择Web UI (Studio):在项目目录下运行 inkos studio,在浏览器打开 Visual Studio 工作台。在“模型配置”处填写 API Key 并测试连接即可开始可视化创作。CLI 命令(Pipeline / Atomic):一键管道推进:inkos write next my-book --count 3 (顺序写作 3 章,含计划 - 构思 - 写草稿 - 审稿 - 自动修订)。原子化拆解:inkos plan chapter / inkos compose chapter / inkos draft / inkos audit / inkos revise。5.3 Natural Language Agent 模式指令式调用:inkos agent "写一部主角是治疗职业的地牢流奇幻小说"6. 注意事项密钥安全性:在 Studio 中配置的 API Key 会保存在本地 .inkos/secrets.json 文件中,不会写入会被版本控制跟踪的 inkos.json。模型选型建议:长篇小说与复杂剧情推演极度依赖大模型的上下文遵循能力与长文本窗口,建议在全局或创作节点选用逻辑强、窗口大的模型(如 Gemini、Kimi、DeepSeek 或 MiniMax 等),简单的审稿或初稿润色节点再路由至低成本模型。正史防护:在使用分支剧情推演(Branching)时,生成的分支推演仅作为临时方案,只有显式执行确认选择后,更改才会写进“正史”与正文档案中。

LocalSend图标

LocalSend

LocalSend 平台使用指南1. 平台概述LocalSend是一款完全免费、开源的局域网文件传输工具,被广泛视为 AirDrop(苹果随手传)的跨平台替代方案。数据传输完全基于局域网(LAN),不经过任何第三方服务器。这意味着既不消耗互联网流量,又能有效保障数据隐私与安全。2. 主要功能跨平台互传: 支持 Windows、macOS、Linux、Android、iOS / iPadOS 等多系统间的文件交互。零配置自动发现: 只要设备连接到同一个 Wi-Fi 或局域网,打开软件即可自动识别邻近设备,无需复杂设置。多样化传输形式: 支持发送文件、文件夹、剪贴板文本以及直接发送文字消息。免安装 Web 接收(Web Share): 支持开启临时 HTTP 网页服务,未安装软件的设备(如访客手机)只需扫描二维码或输入局域网 IP即可通过浏览器下载文件。安全加密: 传输过程采用端到端 TLS/HTTPS 加密,防止局域网内数据被监听。3. 适用人群多设备/跨系统用户: 适合同时使用 Windows 电脑与 iPhone,或者 Android 手机与 Mac 等不同设备混合使用的场景。高隐私/办公敏感人群: 适合不希望将商业机密、私密照片或大文件上传到云盘或微信服务器传输的用户,强调数据本地化。大文件传输需求者: 适合传输动辄几 GB 的视频文件的用户,无需等待云端上传和下载,可直接跑满局域网最高网速。4. 免费与付费情况许可与价格: 项目为 100% 免费且开源(开源协议为 MIT),无广告、无功能限制、无传输文件大小或速度限制。无付费订阅方案: 官方不存在任何收费功能或付费套餐,应用商店中的自选内购仅为志愿捐赠/赞助支持。项目动态与赞助: 如需了解项目进展或赞助开发者,可直接查看:https://github.com/localsend/localsend。5. 如何使用安装软件: 在需要互传文件的所有设备上安装 LocalSend,可通过官网下载对应系统的安装包或应用商店下载。连接同一网络: 确保所有设备连接在同一个 Wi-Fi或同一路由器局域网下。发送文件:打开软件,进入 “发送” 选项卡。选择要发送的文件、文本或文件夹。在下方候选列表中点击目标设备名称(如 Cool Avocado),目标设备弹框确认后即可开始传输。6. 注意事项局域网隔离与防火墙:防火墙拦截: 首次在 Windows/Mac 上运行时,若弹出系统防火墙提示,请务必勾选允许局域网通信。AP 隔离(Guest Wi-Fi): 如果连接的是公共 Wi-Fi、酒店 Wi-Fi 或开启了“AP 隔离/访客网络”的路由器,设备之间无法互相搜索。此时可尝试用一台手机开启热点,其他设备连接该热点来传输。别名识别: LocalSend 默认会自动生成一个随机有趣的动物名(如 Quick Orange)作为设备别名,建议在“设置”中将其修改为易于识别的名称(如 John-MacBook)。静默接收与自动保存: 频繁互传时,可在“设置”中开启“快速保存”或将特定信任设备加入白名单,跳过每次手动点击“同意”的步骤。

VoiceStudio图标

VoiceStudio

VoiceStudio 使用指南一、平台介绍VoiceStudio 是一个开源且完全本地化运行的 AI 声音工作站。该工具被定位为 ElevenLabs 的开源替代品,具有以下核心特点:数据隐私保护: 所有数据、声音模型和生成内容均保存在用户自身的本地设备上,无需依赖云端服务,有效保护隐私。完全本地运行: 避免了将敏感语音或商业机密文本上传至第三方平台的潜在风险。多功能集成: 集成了 TTS(文本转语音)与 ASR(语音识别)引擎,支持从录音到生成内容的完整工作流。二、主要功能特性平台提供了强大的处理能力,具体功能包括:声音克隆与设计 (Voice Cloning & Design): 用户可通过一段音频样本快速克隆特定声音,或自定义调节参数创建全新的 AI 声音。视频自动配音 (Video Dubbing): 支持导入视频/音频文件或 URL,自动提取字幕并将其翻译为目标语言,同时保留原说话者的音色生成新配音。有声书与多角色创作 (Audiobook Creation & Multi-Speaker): 内置剧本编辑器,支持多角色分配与音色映射,可一键生成完整的有声书内容。实时听写与语音转文字 (Dictation & Transcription): 支持多语言的高精度语音识别服务。多模型与多语言支持: 支持多达 16 种 TTS 引擎与 11 种 ASR 引擎,覆盖高达 646 种语言。开发者接口: 提供本地 REST / SSE / WebSocket API、OpenAI 兼容的 Audio API 以及 MCP Server,便于接入应用或自动化工作流。三、适用人群该工具适合以下类型的用户群体:自媒体与视频创作者: 需要进行多语言视频翻译、跨国配音及自动生成字幕的用户。有声书/广播剧创作者: 需要处理长文本朗诵及多角色音色快速分配的制作人。开发者与 AI 爱好者: 需要将本地 TTS/ASR 服务接入应用、Agent 或个人自动化工作流的技术人员。高隐私需求用户: 无法接受数据上传至云端,有严格保密要求的用户。四、免费与付费情况关于许可协议、成本及硬件门槛的说明:许可与价格: 项目为 100% 免费且开源,遵循 AGPL-3.0 开源协议。无需订阅或按字数付费。官方定价策略: 官方项目无付费版本,不存在官方的付费定价页面。如需随时了解项目状态或赞助作者,可直接前往 GitHub 仓库查看。硬件要求: 本地运行需消耗自身算力,支持 NVIDIA CUDA、Apple Silicon MPS/MLX、Linux ROCm 或 CPU 运行。建议配置 8GB 以上显存(或 Mac 统一内存)以获得流畅的生成速度。模型许可证提示: 虽然软件本身开源,但通过界面下载的某些第三方模型可能保留各自的上游许可证(如非商业用途限制),商业化使用前需注意确认具体模型条款。五、如何使用环境准备与克隆: 需准备好 Python 环境与 Git 工具,执行以下命令下载代码:bashgit clone https://github.com/debpalash/VoiceStudio.git cd VoiceStudio 安装依赖: 根据硬件配置(如 Nvidia GPU / Mac M 芯片 / CPU),安装对应的 PyTorch 及依赖项:bashpip install -r requirements.txt 启动应用: 运行启动脚本以打开桌面界面或 Web UI。系统支持快捷键 Ctrl / Cmd + E 来切换引擎、下载或加载模型。六、注意事项在使用前请务必关注以下细节:资源消耗: 高精度克隆与跨语言配音引擎对显存要求较高,低配置设备可能导致生成速度变慢。首次预热时间: 首次运行时需下载模型权重文件,可能耗时较长,请确保网络连接通畅。合规性风险: 务必遵守所加载模型的许可协议,避免在商业环境中使用受限的第三方模型资源。

Pixel RAG图标

Pixel RAG

PixelRAG 开源平台PixelRAG (pixelrag.ai) 是由加州大学伯克利分校(UC Berkeley)Sky Computing Lab 团队推出的开源像素级原生视觉检索增强生成(Visual RAG)平台与技术方案。不同于传统将网页/文档解析为纯文本的 RAG,PixelRAG 采取“用 AI 直接‘看’网页”的思路,保留排版、图表和表格信息。一、平台介绍与核心机制1. 核心逻辑跳过解析流程:跳过传统的 HTML 解析与文本提取(无损、无需传统的 OCR/Chunking)。像素空间检索:将网页或文档渲染为截图(Screenshot Tiles),通过多模态视觉嵌入模型建立向量索引,检索时直接在“像素空间”比对。2. 技术架构渲染层:利用 Playwright CDP 或 PDF 渲染器,将页面切割为图像区块(Tiles)。向量化(Embed):使用 Qwen3-VL-Embedding 模型提取视觉特征(维度 2048)。检索索引:后端基于 FAISS IVF 索引进行海量像素向量检索。二、主要功能像素级文本与图像检索:支持输入“文字查询”或“图片查询”,直接匹配并返回最相关的网页截图碎片。复杂排版与图表保留:完美保留跨列表格、复杂流程图、代码块及 CSS 样式的视觉结构,解决传统文本 RAG 信息丢失的问题。在线体验与维基百科预建索引:官方提供包含 828 万篇 Wikipedia 文章、2810 万张截图分块的轻量在线检索接口与 Demo。Claude Code 插件(pixelbrowse):允许 AI 智能体(如 Claude)调用本地截图工具直接“看”网页并总结,无需经过文本抓取。索引与模型解耦:索引库直接存储像素图片。未来升级更新视觉大语言模型(VLM)时无需重新生成向量库,直接更换读取模型即可。三、适用人群AI 开发人员 & 架构师:构建智能客服、文档问答或知识库,需处理大量包含表格、PDF、图表、PPT 或复杂网页的场景。Agent / 自动化开发人员:需要为 AI Agent 提供视觉抓取与环境感知能力(配合 Playwright/Claude 插件)。科研与学术人员:研究视觉 RAG(Visual RAG)、多模态检索(Multimodal Retrieval)及无 OCR 文档分析。四、免费与付费情况完全开源与免费:PixelRAG 是一个采用 Apache 2.0 许可证 的开源项目,其核心代码、公用 API 端点及数据集均免费提供。无商业收费:目前无付费订阅或商业定价页面。官方 API 及数据集托管于 Hugging Face,本地部署无需任何软件授权费用。五、如何使用(快速上手干货)方式 1:在线 API / Web 端直接体验访问 pixelrag.ai,在搜索框输入文本(如 "Periodic table")或上传图片。即可实时检索 2800 万+维基百科截图区块。方式 2:Python 本地渲染与检索安装核心包:bashpip install pixelrag 将任意网页渲染为像素切片:bashpixelshot https://en.wikipedia.org/wiki/Python --output ./tiles 构建本地私有文档库索引(需安装 index 扩展):bashpip install 'pixelrag[index]' 方式 3:为 Claude Code 添加视觉看网功能安装与注册插件:bashpip install pixelrag claude plugin marketplace add StarTrail-org/PixelRAG claude plugin install pixelbrowse@pixelrag-plugins 终端指令操作:终端中直接让 AI 查看网页截图。bashclaude -p "screenshot https://news.ycombinator.com and summarize the top stories" 六、注意事项与使用建议显存与存储需求较集中构建和检索向量依赖 GPU(支持 CUDA 及 Apple Silicon MPS)。如下载全量预建索引(如维基百科索引包),FAISS 索引文件体积较大(约 214 GB),需预留足够硬盘空间。图像 Token 消耗将图像传递给后续的 VLM(视觉大模型,如 GPT-4o, Qwen-VL)进行生成时,图像会占用较多 Token 额度。建议先通过 Tile 降采样或裁剪缩小上下文范围以节省成本。动态网页适配使用 pixelshot 截取动态加载(SPA / React)页面时,需确保配置合理的 Playwright 等待时间(Wait time)。防止截取到空白或加载中页面。

ReClip图标

ReClip

ReClip 开源项目一、平台介绍定位:一个轻量级、可自托管(Self-hosted)的在线音视频下载器,自带简洁明了的 Web 前端界面。技术底座:底层依赖强大的开源命令行工具 yt-dlp 和 ffmpeg,后端采用 Python (Flask) 构建,极度精简(后端源码仅约 150 行)。二、主要功能海量平台支持:支持下载 YouTube、TikTok、Instagram、Twitter/X、Reddit、Facebook、Bilibili、Vimeo、Twitch 等 1000+ 网站的音视频。双模式导出:支持导出为 MP4(视频)或 MP3(提取纯音频)。分辨率/画质选择:解析链接后可自由挑选不同的清晰度与音视频质量。批量下载:支持一次性粘贴多个 URL 进行批量解析与下载。智能去重:自动识别并过滤重复粘贴的链接。三、适用人群开发者 / 自建服务爱好者:希望在 NAS、服务器或个人电脑上搭建私人下载站的用户。内容创作者 / 离线影音用户:需要经常跨平台(如 TikTok、YouTube、X)下载素材或存档视频的人群。追求极简与隐私的用户:厌烦了第三方下载网站的弹窗广告、限制及隐私泄露风险,希望拥有完全自主可控工具的人。四、免费 / 付费情况完全免费且开源:ReClip 遵循 MIT 许可证,100% 免费开源,无付费版本,无订阅费,无内置广告。定价页面说明:项目无任何收费计划,因此不存在官方付费/定价页面网址。五、如何使用(快速上手指南)方式 1:Docker 一键运行(推荐)前置条件:如果你安装了 Docker。终端执行命令:直接在终端执行以下命令构建并启动容器:bashdocker build -t reclip . && docker run -p 8899:8899 reclip 访问 Web 界面:运行后在浏览器访问 http://localhost:8899。方式 2:本地直接部署安装依赖(前提条件):macOS 系统:执行 brew install yt-dlp ffmpeg。Linux/Windows 系统:确保安装了 ffmpeg 和 Python 环境。克隆仓库并运行:bashgit clone https://github.com/averygan/reclip.git cd reclip ./reclip.sh 打开 Web 界面:浏览器访问 http://localhost:8899。界面操作流程粘贴一个或多个视频链接到文本框。选择输出格式(MP4 视频或 MP3 音频)。点击 Fetch 按钮提取视频信息和缩略图。选择所需画质,点击单个 Download 或 Download All 导出文件。六、注意事项环境依赖:项目本质上是 yt-dlp 的 Web GUI 包裹层,如果解析失败,通常需要及时更新本地/容器内的 yt-dlp 版本(因为目标网站接口变动频繁)。网络环境:下载特定海外平台(如 YouTube、Twitter)视频时,部署 ReClip 的服务器/设备需要具备访问相应网站的网络权限。版权合规:仅供个人学习与离线备份使用,请遵守目标平台的协议及版权法律法规。

OpenWhispr图标

OpenWhispr

OpenWhispr 平台使用指南平台介绍这是一款 开源跨平台语音听写/转录桌面工具,采用 MIT 协议。核心特色为支持 本地离线 Whisper/Parakeet 模型,音频可不上传云端;也可选择官方云服务或填入第三方 API 密钥;支持 Windows/macOS/Linux/iOS 系统,主打隐私优先的语音转文字、会议录音转写。主要功能全局快捷键听写:在任意软件中通过光标处进行语音输入文本,该功能支持离线使用。本地离线转写:模型下载到本机后音频不出设备,支持 100+ 语言识别,包含中文。会议录音转写:录制会议音频生成文稿,可自动区分发言人,并提供 AI 总结与要点提取。BYOK 自带密钥:允许用户填入 OpenAI、Groq 等第三方 API 密钥,复用自己的模型配额进行云转写。高级功能与接口:支持自定义词典、Agent 模式、跨设备同步、MCP 及 API 接口(部分功能需付费)。适用人群适合使用的群体注重隐私安全、处理敏感录音的职场人、律师、医疗从业者。需要离线语音转写的写作者、科研人员。Windows/Linux 用户(因为同类支持 Linux 的工具较少)。开发者,可查看源码并进行二次开发的用户。iOS 付费订阅用户(移动端高级功能)。不适合使用的群体重度团队协作需求的团队(需特定配置)。需要开箱即用、无任何配置门槛的普通入门用户。免费&付费情况定价页面:https://openwhispr.com/pricing请注意:付费仅接受境外信用卡,不支持微信或支付宝。具体套餐如下:免费版本地模型听写永久无额度限制,离线完全免费。OpenWhispr 云服务:每周提供 2000 词额度;每月包含 5 小时会议录音。自带第三方 API 密钥可使用户享受无限云转写。Pro($6.67/人/月,支持年付)解锁无限官方云转写。每月提供 20 小时会议录音额度。包含 iOS 移动端访问、设备间数据同步、Agent 模式、API 访问权限及邮件支持。Business($13.33/人/月,支持年付)拥有全部 Pro 能力。提供无限会议录音额度、数据问答功能及优先技术支持。Enterprise定制报价方案。包含 SSO/SAML 认证、审计日志功能及专属技术支持团队。如何使用下载安装:前往官网下载对应系统的客户端安装包,或访问 GitHub 编译源码。初始化设置:首次启动时跟随向导,三选一处理模式:①本地模型(需下载模型包,断网可用)②OpenWhispr 云登录账号 ③填入自己第三方 API 密钥。权限配置:授予麦克风、辅助权限;设置全局热键。开始听写:按热键说话,松开完成听写;也可导入音频文件做转录,或开始录制会议。注意事项本地模式资源消耗:大模型会占用内存/显存,低配电脑可能运行缓慢;云模式则必须访问外网。网络环境影响:国内用户直连访问官网/官方云服务网络不稳定,但使用本地模型不受网络影响。免费版限额说明:免费版官方云有词数和时长上限,如需无限制云转写,优先建议使用自己的 API 密钥。开源与闭源区别:桌面端客户端是开源的,但 OpenWhispr 云服务属于闭源商业服务,二者需区分对待。隐私安全警示:本地模式下音频完全留在本机;云模式下音频处理后即删除,但仍不建议上传极高敏感或涉密材料。移动端订阅限制:Pro/Business 套餐的 iOS 移动端访问仅对付费订阅用户开放。服务级别协议:无 SLA(服务等级协议)保障,企业级使用建议选 Enterprise 签订正式协议。准确性优化:自定义词典功能可以显著改善专有名词的识别准确率。

RicoUI‑Design图标

RicoUI‑Design

RicoUI‑Design 使用指南平台介绍开源的 DESIGN.md设计系统工作台,由独立开发者 Rico 出品。本项目旨在将 UI 设计规范以 Markdown 格式文档 呈现,用于为 AI(Cursor、Claude Code等) 提供网页前端生成的约束。该工具成功打通了 设计规范 与 代码输出 的链路,支持用户浏览、编辑并导出设计规范文档。主要功能浏览现成品牌 DESIGN.md规范模板(包含 Apple、Linear、Vercel 等)。提供 可视化编辑 面板,可修改颜色、字体、间距、组件、布局及响应式规则。导出完整 DESIGN.md 文本,直接复制给 AI 编码工具使用。支持导入已有 DESIGN.md文件 进行二次修改。预览规范效果,输出参考文档给前端开发使用。适用人群适合群体UI/UX设计师 与 前端开发者。使用 AI 写网页(Cursor、Windsurf、Claude Code) 的开发人员。需要将设计规范转成 AI 可识别提示文档的 团队。不适合场景普通作图 或 PS 类图形设计需求。免费付费情况完全免费 且 开源,无订阅套餐,无付费版本,无定价页面。部分配套素材模板在作者 Gumroad商店 单独售卖,不属于本网站功能。如何使用打开 design.ricoui.com。选择内置模板,或导入本地 DESIGN.md文件。在可视化面板修改色彩、字体、组件、布局规则。预览规范效果,导出完整 DESIGN.md文本。将导出内容粘贴到 AI编码工具,约束网页 UI 输出。注意事项仅输出 规范文档文本,不直接生成前端代码,需要搭配 AI 编码工具使用。浏览器 本地运行,云端不保存项目,修改后务必手动导出备份。面向 网页UI场景,不支持 APP、小程序完整规范。开源项目,无官方客服,稳定性随作者迭代变动。国内访问偶有加载慢,建议浏览器直接导出文件留存副本。

Obscura图标

Obscura

obscura.sh1. 平台介绍定位与架构:基于 Rust 开发的轻量无头浏览器服务,面向 AI Agent、网页数据抓取场景。提供开源本地引擎与 Obscura Cloud托管云服务两种模式。核心特性:兼容 Chrome DevTools Protocol (CDP),可替换 Headless Chrome。会话启动速度<50ms,内存占用远低于原版 Chrome,每个会话完全隔离且无状态污染。2. 主要功能浏览器会话管理:支持页面访问、JS执行、点击交互、表单输入及数据提取。输出与伪装:提供图片截图、PDF文档生成及页面录屏;内置反检测stealth指纹伪装能力。协议兼容性:完全兼容 CDP 协议,原有 Playwright/Puppeteer代码仅需少量修改即可迁移适配。部署灵活性:支持两种模式——Docker自托管开源版与Cloud托管 API 服务,后者支持大规模并发会话。安全隔离:实现会话沙盒隔离,无 cookie/cache互相污染,确保任务可复现。3. 适用人群开发者群体:适用于 AI Agent开发、大规模网页爬虫、自动化测试等场景。技术团队:适合需要大量并发浏览器实例、希望降低 Chrome资源开销的团队。不适用场景:不适合普通用户日常网页浏览;不适用于复杂重度网页渲染、多媒体交互场景。4. 免费付费情况开源引擎模式:采用 Apache‑2.0许可证,可本地Docker部署,所有功能完全免费且无阉割。Obscura Cloud服务:提供托管 API 实例。无公开网页定价页面,需联系销售询价获取报价;仅支持境外支付。付费增值服务:包括托管云实例、住宅代理资源及技术支持(Cloud版配置)。5. 如何使用方式一:本地自托管(开源)通过Docker拉取镜像部署Obscura服务。项目直接复用 Playwright/Puppeteer库,仅修改CDP连接地址指向本地Obscura实例。执行自动化抓取、Agent网页访问任务。方式二:Obscura Cloud托管 API访问官网注册账号获取API Key。通过API快速创建隔离浏览器会话。使用 CDP/Playwright对接,完成页面操作,任务结束后自动销毁会话。支持横向扩容至上千并发会话。6. 注意事项网络稳定性:国内直连Cloud服务网络容易不稳定或超时;建议本地自托管以避免此问题。代理配置:开源版无内置代理,反爬需自行配置代理池;Cloud版代理属于付费增值项。渲染能力:虽然兼容 CDP,但部分重度网页、复杂WebGL页面的渲染能力弱于原版 Chrome。商业合规:Cloud无自助公开定价,商用前必须联系销售确认配额与SLA。法律风险:网页抓取需遵守目标网站的 robots 协议,规避相关法律风险。维护责任:开源版无官方 SLA,生产环境需自行维护监控体系。产品定位:非普通可视化浏览器,无 GUI界面,全部通过代码/API调用。

Archify图标

Archify

ArchifyArchify 是一个面向 AI Coding Agent(如 Cursor、Claude Code、Codex CLI 等)的开源 Agent Skill。它能将代码库或自然语言描述,直接编译并生成漂亮、可验证且带动态交互的架构与流程图。1. 平台介绍定位明确:并非普通的绘图工具或可视化拖拽软件,而是专为 AI Agent 设计的架构图/流程图 渲染与验证引擎。工作机制独特:AI Agent 负责生成类型安全的 JSON IR(中间表示),Archify 则负责严格的布局计算与校验,将其编译为独立的 HTML/SVG。特色效果显著:生成的 HTML 自带单文件离线交互能力,支持 暗黑/亮色主题切换、线路追踪(Route Probe)、上下游影响分析、finite 动画播放以及一键导出高分辨率 PNG/SVG/WebM 等。2. 主要功能5 种核心图表类型:Architecture(架构图):展示系统组件、服务、存储、部署边界与信任域。Workflow(工作流图):展示 CI/CD、工具调用、审批流及分支异常处理。Sequence(时序图):展示 API 交互、缓存回退、异步消息传递等时间序列。Data Flow(数据流图):展示数据管道、数据源/转换/存储及 PII 敏感边界。Lifecycle(生命周期图):展示状态机、重试逻辑、等待状态及最终状态。Architecture Delta(变更对比):支持对比两个版本,高亮显示组件和关系的新增、删除、移动与重定向(Before / Delta / After)。强校验与自动修补:包含自动布局、重叠检测与语义校验。如果 JSON 生成有误,Archify 会输出具名的错误代码与精确的修补指令(Repair Receipt),供 Agent 自动修复。高质量单文件输出:无需依赖外部 CSS/JS 库,直接打包为单一 HTML,支持导出社交/文档分享卡片格式(如 1200×630)。3. 适用人群软件架构师 / 全栈开发者:快速梳理现有代码库架构、绘制 API 时序图 或系统数据流。重度 AI Agent 用户:使用 Cursor、Claude Code 等工具写代码,希望 Agent 在 Chat 界面中直接生成高质量可交互架构图。开源项目维护者 / 技术文档撰写者:需要为 README、release note 或 PR 审查 提供统一风格且精确的架构展示图。4. 免费/付费情况免费模式:完全免费且开源(开源许可证为 MIT License)。开发者可以自由下载、修改和商业化使用,无需支付任何费用。付费方案:项目无任何付费/订阅方案(官方仓库没有付费页面)。5. 如何使用第一步:安装 Skill在你的终端运行 npx 命令,直接将 Archify 作为全局 Skill 添加到对应的 Agent 中:bash# 通用安装 npx skills add tt-a1i/archify -g # 如果使用 Cursor,可以使用非交互式安装命令: npx -y skills add tt-a1i/archify --skill archify --agent cursor --global --copy --yes 第二步:在 Agent 对话中发起请求安装完成后,在 Agent(Cursor / Claude Code 等)对话框里直接描述需求或分析代码:零代码库生成:"Use Archify to draw: Browser -> API -> Redis cache -> PostgreSQL fallback."结合代码库分析:"分析当前项目代码库,使用 archify 生成一个高层级运行时架构图,包含核心组件、主要链路和外部依赖。"第三步:迭代与调整生成的 HTML 会保存在本地,你可以直接在对话中通过自然语言微调,例如:"加上 Redis 缓存节点""把 Auth 服务移到左侧""高亮回滚路径"6. 注意事项不是拖拽画板:它不提供 WYSIWYG(所见即所得) 的拖拽前端,也不支持直接解析 Mermaid 语法;它是为 AI Agent 输出“确定性与验证性图表”而设计的。控制节点数量:为了保证图形的可读性,建议单张图的核心节点控制在 8–12 个,较次要的上下文细节可通过 Card(卡片) 展开,而非一股脑连线。隐私与网络:Archify 生成过程完全在本地(Node.js)进行,不上传你的代码或 Prompt。默认只会每隔 72 小时 发起一次简单的 Stable Manifest GET 请求(用于检测更新),不会上传任何版本、Agent 或项目数据。禁用网络更新:若想完全禁用网络,设置环境变量即可:bashARCHIFY_UPDATE_CHECK_DISABLED=1

VibePrompt图标

VibePrompt

vibeprompts.dev平台介绍面向Vibe‑Coding 氛围编程的前端风格提示词静态资源站,专门提供网页 UI 设计风格 Prompt,用于给v0、Bolt.new、Trae等 AI 代码生成工具使用,静态网页,无需后端账号登录。主要功能可视化风格卡片预览,涵盖极简、赛博、玻璃拟态、粗野、Neumorphism 等网页 UI 风格一键复制完整风格 Prompt,包含配色、排版、组件、交互细节描述支持筛选、搜索风格;部分风格附带示例预览效果复制后的提示词直接粘贴到 AI 编码工具,约束 AI 输出对应视觉风格的前端代码适用人群前端开发者、独立开发者,做 AI 快速原型(vibe coding)不会写复杂 UI 提示词,希望 AI 直接产出好看网页界面使用 v0、Bolt.new、Trae、Cursor 等 AI 编码工具的用户免费付费情况完全免费,无付费版本,无定价页面,全部提示词直接复制使用,无需注册、无需付费。如何使用打开 https://vibeprompts.dev/浏览风格卡片,看预览效果挑选目标 UI 风格点击卡片复制完整 prompt 文本打开 AI 代码工具(v0 / bolt.new / trae),把复制的风格提示词追加到你的业务需求描述后面,发送给 AI 生成代码。注意事项海外静态站点,国内直连可能加载慢、图片预览打不开,建议优化网络环境输出为英文提示词,粘贴给 AI 编码工具,中英文模型均可识别仅提供UI 风格约束,不包含业务逻辑,需要自己补充业务需求不同 AI 模型对 prompt 理解有差异,同一份提示词产出效果会浮动,需要微调网站无账号、无收藏功能,喜欢的提示词建议本地复制保存仅用于前端网页风格,不适合图片、视频生成场景