发布于

AI-Apps

作者

这个页面收面向最终任务的 AI 应用。它们的重点不是扩展开发流程,而是直接完成知识处理、内容生产、协作、图表或界面生成。

知识处理

ebook-to-mindmap

这是一个基于 AI 技术的智能电子书解析工具,支持将 EPUB 和 PDF 格式的电子书转换为结构化的思维导图和文字总结。工具采用 BYOK 模式保障隐私,提供多种处理模式,并具备缓存管理、现代化界面等特性。

MineContext

MineContext 是一个开源的主动上下文感知 AI 伙伴。它通过屏幕截图和内容理解持续收集用户的数字工作上下文,再主动生成洞察、日/周总结、待办、提示和活动记录。项目强调 local-first,数据默认存本地,也支持兼容 OpenAI API 的本地模型服务,适合研究个人 context engineering、ChatGPT Pulse 类产品和长期上下文助手。

Feynman - 开源 AI 研究 Agent

Feynman 是一个面向研究任务的开源 AI Agent,重点覆盖论文检索、文献综述、深度研究、论文与代码一致性审计、实验复现和训练 recipe 生成。它既能作为独立终端工具使用,也能只安装 skills,让 Codex、Claude Code、OpenCode 直接继承这套研究工作流。

  • 任务入口很清晰:deepresearchlitreviewauditreplicaterecipe 等命令把“搜资料、交叉验证、模拟审稿、实验复现”收敛成固定工作流。
  • 不只是网页搜索:会结合论文搜索、Web、Hugging Face、代码仓库和历史 session 做证据汇总,更像研究工作台而不是普通聊天壳。
  • 对 agent 工作流兼容度高:官方提供 skills-only 安装方式,可装到 ~/.codex/skills/feynman,也支持仓库级 .agents/skills/feynman.opencode/skills/feynman
  • 更适合放在 AI-Apps 的“知识处理”:虽然它带技能包和 agent runtime,但核心价值仍是直接产出研究结论、综述和实验方案,而不是服务日常软件开发流程。

llm_wiki - 可自我构建的个人知识库

LLM Wiki 是一个跨平台桌面应用,目标不是做一次性的 RAG 问答,而是让 LLM 持续把你的文档整理成结构化、可交叉引用、可长期维护的个人 Wiki。它基于 Karpathy 的 llm-wiki 方法论,但做成了完整产品,适合把 PDF、Markdown、Office 文档、网页剪藏等资料沉淀成长期知识库。

  • 核心思路是“持久化 Wiki”而不是“每次重查一遍”:原始资料只需被摄入和结构化一次,后续持续增量更新,而不是每次查询都从头检索和拼接答案。
  • 有比较完整的知识组织层:保留 index.mdlog.md[[wikilink]]、YAML frontmatter、Obsidian 兼容等设计,同时新增 purpose.md 来约束 Wiki 的目标和研究方向。
  • 不只是聊天问答:内置两步摄入、知识图谱、Louvain 社区发现、图谱洞察、异步审核、Deep Research、网页剪藏和多对话持久化,已经接近“个人研究工作台”。
  • 检索链路比较值得参考:它把分词搜索、图谱扩展、预算控制和带引用的上下文组装拆成四阶段,而不是只做一个简单的向量检索外壳。
  • 产品形态明确:Tauri + React + TypeScript 的桌面端,支持多 LLM 提供商,也能和本地文件系统、浏览器扩展、Obsidian 工作流打通。

由 AI 生成的书籍深度总结

BookDS · Book Deep Summary 是一个利用先进 AI Agent 对书籍进行深度总结的服务,旨在帮助用户快速掌握书籍核心内容。它强调 AI 总结的辅助性质,并倡导用户支持正版书籍。

内容生产

short-video-factory - 短视频工厂
短视频工厂是一款开源桌面应用,通过 AI 技术实现一键生成产品营销与泛内容短视频,支持自动化剪辑、多语言合成及跨平台使用,旨在降低视频制作门槛。

猫影短剧 novelvids 猫影短剧是一个 AI 驱动的小说转短剧生产平台。它从小说文本输入出发,覆盖章节拆分、实体提取、参考图生成、分镜生成和视频合成,目标是把长篇小说内容转成风格一致的短剧片段。

  • 工作流完整:每个章节按实体提取、资产管理、分镜生成、视频合成四步推进,适合观察 AI 内容生产链路怎么拆状态。
  • 支持多模型配置:文本生成、图像生成、视频生成可以分别配置模型,并支持启用、停用和热切换。
  • 工程结构比较清楚:后端用 FastAPI、Tortoise ORM、Pydantic,前端用 React 19、TypeScript、Vite、Tailwind CSS 和 shadcn/ui。
  • 有视频库和任务状态:支持查看所有生成视频,并追踪排队中、处理中、已完成、失败等状态。
  • 适合参考小说 IP 自动化、AI 分镜、角色/场景资产管理和第三方视频生成 API 接入。

Modly - 本地 AI 图片转 3D 桌面应用

Modly 是一款开源桌面应用,可将照片转换为可继续编辑和导出的 3D 网格模型。模型推理完全在本地 GPU 上运行,不需要把素材上传到云端;提供 Windows、Linux 与 Apple Silicon macOS 版本,适合本地化生成 3D 资产和探索图像转网格工作流。

  • 🖼️ 图片转网格:通过「Image → Generate Mesh → Add to Scene」的节点式工作流,把输入图片生成 3D 模型;运行前会校验工作流连接并展示错误信息。
  • 🔒 本地优先:推理、模型和素材均留在本机 GPU,兼顾离线使用与隐私;macOS 当前仅支持 Apple Silicon。
  • 🧩 可扩展模型:可从 GitHub 安装外部扩展,官方扩展覆盖 Hunyuan3D 2 Mini、TripoSG 与 Trellis2 GGUF 等模型及其变体。
  • 🛠️ 网格处理:导入或生成的网格可在应用内平滑、减面,优化后的结果会写回当前工作区。
  • 🤖 自动化接口:随附 Python CLI,可供脚本或 Coding Agent 查询模型、运行与取消工作流、检查状态,并将生成物导出为 GLB。
  • 📜 开源使用:项目采用 MIT 许可证;二次开发时应保留项目与作者的署名说明。

InkOS - 故事创作 AI Agent

InkOS 是一个面向小说、剧本、互动叙事与长文翻译的开源 AI 创作工作台。它不只让模型生成单段文本,而是把人物、设定、伏笔、章节目标、审稿记录和世界状态持续沉淀到项目中;同时提供 Studio、TUI、CLI 与结构化 Agent 接口,适合长期维护一部作品或搭建互动叙事原型。

  • 长短篇创作:可由创作简报生成世界观、角色、卷纲和章节意图,并按「写作 → 审稿 → 必要修订 → 状态结算」推进;短篇可输出正文、大纲、卖点、封面提示词及可选封面图。
  • 互动叙事:InkOS Play 支持分支剧情、变量与旗标、角色关系、物品、证据、结局和场景配图;既可制作点击选项式互动,也可运行支持自由动作的开放世界。
  • 翻译交付:支持 EPUB、文本型 PDF、TXT 和 Markdown 的分章节、分语义段翻译,可维护术语表、生成对照审校报告并导出 TXT、Markdown 或 EPUB。
  • 多种工作方式:Studio 适合图形化配置与对话创作,inkos tui 提供终端全屏交互,CLI 可用于建书、续写、审阅和导出;外部 Agent 可通过 inkos interact --json --message "..." 接入。
  • 最小上手:npm i -g @actalk/inkos 后执行 inkos init my-novel && cd my-novel && inkos;项目采用 AGPL-3.0,部署或二次集成前需确认许可证义务。

banana-slides

这是一个基于 nano banana pro 模型的原生 AI PPT 生成应用,旨在通过多种灵活的创作路径、强大的素材解析能力以及自然语言交互,帮助用户快速生成美观且专业的演示文稿。

open-slide

Open Slide 是一个面向 coding agent 的幻灯片框架。用户用自然语言描述演示稿,Claude Code、Codex、Cursor 等 agent 负责写 React 页面,Open Slide 负责固定画布、缩放、导航、热更新、演讲模式、素材管理和 HTML/PDF 导出。

  • 适合把演示稿当代码管理:每页都是 React 组件,方便版本控制、二次编辑和静态部署。
  • 适合 agent 迭代打磨:内置浏览器 inspector,可在元素上留言,再让 agent 批量应用修改。

ppt-dsl-generator

PPT 节点 DSL 生成器把既有 PowerPoint 模板转成受约束的生成系统:在选择窗格中用 DSL 标记可编辑节点,先编译出模板 Manifest,再由 Codex 根据结构化 DeckInput 批量替换文本、图片、图标、序号和列表,生成同一视觉风格的 PPTX。

  • 不重新绘制演示稿:保留模板原有页面、母版、布局和未标记节点,适合复用已有品牌模板,而不是从零生成样式。
  • 约束和校验完整:可输出 Manifest、JSON Schema、Lint 报告与模板锁文件,并在生成前校验页面类型、字段、文本长度、列表容量和章节约定。
  • 复杂内容也可批量化:支持固定列表和以 PowerPoint Group 为边界的变长列表;图片会按真实宽高居中裁剪填充,SVG 支持 Office 原生写入。
  • 同时提供 Codex Skill 和 Node.js/TypeScript CLI,适合将“制作模板 → 确认输入 → 生成并验证 PPTX”沉淀为可重复的本地工作流。

Agent 应用

openwork

Claude Cowork 的开源替代方案,由 OpenCode 驱动。

AionUi

免费、本地化、开源的协作工具,支持 Gemini CLI、Claude Code、Codex、Opencode、Qwen Code、Goose Cli、Auggie 等多种平台。

clawdbot Clawdbot 是一款可在本地设备上运行的个人 AI 助手,支持通过 WhatsApp、Telegram、Slack、Discord、Google Chat、Signal、iMessage、Microsoft Teams、WebChat 等多种常用通讯渠道进行交互,并具备语音唤醒、实时画布、多智能体路由等功能。

图表与界面生成

open-design

Open Design 是一个本地优先、开源的 Claude Design 替代方案。它把 Claude Code、Codex、Gemini CLI、Cursor Agent 等本机 coding agent CLI 接进设计生成工作流,用内置 design systems 和 skills 生成网页、移动端、桌面原型、幻灯片和多媒体素材,并支持沙箱预览与 HTML/PDF/PPTX/MP4 导出。

  • 适合设计原型链路:从需求澄清、视觉方向选择到沙箱预览和导出都在同一工作台里完成。
  • 适合本地工作流:BYOK、本地 daemon 和可部署 Web 层的组合,比纯云端设计生成工具更方便接入自己的开发环境。

next-ai-draw-io

Next AI Draw.io 是一款基于 Next.js 的 AI 驱动图表创建工具,它通过自然语言指令与 AI 辅助可视化功能,使用户能够轻松创建、修改和增强 draw.io 图表。

A2UI

vibe_figma
VibeFigma 是一个将 Figma 设计稿自动转换为使用 Tailwind CSS 的生产级 React 组件的工具,支持通过 CLI、API 服务器或集成到 Claude Code 环境等多种方式使用。

coderio
CodeRio 是一个智能 Figma 转代码自动化工具,将设计稿转化为可直接投入生产的 React 代码。它采用多智能体系统,能够验证视觉准确性并迭代修正偏差,致力于实现高保真界面还原与面向生产的代码结构。

inspector

Inspector 是一款为代码库设计的可视化开发工具,它允许开发者通过点击页面元素直接获取代码上下文、进行可视化编辑,并集成常用编程助手,从而提升开发与协作效率。