将各种文件格式(PDF、Office文档、图像、音频、网页内容、结构化数据)转换为针对LLM处理优化的Markdown。适用于将文档转换为Markdown、从PDF/Office文件中提取文本、转录音频、对图像执行OCR、提取YouTube字幕或处理批量文件时使用。支持20多种格式,包括DOCX、XLSX、PPTX、PDF、HTML、EPUB、CSV、JSON、带OCR的图像以及带转录的音频。
你将成为
适用于以下场景
为任何技术栈或框架自动生成包含最佳实践的 CLAUDE.md。
使用当前标准和模块化架构现代化过时的 CLAUDE.md 文件。
创建一致的文档,以加快团队间的AI辅助开发。
切换框架或添加新依赖时更新 CLAUDE.md 文件。
装备后的数字
经过验证的优势和可衡量的影响
通过自动生成,将 CLAUDE.md 文件的创建时间从数小时缩短至数分钟。
通过优化文档提升 AI 辅助编程效率。
确保所有项目自动遵循一致的最佳实践。
装备内容
文件、标签与三步安装
提示: 首次使用前请阅读文档与代码,确认它的功能和所需权限。
接着演下去
基于标签和分类的推荐
使用Google Gemini API处理并生成多媒体内容。功能包括分析音频文件(带时间戳的转录、总结、语音理解、时长最长为9.5小时的音乐/声音分析)、理解图像(字幕、物体检测、OCR、视觉问答、分割)、处理视频(场景检测、问答、时序分析、YouTube URL、时长最长为6小时)、从文档提取内容(PDF表格、表单、图表、图表、多页)、生成图像(文本转图像、编辑、合成、优化)。在处理音频/视频文件、分析图像或截图、处理PDF文档、从媒体提取结构化数据、根据文本提示创建图像或实现多模态AI功能时使用。支持上下文窗口最高为2M个标记的多种模型(Gemini 2.5/2.0)。