Convertir documentos en markdown y resúmenes de chat a archivos de libro electrónico EPUB formateados que se pueden leer en cualquier dispositivo o cargar en Kindle.
EN LO QUE TE CONVIERTES
Perfecto para estos escenarios
Extraer tablas y texto de PDFs financieros o de ventas para su análisis.
Combine múltiples facturas en un solo archivo o divida contratos grandes.
Rellenar formularios o solicitudes de impuestos con datos de hojas de cálculo.
Convertir facturas escaneadas a texto searchable en masa para registros.
GANANCIA MEDIBLE
Beneficios probados e impacto medible
Reducir el tiempo de entrada manual de datos automatizando el análisis de texto y tablas de PDF.
Elimina errores tipográficos e inconsistencias rellenando formularios mediante programación.
Acelera el procesamiento de documentos fusionando/dividiendo archivos en segundos.
QUÉ INCLUYE
Archivos, etiquetas y la instalación en tres pasos
Consejo: Lee la documentación y el código antes del primer uso para saber qué hace y qué permisos necesita.
SIGUIENTES GUIONES
Recomendado según etiquetas y categoría
Esta habilidad debería usarse para tareas de aprendizaje automático de series temporales que incluyen clasificación, regresión, agrupamiento, pronóstico, detección de anomalías, segmentación y búsqueda de similitud. Usarla al trabajar con datos temporales, patrones secuenciales o observaciones indexadas en el tiempo que requieren algoritmos especializados más allá de los enfoques de ML estándar. Especialmente adecuada para análisis de series temporales univariadas y multivariadas con APIs compatibles con scikit-learn.
Generar y mantener archivos AGENTS.md siguiendo la convención pública agents.md. Usar cuando se cree documentación para flujos de trabajo de agentes AI, guías de incorporación o cuando se estandaricen patrones de interacción de agentes en proyectos.
Procesa y genera contenido multimedia utilizando la API de Google Gemini. Las capacidades incluyen analizar archivos de audio (transcripción con marcas de tiempo, resumen, comprensión del habla, análisis de música/sonido hasta 9,5 horas), entender imágenes (descripción, detección de objetos, OCR, preguntas y respuestas visuales, segmentación), procesar videos (detección de escenas, preguntas y respuestas, análisis temporal, URLs de YouTube, hasta 6 horas), extraer de documentos (tablas PDF, formularios, gráficos, diagramas, varias páginas), generar imágenes (texto a imagen, edición, composición, refinamiento). Usar cuando se trabaje con archivos de audio/video, se analicen imágenes o capturas de pantalla, se procesen documentos PDF, se extraiga datos estructurados de medios, se creen imágenes a partir de indicaciones de texto o se implementen funciones de IA multimodal. Soporta múltiples modelos (Gemini 2.5/2.0) con ventanas de contexto de hasta 2 millones de tokens.
Esta habilidad se debe usar cuando se trabaja con matrices de datos anotados en Python, especialmente para análisis de genómica de células individuales, gestión de mediciones experimentales con metadatos o manejo de conjuntos de datos biológicos a gran escala. Usarla cuando las tareas involucren objetos AnnData, archivos h5ad, datos de RNA-seq de células individuales o integración con herramientas scanpy/scverse.