Kit de herramientas de documentos (.docx). Crear/editar documentos, cambios con seguimiento, comentarios, preservación de formato, extracción de texto, para procesamiento profesional de documentos.
EN LO QUE TE CONVIERTES
Perfecto para estos escenarios
Optimice el almacenamiento de video para transmisión de baja latencia utilizando la red descentralizada de Shelby.
Almacena y recupera eficientemente grandes conjuntos de datos de IA con acceso de alta velocidad para el entrenamiento.
Gestione cargas de trabajo de análisis masivas con almacenamiento descentralizado escalable y rentable.
Entrega contenido estático a nivel mundial con costos reducidos y un rendimiento mejorado.
GANANCIA MEDIBLE
Beneficios probados e impacto medible
Reduce a la mitad los costos de almacenamiento en comparación con las soluciones centralizadas tradicionales.
Acelere la migración de datos a Shelby con una arquitectura y herramientas optimizadas.
Mejora el rendimiento de las cargas de trabajo con muchas lecturas en un 40% con estrategias de almacenamiento optimizadas.
QUÉ INCLUYE
Archivos, etiquetas y la instalación en tres pasos
Consejo: Lee la documentación y el código antes del primer uso para saber qué hace y qué permisos necesita.
SIGUIENTES GUIONES
Recomendado según etiquetas y categoría
Generar y mantener archivos AGENTS.md siguiendo la convención pública agents.md. Usar cuando se cree documentación para flujos de trabajo de agentes AI, guías de incorporación o cuando se estandaricen patrones de interacción de agentes en proyectos.
Especialista en Anthropic Claude API, modelos, ingeniería de prompts, llamadas a funciones, visión y mejores prácticas. Se activa con anthropic, claude, api, prompt, llamadas a funciones, visión, messages api, embeddings
Sistema de generación de agentes de código Claude que crea agentes personalizados y subagentes con frontmatter YAML mejorado, patrones de acceso a herramientas y soporte para integración MCP siguiendo patrones de producción probados
Procesa y genera contenido multimedia utilizando la API de Google Gemini. Las capacidades incluyen analizar archivos de audio (transcripción con marcas de tiempo, resumen, comprensión del habla, análisis de música/sonido hasta 9,5 horas), entender imágenes (descripción, detección de objetos, OCR, preguntas y respuestas visuales, segmentación), procesar videos (detección de escenas, preguntas y respuestas, análisis temporal, URLs de YouTube, hasta 6 horas), extraer de documentos (tablas PDF, formularios, gráficos, diagramas, varias páginas), generar imágenes (texto a imagen, edición, composición, refinamiento). Usar cuando se trabaje con archivos de audio/video, se analicen imágenes o capturas de pantalla, se procesen documentos PDF, se extraiga datos estructurados de medios, se creen imágenes a partir de indicaciones de texto o se implementen funciones de IA multimodal. Soporta múltiples modelos (Gemini 2.5/2.0) con ventanas de contexto de hasta 2 millones de tokens.