Segmentador
API gratuita para segmentar texto largo en chunks y tokenizarlo.
API de segmentación
Nuestra API Segmenter es fundamental para ayudar a los LLM a gestionar la entrada dentro de los límites del contexto y optimizar el rendimiento del modelo. Permite a los desarrolladores contar tokens y extraer segmentos de texto relevantes, lo que garantiza un procesamiento de datos eficiente y una gestión de costos.
Utilice la solicitud GET para contar tokens
Utilice la solicitud POST para obtener más funciones
Devuelve los últimos N tokens
Devuelve los últimos N tokens del contenido indicado. Excluye límites. No se puede utilizar con 'head'.
Segmentador
Seleccione el tokenizador a utilizar.
cl100k_base
arrow_drop_down
upload
Pedido
Bash
Idioma
arrow_drop_down
curl -X POST 'https://api.jina.ai/v1/segment' \
-H "Content-Type: application/json" \
-d @- <<EOFEOF
{
"content": "Jina AI: Your Search Foundation, Supercharged! 🚀\nIhrer Suchgrundlage, aufgeladen! 🚀\n您的搜索底座,从此不同!🚀\n検索ベース,もう二度と同じことはありません!🚀"
}
EOFEOF
key
Clave API
visibility_off
Tokens disponibles
0
¿Qué es un segmentador?
Un segmentador es un componente crucial que convierte el texto en tokens o chunks, que son las unidades básicas de datos que procesa un modelo de embedding/reranking o LLM. Los tokens pueden representar palabras completas, partes de palabras o incluso caracteres individuales.
Texto de entrada
¡Agrupe documentos largos a la velocidad del rayo!
También puede utilizar Segmenter API para dividir documentos largos en chunks más pequeños, lo que facilita su procesamiento en embeddings o rerankers. Aprovechamos las señales estructurales comunes y creamos un conjunto de reglas y heurísticas que funcionan bien en diversos tipos de contenido, por ejemplo Markdown, HTML, LaTeX y lenguajes CJK.
Texto de entrada
Número máximo de caracteres en cada fragmento. En la práctica, la longitud del fragmento puede ser menor que este valor, si existe un límite natural en el texto.
0 fragmentos en total
¡La API de Segmenter es gratuita!
Al proporcionar su clave API, podrá acceder a un límite de tarifa más alto y no se le cobrará su clave.
Límite de velocidad
Los límites de velocidad se controlan de dos maneras: RPM (solicitudes por minuto) y TPM (tokens por minuto). Los límites se aplican por IP/clave API y se activan cuando se alcanza primero el umbral de RPM o TPM. Al proporcionar una clave API en el encabezado de la solicitud, controlamos los límites de velocidad por clave, no por dirección IP.
Columnas
arrow_drop_down
| Producto | Punto final de API | Descripciónarrow_upward | Sin clave APIkey_off | con clave API gratuitakey | con clave API de pagokey | con clave API Premiumkey | Latencia media | Recuento de uso de tokens | Solicitud permitida | |
|---|---|---|---|---|---|---|---|---|---|---|
| API de Reader | https://r.jina.ai | Convertir la URL en texto compatible con LLM | 20 RPM | 500 RPM | 500 RPM | trending_up5000 RPM | 7.9s | Contar el número de tokens en la respuesta de salida. | GET/POST | |
| API de Reader | https://s.jina.ai | Buscar en la web y convertir los resultados en texto compatible con LLM | block | 100 RPM | 100 RPM | trending_up1000 RPM | 2.5s | Cada solicitud cuesta una cantidad fija de tokens, a partir de 10000 tokens | GET/POST | |
| API de embedding | https://api.jina.ai/v1/embeddings | Convertir texto/imágenes en vectores de longitud fija | block | 100 RPM & 100,000 TPM | 500 RPM & 2,000,000 TPM | trending_up5,000 RPM & 50,000,000 TPM | ssid_chart depende del tamaño de entrada help | Contar el número de tokens en la solicitud de entrada. | POST | |
| API de Reranker | https://api.jina.ai/v1/rerank | Reordenar documentos según la consulta | block | 100 RPM & 100,000 TPM | 500 RPM & 2,000,000 TPM | trending_up5,000 RPM & 50,000,000 TPM | ssid_chart depende del tamaño de entrada help | Contar el número de tokens en la solicitud de entrada. | POST |
code
¿Puedo usar la misma clave API en todas las API de Jina?
keyboard_arrow_down
code
¿Puedo monitorear el uso del token de mi clave API?
keyboard_arrow_down
code
¿Qué debo hacer si olvido mi clave API?
keyboard_arrow_down
code
¿Caducan las claves API?
keyboard_arrow_down
code
¿Puedo transferir tokens entre claves API?
keyboard_arrow_down
code
¿Puedo revocar mi clave API?
keyboard_arrow_down
code
¿Por qué la primera solicitud de algunos modelos es lenta?
keyboard_arrow_down
code
¿Se utilizan mis datos de API para entrenar sus modelos?
keyboard_arrow_down
code
¿Cuáles son los límites de velocidad para las API de Jina?
keyboard_arrow_down
code
¿Existen límites de tamaño de lote para las API?
keyboard_arrow_down
code
¿Las API de Jina son lo mismo que los modelos de Jina dentro de Elastic?
keyboard_arrow_down
Límite de velocidad
Los límites de velocidad se controlan de dos maneras: RPM (solicitudes por minuto) y TPM (tokens por minuto). Los límites se aplican por IP/clave API y se activan cuando se alcanza primero el umbral de RPM o TPM. Al proporcionar una clave API en el encabezado de la solicitud, controlamos los límites de velocidad por clave, no por dirección IP.
Columnas
arrow_drop_down
| Producto | Punto final de API | Descripciónarrow_upward | Sin clave APIkey_off | con clave API gratuitakey | con clave API de pagokey | con clave API Premiumkey | Latencia media | Recuento de uso de tokens | Solicitud permitida | |
|---|---|---|---|---|---|---|---|---|---|---|
| API de Reader | https://r.jina.ai | Convertir la URL en texto compatible con LLM | 20 RPM | 500 RPM | 500 RPM | trending_up5000 RPM | 7.9s | Contar el número de tokens en la respuesta de salida. | GET/POST | |
| API de Reader | https://s.jina.ai | Buscar en la web y convertir los resultados en texto compatible con LLM | block | 100 RPM | 100 RPM | trending_up1000 RPM | 2.5s | Cada solicitud cuesta una cantidad fija de tokens, a partir de 10000 tokens | GET/POST | |
| API de embedding | https://api.jina.ai/v1/embeddings | Convertir texto/imágenes en vectores de longitud fija | block | 100 RPM & 100,000 TPM | 500 RPM & 2,000,000 TPM | trending_up5,000 RPM & 50,000,000 TPM | ssid_chart depende del tamaño de entrada help | Contar el número de tokens en la solicitud de entrada. | POST | |
| API de Reranker | https://api.jina.ai/v1/rerank | Reordenar documentos según la consulta | block | 100 RPM & 100,000 TPM | 500 RPM & 2,000,000 TPM | trending_up5,000 RPM & 50,000,000 TPM | ssid_chart depende del tamaño de entrada help | Contar el número de tokens en la solicitud de entrada. | POST |
Preguntas comunes relacionadas con la facturación
attach_money
¿La facturación se basa en el número de oraciones o solicitudes?
keyboard_arrow_down
attach_money
¿Hay una prueba gratuita disponible para nuevos usuarios?
keyboard_arrow_down
attach_money
¿Se cobran tokens por solicitudes fallidas?
keyboard_arrow_down
attach_money
¿Qué métodos de pago se aceptan?
keyboard_arrow_down
attach_money
¿Está disponible la facturación para compras de tokens?
keyboard_arrow_down
attach_money
¿Cómo puedo comprar una licencia comercial en lugar de tokens API?
keyboard_arrow_down
attach_money
¿Puedo pagar con factura o con orden de compra en lugar de con tarjeta?
keyboard_arrow_down
attach_money
Realicé el pago, pero mi saldo o límite de velocidad no ha cambiado. ¿Qué debo revisar?
keyboard_arrow_down
attach_money
¿Cómo puedo cancelar, detener la recarga automática o eliminar un método de pago guardado?
keyboard_arrow_down