Pokee-Isaac 28B: modelo de 10M tokens para empresas

⏱ Tiempo de lectura: 3 min
Pokee AI presentó Pokee-Isaac 28B, un modelo de lenguaje de 28 mil millones de parámetros con ventana de contexto de 10 millones de tokens, diseñado para ejecutarse dentro de los límites de seguridad de cada cliente. El modelo alcanza una puntuación de 93,3% en la prueba RULER a 10M tokens, mientras que todos los modelos de comparación obtienen 0,0 más allá de 2M tokens, y lidera en BFCL v4 con 70,94 puntos.
Rendimiento y despliegue del modelo de Pokee AI
Pokee-Isaac 28B demuestra velocidades de prefill de 137.200 tokens por segundo a contexto completo en una única GPU B200, con velocidades de decode cercanas a 335 tokens por segundo. El modelo no está disponible con pesos públicos; en cambio, se ofrece bajo licencia de despliegue en VPC privada, infraestructura local o dispositivos propios, con precios de lista de 0,15 dólares por millón de tokens en entrada y 1,00 dólar por millón en salida. La arquitectura agentic busca permitir que las organizaciones mantengan control total sobre datos sensibles sin depender de infraestructura en la nube pública.
Benchmarks y capacidades confirmadas
Según los datos reportados, el modelo coloca segundo en Terminal-Bench 2.1 y demuestra capacidades agentic adaptadas a flujos de trabajo empresariales de alto contexto. La ventana de 10M tokens permite procesar documentos extensos, conversaciones largas o análisis de múltiples fuentes sin fragmentación. Este enfoque de modelos especializados responde a la demanda de soluciones que preservan privacidad mientras ofrecen rendimiento comparable a alternativas de API pública.
El contexto detrás del anuncio
El lanzamiento de Pokee-Isaac 28B refleja una tendencia creciente hacia modelos on-premise y edge computing en empresas que manejan información confidencial. Organizaciones en finanzas, salud, legal y defensa buscan alternativas que eviten enviar datos a servidores de terceros, manteniendo cumplimiento normativo y control de seguridad interno. La combinación de contexto extremadamente largo y despliegue privado posiciona este modelo para aplicaciones que requieren análisis profundo sin comprometer privacidad.
| Característica | Detalle |
|---|---|
| Nombre del modelo | Pokee-Isaac 28B |
| Parámetros | 28 mil millones |
| Ventana de contexto | 10 millones de tokens |
| Puntuación RULER (10M tokens) | 93,3% |
| Puntuación BFCL v4 | 70,94 |
| Terminal-Bench 2.1 | Segundo lugar |
| Velocidad prefill (B200) | 137.200 tokens/segundo |
| Velocidad decode | ~335 tokens/segundo |
| Disponibilidad de pesos | No publicados |
| Opción de despliegue | VPC privada, on-premises o dispositivo local |
| Precio entrada | 0,15 dólares por millón de tokens |
| Precio salida | 1,00 dólar por millón de tokens |
| Desarrollador | Pokee AI |
Preguntas frecuentes sobre Pokee-Isaac 28B
¿Cuál es la ventaja de una ventana de contexto de 10 millones de tokens?
Permite procesar documentos completos, conversaciones de miles de turnos o análisis simultáneo de múltiples fuentes sin necesidad de fragmentar el contexto, mejorando la coherencia en tareas agentic complejas.
¿Dónde se puede desplegar este modelo?
El modelo se ofrece bajo licencia para despliegue en VPC privada (nube pero aislada), infraestructura on-premises (servidores propios) o dispositivos locales, garantizando que los datos nunca abandonen los límites de la organización cliente.
¿Cuál es el costo de usar Pokee-Isaac 28B?
El modelo se factura según tokens procesados: 0,15 dólares por millón de tokens en entrada y 1,00 dólar por millón en salida. El costo exacto dependerá del volumen de tokens generados en cada aplicación específica.
La lectura para quienes usan IA a diario
Pokee-Isaac 28B representa una opción para equipos que necesitan capacidades agentic avanzadas sin exponer datos a infraestructura de terceros. La combinación de contexto extremadamente largo y control sobre el despliegue la posiciona para análisis documentales complejos, procesamiento de información clasificada y flujos de trabajo que demandan privacía garantizada.
En Inteligencia Artificial consideramos que este modelo evidencia cómo el mercado se fragmenta entre proveedores de API masivos y soluciones on-premise personalizadas, cada una atendiendo necesidades de seguridad y gobernanza distintas. ¿Tu organización requeriría despliegue privado o confía en API de terceros para tareas sensibles?
Fuente: www.marktechpost.com

Deja una respuesta
Lo siento, debes estar conectado para publicar un comentario.