Educación superior / Investigación
StudyFetch está creando infraestructura de aprendizaje con tecnología de IA para más de 7 millones de estudiantes, educadores y estudiantes permanentes. Su plataforma convierte las conferencias en directo, las notas y los materiales de cursos en tutorías de IA personalizadas, planes de estudio, tarjetas didácticas, pruebas de práctica y un plan de estudios de creación de cursos basado en el trabajo real de cada alumno.
A medida que la demanda aumentó hasta alcanzar cientos de miles de conferencias cada mes, los techos de coste y precisión de la transcripción en la nube amenazaron la promesa básica de la empresa: mantener una IA capaz al alcance de las personas que más la necesitan. Al migrar su canalización de transcripción a NVIDIA Riva con el modelo Parakeet ASR, empaquetarla en microservicios de ${ NVIDIA NIM }™ y adoptar modelos abiertos de ${ NVIDIA Nemotron }™ con destilación en toda su pila, StudyFetch redujo los costes de su mayor carga de trabajo de inferencia en aproximadamente 10 veces, desbloqueando la tutoría de voz, la personalización en tiempo real y una nueva plataforma de aprendizaje agéntico diseñada para reducir las barreras a la IA para millones de estudiantes más y estudiantes permanentes. Esta asociación se está ampliando a la planificación de infraestructura dedicada, y StudyFetch explora tres sistemas NVIDIA B300 de 8 vías para apoyar un cambio de las cargas de trabajo de tutoría conversacional y generación de cursos de modelos cerrados a modelos abiertos, lo que proporciona al equipo una capacidad más predecible y menores costes de inferencia a medida que aumenta el uso.
StudyFetch
AWS · Google Cloud
IA generativa / LLMs, IA de voz,
inferencia,
IA de la fuerza de trabajo,
aprendizaje
Eficiencia de inferencia
Aprendizaje personalizado
Aprendizaje escalable
StudyFetch es un espacio de trabajo de aprendizaje nativo de IA utilizado por más de 7 millones de estudiantes, principalmente de educación superior y programas de posgrado, que acuden a la plataforma para recibir tutorías de IA, practicar y estudiar materiales de IA basados en sus cursos reales. La transcripción de conferencias en directo constituye la base de la experiencia: es la forma en que la plataforma captura lo que se enseña a cada alumno y convierte esas aportaciones en un tutor de IA personal, tarjetas didácticas, pruebas de práctica y planes de estudio alineados con un plan de estudios real.
Esa base es también donde la empresa se enfrentó a sus restricciones más difíciles. Al ejecutar transcripciones en directo en el servicio gestionado de un importante proveedor de nube en cientos de miles de conferencias universitarias cada mes, StudyFetch se topó con dos obstáculos a la vez.
La primera fue el coste. La transcripción en directo ya era una partida mensual de seis cifras, y la rentabilidad unitaria empeoraba con cada nuevo alumno. Para una empresa cuya misión es hacer que una educación de calidad sea accesible para todos, cada dólar de coste de modelos se suma a unos márgenes que deben seguir siendo lo suficientemente bajos para que los estudiantes puedan permitirse el producto. La inferencia de modelos de frontera a escala de Internet simplemente no cuadra con la economía de la nube tradicional.
El segundo fue la precisión en los entornos en los que los estudiantes aprenden realmente. Las clases de universidades reales son ruidosas, están llenas de terminología específica del ámbito en materias como química orgánica, anatomía, estadística y programación, y a menudo son impartidas por profesores con una amplia gama de acentos y ritmos. La transcripción estándar no se ajustó a esa realidad, y la brecha de calidad se puso en evidencia en todas las superficies de productos que dependían de la transcripción: el tutor de IA, las tarjetas didácticas y las guías de estudio.
Toda la categoría de tecnología educativa está luchando contra la misma tensión. Los estudiantes necesitan una IA cada vez más capaz para seguir el ritmo de los cambios mundiales, pero servir modelos de frontera a escala no sale a cuenta bajo la economía de inferencia en la nube tradicional. StudyFetch necesitaba una pila de inferencia que pudiera ofrecer una IA capaz y precisa a un precio que sus estudiantes pudieran permitirse, sin sacrificar la precisión ni la flexibilidad de implementación.
Tractian
A través del equipo de NVIDIA Inception, StudyFetch adaptó sus cargas de trabajo de inferencia de mayor coste a la IA de voz y la pila de modelos abiertos de NVIDIA. A medida que se profundizaba la asociación técnica, se ampliaba su alcance, desde la optimización de la infraestructura hasta la alineación de la plataforma en crecimiento de StudyFetch con la misión más amplia de NVIDIA de IA escalable y accesible en todas las instituciones, programas de capacitación laboral y comunidades de aprendizaje. En el núcleo de la nueva arquitectura:
La migración de la transcripción de conferencias en directo a NVIDIA Riva y Parakeet que se ejecutan en las GPU NVIDIA L40S en contenedores NVIDIA NIM permitió reducir aproximadamente 10 veces los costes en la mayor carga de trabajo de inferencia de la empresa. La destilación de Nemotron en las NVIDIA H100 está en camino de ofrecer reducciones sustanciales similares en el resto de la pila de inferencia. El impacto es visible dentro del propio producto. Mientras que el servicio anterior se retrasaba notablemente, los estudiantes ahora ven cómo se transcriben sus clases en tiempo real mientras habla el profesor. Cientos de miles de conferencias pasan por la canalización cada mes con una precisión que se corresponde con el audio de un aula real. El empaquetado de NVIDIA NIM significa que un equipo pequeño puede ejecutar todo esto sin necesidad de crear una función de MLOps independiente. El ahorro de costes permitió financiar capacidades que StudyFetch no podía justificar previamente con el mismo presupuesto:
El ahorro de costes se traduce directamente en una mayor capacidad en manos de más estudiantes y justificó algo más grande que la transcripción.
StudyFetch existe para hacer que una educación de calidad sea accesible para cualquier persona. NVIDIA es lo que hace que eso sea económicamente posible. La asociación con su equipo en Riva, Nemotron y el resto de la pila hizo más que reducir nuestros costes: nos permitió poner más capacidad en manos de más estudiantes, para que puedan aprender las cosas que necesitan aprender a un precio que pueden permitirse».
Ryan Trattner
, cofundador y CTO de StudyFetch
Con la transcripción, la personalización y Honen ejecutándose sobre una base compartida de NVIDIA, StudyFetch está ampliando la asociación en varios frentes:
La asociación de StudyFetch y NVIDIA muestra cómo una victoria en la infraestructura de IA de producción puede convertirse en un modelo para un acceso más amplio. Al reducir los costes de inferencia, mejorar las experiencias de aprendizaje en tiempo real y conectar a los estudiantes con herramientas y contenido alineado con NVIDIA, StudyFetch está ayudando a que la alfabetización en IA y el aprendizaje de la fuerza laboral sean escalables en las aulas, los campus, las comunidades y la fuerza laboral en general.