VentureBeat на русском
Подписаться
Cohere Parse 5 проигрывает бенчмарк по очкам. Он выигрывает по стоимости за страницу.
Предприятия испытывают трудности с интеграцией неструктурированных документов, таких как PDF-файлы и презентации, в системы искусственного интеллекта из-за отсутствия структурной информации в инструментах или их высокой стоимости. Cohere выпустила Parse 5, модель обработки изображений и текста, предназначенную для преобразования этих документов в структурированный Markdown по доступной для предприятий цене. Хотя Parse 5 не является самой точной моделью согласно собственным тестам Cohere, она предлагает превосходное соотношение цены и производительности для крупномасштабного развертывания. Ее однопроходная архитектура эффективно обрабатывает документы, сохраняя структуру и смысл, что крайне важно для понимания данных. Parse 5 призван решить основную проблему разбора документов: сохранение структурной целостности помимо простого чтения текста. Модель поддерживает несколько языков и предлагает различные режимы вывода для улучшения отслеживаемости. Она доступна через API Cohere, Model Vault, Microsoft Foundry и AWS SageMaker. Разбор документов определяется как ключевой фактор для внедрения искусственного интеллекта в предприятиях, поскольку проприетарный контекст содержится в этих неструктурированных документах. Реальная ценность таких инструментов, как Parse 5, заключается в том, чтобы позволить агентам искусственного интеллекта эффективно использовать эту информацию, а не просто извлекать текст. Поэтому предприятия должны оценивать парсеры на основе точности выполнения последующих задач, а не только по результатам тестов.