🔴 Thomson Reuters заявила, что её модель обошла GPT‑5.5 и Gemini 3.1 Pro

Thomson обучена на профессиональном контенте компании и в её ранних тестах обошла несколько ведущих моделей, но независимым рейтингом эти результаты считать нельзя.

Aravana··1 мин

🔴 Thomson Reuters заявила, что её модель обошла GPT‑5.5 и Gemini 3.1 Pro

У Thomson Reuters появилась собственная ИИ-модель для профессиональной работы — и компания сразу поставила её рядом с лидерами рынка. Согласно публикации о первых тестах Thomson, модель сопоставима с Claude Opus 4.8 и опережает GPT‑5.5, Claude Sonnet 5 и Gemini 3.1 Pro. Но это результаты самого разработчика, а не независимый рейтинг.

Thomson построена на открытой базовой модели, а затем обучена на материалах Westlaw, Practical Law, Checkpoint и Reuters. Сотни профильных экспертов оценивали ответы, находили слабые места и проверяли логику рассуждений. Клиентские данные, как утверждает компания, в обучение не попадают. При этом задействовано пока менее 10% контента Thomson Reuters — остальной массив разработчик считает резервом для усиления модели.

Испытания охватывали право, налоги, бухгалтерию, программирование, математику, журналистику, безопасность и агентные задачи. Отдельную проверку юридических исследований провели всего на 53 запросах, составленных внутренними экспертами; полноту и фактическую точность ответов оценивала другая языковая модель, откалиброванная по экспертным оценкам. Поэтому громкое сравнение точнее считать заявкой производителя.

Первое внедрение назначено на август: Thomson станет моделью по умолчанию в Tabular Analysis внутри CoCounsel Legal — инструменте для массовой структурированной проверки документов. В течение следующего года её планируют встроить и в другие юридические и налоговые продукты компании. Там заявка встретится с настоящим экзаменом: закрытые профессиональные базы должны дать измеримую точность в повседневной работе, а не только преимущество на графике разработчика.

Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.

#ИИ #ThomsonReuters #LegalTech #КорпоративныйИИ #AravanaAI

Тип материала: Пост из Telegram

Поделиться:TelegramXLinkedIn
Как вам материал?

Хотите получать подобные материалы раньше?

Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.

Узнать про Intelligence

Не пропускайте важное

Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.

Похожие материалы

Andon Labs поставила AI-агентов управлять реальными бизнесами — и показала разрыв между умением и надёжностью

Реальные магазины и кафе помогают Andon Labs находить неожиданные сбои AI-агентов, но пока не позволяют отделить ошибки модели от влияния программной среды и людей.

·1 мин

🔴 Insight Partners не ставит всё на OpenAI и Anthropic — хотя те привлекли половину венчурных денег

Девен Парех видит в стремительном росте оценок возвращение риска 2021 года и предпочитает ранние небольшие вложения одной крупной ставке на лидера.

·1 мин

🔴 SoftBank взял $11,87 млрд у 20 банков для ставки на OpenAI

Японский холдинг расширил двухлетний кредит до $11,87 млрд и перестраивает долговое финансирование ради вложений в OpenAI почти на $65 млрд.

·1 мин