📊 Лингвистический тест показал разницу в стоимости обработк…
Автор: Андрей
📊 Лингвистический тест показал разницу в стоимости обработки текстов на русском и английском языках Проведено сравнение того, как различные модели искусственного интеллекта расходуют токены при обработке одинаковых по смыслу текстов на русском и английском языках. Выяснилось, что для некоторых систем русскоязычный контент обходится значительно дороже. Причина в том, что токенизатор разбивает русский текст на большее количество фрагментов, а оплата производится за каждый токен. В отдельных случаях разница может достигать четырёхкратного размера. Степень расхождения зависит от конкретной модели. Наиболее эффективно с русским языком справляются Grok, GPT-5 и GPT-6. В свою очередь, DeepSeek, Qwen, Kimi и Claude расходуют больше токенов при обработке русскоязычных текстов.