T-Pro 2.0 é um modelo de linguagem grande da equipe T-Technologies, projetado para tarefas com forte uso de análises e automação de processos. Construído sobre o Qwen-2.5, ele mira consultas em russo com tokenização otimizada e um modo de raciocínio híbrido para reduzir custos de computação.
Para que é usado
O T-Pro 2.0 é posicionado para cenários em que você precisa de respostas rápidas e raciocínio em عدة etapas, incluindo a criação de agentes de IA para fluxos de trabalho de negócios.
Divide tarefas complexas em etapas lógicas
Gera e verifica hipóteses
Produz respostas em russo
Suporta fine-tuning com dados da empresa
Pode executar tarefas com intervenção humana mínima
O modelo é reportado como capaz de lidar com até 45% das solicitações de clientes no T-Bank sem operadores humanos. Também afirma ter custo menor para consultas em russo em comparação com Qwen3 e DeepSeek R1-Distil, além de bons resultados em benchmarks russos como MERA e ruMMLU.
Acesso e implementação
O T-Pro 2.0 está disponível gratuitamente no Hugging Face sob a licença Apache 2.0 para download e integração. Ele roda em Python (Transformers) e normalmente requer um ambiente com GPU NVIDIA. A precificação na Cloud.ru é listada como 85 ₽ por milhão de tokens de entrada e 170 ₽ por milhão de tokens de saída. O modelo suporta russo e outros idiomas cirílicos.
Especificações principais
32B parâmetros
Dataset T-Wix (500K exemplos)
Compatível com SGLang e OpenTX

