Microsoft lança três novos modelos de IA focados em voz, transcrição e visão computacional

·

·

A Microsoft anunciou o lançamento de três novos modelos de inteligência artificial voltados ao processamento de áudio, transcrição em tempo real e análise de imagens. As novidades foram disponibilizadas na plataforma de nuvem Azure e no ambiente de testes MAI Playground, segundo reportagem do TechCrunch.

O fato e os números

De acordo com a publicação, os três modelos lançados pela Microsoft têm focos distintos: um voltado ao processamento de voz, outro dedicado à transcrição de áudio em tempo real e um terceiro especializado em visão computacional, tecnologia que permite a um sistema de IA interpretar e analisar imagens. Os modelos já estão disponíveis para uso na Azure, plataforma de computação em nuvem da empresa, além de estarem acessíveis no MAI Playground, ambiente criado para testes e experimentação de modelos de inteligência artificial.

Contexto e por que isso importa

O lançamento simultâneo de modelos voltados a áudio, transcrição e imagem mostra a estratégia da Microsoft de ampliar seu portfólio de inteligência artificial para além dos modelos de texto, área em que a concorrência entre grandes empresas de tecnologia já é intensa. Ao investir em voz e visão computacional, a companhia busca atender aplicações que vão de assistentes virtuais a ferramentas de acessibilidade e produtividade.

A disponibilização via Azure também indica o interesse da empresa em oferecer esses recursos diretamente a desenvolvedores e empresas clientes da nuvem, que podem incorporar os modelos em seus próprios produtos e serviços.

O que muda para as pessoas e para o mercado

Para desenvolvedores e empresas, o acesso a modelos prontos de voz, transcrição e visão computacional pode reduzir o tempo necessário para criar aplicações que dependem dessas funções, como softwares de legendagem automática, assistentes de atendimento por voz ou sistemas de reconhecimento de imagens em processos industriais.

Para o público em geral, o avanço desses modelos tende a aparecer de forma indireta, por meio de produtos e serviços que passarão a incorporar transcrição mais precisa, reconhecimento de voz mais natural ou análise automática de imagens em aplicativos do dia a dia.

O que observar daqui para frente

A Microsoft não detalhou, segundo a reportagem, prazos específicos para expansão do uso desses modelos além do ambiente de testes MAI Playground e da plataforma Azure. Também não há, até o momento, informações sobre preços ou condições comerciais para empresas interessadas em utilizar os três modelos em larga escala.

O mercado de inteligência artificial deve acompanhar se essas novidades vão gerar produtos concretos voltados ao consumidor final ou se permanecerão restritas, por enquanto, a desenvolvedores e clientes corporativos da Microsoft.


Deixe um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *