A aprendizagem automática é considerada open-source quando os blocos modulares essenciais são partilhados ao abrigo de licenças abertas. Significa que o código fonte das bibliotecas e dos frameworks está disponível ao público, para que as pessoas possam estudar a forma como os modelos funcionam, adaptá-los às suas necessidades e partilhar melhorias com outras pessoas.
O que acontece com o software proprietário é que este é propriedade exclusiva de uma pessoa ou organização, a qual não só pode alterá-lo como quiser como, normalmente, pede aos utilizadores que assinem um contrato de propriedade que vincula os mesmos a não utilizarem o software de uma forma que o proprietário não permita explicitamente.
Em contrapartida, qualquer pessoa pode consultar, modificar e partilhar software open-source, pelo que os utilizadores podem alterar o código fonte e integrá-lo nos seus próprios projetos.
Componentes da aprendizagem automática open-source
Na prática, a aprendizagem automática open-source envolve normalmente os seguintes componentes.
Código aberto
Os algoritmos, os scripts de preparação e as ferramentas de suporte estão disponíveis para consulta e modificação. Esta transparência ajuda a compreender as opções de conceção, verificar o comportamento e adaptar os modelos a novos casos de utilização.
Licenciamento permissivo
As licenças open-source definem a forma como o software pode ser utilizado, modificado e redistribuído. Estas licenças permitem que estudantes, investigadores e organizações criem soluções com base no trabalho existente sem necessitarem de uma permissão especial.
Contribuição da comunidade
O desenvolvimento ocorre de forma aberta, com os contribuintes a rever o código, corrigir problemas e adicionar funcionalidades. Este processo partilhado ajuda as ferramentas a melhorarem mais rapidamente e a refletirem as necessidades do mundo real em todas as indústrias.
Ecossistemas partilhados
A aprendizagem automática open-source raramente funciona de forma isolada. Bibliotecas, conjuntos de dados, blocos de notas e ferramentas de monitorização de experiências funcionam muitas vezes em conjunto, o que facilita a passagem da aprendizagem e da experimentação para a utilização em produção.
Em contrapartida, as ferramentas proprietárias de aprendizagem automática mantêm o código fonte privado. Pode utilizar o software, mas não pode ver como funciona internamente nem alterá-lo para satisfazer uma condição específica.
As abordagens open-source eliminam essa barreira, razão pela qual muitos fluxos de trabalho modernos de aprendizagem automática dependem de ferramentas abertas em conjunto com plataformas cloud para dimensionarem de forma responsável.