{"id":1601,"date":"2023-07-27T10:19:02","date_gmt":"2023-07-27T13:19:02","guid":{"rendered":"https:\/\/www.blogs.unicamp.br\/musicologia\/?p=1601"},"modified":"2024-03-08T16:08:07","modified_gmt":"2024-03-08T19:08:07","slug":"inteligencia-artificial-em-musica-parte-2","status":"publish","type":"post","link":"https:\/\/www.blogs.unicamp.br\/musicologia\/2023\/07\/27\/inteligencia-artificial-em-musica-parte-2\/","title":{"rendered":"Intelig\u00eancia Artificial em M\u00fasica \u2013 parte 2"},"content":{"rendered":"\t\t<div data-elementor-type=\"wp-post\" data-elementor-id=\"1601\" class=\"elementor elementor-1601\" data-elementor-settings=\"{&quot;ha_cmc_init_switcher&quot;:&quot;no&quot;}\">\n\t\t\t\t\t\t<section class=\"elementor-section elementor-top-section elementor-element elementor-element-25eb39b9 elementor-section-boxed elementor-section-height-default elementor-section-height-default jltma-glass-effect-no\" data-id=\"25eb39b9\" data-element_type=\"section\" data-e-type=\"section\" data-settings=\"{&quot;_ha_eqh_enable&quot;:false}\">\n\t\t\t\t\t\t<div class=\"elementor-container elementor-column-gap-default\">\n\t\t\t\t\t<div class=\"elementor-column elementor-col-100 elementor-top-column elementor-element elementor-element-16e91bd3 jltma-glass-effect-no\" data-id=\"16e91bd3\" data-element_type=\"column\" data-e-type=\"column\">\n\t\t\t<div class=\"elementor-widget-wrap elementor-element-populated\">\n\t\t\t\t\t\t<div class=\"elementor-element elementor-element-41adbd81 jltma-glass-effect-no elementor-widget elementor-widget-text-editor\" data-id=\"41adbd81\" data-element_type=\"widget\" data-e-type=\"widget\" data-widget_type=\"text-editor.default\">\n\t\t\t\t<div class=\"elementor-widget-container\">\n\t\t\t\t\t\t\t\t\t<p><\/p>\n<p style=\"text-align: right\">Jos\u00e9 Fornari &#8211; fornari @ unicamp . br<\/p>\n<p style=\"text-align: right\">27 de julho de 2023<\/p>\n<p><span style=\"font-weight: 400\">Conforme disse na palestra mencionada no<\/span><a href=\"https:\/\/www.blogs.unicamp.br\/musicologia\/2023\/07\/17\/inteligencia-artificial-em-musica-parte-1\/\"> <span style=\"font-weight: 400\">artigo anterior<\/span><\/a><span style=\"font-weight: 400\">, os estudos e aspira\u00e7\u00f5es em se criar uma m\u00e1quina inteligente parecessem ter origem milenar. Na Gr\u00e9cia antiga, por exemplo, existia a lenda de um gigante feito de bronze, na ilha de Creta. Este era conhecido como &#8220;Talos&#8221; que, desde a era do bronze (mais de 300 s\u00e9culos atr\u00e1s), patrulhava esta ilha atacando barcos desconhecidos que l\u00e1 tentavam aportar. No juda\u00edsmo, tem-se registros, desde o s\u00e9culo 12, da lenda de &#8220;Golem&#8221;, um ser antropom\u00f3rfico feito de argila que protege o povo judeu. No s\u00e9culo 19, a escritora<\/span><a href=\"https:\/\/pt.wikipedia.org\/wiki\/Mary_Shelley\"> <span style=\"font-weight: 400\">Mary Shelley<\/span><\/a><span style=\"font-weight: 400\"> escreveu o famoso romance de fic\u00e7\u00e3o cient\u00edfica intitulado &#8220;Frankenstein&#8221;, que narra a cria\u00e7\u00e3o de um aut\u00f4mato feito de partes de diversos corpos humanos. Interessante notar que todos estes seres lend\u00e1rios: Talos, Golem, Frankenstein (entre outras fic\u00e7\u00f5es similares, como o rob\u00f4 <a href=\"https:\/\/pt.wikipedia.org\/wiki\/Gort_(rob%C3%B4)\" target=\"_blank\" rel=\"noopener\">Gort<\/a>, do filme &#8220;<a href=\"https:\/\/www.imdb.com\/title\/tt0043456\/\" target=\"_blank\" rel=\"noopener\"><em>the day the earth stood still<\/em><\/a>&#8220;, de 1951), s\u00e3o criaturas mudas; agindo como corpos que se movimentam e cumprem ordens mas que n\u00e3o s\u00e3o capazes de se expressar atrav\u00e9s da linguagem, na minha opini\u00e3o inferindo assim que estes seres n\u00e3o s\u00e3o capazes de pensar por si pr\u00f3prios. O que temos atualmente, na realidade tecnol\u00f3gica, com o avan\u00e7o de modelos computacionais de intelig\u00eancia artificial, em especial os da categorias LLM (<\/span><a href=\"https:\/\/en.wikipedia.org\/wiki\/Large_language_model\"><i><span style=\"font-weight: 400\">Large Language Models<\/span><\/i><\/a><span style=\"font-weight: 400\">), como \u00e9 o caso do ChatGPT, \u00e9 justamente o oposto. Estes s\u00e3o &#8220;vozes&#8221; (que se expressam atrav\u00e9s de textos) sem &#8220;corpos&#8221;. Diferente dos lend\u00e1rios aut\u00f4matos do passado, os modelos LLM parecem muitas vezes pensar por si pr\u00f3prios, por\u00e9m sem a habilidade de agirem diretamente no plano f\u00edsico, uma vez que n\u00e3o possuem, pelo menos at\u00e9 o momento, uma interface f\u00edsica que os permita atuar diretamente, de modo n\u00e3o supervisionado e sem restri\u00e7\u00f5es, no plano f\u00edsico.<\/span><\/p>\n<table style=\"border-collapse: collapse;width: 100%;height: 270px\">\n<tbody>\n<tr style=\"height: 247px\">\n<td style=\"width: 33.3333%;height: 247px\"><img decoding=\"async\" src=\"https:\/\/upload.wikimedia.org\/wikipedia\/commons\/thumb\/c\/c8\/Didrachm_Phaistos_obverse_CdM.jpg\/220px-Didrachm_Phaistos_obverse_CdM.jpg\" \/><\/td>\n<td style=\"width: 33.3333%;height: 247px\"><img decoding=\"async\" src=\"https:\/\/upload.wikimedia.org\/wikipedia\/commons\/thumb\/9\/9f\/Prague-golem-reproduction.jpg\/220px-Prague-golem-reproduction.jpg\" \/><\/td>\n<td style=\"width: 33.3333%;height: 247px\"><img decoding=\"async\" src=\"https:\/\/upload.wikimedia.org\/wikipedia\/commons\/thumb\/7\/73\/Frankenstein_engraved.jpg\/230px-Frankenstein_engraved.jpg\" \/><\/td>\n<\/tr>\n<tr style=\"height: 23px\">\n<td style=\"width: 33.3333%;height: 23px\"><a href=\"https:\/\/pt.wikipedia.org\/wiki\/Talos\" target=\"_blank\" rel=\"noopener\">Talos<\/a><\/td>\n<td style=\"width: 33.3333%;height: 23px\"><a href=\"https:\/\/pt.wikipedia.org\/wiki\/Golem\" target=\"_blank\" rel=\"noopener\">Golem<\/a><\/td>\n<td style=\"width: 33.3333%;height: 23px\"><a href=\"https:\/\/pt.wikipedia.org\/wiki\/Frankenstein\" target=\"_blank\" rel=\"noopener\">Frankenstein<\/a><\/td>\n<\/tr>\n<\/tbody>\n<\/table>\n<p>Isto para mim se deve \u00e0 lenta mudan\u00e7a de paradigma de poder que vem ocorrendo na humanidade (desde o final da idade m\u00e9dia at\u00e9 atualmente, com as tecnologias de informa\u00e7\u00e3o e comunica\u00e7\u00e3o, que permitem o entretenimento, o estudo e o trabalho remoto, ao inv\u00e9s de necessariamente presencial) migrando da for\u00e7a f\u00edsica, representada pelo corpo, para a for\u00e7a mental da cogni\u00e7\u00e3o, evidenciada pela sua express\u00e3o atrav\u00e9s da linguagem, pois \u00e9 desta inerente habilidade comunicacional humana que adv\u00e9m outras \u00e1reas do conhecimento humano, como a filosofia, a l\u00f3gica, a matem\u00e1tica, e assim toda a ci\u00eancia e a tecnologia.<\/p>\n<p>Na primeira metade do s\u00e9culo 20, com o avan\u00e7o tecnol\u00f3gico da eletr\u00f4nica, come\u00e7ou-se a estudar a possibilidade do desenvolvimento do que chamavam na \u00e9poca de &#8220;c\u00e9rebro eletr\u00f4nico&#8221;; uma m\u00e1quina eletr\u00f4nica capaz de resolver problemas l\u00f3gicos, simulando assim, uma das habilidades da intelig\u00eancia humana, que passou a ser chamada de &#8220;<a href=\"https:\/\/en.wikipedia.org\/wiki\/Artificial_intelligence\" target=\"_blank\" rel=\"noopener\">intelig\u00eancia artificial<\/a>&#8220;. Dentre tantos pesquisadores, pode-se citar os trabalhos de <a href=\"https:\/\/pt.wikipedia.org\/wiki\/Alan_Turing\" target=\"_blank\" rel=\"noopener\">Alan Turing<\/a>, com o desenvolvimento de uma m\u00e1quina hipot\u00e9tica, intitulada de <a href=\"https:\/\/en.wikipedia.org\/wiki\/Turing_machine\" target=\"_blank\" rel=\"noopener\"><em>Turing Machine<\/em><\/a>, que atrav\u00e9s de recursos parcimoniosos\u00a0 (uma fita unidimensional dividida em segmentos regulares onde uma cabe\u00e7a poderia ler ou escrever s\u00edmbolos nestes segmentos) podia investigar os limites da computabilidade, tamb\u00e9m chamado de problema da &#8220;parada de Turing&#8221;, ou <a href=\"https:\/\/en.wikipedia.org\/wiki\/Halting_problem\" target=\"_blank\" rel=\"noopener\"><em>Halting Problem<\/em><\/a>, relacionado \u00e0 incompletude matem\u00e1tica, comprovada pelos dois teoremas de Godel, em 1931.\u00a0<\/p>\n<p><iframe title=\"INCOMPLETUDE DE G\u00d6DEL: a Matem\u00e1tica N\u00c3O \u00e9 Perfeita\" width=\"700\" height=\"394\" src=\"https:\/\/www.youtube.com\/embed\/aSXEd5iNVGo?feature=oembed\" frameborder=\"0\" allow=\"accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share\" allowfullscreen><\/iframe><\/p>\n<p><a href=\"https:\/\/pt.wikipedia.org\/wiki\/John_von_Neumann\" target=\"_blank\" rel=\"noopener\">John Von Neumann<\/a>, um dos fundadores dos estudos em intelig\u00eancia artificial, criou a <a href=\"https:\/\/pt.wikipedia.org\/wiki\/Arquitetura_de_von_Neumann\" target=\"_blank\" rel=\"noopener\">arquitetura computacional<\/a>\u00a0 baseada na <em>Turing Machine<\/em>, bem como no <a href=\"https:\/\/www.leydesdorff.net\/vonneumann\/\" target=\"_blank\" rel=\"noopener\">c\u00e9rebro humano<\/a>, contendo uma unidade processadora de aritm\u00e9tica e l\u00f3gica (a meu ver, inspirada em nossa <a href=\"https:\/\/cambridgecognition.com\/what-is-cognition\/#:~:text=Cognition%20is%20defined%20as%20'the,used%20to%20guide%20your%20behavior.\" target=\"_blank\" rel=\"noopener\">cogni\u00e7\u00e3o<\/a>), uma unidade de controle (o <a href=\"https:\/\/en.wikipedia.org\/wiki\/Prefrontal_cortex\" target=\"_blank\" rel=\"noopener\">c\u00f3rtex pr\u00e9frontal<\/a>), uma mem\u00f3ria principal (a nossa <a href=\"https:\/\/rmmg.org\/artigo\/detalhes\/577\" target=\"_blank\" rel=\"noopener\">mem\u00f3ria de longo prazo<\/a>), mem\u00f3ria perif\u00e9rica (como a nossa <a href=\"https:\/\/pt.wikipedia.org\/wiki\/Mem%C3%B3ria_a_curto_prazo\" target=\"_blank\" rel=\"noopener\">mem\u00f3ria de curto prazo<\/a>) e dispositivos de entrada e sa\u00edda (como s\u00e3o nossos sentidos). Esta arquitetura foi usada no primeiro computador eletr\u00f4nico com l\u00f3gica bin\u00e1ria (como s\u00e3o os <a href=\"https:\/\/pt.wikipedia.org\/wiki\/Potencial_de_a%C3%A7%C3%A3o\" target=\"_blank\" rel=\"noopener\">potenciais de a\u00e7\u00e3o<\/a> neurais), em 1946; o\u00a0 <a href=\"https:\/\/pt.wikipedia.org\/wiki\/EDVAC\" target=\"_blank\" rel=\"noopener\">EDVAC<\/a>\u00a0 (<em>Electronic Discrete Variable Automatic Computer<\/em>).<\/p>\n<p><span style=\"font-weight: 400\">Interessante observar que a arquitetura computacional visionada por Von Neumann n\u00e3o levou em considera\u00e7\u00e3o os aspectos expressivos da mente humana, como o sistema l\u00edmbico, a parte primitiva e profunda de nosso c\u00e9rebro onde emo\u00e7\u00f5es s\u00e3o geradas e percebidas. Se j\u00e1 \u00e9 definitivamente comprovado que os m\u00e9todos formais da l\u00f3gica, da matem\u00e1tica e da computa\u00e7\u00e3o, s\u00e3o comprovadamente incompletos (atrav\u00e9s de diversas evid\u00eancias formais, como o <\/span><i><span style=\"font-weight: 400\">Halting problem<\/span><\/i><span style=\"font-weight: 400\"> e os teoremas da incompletude de Godel, ambos mencionados acima, bem como o famoso e misterioso<\/span><a href=\"https:\/\/youtu.be\/R9Plq-D1gEk\"> <i><span style=\"font-weight: 400\">Game of Life<\/span><\/i><\/a><span style=\"font-weight: 400\">) as estrat\u00e9gias que a linguagem se vale para lidar como tal incompletude (ou, no caso da linguagem, a inefabilidade), a meu ver, n\u00e3o s\u00e3o cognitivos mas sim expressivos, ou seja, ao inv\u00e9s de corticais, estes s\u00e3o l\u00edmbicos. Podemos observar tais evid\u00eancias na expressividade contida em<\/span><a href=\"https:\/\/pt.wikipedia.org\/wiki\/Figura_de_linguagem\"> <span style=\"font-weight: 400\">figuras de linguagem<\/span><\/a><span style=\"font-weight: 400\">, como a dualidade da met\u00e1fora, a exemplifica\u00e7\u00e3o da analogia, a extens\u00e3o sensorial da sinestesia, o refor\u00e7o da hip\u00e9rbole, o abrandamento do eufemismo ou a imponderabilidade do paradoxo. A linguagem se vale de diversas estrat\u00e9gias para evitar, contornar, referir ou mesmo utilizar expressivamente a incompletude da raz\u00e3o. N\u00e3o apenas de figuras de linguagem mas tamb\u00e9m, na sua forma falada, a oralidade agrega a pros\u00f3dia que enriquece a comunica\u00e7\u00e3o sem\u00e2ntica com significados expressivos, que s\u00e3o muitas vezes essenciais para a comunica\u00e7\u00e3o humana. Pessoas no espectro <a href=\"https:\/\/www.saude.pr.gov.br\/Pagina\/Transtorno-do-Espectro-Autista-TEA\" target=\"_blank\" rel=\"noopener\">TEA<\/a>, por exemplo, muitas vezes tem dificuldades de entender e expressar nuances da oralidade, o que os dificulta entender a emo\u00e7\u00e3o de outros, atrav\u00e9s da oralidade; que \u00e9 parte fundamental da prosa, da poesia e da can\u00e7\u00e3o, que artisticamente ergue a metaf\u00f3rica ponte entre linguagem e a m\u00fasica.\u00a0<\/span><\/p>\n<p><span style=\"font-weight: 400\">Como a linguagem \u00e9 a base da raz\u00e3o humana, ao se criar um modelo computacional eficiente de processamento de linguagem artificial (os modelos <a href=\"https:\/\/en.wikipedia.org\/wiki\/Large_language_model\" target=\"_blank\" rel=\"noopener\">LLM<\/a>, como o ChatGPT) estes tamb\u00e9m se tornam capaz de lidar com problemas matem\u00e1ticos, l\u00f3gicos, filos\u00f3ficos e tecnol\u00f3gicos. No entanto, na parte expressiva, como irei discutir adiante, estes modelos n\u00e3o impressionam tanto quanto o fazem ao gerar c\u00f3digo de programa\u00e7\u00e3o, criar poesia em estilo de grandes autores, esclarecer quest\u00f5es cient\u00edficas e tecnol\u00f3gicas, resolver complexos problemas matem\u00e1ticos ou mesmo discorrer sobre quest\u00f5es filos\u00f3ficas. A criatividade, na minha opini\u00e3o, \u00e9 uma capacidade humana que transcende a raz\u00e3o; que se origina de um processo <a href=\"https:\/\/pt.wikipedia.org\/wiki\/Abdu%C3%A7%C3%A3o_(l%C3%B3gica_filos%C3%B3fica)\" target=\"_blank\" rel=\"noopener\">abdutivo<\/a> que posteriormente se vale da <a href=\"https:\/\/pt.wikipedia.org\/wiki\/M%C3%A9todo_indutivo\" target=\"_blank\" rel=\"noopener\">indu\u00e7\u00e3o<\/a> e da <a href=\"https:\/\/pt.wikipedia.org\/wiki\/M%C3%A9todo_dedutivo\" target=\"_blank\" rel=\"noopener\">dedu\u00e7\u00e3o<\/a> (na minha opini\u00e3o, os \u00fanicos processos que os modelos <a href=\"https:\/\/en.wikipedia.org\/wiki\/Large_language_model\" target=\"_blank\" rel=\"noopener\">LLM<\/a> s\u00e3o capazes de simular) para gerar novo conhecimento ou arte, como a m\u00fasica. Os modelos LLM, a meu ver, s\u00e3o capazes de utilizar o vasto conhecimento humano (atrav\u00e9s de processos similares \u00e0 dedu\u00e7\u00e3o) e de o processar (analisando, recombinando, testando uma enorme quantidade de dados; atrav\u00e9s de processos similares \u00e0 indu\u00e7\u00e3o) mas n\u00e3o s\u00e3o capazes de gerar conhecimento novo pois n\u00e3o possuem a capacidade de criar, o que pode at\u00e9 certo ponto ser simulado por processos <a href=\"https:\/\/pt.wikipedia.org\/wiki\/Pseudoaleatoriedade\" target=\"_blank\" rel=\"noopener\">pseudoaleat\u00f3rios<\/a>, mas que para mim n\u00e3o se equiparam ou substituem a abdu\u00e7\u00e3o da mente humana.\u00a0<\/span><\/p>\n<p>\u00a0<\/p>\n<hr \/>\n<p><strong>Como citar este artigo:<\/strong><br \/>Jos\u00e9 Fornari. \u201cIntelig\u00eancia Artificial em M\u00fasica \u2013 parte 2\u201d. Blogs de Ci\u00eancia da Universidade Estadual de Campinas. Data da publica\u00e7\u00e3o: 27 de julho de 2023. Link: https:\/\/www.blogs.unicamp.br\/musicologia\/2023\/07\/27\/inteligencia-artificial-em-musica-parte-2\/<\/p>\n<p>\u00a0<\/p>\n<p><\/p>\n<p><\/p>\t\t\t\t\t\t\t\t<\/div>\n\t\t\t\t<\/div>\n\t\t\t\t\t<\/div>\n\t\t<\/div>\n\t\t\t\t\t<\/div>\n\t\t<\/section>\n\t\t\t\t<\/div>\n\t\t","protected":false},"excerpt":{"rendered":"<a href=\"https:\/\/www.blogs.unicamp.br\/musicologia\/2023\/07\/27\/inteligencia-artificial-em-musica-parte-2\/\" rel=\"bookmark\" title=\"Link permanente Intelig\u00eancia Artificial em M\u00fasica \u2013 parte 2\"><\/a>","protected":false},"author":389,"featured_media":0,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"_monsterinsights_skip_tracking":false,"_monsterinsights_sitenote_active":false,"_monsterinsights_sitenote_note":"","_monsterinsights_sitenote_category":0,"pgc_sgb_lightbox_settings":"","_vp_format_video_url":"","_vp_image_focal_point":[],"footnotes":""},"categories":[1],"tags":[],"class_list":{"0":"post-1601","1":"post","2":"type-post","3":"status-publish","4":"format-standard","6":"category-sem-categoria","7":"h-entry","8":"hentry"},"jetpack_featured_media_url":"","_links":{"self":[{"href":"https:\/\/www.blogs.unicamp.br\/musicologia\/wp-json\/wp\/v2\/posts\/1601","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.blogs.unicamp.br\/musicologia\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.blogs.unicamp.br\/musicologia\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.blogs.unicamp.br\/musicologia\/wp-json\/wp\/v2\/users\/389"}],"replies":[{"embeddable":true,"href":"https:\/\/www.blogs.unicamp.br\/musicologia\/wp-json\/wp\/v2\/comments?post=1601"}],"version-history":[{"count":15,"href":"https:\/\/www.blogs.unicamp.br\/musicologia\/wp-json\/wp\/v2\/posts\/1601\/revisions"}],"predecessor-version":[{"id":1639,"href":"https:\/\/www.blogs.unicamp.br\/musicologia\/wp-json\/wp\/v2\/posts\/1601\/revisions\/1639"}],"wp:attachment":[{"href":"https:\/\/www.blogs.unicamp.br\/musicologia\/wp-json\/wp\/v2\/media?parent=1601"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.blogs.unicamp.br\/musicologia\/wp-json\/wp\/v2\/categories?post=1601"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.blogs.unicamp.br\/musicologia\/wp-json\/wp\/v2\/tags?post=1601"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}