{"id":1259,"date":"2024-07-22T06:55:47","date_gmt":"2024-07-22T09:55:47","guid":{"rendered":"https:\/\/portal7ia.com.br\/?p=1259"},"modified":"2024-07-22T07:01:43","modified_gmt":"2024-07-22T10:01:43","slug":"gpt-4o-mini-avancando-na-inteligencia-com-eficiencia-de-custos","status":"publish","type":"post","link":"https:\/\/portal7ia.com.br\/index.php\/2024\/07\/22\/gpt-4o-mini-avancando-na-inteligencia-com-eficiencia-de-custos\/","title":{"rendered":"GPT-4o mini: avan\u00e7ando na intelig\u00eancia com efici\u00eancia de custos"},"content":{"rendered":"\n<p class=\"wp-block-paragraph\">Esse post \u00e9 uma tradu\u00e7\u00e3o da apresenta\u00e7\u00e3o do nov\u00edssimo GPT-4o mini pela OpenAI.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Apresentando nosso modelo pequeno mais econ\u00f4mico<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">A OpenAI est\u00e1 comprometida em tornar a intelig\u00eancia o mais amplamente acess\u00edvel poss\u00edvel. Hoje, estamos anunciando o GPT-4o mini, nosso modelo pequeno mais econ\u00f4mico. Esperamos que o GPT-4o mini expanda significativamente a gama de aplicativos criados com IA, tornando a intelig\u00eancia muito mais acess\u00edvel. O GPT-4o mini pontua 82% no MMLU e atualmente supera o GPT-4 em prefer\u00eancias de bate-papo no placar do LMSYS(abre em uma nova janela). Ele custa 15 centavos por milh\u00e3o de tokens de entrada e 60 centavos por milh\u00e3o de tokens de sa\u00edda, uma ordem de magnitude mais acess\u00edvel do que os modelos de fronteira anteriores e mais de 60% mais barato que o GPT-3.5 Turbo.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">O GPT-4o mini permite uma ampla gama de tarefas com seu baixo custo e lat\u00eancia, como aplicativos que encadeiam ou paralelizam v\u00e1rias chamadas de modelo (por exemplo, chamando v\u00e1rias APIs), passam um grande volume de contexto para o modelo (por exemplo, base de c\u00f3digo completa ou hist\u00f3rico de conversas) ou interagem com clientes por meio de respostas de texto r\u00e1pidas e em tempo real (por exemplo, chatbots de suporte ao cliente).<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Hoje, o GPT-4o mini suporta texto e vis\u00e3o na API, com suporte para entradas e sa\u00eddas de texto, imagem, v\u00eddeo e \u00e1udio chegando no futuro. O modelo tem uma janela de contexto de 128K tokens, suporta at\u00e9 16K tokens de sa\u00edda por solicita\u00e7\u00e3o e tem conhecimento at\u00e9 outubro de 2023. Gra\u00e7as ao tokenizador aprimorado compartilhado com o GPT-4o, lidar com texto que n\u00e3o seja em ingl\u00eas agora \u00e9 ainda mais econ\u00f4mico.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Um pequeno modelo com intelig\u00eancia textual superior e racioc\u00ednio multimodal<br>O GPT-4o mini supera o GPT-3.5 Turbo e outros modelos pequenos em benchmarks acad\u00eamicos em intelig\u00eancia textual e racioc\u00ednio multimodal, e suporta a mesma gama de idiomas que o GPT-4o. Ele tamb\u00e9m demonstra forte desempenho em chamadas de fun\u00e7\u00e3o, o que pode permitir que os desenvolvedores criem aplicativos que buscam dados ou realizam a\u00e7\u00f5es com sistemas externos, e melhoram o desempenho de longo contexto em compara\u00e7\u00e3o com o GPT-3.5 Turbo.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">O GPT-4o mini foi avaliado em v\u00e1rios benchmarks importantes<\/h3>\n\n\n\n<figure class=\"wp-block-image size-large\"><img loading=\"lazy\" decoding=\"async\" width=\"1024\" height=\"590\" src=\"https:\/\/portal7ia.com.br\/wp-content\/uploads\/2024\/07\/image-3-1024x590.png\" alt=\"\" class=\"wp-image-1264\" srcset=\"https:\/\/portal7ia.com.br\/wp-content\/uploads\/2024\/07\/image-3-1024x590.png 1024w, https:\/\/portal7ia.com.br\/wp-content\/uploads\/2024\/07\/image-3-300x173.png 300w, https:\/\/portal7ia.com.br\/wp-content\/uploads\/2024\/07\/image-3-768x442.png 768w, https:\/\/portal7ia.com.br\/wp-content\/uploads\/2024\/07\/image-3-1536x885.png 1536w, https:\/\/portal7ia.com.br\/wp-content\/uploads\/2024\/07\/image-3.png 1663w\" sizes=\"auto, (max-width: 1024px) 100vw, 1024px\" \/><\/figure>\n\n\n\n<p class=\"wp-block-paragraph\"><strong><em>Tarefas de racioc\u00ednio<\/em>:<\/strong> o GPT-4o mini \u00e9 melhor do que outros modelos pequenos em tarefas de racioc\u00ednio envolvendo texto e vis\u00e3o, pontuando 82,0% no MMLU, um benchmark de intelig\u00eancia textual e racioc\u00ednio, em compara\u00e7\u00e3o com 77,9% do Gemini Flash e 73,8% do Claude Haiku.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong><em>Profici\u00eancia em matem\u00e1tica e codifica\u00e7\u00e3o<\/em>:<\/strong> o GPT-4o mini se destaca em racioc\u00ednio matem\u00e1tico e tarefas de codifica\u00e7\u00e3o, superando modelos pequenos anteriores no mercado. No MGSM, medindo racioc\u00ednio matem\u00e1tico, o GPT-4o mini pontuou 87,0%, em compara\u00e7\u00e3o com 75,5% para o Gemini Flash e 71,7% para o Claude Haiku. O GPT-4o mini pontuou 87,2% no HumanEval, que mede o desempenho de codifica\u00e7\u00e3o, em compara\u00e7\u00e3o com 71,5% para o Gemini Flash e 75,9% para o Claude Haiku.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong><em>Racioc\u00ednio multimodal<\/em>:<\/strong> o GPT-4o mini tamb\u00e9m mostra um desempenho forte no MMMU, uma avalia\u00e7\u00e3o de racioc\u00ednio multimodal, pontuando 59,4% em compara\u00e7\u00e3o com 56,1% do Gemini Flash e 50,2% do Claude Haiku.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Como parte do nosso processo de desenvolvimento de modelo, trabalhamos com um punhado de parceiros confi\u00e1veis \u200b\u200bpara entender melhor os casos de uso e as limita\u00e7\u00f5es do GPT-4o mini. Fizemos parcerias com empresas como a Ramp(ver link no rodap\u00e9)e sobre-humano(ver link no rodap\u00e9)que descobriram que o GPT-4o mini tem um desempenho significativamente melhor do que o GPT-3.5 Turbo para tarefas como extrair dados estruturados de arquivos de recibos ou gerar respostas de e-mail de alta qualidade quando fornecido com hist\u00f3rico de threads.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\"><em>Medidas de seguran\u00e7a integradas<\/em><\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">A seguran\u00e7a \u00e9 incorporada em nossos modelos desde o in\u00edcio e refor\u00e7ada em cada etapa do nosso processo de desenvolvimento. No pr\u00e9-treinamento, filtramos informa\u00e7\u00f5es das quais n\u00e3o queremos que nossos modelos aprendam ou produzam, como discurso de \u00f3dio, conte\u00fado adulto, sites que agregam principalmente informa\u00e7\u00f5es pessoais e spam. No p\u00f3s-treinamento, alinhamos o comportamento do modelo \u00e0s nossas pol\u00edticas usando t\u00e9cnicas como aprendizado por refor\u00e7o com feedback humano (RLHF) para melhorar a precis\u00e3o e a confiabilidade das respostas dos modelos.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">O GPT-4o mini tem as mesmas mitiga\u00e7\u00f5es de seguran\u00e7a incorporadas ao GPT-4o , que avaliamos cuidadosamente usando avalia\u00e7\u00f5es automatizadas e humanas de acordo com nossa Estrutura de Prepara\u00e7\u00e3o e em linha com nossos compromissos volunt\u00e1rios . Mais de 70 especialistas externos em \u00e1reas como psicologia social e desinforma\u00e7\u00e3o testaram o GPT-4o para identificar riscos potenciais.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Com base nesses aprendizados, nossas equipes tamb\u00e9m trabalharam para melhorar a seguran\u00e7a do GPT-4o mini usando novas t\u00e9cnicas informadas por nossa pesquisa. O GPT-4o mini na API \u00e9 o primeiro modelo a aplicar nosso m\u00e9todo de hierarquia de instru\u00e7\u00f5es, que ajuda a melhorar a capacidade do modelo de resistir a jailbreaks, inje\u00e7\u00f5es de prompt e extra\u00e7\u00f5es de prompt do sistema. Isso torna as respostas do modelo mais confi\u00e1veis \u200b\u200be ajuda a torn\u00e1-lo mais seguro para uso em aplicativos em escala.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Continuaremos monitorando como o GPT-4o mini est\u00e1 sendo usado e melhoraremos a seguran\u00e7a do modelo \u00e0 medida que identificarmos novos riscos.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\"><em>Disponibilidade e pre\u00e7os<\/em><\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">O GPT-4o mini agora est\u00e1 dispon\u00edvel como um modelo de texto e vis\u00e3o na API Assistants, API Chat Completions e API Batch. Os desenvolvedores pagam 15 centavos por 1M de tokens de entrada e 60 centavos por 1M de tokens de sa\u00edda (aproximadamente o equivalente a 2500 p\u00e1ginas em um livro padr\u00e3o). Planejamos lan\u00e7ar o ajuste fino para o GPT-4o mini nos pr\u00f3ximos dias.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">No ChatGPT, usu\u00e1rios Free, Plus e Team poder\u00e3o acessar o GPT-4o mini a partir de hoje(18\/07\/2024), no lugar do GPT-3.5. Usu\u00e1rios Enterprise tamb\u00e9m ter\u00e3o acesso a partir da semana que vem, em linha com nossa miss\u00e3o de tornar os benef\u00edcios da IA \u200b\u200bacess\u00edveis a todos.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\"><em>Qual \u00e9 o pr\u00f3ximo<\/em><\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Nos \u00faltimos anos, testemunhamos avan\u00e7os not\u00e1veis \u200b\u200bna intelig\u00eancia de IA combinados com redu\u00e7\u00f5es substanciais em custos. Por exemplo, o custo por token do GPT-4o mini caiu 99% desde text-davinci-003, um modelo menos capaz introduzido em 2022. Estamos comprometidos em continuar essa trajet\u00f3ria de redu\u00e7\u00e3o de custos enquanto aprimoramos as capacidades do modelo.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">N\u00f3s imaginamos um futuro onde os modelos se tornam perfeitamente integrados em todos os aplicativos e em todos os sites. O GPT-4o mini est\u00e1 abrindo caminho para que os desenvolvedores criem e dimensionem aplicativos de IA poderosos de forma mais eficiente e acess\u00edvel. O futuro da IA \u200b\u200best\u00e1 se tornando mais acess\u00edvel, confi\u00e1vel e incorporado em nossas experi\u00eancias digitais di\u00e1rias, e estamos animados para continuar a liderar o caminho.<\/p>\n\n\n\n<hr class=\"wp-block-separator has-alpha-channel-opacity\"\/>\n\n\n\n<p class=\"has-small-font-size wp-block-paragraph\"><em>Pesquisa, Curadoria, Edi\u00e7\u00e3o, formata\u00e7\u00e3o e finaliza\u00e7\u00e3o:<br>Werney Lima, julho 22, 2024 (Segunda-feira) &#8211; 06:25 hrs.<br>Fonte: <a href=\"https:\/\/openai.com\/index\/gpt-4o-mini-advancing-cost-efficient-intelligence\/\" target=\"_blank\" rel=\"noreferrer noopener\">https:\/\/openai.com\/index\/gpt-4o-mini-advancing-cost-efficient-intelligence\/<\/a><\/em><br><\/p>\n","protected":false},"excerpt":{"rendered":"<p>Esse post \u00e9 uma tradu\u00e7\u00e3o da apresenta\u00e7\u00e3o do nov\u00edssimo GPT-4o mini pela OpenAI. Apresentando nosso modelo pequeno mais econ\u00f4mico A OpenAI est\u00e1 comprometida em tornar a intelig\u00eancia o mais amplamente acess\u00edvel poss\u00edvel. Hoje, estamos anunciando o GPT-4o mini, nosso modelo pequeno mais econ\u00f4mico. Esperamos que o GPT-4o mini expanda significativamente a gama de aplicativos criados [&hellip;]<\/p>\n","protected":false},"author":1,"featured_media":1262,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[1,30,33],"tags":[8,266,9,10,26,34],"class_list":["post-1259","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-blog","category-llms","category-news","tag-ai","tag-gpt-4o-mini","tag-ia","tag-inteligencia-artificial","tag-llm","tag-openai"],"blocksy_meta":[],"brizy_media":[],"_links":{"self":[{"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/posts\/1259","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/comments?post=1259"}],"version-history":[{"count":3,"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/posts\/1259\/revisions"}],"predecessor-version":[{"id":1266,"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/posts\/1259\/revisions\/1266"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/media\/1262"}],"wp:attachment":[{"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/media?parent=1259"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/categories?post=1259"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/tags?post=1259"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}