{"id":1603,"date":"2025-02-01T10:19:34","date_gmt":"2025-02-01T13:19:34","guid":{"rendered":"https:\/\/portal7ia.com.br\/?p=1603"},"modified":"2025-02-01T10:20:49","modified_gmt":"2025-02-01T13:20:49","slug":"lancamento-do-openai-o3-mini","status":"publish","type":"post","link":"https:\/\/portal7ia.com.br\/index.php\/2025\/02\/01\/lancamento-do-openai-o3-mini\/","title":{"rendered":"Lan\u00e7amento do OpenAI o3-mini"},"content":{"rendered":"\n<h3 class=\"wp-block-heading\">OpenAI o3-mini: O Novo Modelo de Racioc\u00ednio Econ\u00f4mico<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\"><em>Esta \u00e9 uma tradu\u00e7\u00e3o do an\u00fancio oficial da OpenAI sobre o lan\u00e7amento do o3-mini, seu mais recente modelo de linguagem focado em racioc\u00ednio STEM. O texto original foi publicado no blog da OpenAI em 31\/01\/2025.<\/em><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Estamos lan\u00e7ando o OpenAI o3-mini, o modelo mais recente e econ\u00f4mico da nossa s\u00e9rie de racioc\u00ednio, dispon\u00edvel tanto no ChatGPT quanto na API a partir de hoje. Apresentado previamente em dezembro de 2024, este modelo poderoso e r\u00e1pido amplia os limites do que modelos pequenos podem alcan\u00e7ar, oferecendo capacidades excepcionais em STEM\u2014com destaque especial para ci\u00eancia, matem\u00e1tica e programa\u00e7\u00e3o\u2014tudo isso mantendo o baixo custo e a lat\u00eancia reduzida do OpenAI o1-mini.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">O OpenAI o3-mini \u00e9 nosso primeiro modelo pequeno de racioc\u00ednio que suporta recursos altamente requisitados pelos desenvolvedores, incluindo chamadas de fun\u00e7\u00e3o, Sa\u00eddas Estruturadas e mensagens de desenvolvedor, tornando-o pronto para produ\u00e7\u00e3o desde o lan\u00e7amento. Assim como o OpenAI o1-mini e o OpenAI o1-preview, o o3-mini oferecer\u00e1 suporte a streaming. Al\u00e9m disso, os desenvolvedores podem escolher entre tr\u00eas n\u00edveis de esfor\u00e7o de racioc\u00ednio\u2014baixo, m\u00e9dio e alto\u2014para otimizar conforme seus casos de uso espec\u00edficos. Essa flexibilidade permite que o o3-mini &#8220;pense mais profundamente&#8221; ao lidar com desafios complexos ou priorize a velocidade quando a lat\u00eancia \u00e9 uma preocupa\u00e7\u00e3o. O o3-mini n\u00e3o suporta capacidades de vis\u00e3o, ent\u00e3o os desenvolvedores devem continuar usando o OpenAI o1 para tarefas de racioc\u00ednio visual. O o3-mini est\u00e1 sendo lan\u00e7ado hoje na Chat Completions API, Assistants API e Batch API para desenvolvedores selecionados nos n\u00edveis de uso 3 a 5 da API.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Usu\u00e1rios do ChatGPT Plus, Team e Pro podem acessar o OpenAI o3-mini a partir de hoje, com acesso para Enterprise previsto para fevereiro. O o3-mini substituir\u00e1 o OpenAI o1-mini no seletor de modelos, oferecendo limites de taxa mais altos e menor lat\u00eancia, tornando-o uma escolha atraente para tarefas de programa\u00e7\u00e3o, STEM e resolu\u00e7\u00e3o l\u00f3gica de problemas. Como parte dessa atualiza\u00e7\u00e3o, estamos triplicando o limite de taxa para usu\u00e1rios Plus e Team, de 50 mensagens por dia com o o1-mini para 150 mensagens por dia com o o3-mini. Al\u00e9m disso, o o3-mini agora funciona com pesquisa para encontrar respostas atualizadas com links para fontes da web relevantes. Este \u00e9 um prot\u00f3tipo inicial enquanto trabalhamos para integrar a pesquisa em nossos modelos de racioc\u00ednio.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">A partir de hoje, usu\u00e1rios do plano gratuito tamb\u00e9m podem experimentar o OpenAI o3-mini selecionando &#8220;Reason&#8221; no compositor de mensagens ou regenerando uma resposta. Esta \u00e9 a primeira vez que um modelo de racioc\u00ednio \u00e9 disponibilizado para usu\u00e1rios gratuitos no ChatGPT.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Embora o OpenAI o1 continue sendo nosso modelo de racioc\u00ednio de conhecimento geral mais abrangente, o OpenAI o3-mini fornece uma alternativa especializada para dom\u00ednios t\u00e9cnicos que exigem precis\u00e3o e velocidade. No ChatGPT, o o3-mini utiliza um n\u00edvel m\u00e9dio de esfor\u00e7o de racioc\u00ednio para equilibrar velocidade e precis\u00e3o. Todos os usu\u00e1rios pagos tamb\u00e9m ter\u00e3o a op\u00e7\u00e3o de selecionar o o3-mini-high no seletor de modelos, uma vers\u00e3o de maior intelig\u00eancia que leva um pouco mais de tempo para gerar respostas. Usu\u00e1rios Pro ter\u00e3o acesso ilimitado tanto ao o3-mini quanto ao o o3-mini-high.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">R\u00e1pido, poderoso e otimizado para racioc\u00ednio em STEM<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Semelhante ao seu antecessor OpenAI o1, o OpenAI o3-mini foi otimizado para racioc\u00ednio em STEM. O o3-mini, com esfor\u00e7o m\u00e9dio de racioc\u00ednio, iguala o desempenho do o1 em matem\u00e1tica, programa\u00e7\u00e3o e ci\u00eancia, enquanto fornece respostas mais r\u00e1pidas. Avalia\u00e7\u00f5es por testadores especializados mostraram que o o3-mini gera respostas mais precisas e claras, com habilidades de racioc\u00ednio mais fortes do que o OpenAI o1-mini. Os testadores preferiram as respostas do o3-mini ao o1-mini em 56% das vezes e observaram uma redu\u00e7\u00e3o de 39% em erros graves em perguntas dif\u00edceis do mundo real. Com esfor\u00e7o m\u00e9dio de racioc\u00ednio, o o3-mini iguala o desempenho do o1 em algumas das avalia\u00e7\u00f5es mais desafiadoras de racioc\u00ednio e intelig\u00eancia, incluindo AIME e GPQA.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Matem\u00e1tica de competi\u00e7\u00e3o (AIME 2024)<\/h3>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong>Matem\u00e1tica:<\/strong> Com baixo esfor\u00e7o de racioc\u00ednio, o OpenAI o3-mini apresenta desempenho compar\u00e1vel ao OpenAI o1-mini. Com esfor\u00e7o m\u00e9dio, o o3-mini atinge desempenho semelhante ao o1. J\u00e1 com alto esfor\u00e7o de racioc\u00ednio, o o3-mini supera tanto o OpenAI o1-mini quanto o OpenAI o1, com as \u00e1reas sombreadas em cinza mostrando o desempenho da vota\u00e7\u00e3o majorit\u00e1ria (consenso) com 64 amostras.<\/li>\n<\/ul>\n\n\n\n<h3 class=\"wp-block-heading\">Quest\u00f5es de ci\u00eancia em n\u00edvel de doutorado (GPQA Diamond)<\/h3>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong>Ci\u00eancia em n\u00edvel de doutorado:<\/strong> Em perguntas de biologia, qu\u00edmica e f\u00edsica em n\u00edvel de doutorado, com baixo esfor\u00e7o de racioc\u00ednio, o OpenAI o3-mini supera o desempenho do OpenAI o1-mini. Com alto esfor\u00e7o, o o3-mini alcan\u00e7a um desempenho compar\u00e1vel ao o1.<\/li>\n<\/ul>\n\n\n\n<h3 class=\"wp-block-heading\">FrontierMath<\/h3>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong>Matem\u00e1tica em n\u00edvel de pesquisa:<\/strong> O OpenAI o3-mini, com alto esfor\u00e7o de racioc\u00ednio, supera seu antecessor no FrontierMath. No FrontierMath, quando solicitado a usar uma ferramenta Python, o o3-mini com alto esfor\u00e7o de racioc\u00ednio resolve mais de 32% dos problemas na primeira tentativa, incluindo mais de 28% dos problemas mais desafiadores (T3). Esses n\u00fameros s\u00e3o provis\u00f3rios, e o gr\u00e1fico acima mostra o desempenho sem ferramentas ou calculadora.<\/li>\n<\/ul>\n\n\n\n<h3 class=\"wp-block-heading\">Programa\u00e7\u00e3o competitiva (Codeforces)<\/h3>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong>Programa\u00e7\u00e3o de competi\u00e7\u00e3o:<\/strong> No Codeforces, OpenAI o3-mini obt\u00e9m pontua\u00e7\u00f5es Elo progressivamente mais altas \u00e0 medida que o esfor\u00e7o de racioc\u00ednio aumenta, sempre superando o o1-mini. Com esfor\u00e7o m\u00e9dio, ele iguala o desempenho do o1.<\/li>\n<\/ul>\n\n\n\n<h3 class=\"wp-block-heading\">Engenharia de software (SWE-bench Verified)<\/h3>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong>Engenharia de software:<\/strong> O o3-mini \u00e9 o nosso modelo mais avan\u00e7ado no SWEbench-verified. Para mais dados sobre os resultados do SWE-bench Verified com alto esfor\u00e7o de racioc\u00ednio, incluindo com o scaffold open-source Agentless (39%) e um scaffold interno de ferramentas (61%), consulte nosso system card.<\/li>\n<\/ul>\n\n\n\n<h3 class=\"wp-block-heading\">LiveBench Coding<\/h3>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong>Programa\u00e7\u00e3o LiveBench:<\/strong> O OpenAI o3-mini supera o o1-high mesmo com esfor\u00e7o m\u00e9dio de racioc\u00ednio, destacando sua efici\u00eancia em tarefas de programa\u00e7\u00e3o. Com alto esfor\u00e7o de racioc\u00ednio, o o3-mini amplia ainda mais sua vantagem, alcan\u00e7ando um desempenho significativamente superior em m\u00e9tricas-chave.<\/li>\n<\/ul>\n\n\n\n<h3 class=\"wp-block-heading\">Conhecimento geral<\/h3>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong>Conhecimento geral:<\/strong> O o3-mini supera o o1-mini em avalia\u00e7\u00f5es de conhecimento geral.<\/li>\n<\/ul>\n\n\n\n<h3 class=\"wp-block-heading\">Avalia\u00e7\u00e3o de prefer\u00eancia humana<\/h3>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong>Prefer\u00eancia humana:<\/strong> Avalia\u00e7\u00f5es de testadores externos tamb\u00e9m mostram que o OpenAI o3-mini gera respostas mais precisas e claras, com habilidades de racioc\u00ednio mais fortes do que o OpenAI o1-mini, especialmente para STEM. Os testadores preferiram as respostas do o3-mini ao o1-mini 56% das vezes e observaram uma redu\u00e7\u00e3o de 39% em erros graves em perguntas dif\u00edceis do mundo real.<\/li>\n<\/ul>\n\n\n\n<h3 class=\"wp-block-heading\">Velocidade e desempenho do modelo<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Com intelig\u00eancia compar\u00e1vel ao OpenAI o1, o OpenAI o3-mini oferece desempenho mais r\u00e1pido e maior efici\u00eancia. Al\u00e9m das avalia\u00e7\u00f5es STEM destacadas acima, o o3-mini demonstra resultados superiores em avalia\u00e7\u00f5es adicionais de matem\u00e1tica e factualidade com esfor\u00e7o m\u00e9dio de racioc\u00ednio. Nos testes A\/B, o o3-mini forneceu respostas 24% mais r\u00e1pidas do que o o1-mini, com um tempo m\u00e9dio de resposta de 7,7 segundos em compara\u00e7\u00e3o com 10,16 segundos.<\/p>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong>Lat\u00eancia:<\/strong> O o3-mini apresenta um tempo m\u00e9dio 2500ms mais r\u00e1pido para o primeiro token em compara\u00e7\u00e3o com o o1-mini.<\/li>\n<\/ul>\n\n\n\n<h3 class=\"wp-block-heading\">Seguran\u00e7a<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Uma das principais t\u00e9cnicas utilizadas para ensinar o OpenAI o3-mini a responder com seguran\u00e7a \u00e9 o alinhamento deliberativo, no qual treinamos o modelo para raciocinar sobre especifica\u00e7\u00f5es de seguran\u00e7a escritas por humanos antes de responder a solicita\u00e7\u00f5es dos usu\u00e1rios. Semelhante ao OpenAI o1, o o3-mini supera significativamente o GPT-4o em avalia\u00e7\u00f5es desafiadoras de seguran\u00e7a e jailbreak.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">O que vem a seguir<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">O lan\u00e7amento do OpenAI o3-mini marca mais um passo na miss\u00e3o da OpenAI de expandir os limites da intelig\u00eancia econ\u00f4mica. Mantendo a qualidade e reduzindo custos, continuamos comprometidos em desenvolver modelos que equilibrem intelig\u00eancia, efici\u00eancia e seguran\u00e7a em larga escala.<\/p>\n\n\n\n<hr class=\"wp-block-separator has-alpha-channel-opacity\"\/>\n\n\n\n<p class=\"has-small-font-size wp-block-paragraph\"><em>Pesquisa, Edi\u00e7\u00e3o, formata\u00e7\u00e3o e finaliza\u00e7\u00e3o:<br>Werney A. Lima, s\u00e1bado, 1 de fevereiro de 2025 \u2013 10:18 (s\u00e1bado)<br>Fonte: <a href=\"https:\/\/openai.com\/index\/openai-o3-mini\/\">https:\/\/openai.com\/index\/openai-o3-mini\/<\/a><\/em><\/p>\n","protected":false},"excerpt":{"rendered":"<p>O OpenAI o3-mini \u00e9 o mais recente modelo de linguagem da OpenAI, focado em racioc\u00ednio STEM (ci\u00eancia, tecnologia, engenharia e matem\u00e1tica). Lan\u00e7ado como sucessor do o1-mini, ele oferece melhor desempenho mantendo baixo custo e menor lat\u00eancia. O modelo se destaca especialmente em matem\u00e1tica, programa\u00e7\u00e3o e ci\u00eancias, com a novidade de tr\u00eas n\u00edveis ajust\u00e1veis de esfor\u00e7o de racioc\u00ednio (baixo, m\u00e9dio e alto).<\/p>\n","protected":false},"author":1,"featured_media":1604,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[1],"tags":[],"class_list":["post-1603","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-blog"],"blocksy_meta":[],"brizy_media":[],"_links":{"self":[{"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/posts\/1603","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/comments?post=1603"}],"version-history":[{"count":2,"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/posts\/1603\/revisions"}],"predecessor-version":[{"id":1606,"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/posts\/1603\/revisions\/1606"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/media\/1604"}],"wp:attachment":[{"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/media?parent=1603"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/categories?post=1603"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/portal7ia.com.br\/index.php\/wp-json\/wp\/v2\/tags?post=1603"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}