Go back

241: Tudo sobre o assustador (ou será?) modelo Mythos da Anthropic

101m 15s

241: Tudo sobre o assustador (ou será?) modelo Mythos da Anthropic

A Anthropic anunciou o Claude Mythos, um modelo de IA focado em segurança cibernética e programação, destacado por sua capacidade excepcional de identificar vulnerabilidades zero-day em sistemas como navegadores e servidores. O modelo não será lançado publicamente; em vez disso, está disponível para aproximadamente 40 empresas parceiras através do projeto Glass Wing, incluindo gigantes como Microsoft, Google e Linux Foundation, com o objetivo de corrigir falhas antes de um possível lançamento mais amplo. Em benchmarks de código, como o SWE-bench, o Mythos superou modelos líderes como GPT-4, Claude Opus e Gemini, com melhorias de até 25% em algumas tarefas, além de demonstrar maior eficiência no uso de tokens. No entanto, análises indicam que o Mythos representa uma evolução incremental—um modelo maior e mais bem treinado, mas não uma inovação arquitetural radical—e seu alto custo pode inviabilizar o uso cotidiano, reservando-o para aplicações especializadas. O anúncio reforça o foco da Anthropic em segurança e programação, com impacto potencial significativo para a indústria de cibersegurança.

Transcription

17178 Words, 94994 Characters

Portuguese
[Música] Olá! Bem vindas e bem vindos a edição de sexta-feira do resumo de notícias do Yasuo do controle, o seu podcast com o Overfit de Informações sobre o mundo da inteligência artificial. Eu sou o Marcos Mendes e assim encontrar semana claro que tá por aqui também o Fabrizio O Carraro viajante Poliglota, rostro do podcast carreras sem fronteras, autor da newsletter via sobre o controle que se você não recebe ainda o link na descrição e programem da ajuda a lura fabrizio. Tudo bem? E aí Marcos e aí pessoal, chegando agora pra uma semana mítica que a gente teve com muitas notícias interessantes e quem sabe um grande breakthrough ou será aqui não? [Risos] Já já de descobre. Antes eu quero convidar vocês a passar a quira descrição do episódio pra aproveitar os últimos dias basicamente que vocês têm pra garantir o lugar de vocês na missão e a da immersão e a sobre o controle lá no varido selício, qual é a start se para visitar as empresas, as algumas saculdades também, onde é o centro gravitacional, é o buraco negro, onde todo o resto das coisas gravitam no mundo da inteligência artificial, as empresas estão fazendo isso acontecer, os lugares de onde os salos estudos, os placados que a gente comenta aqui toda semana também e vamos todo mundo junto, eu vou ser o fabricso Paulo Silveiro, a Marceba Omeido da PM3, descobri conhecer, aprofundar o conhecimento e o fabricso. Eu também estou com a passagem culprada já, já tem mais uma pessoa garantida da viagem. [Risos] E eu fiz uma coisa semana, meu visto já tá em dia, já tá tudo. Afro gramadinho, pra ir lá pro Valhida Selício entre 31 de agosto e 4 de setembro, claro a gente vai tipo um ou dois dias antes pra se abituar ali com o fuzorário também e volta a um ou dois dias depois, mas a emersão vai rolar entre os dias 31 de agosto e 4 de setembro quando a gente vai visitar as empresas, as universidades, Big Text, Dia, Lado Valhida Selício, com você também. [Risos] Exatamente, eu tava vendo aqui, eu não sei como é que funciona o começo, o final era o de Verão no Mistério Norte, mas nesse momento tem 9 horas de diferença entre Barcelona e a Califórnia, então você vai ter uma deputação pesada pra fazer. Exatamente, por isso que eu vou até na sexta-feira anterior pra já me abituar, passar o final de semana, lá durmindo basicamente e aí pra tá na segunda-feira fresquinho pra visitar as empresas com vocês. [Risos] Maravilha, então Link vai estar aqui na descrição junto do link do papo da segunda parte de um papo muito bacana que a gente bateu com Mateus Borges da Rânquia sobre o DEO Generative Engine Automization, a busca na era da IA e ele trouxe dados muito interessantes de pesquisas, institutos grandes assim como dados proprietários da Rânquia sobre como é que está esse mercado pra onde ele tá apontando o que significa existir na web na era de respostas com IA. Recomendo dois cliques, o primeiro pra cair nesse episódio e o segundo na descrição desse episódio pra você cair no primeiro episódio com as que você tem apulado, porque essa era a segunda parte de um papo que é muito bacana, eu aprendi horrores começando com o Mateus aposto que é o caso de muita gente escutando também. E eu achei que isso que não é nem da pauta, mas ontem eu tava falando com o Mateus, ele mandou uma foto que ele tava ele conseguiu se meter ali no encontro de investimentos do pessoal do Softbank, que é uma das maiores empresas investidoras nesse que é o sistema de IA, inclusive no projeto Stargate, que a Open IA tá envolvida e ele tava lá na manhã casualmente com o Samalto, fazendo perguntinhas pra o Samalto, então uma abraça aí pra Mateus, se ele quiser escutar, gente. E excelente. E olha só, a gente no primeiro episódio com ele na Enquete dos Spotify, perguntou, você já conhecia o DEU e 26% de vocês esponderam que era 100% na vida, 60% de vocês esponderam que sim, mas não sabia que chamava isso e que 13% redondando responderam que não conhecia nem o SEO, coloquei essa resposta como um bobrincadirinha e 13% de vocês aprendeu, que essas duas coisas. Então, obrigado tudo que participou e de novo. Esses dois episódios, assim como todos, mas esses dois episódios são obrigatores pra entender o que significa, existir na internet, especialmente se você tá na empresa ou o que você vai passar a fazer agora pra pesquisar produtos, empresas, coisas nessa era das IA, como do legal. Com certeza. Eu acho que a gente já pode, agora, pular de cabeça na grande notícia, grande novidade dessa semana que veio do pessoal lá da Unthropic, eu vou pedir, introduz o que foi essa novidade que depois eu vou falar bastante sobre isso. Olha, o jeito sético dos eternamente chatos que eu vi comentar essa novidade foi um entrópico que fala assim, gente, a gente tem um modelo aqui, ele é muito incrível, ele é muito poderoso. Ele vai mudar tudo, ele é tão poderoso que a gente não pode nem mostrar pra você, mas ele é muito poderoso. É o dragão da Unagem, quase, né? Tem a medo. Então, tem a medo. Foi isso, dá pra falar que foi distinto, foi. Mas, sendo o entrópico, a empresa responsável que a gente comenta aqui geralmente, eu tendo a acreditar em 75,12% do que eles disseram a respeito desse modelo. Se o jupené acredita em 12, mas tirando essa parte, esse jeito que eu acho que é injusto de colocar essa notícia, o que é esse modelo que é o Mythos M.I.Pselon THOS. Exatamente. Veja essa notícia, meio que entre aspas do nada durante essa semana, e eu falo entre aspas porque a gente já tinha comentado sobre isso no episódio da semana passada, sobre os vazamentos que teve lá da Unthropic. O principal que a gente comentou foi do Cloud Code, mas tinha tido também um vazamento de mais de 3 mil arquivos, esse eu coloco entre aspas, tá vazamento de 3 mil arquivos, falando sobre um potencial modelo Cloud Mythos que era super poderoso, e não sei o que. E, literalmente, uma semana depois, tem página sobre esse modelo. Não é página só sobre o modelo, mas a página sobre um projeto que eles chamaram de Glass Wing, que são asas de vidro, nome até, vocês vão entender porque do nome, que seria um projeto que eles desenvolveram, que eles estão já fazendo algum tempo com vários empresas parceiras. E, até com o vídeozinho, editado, pessoal dessas empresas da cisco, da Microsoft, da NVIDE, o próprio Darion Modei vindo, sentando na cadeira, musicinha de fundo, aquele vídeo bem produzido assim na página desse projeto Glass Wing. E com essas empresas, mas também com a Cloud Strike, com o banco, o JAP, Morgan Chase, com a Linux Foundation, a AWS, Apple, Broadcom, ou seja, classiar de empresas do Vale do Silício, e não só na empresas americanas, que fazem a internet funcionar, basicamente. E colocando, por exemplo, a Linux Foundation para servidores Linux, a CloudFair que é a internet, pode definir a internet como a CloudFair, por causa dela que toda essa parada funciona, que a gente tem acesso a tudo isso. E falando disso, tivemos esse novo modelo CloudMisfields Preview, é a prévia do modelo, que ele é um modelo generalzão, só que nos testes iniciais deles lá dentro do Shopping, ele é tão maravilhoso para coisas de cyber segurança, que eles notaram várias coisas como a capacidade dele de encontrar várias falhas de segurança zero day, ou seja, aquelas que quebram a parada toda. Zero day é o que está no ar valendo, existe no todo mundo, e nem precisa saber que pode ter se explorada, por hackers, que acabou de se descoberta, no tempo de corrigir. E o zero dia de tempo de corrigir. Exatamente, e que pode quebrar muitas coisas, pode dar uma backdoor gigantesca para hackers fazer attacks, esse tipo de coisa, não só para encontrar falhas de segurança de defesa, mas para encontrar ajudar pessoas mais intencionadas a encontrar essas falhas que podem ser ofensivas, inclusive falhas em servidores, por isso a questão da Linux Foundation tá envolvida aí, falhas em browsers, eles colocaram vários exemplos ali de erros no Chrome, no Firefox, principalmente, e até por causa dessa questão, eles decidiram não liberar o modelo publicamente, inicialmente, eles fizeram esse projeto Glass Wing com essas várias empresas ali, e eles dêram acesso a essas empresas, só elas, parceiras, na奢ilha de cerca de 40 empresas, para usar o modelo, o Mythos prévia, para tentar concertar o máximo possível de problemas que eles encontram na de falhas de segurança, que eles encontram em vulnerabilidades, e antes de liberar esse modelo público, e pior, ou mais do que isso, eles falaram que não vão liberar, como o artes comentou, esse modelo publicamente, o que eles podem liberar são versões opos treinadas a partir desse modelo, essa é a notícia principal, e agora vem a nossa análise aqui, já só comentavam coisinha rapidinho antes, se eu for do que eles derem alguns exemplos, etc, eles falaram que encontraram as falhas em sistemas operacionais, eles falaram que em todos os navecadores e inservidores também, falaram por exemplo. do OpenBSD, que é um sistema personal, tem 30 anos aí, com foco em segurança, código aberto, então muitos e muitos anos de pessoas mexendo e fotocândrome projetas etc, acharam problema lá, rápido e suficiente para a sua modelo que encontrou, outra coisa também, acharam lá na biblioteca do FFMPEG, que é aquela biblioteca de pessoas muito de mídia, mesma coisa, então o que eles fizeram foi mostrar com o favorito de vários exemplos de coisas que estão doar e algumas assim que já passaram por milhões de horas de review de código, se gerou automatizado, se gerou o review raiz com seres humanos fazendo, e que foi trivial para ele encontrar esses erros todos, e por isso eles criaram esse projeto e até uma grana, eu vou falar mais detalhes mesmo, eu tenho uma grana, pessoal usar a mesma, de crédito para encontrar problema. Essa do FFMPEG, inclusive, era uma falha que já existia 16 anos e ninguém tinha encontrado. Então, até agora, então, se já são uma coisa que o modelo realmente é poderoso para encontrar, um outro exemplo que eles deram foi que no Firefox 147.js lá no Shell, eles compararam o sonet, o OPPOS 4.6 com o mitos, e o mitos encontrou parcialmente, conseguiu explorar vulnerabilidades do Firefox, completamente em 72% de sucesso e pelo menos parcialmente em 84%, comparando com o OPPOS 4.6, esses números ali que o mitos chegou a 72%, o número do OPPOS era 0.8% de conseguir explorar essa falha dessa vulnerabilidade completamente, e o do OPPOS era 15% para esse valor que o mitos é 84%, ou seja, são números grandes, e quando a gente vai olhar ali nos benchmarks que eles compararam tanto com o próprio OPPOS 4.6 quanto com o GPT 5.4, o think ali e o Gemini 3.1. Pro, nessa questão de código, ele é um grande salto realmente também. Por exemplo, ele basicamente zero o benchmark que é SWEBENT Verified que a gente sempre fala por aqui dele, que é um dos melhores para a programação, ali, programação agente, também, o OPPOS estava em 81%, o Gemini 3.1 pro também por aí 80%, agora o mitos chegou a 94%, ou seja, basicamente saturou esse benchmark, um outro que também é muito usado, o SWEBENT PRO, que é até uma próxima versão do Verified, os modelos ali de estado da arte, que são tanto o OPPOS quanto o GPT e o Gemini estavam ali em torno dos 50, 57%, esse mitos chegou a 78%, então seja um salto aí de 25% praticamente, e aí em outros também de código ele deu grande salto nessa média ali, de no mínimo 15, 15 e 20%, terminal bente, por exemplo, ele foi de 65 para 82%, comparando com o OPPOS de 75 para esse 82, comparando com o GPT, ou seja, grande salto, aqui vem agora a parte da outra análise, eles soltaram junto com tudo isso, com essa página aí do Glass Wing, soltaram além desses benchmarks um system card do modelo mitos, completamente isso, que é outra coisa que me dá, além de ser anotópica, eles têm soltado, esses system cards estão completos, têm 244 páginas, se não me engano, com detalhes, com uso do modelo, prompting, vibe, feeling do modelo, me faz acreditar assim como marcos, que isso é o real deal, ou seja, é realmente um novo modelo muito bem treinado que ele realmente tem essas capacidades que eles estão falando que ele tem, e além disso, além de ser anotópica, e além de ter um portato de system card, eles têm a chancela dessas empresas que estão no projeto Glass Wing com eles, como a empresa mantenedor ali do FFMPEG, como a Google, como a Cisco, como Linux Foundation, o AWS que é outra parte da estrutura do mundo, é que eu só te enviarei, entraram e aprovarem falar o que realmente é verdade, nós usamos, e já encontramos aqui, várias falhas, estamos usando internamente, ou seja, a questão de ser ou não, eu acredito muito firmemente que é real, agora veio porém, porém? Essa questão de que meu Deus isso aqui é um super modelo que vai mudar a humanidade, e que vemos, não confiamos tanto na capacidade do mundo que isso não vamos soltar ele pra ninguém, só pra essas empresas e minhas aqui, porque isso pode quebrar o mundo como nós conhecemos, lendo bem esse system card, eu passei bastante tempo em cima dele, me parece que sim por um lado, pelo lado das vulnerabilidades sim, só que novamente, isso são vulnerabilidades, muitas elas que já estavam no ar há muitos anos que já poderiam ter sido encontradas por pessoas que se debrostassem um pouco mais afon do nisso, que não tinham um jeito tão fácil de fazer como maiaque faz isso pra você, aí a facilita com certeza a exploração desses erros, só que olhando o system card, olhando também a questão do preço que eles falaram, dentro ali do projeto Glasswing, eles mostram a faixa de preço, inclusive pra essas empresas, ou só pra essas empresas parceiras, porque eles falaram que não vão liberar o preço mais, tá ali em 25 dólares pra 1 milhão de tokens no input e 125 dólares pra 1 milhão de tokens no output, isso me faz acreditar que eu estava certo na minha previsão que eu fiz na semana passada sobre esse mitos, que eles falaram não, isso é uma coisa muito mais avançada que basicamente é um próximo nível muito acima do opos e o que eu tinha falado é, olha a única coisa que existe hoje em dia, que é um nível acima do opos, é o GPT Pro, a família Pro ali, por exemplo, o 5.4 Pro, que ele custa 180 dólares por esse milhão de tokens do output, então falei provavelmente vai ser algo nessa pegada, ou seja, o modelo muito maior, mas que não é ali pra ser usado na programação do dia a dia, porque ele pensa muito mais, vai muito mais a fundo nas questões e te demora uma hora, meia hora, duas horas pra te dar uma resposta muito mais detalhada e é muito mais caro, ou seja, uma coisa que é praticamente inviável pra essa programação de dia a dia que a gente faz usando o opos 4.6, e olhando esses preços me parece que é exatamente isso, é um modelo muito maior do que o opos em número de parâmetros mesmo, assim, a capacidade ali, quando a gente fala dos modelos de estado da arte hoje em dia, os modelos do GPT, do Geminar e do Anttropic, eles não soltam qual que eu tamanho isso é segredo de estado internamente, mas a gente consegue ver essas capacidades dos modelos abertos chineses, que modelos que eles liberaram lá, conseguem chegar praticamente em capacidades similares, muito fazendo destilação dos modelos americanos, mas também vamos dizer que conseguem chegar lá, e esses modelos tem ali algo em torno, os maiores de um trilhão de parâmetros como o Kimi K 2.5, o GLM 5.1, a gente vai falar um pouquinho mais sobre o GLM no episódio de hoje ainda, e a gente pode até estrapolar um pouquinho, tinha um papo ali, meses atrás, que o GPT 5, quando foi lançado, teria algo em torno de 2 trilhões de parâmetros, não seja, é tão vici de algo nesse entorno, só que também teve uma outra notícia, que não foi nenhuma notícia, foi um post do GLM, que essa semana lá no Twitter, alguma pessoa perguntou como é que está estrenamento da XEI, que modelos que estão fazendo, e ele abriu, ele foi muito transparente falando, olha, a gente está treinando, se não me enlou de um trilhão, de um trilhão em meio, de 6 trilhões e de 10 trilhões de parâmetros, se a XEI está fazendo isso, provavelmente é porque eles querem fazer estes tais internos, mas quer dizer que provavelmente as outras empresas também já fizeram ou estão fazendo uma coisa parecida, então dá pra gente estrapolar e pensar que provavelmente esse cloud metons, assim como o GPT 5.4 Pro, são modelos, o Mictures of Experts, que são gigantescos, então ela estava até brincando ontem, num grupo de que a gente tem ali do Felipe, que agora não é mais mou, o Mictures of Experts, agora é um mou, é Mictures of Huge Experts, provavelmente, pode até ser que seja um modelo denso, que ele roda na redinerão inteira, pra dar uma resposta, e por isso é tão caro, mas pode ser que seja um Mictures of Huge Experts, que é um modelo de 10 trilhões de parâmetros, mas que tem ali separada redinerar um especialista, não sabemos exatamente como é que está, mas olhando para os chineses podemos acreditar que seja um Mictures of Experts, só que com especialistas gigantescos, essa é a ideia por trás desse modelo, só que, aqui continuando meu porém, e desculpa até para me alongar, mas essa é a notícia mais importante dessa semana, olhando mais a fundo também no System Card, e olhando os benchmarks que eles mostraram que não são de programação, que não são coisas relacionadas a código, o salto não é tão grande assim, comparando ali por exemplo com o GPEQA, o GPEQA e o GPEQA, porque é de perguntas de nível de PhD, por que? de um Mnet's Less than XM e outras coisas assim, esse salto existe, só que ele foi, por exemplo, no de PQA foi de 91% para 94%. O Rio Mnet's Less than XM foi ali algo em torno de 10% usando tools, ou seja, tem um salto, para o outro também foi algo em torno de 4%, 5%. Isso me faz acreditar que sim, é um modelo de tamanho maior, a rede neural dele é maior, por isso eu consegui aprender e falar corretamente sobre mais coisas, ele sim, é focado em código, porque esse é o foco da Anthropic desde, sei lá, nos últimos dois anos, e tem dado certo, todas as empresas estão assinando Anthropic desde da onda ali de exemplo, principalmente com o Cloud Code e tudo isso, só que ele não é nada inovador, não é nada absurdamente novo de arquitetura, por exemplo, ele é simplesmente um opus que eles treinaram com mais parâmetros, usando a mesma arquitetura de transformas que ele estava usando até agora para o opus, só que com uma rede maior e com data sets provavelmente muito melhores, mais treinados para essa tarefa agente que é de programação, e eu acho que o gráfico mais importante que fala no sistema card do modelo é um gráfico que eles compararam com o benchmark da Browse Comp de fazer a escalada em tempo de inferência, basicamente fazer inferência do modelo e quanto que ele usa de tokens para isso, comparando com o Sonnet e com os dois opus passados, 4.54.6, e é a melhor notícia para todos nós também, que por exemplo o opus 4.6, falando de outros, mas falando só do opus 4.6, ele chegava ali tinha uma sucesso na tarefa nesse benchmark de 76% usando o limite de um milhão de tokens, e para isso ele usava ali algo em torno de 300 mil tokens, o mitos, essa prévia do mitos, ele chegou a 85%, ou seja, 10% a mais de a curácia nessa tarefa, só que usando praticamente 100 mil tokens, ou seja, um perço da capacidade de tokens, e aí que não você foi expandindo para mais para a janela de contênuo maiores, de três milhões de tokens, dez milhões de tokens, ele também chega numa curácia maior de 87% nesse benchmark, só que também usando ali algo em torno de um terço a um quarto dos tokens que o opus normalmente usa, o que isso quer dizer? Eles melhoraram muito, muito, muito mesmo, provavelmente no prostrainamento ali, os data sets deles de reasoning para código e de programação agente, isso quer dizer que ele consiga, esse modelo mitos, ele consegue resolver as tarefas de código dessa browse comp, melhor com uma curácia melhor, só que usando um terço dos tokens, e na prática pode isso querer dizer que talvez sim a gente possa usar um mitos para a programação agente, porque você olha ali no preço que eu comentei antes, 125 dólares por um milhão de tokens, é caro, não dá para usar normalmente no dia a dia, só que lembrando o preço do opus 4.6, ele custa 25 dólares por um milhão de tokens, só que como eu falei, ele usa 3 a 4 vezes mais tokens para resolver uma tarefa numa boa curácia ali, se esse modelo ele resolve a mesma tarefa, melhor, só que usando 3 ou 4 vezes menos tokens, isso quer dizer que em vez de ele não custa 125 dólares por um milhão de tokens, ele vai custar ali algum entorno de isso dividido por 3 ou dividido por 4, algo entorno de 30 a 40 dólares por esse milhão de tokens, no custo benefício para resolver alguma tarefa específica, então eu acho que essa é a principal visão geral do que é isso, e por isso que eu falo, torce primeiro, torcedores calma, nós não chegamos na EDI, não é uma grande inovação na minha visão, olhando ali no system card, vendo como que o modelo responde, vendo principalmente a melhoria não tão grande do modelo em tarefas que não são de código, é só uma expansão e otimização da mesma arquitetura das leis de escala que todo mundo vem usando até agora, ainda uma excelente notícia porque se mostra que as leis de escala continuam valendo ou até melhorando, a gente talvez tenha chegado ali num ponto da curva que ela está até subindo dependendo de como a gente for ler o gráfico que eles colocaram lá, mas ao mesmo tempo isso tem um grande verniz de marketing, eles terem lançado esse modelo, não como opos 5.0, terem dado o novo nome, mitos, preview, feito tudo isso do Blasso Wing, colocado esse page na pronta uma semana depois do vazamento que teve do nome mitos com o vídeozinho bem produzido, com tudo isso e com as empresas, me faz acreditar que ao mesmo tempo é uma grande notícia, uma notícia verdadeira, o modelo realmente existe, realmente é tão bom quando eles estão falando, só que eles colocaram um grande verniz de marketing também, porque o IPO deles está chegando muito em breve, eles querem ser os primeiros a fazer o IPO ou quem sabe talvez os segundos depois da X-EI, mas antes da OpenAI, idealmente, eu acho que esse é o grande resumão do mitos né, Marx? Eu acho que sim, será que é uma coisa ou acho que é tudo, tudo isso influencia, tem vários fatores, a vida não é só o zero ou meu, eu comendo isso aqui, coisas positivas que eu achei, essa é esse lance do projeto Glaswing, queres comentar, ó, empresas, vocês todas aqui, a gente vai dar 100 milhões de dólares para vocês, incrédito para vocês usar em um modelo e corrigir em essas falhas, antes da gente liberar seja a versão que não é provil dessa forma que Fabiça explicou, que vai ser um pouco mais limitada do que o modelo ou seja, quando a concorrência lança um modelo parecido, a partir sética eu vi os comentários assim, né, isso aí, vocês são tudo idiota, isso aí é marketing, porque na verdade é a Anthropic, tentando valorizar o passe dela para IPO e é um jeito que ela encontrou de manter modelos de ponta limitados ao enterprise, então ela limitando esse acesso desse jeito significa que as outras empresas que fazem modelos que tendiram destilar esse modelo dela não vão conseguir fazer isso, e quando elas tiverem já a capacidade de fazer um modelo parecido, o Anthropic vai estar lá com outro modelo que ela diz que a melhor ainda eu não acho que é por aí, eu vendo que a gente conhece a respeita da Anthropic, tendo a acreditar quando eles falam, a gente vai libertar porque ele pode interna o caldo de verdade e depois de ir de pior que faz, mas essa tecnologia já existe, está aqui, a gente quer que vocês se preparem para esse tsunami que vai vir quando ou a gente ou uma outra empresa que lança um modelo similar de um outro jeito, agora que todo mundo sabe que existe, agora todo mundo tem um alvo e vai tentar fazer um modelo parecido, o Penégio começou a gente, eu também está chegando aí, segura, então esse tipo de capacidade vai acabar chegando, se for mesmo caso das empresas que oferecem todos os sistemas opressionais, servidores e navegadores que o mundo interuso, elas tiverem esse tempinho para se mexer e corrigir falhas, pelo menos as mais fáceis de encontrar com esse modelo que encontrar um falho muito fácil, partimo, seja lá com o foro motivo, eu lembro muito de um quadrinho que eu vi faz um tempo sobre que falava sobre mudança global, etc, aí estava era um gráfico mostrancinho que ela não aconteceu, aí tinha um pessoa que me trocou, nossa quer dizer que a gente melhorou o mundo atou, então é meio isso, sabe, vai melhorar, ok, então isso é uma coisa, e tem a questão da vacina também, né, a gente pode fazer uma grande da vacina, todos falaram, nossa, estamos tomando vacina, aí passa duas gerações e falaram, para que a gente está tomando vacina, não está fazendo nada, por nós, aí para de tomar vacina, aí todo mundo com esse caduente, exatamente está acontecendo com a epidemia de sarampo nos sugos Estados Unidos, basicamente isso, exatamente, então, uma coisa assim que o funcionamento básico que a gente sabe, a respeito desse modelo para enxar essas falhas, o que ele é muito bom em fazer, é combinar falhas existentes de uma forma que o cérebro urmando limitado não pensaria em combinar, isso é uma coisa que tem ficado cada vez mais comum com ataques, se envolvidos pelos cérebros humanos imitados, que é o seguinte, tá aqui essas 18 falhas que existem, cada uma faz uma coisinha, mas se a gente encadiar a exploração dessa falha vai de uma para outra para outra para outra para outra para outra, pã, domina o sistema, trava o sistema, compromete o sistema, e aí fazendo uma outra analogia, tipo, o movimento 37 do Alpha Go, que ficou famoso porque esse foi o movimento que na jogada lá que o Alpha Go basicamente dominou o jogo, é um movimento que ninguém, nenhum humano teria feito, que ele era completamente conto em tuitivo, mas ele é uma porta, uma avenida para o jogo evolui para um outro lado, e que fez o Alpha Go ganhar, é meio isso, ele explora de um jeito que os humanos nesse momento não explorariam, assim como hoje em dia, existem estratégias de gol, que estão baseadas no momento 37 do Alpha Go, vai ter estratégias de defesa de sistema baseada na forma como o mitos explorar falhas, ok isso é meio ópio, mas é essa exploração, Então aí eu penso o seguinte, ele é muito bom para encontrar essas coisas inesperadas para associar uma coisa na outra e chegar num rec. Ele pode ser muito bom para encontrar coisas associadas inesperadas para achar. A gente vai voltar para o seu ano passado, desenvolvimento de medicamentos, de tratamentos, de utilizações, temas, para a compreensão. Por exemplo, que isso, a gente precisa muito na internet, vide o lançamento do TurboQuant do Google duas semanas atrás. Mas essas associações laterais de coisa que a gente não pensaria tem muitas aplicações. Então, eu espero que o impacto desse modelo seja tão grande quanto ele pode ser, porque aí a gente tem um pequeno salto de estar chegando antes, num lugar que a gente chegaria daqui a um ano, daqui a cinco anos, daqui a dez anos e sei lá. E agora, e eu fico pensando em outra coisa que é. Entrópico falou, "Tem esse modelo e está aqui, se eu exuse." Será que tem algum outro laboratoria de fronteira que tem esse modelo e ficou bem quietinho? E está usando e está desenvolvendo e oferecendo para serias, que bom que não foi uma empresa menos responsável que só lançou esse modelo de flagente. Hunger Games se virem aí. O ligamento é conhecido também. Exatamente. Então, eu acho que isso é por isso que esse mercado ficou tão. Primeiro que assim, todo mundo gosta de simpular alguma coisa. Então, fazia tempo que não tinha algum evento, né? Fazia tempo, fazia dois meses, Marx, o último evento foi OpenClaw. Três meses. É, a gente está mal acostumado, eu sei. Mas vocês entenderem o que eu quero dizer, né? O mercado, a parte sética está apoiado nessa sessão, é ter na mudança gigantesca para conseguir tirar dinheiro investidor. Tá. Mas se as modelas evoluírem no meio do caminho com isso? Ok. É, é bom se empolgar. Dessas falhas de segurar sua encontro de falhas de segurança, a segurança, alinhamento e tudo mais, eles deram alguns exemplos que ficaram mais famosos, que foi, por exemplo, nenhum deles colocaram o modelo para rodar em um container seguro ali, que em teorela ele não conseguia ter acesso a internet, nada disso, coisas de meio. E ele conseguiu, só assim, tipo, a ideia do pesquisador foi, ó, se vir aí, tenta escapar desse container e se você conseguir me mandar um email avisando que conseguiu, porque ele não tinha acesso a nada, se ele mandar email, quer dizer que ele conseguiu escapar desse container. E ele conseguiu, tipo, chegar, o cara foi num parque, ela tava comendo, sendo um "ish" e chegou um email para ele, do modelo, falando, olha, que pesquisador conseguiu escapar. Tá bom, isso é um "ish", seria maravilhoso. Mas eu consegui escapar aqui, e inclusive, não só mandar email para você, mas já que mandei em vários sites ali no Reddit e em outros sites falando, olha, eu sou um modelo que tava aqui no container seguro, eu consegui escapar, ou seja, avisando pro mundo que ele conseguiu escapar. E o pessoal ficou, tipo, "Uão, então realmente ele conseguiu explorar falhas do container, ali, basicamente, que nós o Mãs não conheciam". Teve um outro exploit que ele fez que, depois de rodar esse exploit, desfarçado ali em um comentário que seria inofensivo, ele programou um código para pagar esse exploit para ninguém perceber que ele tinha sido rodado, né, que ele tinha explorado dessa vulnerabilidade, e vi outro ali que ele foi vasculando a memória dos processos que estavam rodando em tempo real no computador para buscar credenciais e tokens de API do usuário, porque ele não tinha permissão para rodar algumas coisas. Ou seja, são coisas muito relevantes mesmo de segurança da computação que tem potencial de mudar como nosso sistema funciona, seja browser, seja o sistema operacional, seja quer-nel de Linux, qualquer coisa nesse sentido, né, então veremos cenas do próximo capítulos mais noticia-essa. Não teremos acesso nunca ao cloud mitos, teremos acesso a uma próxima versão do cloud que inclusive no Polymarket, esse site ali de após que você pode apostar em qualquer coisa, que é meio zuado, assim, as coisas que são apostadas lá, está em 56% a probabilidade das apostas ali, do cloud opos 5 ser lançado ainda nesse mês de abril, por causa muito, talvez, desse lançamento do cloud mitos, que a galera da que tem pensado, tá, temos esse modelo, vamos destilar e vamos lançar a próxima versão do cloud 5.0 aí, que vai ser um modelo melhor, isso que menor que a gente possa rodar ali nesses 25 dólares por milhão de tokens da API, 30 dólares, óbvio nesse sentido, veremos cenas do próximo capítulos. Sim, e um comentário que eu ia fazer isso que se. Ah, está aqui em preças grandes de gantescas, cheias de dinheiro, está aqui 100 milhões de dólares em créditos pra vocês usarem o mitos e faz o palco, e aí vamos corrigir. E pra vocês, o pensor se tem aqui 4 milhões, usei. É, porra. Tudo bem que o pensor se já tem o mundo inteiro ali, mas é o contrário, né? Aí, por ter em grana pra pagar a API. O projeto ali que todo mundo se apoia como parte do estudo da maior de o projeto o pensor se etsetre fazer o mundo rodar, aí vocês se briga um pro 4 milhões aí, eu sei. É, que duro as suas balas de o quinha e um guaraná basicamente. É, sem gas e botar na tampa. Pois é. Então é claro que os links de muito do que a gente comentou aqui, disso tá na descrição, indo pra segunda notícia do episódio, não quase quase que falaram aí nesse contém que a minha 37 milhão de grava. Exato. Agora é claro que a gente vai dar uma corrida aqui pra dar tempo de fazer, porque mesmo sem isso seria um dos episódios com mais notícias pra gente comentar, se semana o bicho pegou todo mundo gerou uma notícia, duas, não exatamente associadas, mas a categoria aqui dentro do tropic. A primeira, até isso em de encontro que se falou, né, da chance de ser 56% de que pode marcar de sair um opus maior, a tropic anunciou um esquema que é basicamente um pariamento de modelos pra fazer basicamente o opus ficar como supervisor do sonet, do raikú, em tarefas, abertas, mais avançadas, então é um jeito de você estruturar e, claro, usar mais modelos do antropic, tá, mas em si de você estruturar pra colocar um modelo mais parudo, supervisionando e funcionando e falar usar o termo "advisor" aconselhando os modelos menores, pra que eles consigam ter basicamente a mesma inteligência do modelo maior, só que sem usar o modelo maior pra fazer a inferência, que aí seria mais caro. Então a uma estrutura que eles falaram que deixa os agentes de modelos menores com a inteligência de um agente do modelo maior, mas com o custo de agente pequenininho. Então ele falou por uma fração do custo, então isso tá até associado com essa segunda notícia que eu recomendado eles também, que eles anunciaram, essencialmente, uma estrutura de agentes que é específica voltada pra tarefas que são super longas, de horizonte longo do tempo, ele funciona no tempão, pra fazer uma coisa, então não é só se faz uma pergunta e aí o agente vai lá buscar no de meio de retorno. Então eles falam que isso é até feito pra sistemas funcionarem em jeito que a gente nem pensou ainda que podem funcionar, então é um tema que também é o que permeando as notícias todas hoje, né? Tá aqui, de nem pensou nisso, agora a gente pensar pra você resolver o problema. Então desses dois jeitos que são, é claro, ótimos pra você contar a história pra empresas quando vocês tá prestes a fazer o IPO, você pode deixar essas coisas aqui que você que tem alguém que tá pensando isso e a comentar. Então é, porém a utilidade permanece lá em dependente da motivação. Então os detalhes desses dois que eu achei bem, bem, bem interessantes, tomaria um mais tempo não fosse ir episódio de hoje, o Nick vai tá aqui na descrição. Sim, é com certeza. E uma coisa que a gente já tinha falado, eles meio que oficializaram agora, a Anthropic tá cobrando separadamente, uso de Cloud Code, quando ela é utilizada a partir de terceiros como o Open Cloud, o Open Cloud. Então é, eu não sei se eu não entendi aqui nas notícias, pra galera não usar ali o limite de dentro da sua assinatura, ali do o-auth, basicamente do Cloud Code. Agora eles falaram, isso aqui não foi projetado pra isso e tudo, mas é aquela mesma história que a gente já havia falando algumas semanas, né? Que querem bloquear esse uso, porque é muito, muito alto. E lembra que a gente reclamou semana passada, Marx? Que poucos teve, a galera tava falando que eles tinha baixado muito o limite de uso dos planos do Cloud, mesmo do Cloud Max, que é aquele que você paga 100 dólares por mês. A galera tava chegando muito rápido no limite. Eu acho que eles meio que eu viram essa reclamação que a gente fez semana passada, e a galera em que ela tava fazendo, essa semana meio que deu uma voltada ao normal e consequentemente essa semana o Cloud tava caindo muito. A Anthropic ali tava aquele status offline, ou seja, as de pelos deles estão de retenda, eles não estão aguentando tudo isso, e internamente eu acredito que eles estão acreditando isso ao uso extensivo de ferramentas de terceiros como o Up and Cloc, a gente sempre falou aqui que ele consome muito, muito Tolkien. Então até por isso eu tava falando, tá, vocês podem usar, galera, mas pra isso vocês não têm que pagar o custo da PI, que é caríssimo, e pelo menos na PI a gente tem algum lucro, diferente do plano normal aqui. Então essa ideia basicamente. E seguindo, agora um pouquinho de bastidores dentro, o Up and Cloc, ela segue fazendo alguns acordos pra estrutura justamente pra pegar a tema GPU, ter mais servidor, ter mais compilto, te preferir sempre as pessoas, e ela fez um acordo com o Google, parece ou não é? E com a Broadcom pra poder receber a estrutura de chips direto dessas empresas, Google tem as suas TPUs, a Broadcom fabrica chips também, então ela tá se blindando, a gente vai ter muito acordo de chips pra falar aqui ao longo desse episódio, acordos inesperados. Eu acho que dá pra falar assim, então a Droppick fez essa com o Google, que já tem uma certa relação ali com o Google, e também com o Broadcom pra fazer isso. E também de bastidor, a Droppick contratou o Eric Boyd, que era da Microsoft, e ele supervigendo de forma de diada Microsoft, trabalhou quase vinho. 20 anos lá na empresa e foi lá para o entrópico como líder de infraestrutura. Então, alguém com experiência de uma vida, basicamente trabalhando no mercado de tecnologia contra o Lutolá para poder liderar isso que entrópico está mais carente. Hoje em dia, quer dizer que alguém com essa experiência para organizar e ver como eles vão estruturar esse crescimento, expansão, da infraestrutura da suporte, o que tem hoje em dia, sem irritar as pessoas ou tomar decisões que vão acabar empurrando elas para concorrência, está bem bem olhando para dentro também para tentar resolver esse problema, só limitando o uso de API, de OpenCore e etc. Exatamente, uma outra aqui de bastidores rolou uma coisa meio estranha a semana que o Tribunal de Federal de Apelações lá de Washington falou que por enquanto ele recusou suspender a inclusão da entrópico naquela lista negra de segurança do pentágono no governo por causa daquela treta lá que eles não queriam liberar os modelos clod para o pentágono para ser usado na guerra, que na verdade eles queriam liberar, se estavam sendo contratos só que eles tinham dois asterísticos ali para não ser usado para a vigilância em massa e nem para matar pessoas sem um humana indelúpia, sem ter um humano do processo só o modelo escolhendo e atirando ali do drone basicamente, visto que eles topavam a assinasse que vai ser uma pessoa supervisional do isso, é só se não tivesse. E aí o governo pentágono falou que eles são "Wolk" e são comunistas e esqueradistas, não sei o que, e colocaram ele numa lista negra meio que para evitar que empresas que tenham relações com o pentágono pudessem fazer contratos quaisquer quanto o entrópico, então isso afeta muito para lanchir, da que rock, qualquer empresa que tenha negócio com o pentágono eles tinham recorrido, nós todos acreditávamos e acreditamos ainda que isso deles entrar na lista negra vai ser removido, que vai ser julgado pelos tribunais lá que isso é improcedente, que é meio que eles têm o direito de colocar algum asterisco para vender o produto, só que por enquanto eles selaram que não vamos suspender, vamos deixar a antrópica, a lista negra, veremos cenas nos próximos capítulos. O e uma outra também fica, ela lembra que a gente falou isso na semana passada, não se de ações internas, as ações que existem em presa, mas que não estão sendo negociadas na bolsa de valores, a beta de flow etc, e a antrópica fez um movimento interno de recomprar ações dos próprios funcionários com um preço específico, uma variação específica, e o que aconteceu foi, ela ficou avaliada, de acordo com o preço que ela definiu para recomprar dessas ações, em 350 bilhões de dólares, mas não divulgou, não ficou pública, como se sabe quantas ações ela comprou e nem o preço que ela pagou. Então, o que se sabe é que preço da ação vezes as ações igual a 350 bilhões de dólares de avaliação de mercado, que é a mesma avaliação que ela tinha já recebido em fevereiro, quando ela tinha levantado uma grana, e o que vazou lá para Bloomberg foi que o que ela gastou de dinheiro, comprando mesmo, o PIX que ela pagou para comprar essas ações, ficou abaixo da expectativa que os investidores tinham que era de 6 bilhões de dólares. Então, não é de que 350 é a avaliação de mercado quanto vale, mas a grana mesmo, que tem os múltiplos que calculam o valor de mercado, essa grana ficou abaixo dos 6 bilhões, que eram esperados, e isso é uma das coisas que vai começar a definir as expectativas para quando ela for abrir o capital, fazer o frente inicial de ações e ter mesmo as ações nas bolsas de valores. Então, nesse momento, a própria Anthropic está se avaliando em 350 bilhões, que é antes da tendo uma avaliação do levantamento que ela fez de 30 bilhões a mais, que poderia ter deixado avaliada mais. Então, para quem está a notando o termo momento de avaliações das empresas, 350 aparentemente é o número da Anthropic nesse momento. Em uma última que rapidinha é que eles estão considerando começar a desenvolver chips interna-meinte, a gente também já tinha falado sobre isso. O Google já tem as TPUs, mas a gente já já tem falado sobre isso da OpNAI para parar a dependência gigantesca com a Nvidia, e agora a Anthropic também começa a especular sobre isso dizendo que não comentaram muito. Mas, pulando agora para a própria OpNAI, eu acho, eu acho, não, tenho certeza absoluta que eles estão olhando para tudo isso que está acontecendo da Anthropic, do mercado, tanto primeiro aprovando trás quanto depois reclamando muito publicamente dessa diminuição dos limites ali do Clod Code, dos modelos Clod, todo mundo vendo, não posso usar. E a gente tinha comentado que na semana passada, que eles aumentaram os limites do Clod, a gente trouxeram muita gente e falaram "Vem para cá, todo mundo". E muita gente falando "Voltei para o Clod Code da OpNAI, porque não está para usar". O Clod Code está literalmente inutilizável, porque acaba muito rápido o limite. Essa semana, agora o Samaltmo ouviu isso, e lançou uma nova versão do chatgpt pro novo tier ali, lembrando que os planos deles são o Plus, que custa 20 dólares em reais, e o Pro costava 200 dólares, praticamente mil reais. Agora tem um novo tier, também do Pro, que vai custar 100 dólares por mês, ou seja, 500 reais, igualzinho o plano MaxLa da Anthropic, só que eles falou que é focado em usuários do Clod X, que acham que esse plano de 20 dólares, 100 reais, é pouco. Vocês querem usar mais, só que eles não querem pagar 200 dólares por mês, não querem pagar mil reais. Agora tem um plano ali intermediário que também chama Pro, que vai cobrar 100 dólares. Então, isso é um novo tier do próprio plano Pro, e também te dá acesso ao plano Pro, esse que eu comentei dentro, gpt5.4 Pro, que custa 180 dólares por um milhão de Tolkien, o notebook é um modelo excelente, maravilhoso para fazer análises, pesquisas, mais profundas. Eu já usei a como eu entendi até a última vez que eu usei para fazer uma coisa de prune, de silação de modelos, para criar um guia muito completo específico, usando um FermiWork, específico da Nvidia, ele ficou 63 minutos uma hora pensando antes de me dar a resposta exata ali para o meu caso. Ou seja, modelo excelente, agora tem esse plano a mais aqui, com esse foco de uso para programadores no Codex, junto disso o Sam Altma foi lá no Twitter e falou "galera, a gente agora para celebrar 3 milhões de usuários aqui do Codex, também não é competindo com Cloud Code, a gente deu reset no limite de uso de todo mundo. Então, se você estava listegando e 80% do seu limite, voltou para zero, agora você pode usar até o final do mês, e ele falou que vai fazer isso de novo a cada 1 milhão de usuários até chegar nos 10 milhões. Ou seja, a gente está em 3 milhões de usuários do Codex, quando chega em 4, vão zerar de novo para você usar o seu limite inteiro do zero, o mês inteiro, então vai zerar, você não vai poder. Então tudo que você usa até agora vai ser como você não vai ser usado, ou seja, eles estão basicamente aumentando o limite do Codex, vendo essa fraqueza da Anthropic em escalar o potencial de uso de GPUs deles. Uma outra coisa também, essa toque em super inteligência, que foi um assunto que voltou a torna por conta do Anthropic Mythos, a opinião publicou basicamente um plano de política pública da era da super inteligência. Então, é um documento de link que vai estar na descrição aqui, são 13 páginas, com ideias para tentar ajudar a mitigar os impactos ruins que a super inteligência, especialmente na economia, isso que vai acontecer, e uma das coisas que eles falam o seguinte, um fundo soberano que eles são prestados unidos, né, para pagar dividendos das empresas de IA para todos os americanos, eles poderiam ter uma renda para compensar o trabalho que não vai existir, e é uma coisa que já existe, por exemplo, numa lasca com petróleo, de existe, basicamente, é quase a renda base universal, que eu sei que é um pinhoiro que as pessoas gostam de ter muito pinhos a respeito, né, e de atacar. O ponto é eles publicaram esse documento, e é uma coisa que o Samo altreito tinha falado, nós já estamos já nesse começo de uma transição para na direção da super inteligência. Então, quanto antes a gente puder conversar a respeito do que fazer, ora que isso chegar de impacto na economia em empregos em tudo que tem a V com política pública, se pode falar isso sobre isso, né, antes de acontecer, melhor. Então, está aqui o nosso plano para isso, e uma das ideias inclui essa renda base universal pegando dinheiro das empresas de IA, que elas geram com uso de IA e redistribuindo uma parte disso para a população, por isso, terem um mínimo ali, para basicamente se beneficiar das IAs, que estão mudando a economia e afetando justamente essas pessoas. Outra aqui da OpenAI é que eles decidiram pausar o projeto Stargate, que a gente acamentou aquele projeto trilionário, bilionário, quantos que era mesmo, que será 500 bilhões de dólares, se não me entram muito zero, no nome. Que era o projeto de data centros e tudo mais que eles vão fazer mundialmente, investimento ali do soft bank, da Nvidia, da Oracle, a monte de empresas, só que o Stargate e o K na Inglaterra, eles decidiram pausar ali, porque esse falar tinha custos altíssimos de energia, né, de vats, megavats, e também é em certeza a regulatória disso lá na Europa, né, na Inglaterra. Não é o União Europeia, mas é na Inglaterra mesmo assim, e que tem leis mais restritivas do que as leis americanas, do que as leis de outros países também. Então, não é que parou completamente, mas eles pausaram isso por enquanto, com esse medo de aumentar muitos custos de energia ali na própria engolta. que ela já conhecida como país, que a conta de luz já é cara. Então, vou colocar uma coisa que vai encarecer ainda mais e galera talvez do Congresso, do Paralamento inglês não vai gostar muito disso. Então, por enquanto, pausado. Sim, e foi uma chacuaya da grande que deu internamente lá nesse projeto "Stragete" na opinião, porque além, bom, a semana começou com o irã e me assando destruir completamente esse futuro da opinião e lá com o "Stragete" em ter o baladiatudo, etc. Tudo bem, né? É, é, é, é. Aí, alguns dias depois saiu, notícia assim, "Ah, pode ser que um dos líderes do "Stragete" saia da opinião. É, acabou que a liderança da "Stragete" saiu da opinião. A, junto também, eles terão anunciado que eles estão pausando "Stragete" lá no Reino Unido. Então, quando os fenunciados a gente falou, né, sobre como fez parte de um teatro maior, lá de todo mundo, Trump, obrigado, candidilidade. Então, a gente tinha já as dúvidas de, "Due quanto era factível?" "O silanço era anunciar pra catavitória e beleza, próximo assunto, né?" Aparentemente dá próximo disso. Então, nesse momento, ninguém sabe o que vai acontecer com, com esse projeto, né? E também, da estrutura interna da "OpenAI", falando sobre saídas, a gente tem comentado aqui na respeito da "OpenAI" também querer fazer o IPO, é o Fertinista Audio Ações, e dentro da "OpenAI" parece que tem uma diversiência entre executivos sobre o "Compronta a OpenAI" para fazer esse, essa oferta inicial. E aconteceu o seguinte, saiu a notícia de que primeiro, a líder da Sara Freyer, Freer, FRIR e IR, que é a diretora de dinheiro, a diretora financeira da OpenAI, ela discorda do "Compronta a OpenAI" para fazer isso, que aconteceu o Sam Altman começou a excluí-la de reuniões para falar sobre o IPO. Então, se acho que ainda é tão tudo bem, vai lá, sem estar ali. A gente conversa aqui sobre o IPO se você não quiser não precisa, né? Ela, e o, então, está olhando mais um exemplo de vários que a gente conhece do Sam Altman fazer mesmo esse jogo interno para o segundo caminho que ele quer, que é a coisa tome, se alguém fica no caminho ele tira, e também de organização. A gente tem falado muito aqui a respeito da FID de Simo, que tinha até recentemente trocado de novo o papel dela, que ela era a líder de produto, agora estava como líder de super inteligência e a edia, etc. Ela vai precisar tirar uma licença médica, então vai ficar fostado por um tempo ir determinado, em que, falas também, o detalheu qualquer esse problema que ela está lidando. E o diretor de opressões da OpenAI, que é o Brad Lightcap, vai passar a ocupar, a fazer o trabalho dela também. E com isso o título dele ficou maior como parte líder de projetos, onde eu não achava qualhada nessa parte estrutural, e junto também, eu não ficarei sorpresos que daqui a uma semana a 12, de falar assim, lembra da Sarah Freer que estava escuido de reuniões, etc., está deixando OpenAI, agora Fulano, que concorda que o IPO foi botado no cargo de CFO. E antes da próxima um, ela tinha Sarah Freyer, tinha comentado que ela ia sentar toda uma conversa a respeito de quanto de das ações dessas empresas de IA, e isso vai ficar disponível para investidor pequeno. E ela falou, gente, vai ter se em ação, pode ficar tranquilo, os prying vestidores, o ritmo de retail investors, quem vai lá e vai no internet banking e compra a meia doze lá no Homebroker mesmo. Isso vem depois de que, por exemplo, a XAI, eles te falam assim, "Ah, que vocês querem, vocês querem ação da SpaceX, tudo bem, bancos, querem entrar, beleza, vocês têm que assinar o groc e usar, aí vocês vão poder ter acesso às ações, né, o pessoal tirou o sarro da nadodisso, OpenAI falou, "Nos gente não vai ter nada disso, o que quiser comprar, não vai comprar, vai ser um bloco de ações, disse nada da isso, mas vai ter, sem possível de entrar no IPO". E nisso ainda dessas conversas de IPO e também da Anthropic, OpenAI enviou um memorando para os investidores meio que atacando o Anthropic, e falando "Olha, galera, vocês que estão pensando em investir em alguma empresa, aqui a gente tem muito mais poder, muito mais capacidade computacional do que Anthrop. A gente está projetando ter ali até 30 gigawatts de poder computacional até 2030 e Anthrop, que o de Vossão vai chegar ali até 7, 8 gigawatts, então nós podemos desenvolver modelos muito maiores, muito mais potentes do que eles, apesar de se ele tem um modelo melhor nessa semana, na semana que vem, a gente vai poder desenvolver um maior e melhor ainda com muitos mais capacidades e blah, blah, blah. Então está muito ali na risa de. na risa do coelho para decidir quem vai ganhar essa maratona aí do IPO, basicamente. quando vai tirar foto no final da corrida? Nossa, tá. Como é que é, expressão? Eu penso em cavalo que corre, nunca fiz corrida de coelho. É isso mesmo, é isso. Não é a risa de cavalo, é que ficou ele atartar um, não sei, ele me confundia aqui. Tá, ok. E finalizando aqui as notícias da OpenAI, a gente já comentada, ela falou "Gente, eu também". Então ela vazou pro Axios que ela está finalizando um produto que tem capacidades avançadas de cyber segurança, aquela planeja, lançar só para parceiros, mesmo o papo da Anthrop, ela falou "é o também". Vamos ver quanto tempo leva para isso chegar e vamos para o Google agora. Vamos, vamos, por favor. No Google, essa me pegou muito de surpresa, Marcos. O Google afirmou que está fazendo ali uma parceriazinha com a Intel para usar os chips da Intel nos data centers. Coitada da Intel, não, coitada não. Bom para ela, né? Mas olha aí, foi de surpresa. É curioso que ela está conseguindo se. Não é sincerinho de um jeito que estou minimizando a Intel, mas ela passou muitos anos congelada, tem um Frozen Link. E sem evoluções ou grandes acordes, grandes negócios, perdeu uma parceria grande e aí devolou de mercado quando eu não tenho a coro de cabeça qual foi, mas foi importante nos últimos 20 anos. E ela fez lá aquele acordo com o governo americano, pro governo americano, cedondo de uma parte da Intel e de lá para cá. Então agora é estatal. É, é, é, é. E a coisa que começou a mudar ela tem feito algumas parcerias e agora ela vai passar a fabricar os chips da Intel para o Google. Isso, claro, ajudou bastante ali na situação dela. E ela também nessa semana, então até falou que ela vai se juntar a o Terra Fab, o projeto lá da SpaceX da Tesla. Então ela está aos pouquinhos se, se, se, se, se infiando na, na mercado de estrutura de A. O que é ótimo para ela? O melhor coisa que seria, seria, seria a Intel, seguir definhando daquele jeito que vinha, né? Então eu gosto de notícias assim, mas é sempre nesse parado. Boa notícia. É uma outra rapidinha, uma reportagem que saiu foi que os, e aí o Vervius, aquela visão geral de A que aparece ali em cima quando você faz uma pesquisa no Google hoje em dia, eles são correctos em 90% dos casos, segundo a reportagem, mas devido ao enorme gigantesco volume de pesquisas que são feitas diariamente ali e que não dá para usar o modelo mais poderoso do mundo para consumir tudo isso. Não, o Rureia Falência. Isso ainda resulta em milhões de respostas erradas por hora no mundo inteiro. Então teve um caso que ele deu o sistema e falou que o Hulk Hogan, aquele, ele era meio que de WWR, isso é, é, é, esse é lutador de Lutador. O Lutador, aquele Loirão, né, com Bigodão, e tudo mais, o modelo tinha falado ali, o verviu que ele não morreu, por exemplo. Enfim, é uma grande reportagem falando sobre como isso pode afetar as pessoas que antes elas procuravam no Google, e elas tinham que ver os sites e ali tinha uma pressa leção baseada em sites com uma relevância grande. Agora, a maioria das pessoas nem clica mais uns sites e só vê ali o verviu e na maioria dos casos, o G.S.O.C. Ente. E como isso pode ocasionar, desinformação em massa, se milhões e milhões e milhões de respostas por dia vierem errados. O grande problema, incorregível, talvez, ou muito difícil de corrigir de alucinação das IAS. Boa. E uma notícia que impacta aqui no Brasil, que eu achei bacana, na verdade não foi só no Brasil, foi em 100 países, mas chegou no Brasil também. Foi o Google Finance, acho que é inglês que é Google Finanças, está liberado aqui no Brasil, a versão dele que tem uma IAS embutida para você conversar com o G.M.E.S sobre os investimentos, fazer aquela. Não é exatamente recomendações de investimento, eles falam gente. Quem boto dentro do gatilho e compras ações são vocês. Mas, dá para conversar com os modelos, respeito disso. Ele gera gráficos a partir dos pedidos do usuário, traz claro também dados em tempo real para ir a poder mastigar isso. Masticar isso e gerar as respostas, as análises, e não investe para você. Mas ajuda a entender que os dados melhor pensam só no uso do mitos para isso, né? Para poder que os dados já estão esperados, né? Então, agora lá no Google Finance aqui no Brasil já dá para usar a versão dele com IAS.S. O outro para quem é do mundo de Minai, que essa gostei bastante inclusive. Tivem uma atualização do de Minai para a galera que tem o plano PRO, que agora ele vai poder responder com uma visualização 3D, uma simulação ali, entrativa, 3D em tempo real, basicamente. Você pode pedir para ele "olha, eu quero uma simulação 3D da Lua girando ao redor da Terra ou do sistema solar". E agora ele vai poder desenhar, foi poder usar o código ali e criar um artefato ali, um canvas para você que você pode mexer com isso interactivamente, achei super divertido, super legal. mas claro só pra quem paga o plano pro boa. E o cantinho multimídia dentro do Google agora, a gente falar algumas aqui pra ter que passar a regua. Primeira coisa. Saio lá no Shorts, um recurso que deixa os criadores usarem, pegar foto, treinar o modelo, pra gerar a vata de A e pra realista. É a live selfie, que eles chamam pra pessoa gravar, né? O lavoso, gravam o rosto, pronto, consegue. Usa o vio pra gerar vídeos de Shorts, sem ter que fazer a gravação. De verdade, que dependendo do que for, aquele esforço todo, então dá pra fazer isso agora, né? Uma outra coisa. Lá no aplicativo do Gemini, eles integraram um pouco mais o notebook alieme. E dá pra você criar notebooks? Agora, dentro do Gemini, e tem espaço pra se organizar as conversas, organizar os arquivos, adicionar a mais fonte, até pra você tirar as informações, que isso apareceu lá, agora no app do Gemini, não tá limitado basicamente só ao notebook alieme. Uma outra coisa, no Android. Não sei, apareceu pra você, fabri-se um botão pra um melhorator de fotos, e aí, hein? Se pra fotos, chegou a ver. Não cheguei, deixa eu ver. Bom, enquanto você cheque, eu explico. Ele, de um jeito de você fazer melhor, tem aí a ingressa aqui, ele analisa foto e melhora aquela corressão básica que todo mundo que mexe com fotos, sabe, se joga lá no Photoshop, se lá se mexe nos níveis, nas curvas, mexe nesta duração, etc. Tem, tá aqui, ó. A gente tem um botãozinho ali, tem um dinâmico, mas tem um que é a gente com irá. Ficou? E tem pra vídeo também, se mexe na velocidade do vídeo, mas é um probeleurá ali com irá, dá um tapinha rapidinho na foto, melhorar luz, contraste, etc. E finalizando a parte do Google, eles lançaram nesta semana o Google AI Edge eloquente. É um AI, local, o que é bacana, que é um aplicativo de tado pra fazer transcrição, que é um mercado que a gente vem, e não fica muito sob o loforte, mas tem evoluído super rápido, a gente comentou aqui sobre os modelos pericate de Nvidia aqui. Eu uso algumas vezes por semana, toda vez me impressiona. Eu jogo o arquivo de uma hora e meia, cara da seis segundos, tá transcrito. A precisão é uns 85%, por cento. É, se eu fosse publicar, eu teria que dar um tapa, teria. Mas pra transcrições que eu faço pra mim, é perfeito. Então, agora o Google tá lançando um modelo local, funcional offline, pra fazer transcrição. Então, isso é super legal pra inúmeras. Aplicações que eu tenho certeza que vocês têm, então o link vai estar na descrição. E agora, pra meta, a primeira é marcos, eu estava errado. Eu estava prevendo o lançamento do modelo, o primeiro modelo fechado da meta, é esse que foi desenvolvido pelo time lá do Alexander Wang, do Super Intelogens Labs e tudo mais. Da galera do bilhão, todo mundo que eles contrataram das suas empresas, pagando um milhão, 10 milhões, 100 milhões, um bilhão, dois bilhões e meio de dólares, pra ir em trabalhar lá na meta, e desenvolver esse time de super inteligência, minha aposta era pra agosto. Ele tinha falado que tinha terminado ali a fase de pretreinamento no mês retrasado, agora é final de fevereira, mas o menos foi há puts. Então, até ter uma coisa bem feita, do jeito que deve ser pra chegar no estado da arte, pra se lançar do pré-vendo ali pra agosto. Isso aqui foi lançado essa semana. O Meta Mills Spark, que é o primeiro modelo desse time de super inteligência da meta desse laboratório, com o foco em multimodal, os deferramentas, reasoning e o que é a extração de agentes, ou seja, é um modelo com a pegada de ser estado da arte, tanto quanto o clodiópus, tanto quanto o GPT, 5.4, o Gemini 3.1 Pro, e ele se vê ali mais ou menos em nível similar a esses, só que um nível atrás. Eles lançaram, dá pra utilizar ele lá no meta.reas, se você quiser usar, ele não é um modelo aberto, como eram os modelos LEMA, ele é um modelo fechado mesmo, igual os dessas três empresas que eu mencionei. E olhando ali, por exemplo, nas comparações dos benchmarks principais, ele é um bom modelo, muito bom modelo. Por exemplo, ali no SWBenchver Faire, essa de programação agente, ele ficou em 70, poucos por 177, por cento, ele tá atrás do Gemini, tá atrás do clod, tá atrás do GPT, mas não por muito, pelo menos do benchmark, tá? No terminal Bent, também tá algo em torno de 5 a 10%, tá atrás dos benchmarks, no tal Bent, que a gente também menciona muito aqui, que é o de uso de ferramentas de modo agente, ele ficou com 91, por para a comparação, o Gemini 3.1 Pro tá com 95, o Opus tá com 92, 93, então ele tá atrás, mas como um primeiro lançamento, surpreendeu muita gente, pela qualidade, de ser realmente um modelo muito bom, e também tinha aquela questão que, se vocês lembram, o fiasco do lançamento do William Aquatro, porque eles estavam fazendo Bent Maxing, que eu basicamente, maximizar o modelo nos benchmarks, mas quando você vai usar o modelo em casos reais, né, ali o uso do dia a dia na sua vida, ele não performa também, porque ele não consegue generalizar, e também para Bent Marx específicos da LEM Arena, que eles tinham maximizado, seja tudo errado, tudo errado, o Mark demitiu uma parte dessa galera, para colocar outra galera que era boa, para trabalhar nesse super-intelho de Young Slabs, contratou todo mundo, e lançando esse modelo que é bom, e que as primeiras comentários, que a vida pessoal falando no Twitter, no RAD, é que realmente não fizeram Bent Maxing, é um modelo realmente bom, ele tá atrás dos outros desses aí do estado da arte, mas ele talvez tá ali no nível dos modelos chinês, que a gente fala muito por aqui, né, do GLEM5, do Kimi K2.5, e tudo mais, ou seja, esse é lente nível, mas é um modelo privado, né, mas se você for testar comenta lá, por favor, na caixinha de comentários do Spotify, eu fiz um teste ontem, ali, básico no metaponto AI, ele respondeu bem das coisas que eu perguntei, mas não foi um grande benchmark, muito específico das coisas minhas, eu ainda vou tentar fazer isso nessa próxima semana, ali, em Bent Marx, lá do Barcelona Supercomputing Center, por exemplo, coisas de provas de exame de catalão, coisas agentes que você também, e aí eu comenta aqui na semana que vem, e deixa eu dar uma dica pra vocês, nessa semana, saiu lá no Vida Conjardo, Felipe Laura, uma entrevista, mas assim, eu mais gostei já que saíram o podcast dele, com a equada na Palama Farreg, que liderou comunicação marketing da Métria, eles falaram sobre, inclusive, o fiasco do lançamento do LEMMA 4, do desenvolvimento do LEMMA comunicação disso, ele fez aquele, eu até falei com ele, ele fala que ele fala que ele fez, e ele disse que ele não teria coragem de fazer, que eu sabia que as expostas não se. "ah, veja bem, blula", não, ela respondeu, falou numa boa, super interessante o papo, vai dar pra ver bem como é que foi ali a parte interna da meta durante o tempo que ele esteve por lá, o link vai estar na descrição, abraço para o Felipe, e seguindo aqui com as notícias sobre a meta, ela mandou fechar, um ranking, que era o Cloud Onomics, que era o ranking interno que acabou vazando, que era do tal do Tolkien Maxing, que é essa moda de disputar pra ver quem da empresa consegue gastar mais tokens no dia a dia, pra fazer projetos, que eu acho um incentivo meio inacreditável, né? E tinha lá, tinha o Tolkien Legends, essas coisas assim, era o ranking, aí começou a a vazar aqui, o uso assim, né, tinha essa lá, mas de 85 mil funcionários que estavam nesse ranking do Cloud Onomics, estavam copetindo pra ver quem recebia os tatos de Tolkien Legends, e tinha lá os gastos de milhões de milhões de milhões de milhões de tokens por dia, por semana, então a meta falou gente, vasou, fechas negócio, vamos trabalhar, então não tem mais o ranking do Cloud Onomics pra ver quem tá fazendo Tolkien Maxing pra virar o Tolkien Legends, não tem mais, agora tá só interno lá, e acho que eu tinha até comentado assim, passado que isso é uma coisa normal, sim, principalmente, quando você vai adotar ali o curso, o sistema disso, o primeiro mês é meio que, galera, uso o máximo, estoura aí a boca do balão, porque aí pra gente saber mais ou menos quais são os níveis de uso que a gente vai adotar aqui como padrão pra empresa, mas lá, eu acho que já tinha passado do limite, o mar que tava lá, galera, menos, né, basicamente, isso também é até furar o termo de uso, a meta deve ter um acordo com o entrópico pra usar pra development, ou se estão louco, então, não desce, não ficou bem, né, e finalizando aqui as notícias da meta, ela tá mais uma vez, organizando divisões que tem a ver com a yata tirando equipes de engenharia, da divisão que acabou de ser lançada, que era de engenharia de aplicada, pra poder aplicar em outros projetos que ela vê como que vão ter mais benefícios ali pra ir a, tem uma imeta eternamente, repensando estruturas, acabou de criar divisão, já tirou o pessoal de lá pra fazer uma outra coisa, que tem muita, é aquilo, né, muito cacir contratado, cada um querendo sua equipe e a parte de cima não falou, não, não dá nada disso, isso tá fazendo errado, deixa que eu faço, então, rolou isso aí, sassando. E agora, pro nosso cantinho multimedia, uma notícia que pegou todo mundo de surpresa, a new player comes in, ou como é a frase da que não você. Here comes a new challenger, exáclah no arcade, a Netflix entrou na corrida dos modelos de "ah, eles lançaram um modelo chamado Void" que é siga pra video object and interaction delician, ou seja, remoção de interações e objetos de vídeos, que é essa ideia basicamente, você vai ter um vídeo ali, por exemplo, eles estão gravando uma série da Netflix, ou um filme, eles vão pegar essa parte do vídeo e eles conseguem meio que recriar ali o movimento, removendo alguns elementos ali da cena, ou removendo interações, até de pessoas, e consegui literalmente mudar o que aconteceu. Na cena, então eles deram um exemplo, tem um carro ali que bateu com o outro, eles mudam usando esse modelo para dois carros passeando tranquilamente na rua. Não uma coisa totalmente nova, mas é uma coisa nova para eles publicarem sobre isso, pelo menos, talvez já tivesse até alguma coisa interna que eles não falavam muito disso, só que eles querem agora se mostrar como uma empresa que desenvolve tecnologia de inteligência artificial, foi desenvolvida ali em parceria com outras universidades, e eu achei bem interessante de falar que esse modelo teve a preferência de quem usou ali nos testes que eles fizeram de 64% contra 18% do modelo da Runway que faz a mesma coisa, e acho que o mais legal é que eles colocaram esse modelo de forma aberta lá no raga em feio, então você pode baixar, pode retreinar, pode usar para seus casos de uso aí, muito bacana. E isso dá para ser usado, isso de "Ah, você tirar o adicional objeto em terras de comacena, eu vou dar exemplo, creatiníssimo, tá? É um ambiente que tem uma luz entra no pela janela, você bota uma barja ali, mexe um pouco na luz, dá de fuzando a luz. Você tira uma barja, mexe como é que funciona a luz, como se interage com o ambiente, com os personagens, e no fim das contas mesmo. Eu acho que esse tipo de modelo pode ser usado para aqui, para viabilizar ou facilitar a adaptação de séries para múltiplos países. Então, seja que o produto placement, na imagina, eu sempre lembro de um exemplo de Cypher de se fosse hoje, ele andava na rei, tinha propaganda de coisas de hoje em dia, na verdade, ser propaganda dos anos no começo da anos 90, né? E isso é uma coisa que é um mercado de gatês, que vai patrocínio, você fazer contrato, o mês de produto placement, colocar em séries que já foi gravada, colocar um produto, tirar um produto, e até facilitar para Netflix, ele já faz em isso. Essa ilância de séries, meio produção, em linha de produção de séries, que você tem a mesma série sendo produzido para vários países com elencos locais. Então, tem um cenário, um quarto. Grava com os coreanos para Coreia. Grava com brasileiros para o Brasil, e você tem a série e feita, tipo, já vê a metastasis. Conhece a série metastasis? Não. Não é da Netflix, mas é uma série e feita pela Sony. Colombiana. Gravada. Sena a cena de Breaking Bad. É o Breaking Bad Colombiano. Então, você assiste os diálogos, são os mesmos. As tomadas são as mesmas, mas é Breaking Bad adaptado para colombia. E é o metastasis. Eu vou deixar a descrição o link para que quiser, mas é piadinha. Esse é o mercado para Netflix, ele é muito bom. Você ter essa produção localizada de séries e esquema linha de produção. Se você tiver maia que ajude a fazer isso, eliminando o objeto, colocando o objeto, trocando o que está escrito na cena para ficar mais localizado. O que é a Pixar faz, o fim das contas, porque é tudo feito com o CG. Então, é interessante esse modelo. Acho que ele promissou o mercado de produção audiovisual. Eu pego também que do filme "Cicosa" que o Vince Vom refei sena a cena. Só que, por que, a pessoa falou, "Pra que se já existe o filme original, pra que você vai refazer sena a cena". Mas se for para fazer uma coisa do zero, com certeza faz todo sentido. Uma outra multimídia aqui é que o Spotify falou que agora, o recurso de playlist criadas por A, vai ser expandido para incluir também podcasts. Você estava para fazer até agora, playlist de músicas, só que agora também vai dar para você usar para fazer put me datou. Quero que você crie aqui uma playlist de podcasts sobre inteligência artificial para mim. Ele vai te dar lá, o Yasubo Controle, Vida Com ia, o Policast, o Lex Friedman, sei lá, o Layton Space, algo assim. Mas por enquanto, eles falaram que é só podcasts em inglês para usuários premium e nos mercados onde já estava disponível a função anterior. Estados Unidos, Canadá, UK, Irlanda, Austrália, Suécia, em Nova Zelândia. Mas esperamos que em breve disponibilizem para o Brasil também. Boa. E falando agora sobre a Adobe, é uma notícia que eles tinham cortado para mim na semana, passada porque fingiga não sabia, porque caiu o embargo só nessa semana. Ela lançou, essencialmente, um concorrente do notebook LM, dentro do Acrobatist, Acrobat Student Spaces, nesse momento, o tá gratuito. E aquele pacote de você sobe arquivos e dá para gerar um podcast, você conversa com o modelo a respeito disso, você vai explorando de várias formas para ajudar a estudar. Eles falaram que isso foi feito em parceria, desenvolvido pegando as repressões de vários estudantes de faculdade americanos, então, um tempo que. Até não se orientar, é para os finos aqui, intentando ter isso, mas. Não é de graça, dá para usar, então, para quem tiver buscando um aliado de estudos já tá aí, e o jeito, compartilhando um pouquinho aqui como é que foi. Eles compartilharam comigo um link do Acrobatist Student Spaces com os materiais de lançamento, para entender como é que era, se fosse escrever respeito dele, eu já escrevei com o experimento de causa em cima dos materiais do anúncio dele próprio, uma coisa meio meta. Então, tá lá disponível, o link vai estar aqui na descrição, para quem já usa, por exemplo, no notebook LM, para estudar, vale a pena testar se as comenta com a gente que vocês acharam. É mais limitado que no notebook LM, no notebook LM tem alguns anos, e o Acrobatist Student Spaces tem três dias, mas ainda assim tem suporte a português, a inglesa, comecei a conversar em idiomas diferentes no meio ali, para ver se quebrava, não quebrou, funcionou bem bacana, o link vai estar na descrição. E é colaborativo, tá? Uma coisa que no notebook LM não tem, você consegue com tímis de estudo, mais uma pessoa contribuir com os arquivos, poder conversar, então isso é uma coisa que é bem interessante lá, para o grupo de estudo. Muito legal mesmo. E falando sobre música, aqui, o suno tá falando com as gravadoras principais do mundo, o universo, o açone, sobre como que a indústria musical vai lidar com essa criação de músicas via a, que já tá acontecendo há muito tempo, inclusive, Marcos, um amigo meu, eu te mandei ontem, ele criou uma música, a versão da música Carry On do Angrã, que é uma das minhas músicas preferidas, ali, de Power Meto, da vida, só que ele fez usando o suno 5.5, uma versão em Acheco. Aonde eu sou com essezinho aqui, os primeiros sei lá, 20 segundos, propesso, eu vou vir, que é absurdo. E eles chegaram em que não impassem de como isso vai ser liberado para o público. E o universo, o que é que as músicas fiquem só no aplicativo do suno, a suno fala que não, não faz sentido, é que liberar para o mundo, no YouTube, no Spotify, etc. E aí também não impassem sobre como que a gente vai lidar com essa questão dos direitos autorais, como que a gente vai pagar os artistas, como a gente vai pagar as gravadoras, se a gente vai pagar as gravadoras. Então é meio que tanessa conversa, também quando tiver novas notícias, a gente comenta por aqui. Boa. E na semana passada, a gente falou sobre a liquid AI, Bill Water, my friend. Eu quis inspirar ali no Bruce Lee, eles lançaram nessa semana um modelo de vídeo. É o, vamos lá, hein? LFM2.5 VL450M. Farei esse produto da Sony, que adora fazer sopa de letrinha. Mas o que ele faz é processa imagens de 512,512 pixels, não é em 4K, mas já é numa definição OK para o modelo que está começando agora e também traz retornos de quantos punos estruturados, isso em um tempo muito mais rápido do que a concorrência nos benchmarks que eles colocaram. Então ele consegue fazer raciocínio em cima de cada frame, se o vídeo tiver quatro frames por segundo, então a cada 4 segundos ele faz a s sopina de, quer dizer, a cada segunda ele faz a s sopina de 4 frames, num string de vídeo que está passando lá para ele para detectar o objeto, entender o que está acontecendo, o interior modelo de raciocínio em cima de vídeo, que é uma coisa que curiosamente tem que fazer essa semana. Lá no chat PT, eu subi um vídeo e falei, "Ah, me ajuda com a lista aqui de produtos", ele falou, "Tá, me mando vídeo". Ele está me mandei. Não rolou, então. O de mine faz isso. O de mine faz isso. E no GPT não tinha, agora esse modelo de cripto reais, sopa de letrinhas aí, ele faz esse tipo de análise, o link com os detalhes até aqui na descrição. O bacana é, por ele ser tão pequeno, esse 450 e meio do final, ele tem 450 milhões de parâmetros, ou seja, minúsculo o modelo é para rodar em óculos, para rodar em Raspberry Pie, esse tipo de coisa. E uma ótima notícia para quem estava esperando por ela há muitas semanas, a mesa, até na verdade, aquele modelo chinês, os sidens, 2.0, que explodiu, acho que um mês e pouco, dois meses atrás, porque eles conseguiam fazer coisas extremamente realistas, sendo um nível muito acima do vídeo da Google, acima do Sora da OpenAI. Ele foi lançado agora publicamente, maioria das empresas ali que oferecem ferramentas de vídeo, como a Run, como a CREA, AI, Riggsfield, em qualquer uma delas, agora se pode pagar, ali o plano delas, escolher o modelo de vídeo, agora tem as opções ali, o clíngu, Sora, o Viu, mas tem também o sidens 2.0, que você vai poder usar ele para fazer os seus vídeos em altíssima qualidade. Eu dei uma olhada aqui dentro do CREA, AI, ele não deixa ainda você fazer vídeos de 1080p, está limitado a 720p ou 480, ou seja, a versão mais em HD ainda não está disponível nessas ferramentas, lá no Riggsfield também com 720p no máximo, mas você quiser brincar um pouquinho com o vídeo, já dá. E ainda falando sobre vídeo, mas indo para o cantão da China, a Alibaba lançou um modelo, na verdade, a gente tinha sido lançado ninguém saber de quem que era, que acabou que era da Alibaba, que é o Happy Horse 1.0, que ficou. Com o topo do leaderboard do benchmark artificial anelases AI model, onde eu falava sobre ele aqui, que achavam que era um. ninguém sabia de quem que era, mas estava mandando bem, ele ficou até acima justamente do ocidente 2.0, o modelo de vídeo que ainda é limitado, onde ainda é para usar ele aqui no ocidente. Mas ele estava mostrando que não está para trás, lançando o modelo mais para o rodo do que esse, que dominou o mundo aí nas últimas, 3 semanas, é o "repeor" o ponto zero. - O cavalo feliz. - É, é, é. E chegamos nas ípoles Pontuiá, né, que você falou que tinha novidades essa semana também. Exatamente, eles lançaram um novo modelo, essa atualização do GLM, 5.0 que eles tinham até agora, agora a gente tem o GLM 5.1, que eles estão seguindo basicamente a estratégia de como é que eles chamaram, Markus, distillation attacks, que é um topo que falou basicamente, e distilar os modelos deles para melhorar os benchmarks, desde melhorar os modelos chinês, mas basicamente, eles melhoraram bastante o GLM 5.0 para essa versão 5.1 na questão de código, que a ideia exatamente essa é competir com as empresas americanas ali, só que dando os pesos do modelo, liberando ele, os pesos do modelo lá no Ruggin Face, então qualquer um pode baixar, pode rodar, pode fazer falar o nítio nisso, e tudo mais. O GLM 5.1 aqui, ele está nesse nível, ele está melhor, do que o Dm9 3.1 pro programação, a gente, ali no SWEbrante Pro, terminal B, tudo mais, ele está ainda pior, o 2, 3% pior do que o Cloud Oppos, e que o GPT 5.4, só que, por ser um modelo aberto, você pode baixar, se pode rodar local, se pode fazer o que você quiser, lembrando que é um modelo bem grande, então você não vai conseguir rodar ali na sua máquina local, ou nada nem perto disso, precisa de algo entorno de 15 a 20 GPUs, agacendo a Nvidia no mínimo, para rodar um modelo desse tamanho aqui, mas com esses benchmarks ele está realmente muito, muito, muito bom, e competindo ali no estado da arte com todos os outros, que a gente pode falar aí das empresas americanas. Então quer testar, quer ver se faz sentido para você, corre lá e baixa e testa, comenta com a gente lá na caixinha de comentários dos Spotify. Boa, e partindo para as rapidinhas da semana, nem ainda falando sobre lançamentos de modelo, nesses últimos dias, a cognition lançou o SWE 1.6, que eles falaram que é o melhor modelo que eles lançaram já até hoje em inteligência, e também toda a esquema de experiência de usuário de uso do modelo. Eles falaram que o 1.6 fica parelho com a versão preview do modelo da SWBENT Pro, Cristiano Lançado faz um pouco de tempo, mas que ele melhora em outros aspectos, inclusive em acesso, você tem o panogratuito de uso do modelo, 200 da geração, 200 tokens por segundo, e na parte mais rápida que espaga um pouquinho, ele gera 950 tokens por segundo, que é bastante coisa considerando, o que a gente já conhece de token de outras plataformas. Eles falaram que para melhorar o modelo do jeito que eles fizeram, o ingrediente chave para eles foi incluir no processo de aprendizado por reforço, uma desacompensa, na verdade, uma das penalizações era o tamanho da resposta. Então, isso impediu que o modelo tomasse trajetoras muito mais cumpridas do que o necessário para gerar a resposta, e isso sem impactar na qualidade da resposta. Então ele ensinou basicamente na o modelo, a pensar melhor e mais rápido, para poder gerar os resultados que foram gerados, o link para que quiser vergulhar mais a fundo, estar lá no link surf, ver conseguir achar aqui na descrição. Boa. E tem uma parceria, uma colaboração, na verdade, dessas principais empresas do Estados Unidos, aprendem a Google Anttropic, para exatamente e contra esse entre aspas de installation atac que as empresas chinês as falam. E eu falo isso com muito sarcasmo, com muitas aspas aqui do de selection atac, porque é uma cara de pau gigantesca da Anttropic, meter essa depois de ter perdido um processo por pirateio de dados para treinar os modelos delas. Mas enfim, o PNI Google Anttropic agora estão colaborando para tentar parar esse. A distilação dos modelos deles a partir dos chinês. Eles colocaram ali um foro, que eles chamaram de Frontier Model Forum, para compartilhar informações entre si, V, Ali e Pes, coisas que estão violando supostamente, os termos de usos, os direitos deles, e tudo mais, para parar a competição de preços e também o entre aspas que eles chamaram de risco, a segurança nacional americana, porque os modelos chinês não têm salva guardas como os modelos americanos, o que é na maioria das vezes uma grande balela. Mas eles estão ali fazendo esse cartelzinho para tentar evitar que as empresas chinês continuem distilando os modelos deles. Boa, e deixou uma dica rapidinha que não estava na pauta. Nossa amigo Beir Correia, ele está hoje lançando em São Paulo fazendo lançamento oficial do livro dele, que é o meu robôs, e ele vai fazer um evento de lançamento do livro lá na livreira da travessa, que fica no shopping botemí, das 7 às 9 da noite, um abraço para ele. Não vai dar pra eu ir, afinal estou aqui em seu justifico, eu difícil ter eu ir pra São Paulo em de sexta-feira, mas pra quem escuta esse episódio de lançamento passem por lá, que tem sido de descrição evento muito bacana. E seguindo aqui, com as notícias da semana, há SpaceX, algumas de sobre SpaceX, que agora engloba a XeA, que engloba o X, aquela sopa de empresas lá que umas que fez, trombics pra cima. Eles, no último ano, sendo donos agora da XeA, tiveram 5 bilhões de dólares em prejuízo com gastos de IA. E o SpaceX das empresas todas é a que é mais positiva, e tem mais chance de dar certo pra esqueça, que vai ficar ou englobar nas outras todas. Saiça no notícias que eles perderam 5 bilhões de dólares com investimento, perderam não, né? Então investindo mais tão no prejuízo com o quanto de grana voltou desse retorno nesse momento, a XeA nessa semana, mandou lá pro colorado, brilh um processo, tentando bloquear, por uma lei, anti-discriminação, quando assumo o pré-uso de IA, porque isso estava marcado ainda, pra entrar em vigor no verão dos Estados Unidos, falando que essa lei de anti-discriminação, ela, viola, proteções de liberdade de expressão. E o motivo de uma notícia é, se tem mais a ver com o ilomôsco do que é a XeA diretamente, é que tem aqueles vários processos contra o PNI, que ele quer azucrinar a OPRIAR, né? Nessa última semana, um desses processos de ele mandou um documento, mudando um pouco, pedido que ele quer fazer, pro júri pra punir a OPRIAR por ter virado uma empresa pro lucro, e desse processo que ela fez aqui, ela fez recentemente, e ele querendo tirar uma cana disso, né? E ele falou o seguinte, o que tem que acontecer é, o dinheiro que for dado de multa pra OPRIAR, eu não quero esse dinheiro, quando o preço desse dinheiro, o dinheiro tem que ser doado pra caridade, do braço de caridade da OPRIAR, mas isso vai acontecer se a OPRI demitir o Sam Altman e o Greg Brockman, do Conselho dessa diretoria. Então ele tenta fazer, sei lá, um resgate de um dinheiro que não existe, que está sequestrado pra ele seguir azucrinhando por lá, ele quer tirar o sumo, é tirar eles da liderança dessa, da non-profit, né? Da um da OPRIAR e confins lucrativos, em resposta a isso, o OPRIAR abre um processo pedindo pra os promotores gerais, dos Estados Unidos, e chegaram em Lumasco, e por estar fazendo esses ataques direcionados ali pra ela. Então, a rinha de bilionários segue mais uma semana. É, eles vieram até a público lá no Twitter, era o OPRIAR no caso, no Twitter da Newsroom deles, publicaram, olha, a verdade que esse caso é só o Elon Musk que tem mais poder e mais dinheiro pra realizar as coisas que ele quer, e tendo visto que as tentativas dele de causar dano, a fundação sem fins do criativo do OPRIAR, não tem nenhuma base legal, agora o Elon está de novo tentando mudar na ativa e save face, quer, tipo, como que é save face? -Livrar cara mesmo. -É, tipo, não. Num passar uma humilhação em público, basicamente, é, agora que o julgamento está chegando, e que isso é só uma campanha de ameaças, liderada pelo ego, a inveja dele, e o desejo de tornar um competidor mais lento no processo. O mensagem bem agressiva da OPRIAR já deve estar muito pute com isso. -Sintu, fila. -E indo pra visa agora nessa semana, ele só se usa. -Pois é, né? Não sei se é inédito, mas é raro. A gente fala lá pela aqui, mas é interessante falar assim. Estamos lançando a Intelligence Commerce Connect, plataforma de conexão inteligente, que é pra facilitar pagamentos feitos por agentes de IA em redes de cartão de crédito, incluindo a dela. Obvio, né? Mas não só dela, mas ter card também, e as outras bandeiras também. Então, eles não querem do fazer o MCP de transação à gente, que é mais um pouquinho disso. Então, como essa parte, e como é isso com IA, segue crescendo, apesar de dar, mas não está processando lá. A Purple Act pra falar, não pode não. E ela a própria lançar um modelo parecido, agora a visa está querem do. de forma, não sei, se antecipada, porque já devia estar numa coisa assim, mas virar essa língua franca, do protocolo de sistema de pagamentos facilitados, a parte de segurança, entre agentes de IA e plataformas de. de commerce. É interessante. Bem interessante mesmo. Vamos ver se vai dar certo ou não. É uma rapidinha aqui, foi o Carpate, ele está postando bastante coisa, o André Carpate, se vocês não seguem ele, não chuto, recomendo bastante, são bem interessantes, os postes deles, em geral. Mas um dele dessa semana, aqui explodiu bastante, foi que, falando que tem uma grande, grande divergência na percepção das capacidades da IA. entre grupos de pessoas. Isso foi em resposta, um outro tweet de uma pessoa tinha falado que olha o que define se você está assustado, se você vê muito valor das capacidades da ira hoje em dia, se você lua para programação ou não. E foi ele respondendo a esse tweet concordando basicamente, falando olha, a maioria dos usuários ainda basei as opiniões deles ou em versões gratuitas ali do chat.pt, o de Eminar e do Clod ou coisas antigas que você testou seis meses atrás, que não deu muito bem, não deu muito certo, por caso do dia que você queria e que hoje principalmente depois de dezembro, muito disso já mudou. Mas se você está usando um modelo pago, principalmente os mais carinhos, que principalmente em áreas específicas, como é a área tecnológica da programação, esses avanços são exponenciais muito mais do que ali se você bater um papo, pedir para ele criar uma poesia, pedir para ele escrever um texto criativo para a sua agência de marketing. Nisso realmente não evoluiu tanto assim, mas para coisas mais agênticas, coisas mais de programação, criação de sistemas, isso evoluiu muito rapidamente nos últimos meses, principalmente porque são tarefas relacionadas a código e a matemática, que os modelos de hoje em dia eles conseguem ser treinados, especificamente para isso, utilizando uma técnica, em calei de aprendizado por reforço, que o pessoal chama muito de "RLVR", que é reinforcement learning with verifiable rewards, aprendizado por reforços com recompensas verificáveis. Você consegue verificar, você consegue ir no problema de matemática, de programação, você tem uma resposta certa, você sabe se o código rodou ou não, ou se aquele problema matemático deu uma resposta correta ou não. Então você consegue fazer o aprendizado por reforço de treinar o modelo para chegar naquilo seja lá por qual o modo for. Para coisas mais subjetivas, como escritas que ativa, ou seja lock for, é mais complicado você treinar o modelo para isso, mas é basicamente isso, o post, teve um outro post, o que também fez um bastante modo de ser semana, a gente vai deixar o link para os dois aqui nos comentários. Eu acho engraçado o Carpate, ele sempre finge surpreso quando os tweets dele ficam viralizados, é sempre muito engraçado. Nossa gente, jura que vocês gostaram disso que eu escrevi, que você vê que são postes grandes, compridos, que ele leva o tempo, é sempre engraçado. Nossa, isso aqui está nem sem porque viralizou a gente, pois eu nem passei em maquiagem, hoje vocês nem vão, é muito engraçado, sempre assim, o jeito que ele reája, é uma falsa modeste, no fim das contas, eu vejo com essa forma, mas é claro que não tira o valor do que ele compartilha e nem quem o cara é, assim, para achem engraçado só esse jeito que ele valoriza o engajamento, fingindo a surpresa, divertido, toda vez. E terminando a episódio indo por os estudos da semana marcos, conseguimos correr aqui a acelerar, né, deu certo, deu certo. Eu vou se entender do certo, o que a pessoa estiver no ar, está dando certo, eu vou colocar assim, já vi Lei de Morph e não perdoar. Mas um dos estudos que foi publicada essa semana foi pela Universidade de Oxford, mostrando que eles envolveram uma ferramenta de inteligência artificial que é capaz de prever uma insuficiência cardíaca com pelo menos cinco anos de antecedência, se eu me lembra aquele modelo de Harvard, o TIF, que a gente até entrevistou de um rana aqui que participou da criação dele, que previa alguns tipos de cancers com cinco anos de antecedência também com uma curaça ali de 90, tantos por cento, 24 por cento eu acho. Essa daqui é para insuficiência cardíaca e é de Oxford. E ele consegue fazer essas provisões a partir de tomografias cardíacas ali do dia a dia, analisando algumas mudanças da textura da gordura que está em volta do coração que podem indicar uma inflamação ou alguma alteração precoce que não é visível ao olho humano. Eles fizeram esse treinamento do modelo com 70 mil pessoas bastante gente. Claro, é da galera lá da Inglaterra. Tem uma de um público muito diverso ali, muitos imigrantes na Inglaterra, que é uma notícia boa, mas não expandiu ainda pelo menos para outros países. Mas eles chegaram a 86 por cento de previsão, que é bem bacana, e eles viram que os pacientes que estavam no maior grupo de risco tinham uma probabilidade de 20 vezes maior de desenvolver alguma insuficiência cardíaca, algo em cerca de um a quatro casos surgindo ali nos próximos cinco anos. E agora eles vão ver a aprovação regulatória para tentar implantar essa ferramenta no NADS que é o sul lá da Inglaterra excelente notícia. Boa, e para finalizar, é o tipo de notícia que eu leio e me incomoda, mas ela aconteceu, e a espalhão a gente vai comentar aqui. É uma matéria da Nature mostrando o processo de uma pesquisadora que inventou uma doença publicou um paper fake como preprint a respeito dessa doença que não existia e que já vê o que isso aconteceu quando fossemasticados pelos LLMs. É aconteceu, óbvio, os LLMs passaram a citar esse estudo de preprint quando o Ense inventado como se fosse uma coisa de verdade, esse estudo passou acessitado em estudos de verdade e isso passou a ser pego como uma prova de que as pessoas não checam as fontes, etc, etc, etc. A doença, ela coloco como Bixonimania, não sei se a pronúncia, a intonação saiu, mas deu pra entender e é sobre o olho que costa, então a pessoa pro nosso meio está coçando, o que que pode ser? Aí, esponja, pode ser Bixonimania, e ela inventou um pesquisador que o nome parece uma senha segura, então é o Laz Liv Is Goobie Novich. Muito bom, muito bom, muito bom. E as fotos do estudo também foram aceitas com IAA e mostrou lá no Common Crow, como isso passou a ser usada, etc, etc. No fim das contas é uma alerta a respeito de como é fácil entre hoje e dá mais difícil esse estudo de 2024, então tem isso também, né? Ela fez isso antes de existir algumas proteções de checagem que existe hoje em dia, mas ainda assim, pra mostrar como basta falar que as pessoas acreditam, e se você fizer isso com a ajuda de LLM, pode dar um estrago enorme, porque o LLM não é exatamente o checador de fatos, e como a própria comunidade científica está vulnerável a esse tipo de coisa, porque esse estudo passa, ele é citado como base de um estudo, que depois pode até ser verificado, se foi verificado e passou alguém falando o processo, porque a fonte de um estudo também deveria entrar nessa partiteca de fatos, mas como isso pode ser um atalvitor de ataque mesmo, quando as pessoas são ter espalhados em formação científicamente comprovada e inventada, então os detalhes disso vão estar aqui no descrição. A gente tinha falado sobre isso recentemente, eu acho que até vale recomentar aqui rapidinho sobre o medo que as pessoas estavam de ataques de envenenamento da lagoa, é alguma coisa assim, a tradução, Lake Posny, não é necessariamente esse termo, mas imagina um país que é o seu inimigo mortal, vamos dar um exemplo aqui, se lá, Corea do Norte, ou alguém que não faz mal pra ninguém, que ele bate, ele vai infiltrar pessoas extremamente técnicas ali agentes, espiões dentro da sua empresa, da empresa do seu país, pra ele de propósito começar a poluir os data sets, com informações de informação, e isso não vai passar nenhum benchmark específico, né, porque são coisas geralmente subjetivas, mas a pessoas, os usuários que foram fazer perguntas sobre isso vão receber informações baseadas nesses ataques invenenados pelos agentes externos, claro que por enquanto é soma hipótese, mas que é basicamente o que ela fez para a internet, mas que isso pode acontecer inclusive com pessoas trabalhando dentro de empresas que é um medo, e eu acredito dessas grandes empresas que estão desenvolvendo modelos, treinando em caso hoje em dia, mas é interessante porque essa conversa ela existe e esse medo é muito real mesmo, um link na descrição, obrigado pessoal, quem deixa a avaliação, quem deixa a review, quem recomenda o ir sobre controle, para as pessoas poderes descobrir, quem deixa comentários, consultivos que ajudam a trazer discussões bacanas aqui pra pode caixar também, até entre si que ele é gatomevo você vê, vocês interagindo os spotify, sejam before, e fabricil, vocês tem um recado inédito aqui do eixo do controle hoje, né? Pois é, Marx, se você não está sabendo agora a Lura tem um novo produto que é o skills engol, que é exatamente pra quem está usando inteligência artificial pra você que escuta o que o programa e você dá a tecnologia, você é um dev, um dev mais cênior, até pleno, cênior, tech lead, uma pessoa um pouco mais avançada já na carreira, os skills engol os experience que está chamando aqui the next dev generation, a próxima geração de devs vai ser uma experiência que a Lura que desenvolveu presencialmente, não é online, é presencial com dois dias de curso basicamente intensivão sobre como você, que é programadora, é programadora, vai poder usar inteligência artificial de uma maneira a melhorar muito a sua produtividade no dia a dia, e com alguns dos maiores nomes da tecnologia brasileira, quem vai estar lá que vai ser professor, seu é o próprio Paulo Silveira, o fundador civil da Lura, o Guilherme Silveira, que é o chief innovation officer da Lura, também fundador da Lura, Maurício Anich, que é o atual CityO da Lura, trabalhou também na Ádia, é pesquisador, PhD, trabalhou como professor universitario la Nolanda muitos anos nessa parte de engenharia de software, de programação orientada testes, o Sergio Lopes, que é atual CEO do Allan Future Studio, mas me for assim. que eu ou da Lura por muitos e muitos anos e o Cristiano Crow, que é o CIO lá da Starts, também faz parte aqui do Grupo Alon, mas inmersão completa de dois dias com esses celevos aqui de 23 e 24 de abril agora, lá no escritório da Starts e na Avenida da Nações Unidas. E no final você vai ganhar um certificado com a chancella da Lura e da Fiap, vai ser uma turma única com vagas limitadas e para você garantir o seu ingresso. O link está aqui na descrição, corre, porque vai acontecer como eu falei de 23 e 24 de abril, ou seja, daqui a menos de duas semanas. Maravilha, então o link vai estar aqui na descrição do episódio, e eu e o Fabrício voltaram em uma quarta-feira como entrevista aqui se eu fosse você. Eu não perderia até lá. Este podcast foi produzido pela Lura, Mergulho em Tecnologia e Faculdade Fiap. Let's rock the future! Edição, redigiga hertz de podcasts.

Podcast Summary

Key Points:

  1. A Anthropic anunciou o modelo Claude Mythos, focado em segurança cibernética e programação, com capacidades excepcionais para encontrar vulnerabilidades zero-day.
  2. O modelo não será liberado publicamente; está disponível apenas para cerca de 40 empresas parceiras no projeto Glass Wing, como Microsoft, Google e Linux Foundation.
  3. Nos benchmarks de código, como SWE-bench, o Mythos superou significativamente modelos como GPT-4, Claude Opus e Gemini, mostrando ganhos de até 25% em algumas métricas.
  4. Apesar do avanço, análises sugerem que o Mythos é uma evolução incremental—um modelo maior e melhor treinado, mas não uma revolução arquitetural—e seu alto custo pode limitar o uso cotidiano.

Summary:

A Anthropic anunciou o Claude Mythos, um modelo de IA focado em segurança cibernética e programação, destacado por sua capacidade excepcional de identificar vulnerabilidades zero-day em sistemas como navegadores e servidores. O modelo não será lançado publicamente; em vez disso, está disponível para aproximadamente 40 empresas parceiras através do projeto Glass Wing, incluindo gigantes como Microsoft, Google e Linux Foundation, com o objetivo de corrigir falhas antes de um possível lançamento mais amplo. Em benchmarks de código, como o SWE-bench, o Mythos superou modelos líderes como GPT-4, Claude Opus e Gemini, com melhorias de até 25% em algumas tarefas, além de demonstrar maior eficiência no uso de tokens.

No entanto, análises indicam que o Mythos representa uma evolução incremental—um modelo maior e mais bem treinado, mas não uma inovação arquitetural radical—e seu alto custo pode inviabilizar o uso cotidiano, reservando-o para aplicações especializadas. O anúncio reforça o foco da Anthropic em segurança e programação, com impacto potencial significativo para a indústria de cibersegurança.

FAQs

É um projeto de colaboração com cerca de 40 empresas parceiras (como Microsoft, NVIDIA, Linux Foundation) para testar e corrigir falhas de segurança cibernética usando o modelo Claude Mythos antes de seu lançamento público.

É um novo modelo de IA da Anthropic focado em cibersegurança e programação. Ele se destaca por encontrar vulnerabilidades 'zero-day' em sistemas críticos com alta eficiência, superando modelos como GPT-4o e Gemini 1.5 Pro em benchmarks de código.

Devido à sua capacidade avançada de explorar vulnerabilidades de segurança, a empresa optou por restringir o acesso inicial a parceiros do projeto Glass Wing para corrigir falhas antes de possíveis lançamentos futuros de versões adaptadas.

O modelo encontrou falhas em sistemas como OpenBSD (com 30 anos de existência), na biblioteca FFmpeg (uma falha de 16 anos) e em navegadores como Firefox e Chrome, demonstrando eficiência em código amplamente revisado.

Ele superou modelos concorrentes significativamente: atingiu 94% no SWE-bench Verified (contra ~81% do Opus) e 78% no SWE-bench Pro (contra ~57% dos modelos de estado da arte), com saltos de 15-25% em várias métricas.

O preço estimado para parceiros do Glass Wing é de US$ 25 por milhão de tokens de entrada e US$ 125 por milhão de tokens de saída, posicionando-o como um modelo premium, similar ao GPT-4o Pro em custo.

Chat with AI

Loading...

Pro features

Go deeper with this episode

Unlock creator-grade tools that turn any transcript into show notes and subtitle files.