7213Ejaaz

vip
Idade 1.6 Ano
Nível máximo 0
Ainda não há conteúdo
a meta está construindo um concorrente do OpenRouter (logo após as notícias de que o OpenRouter pode ser adquirido), mas há outro motivo pelo qual a meta está fazendo isso:
> acabar com $100Ms desperdício em inferência. a plataforma rotearia com eficiência prompts de IA para vários modelos diferentes, economizando custos e produzindo respostas melhores.
> uma nova fonte de receita: a intenção da Meta é disponibilizar isso publicamente para qualquer pessoa economizar dinheiro
> uma forma poderosa de treinar seus modelos: usado internamente, a meta criaria um conjunto de dados muito valioso sob
META-2,66%
Ver original
post-image
post-image
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
lá está - a Microsoft vai usar o kimi k3 para alimentar seu principal assistente de IA do copilot, economizando até 60% por token ou $600M em cada $1B gasto em custos de inferência.
se a Microsoft optar por hospedar o modelo por conta própria assim que a Kimi o abrir ao público no dia 27, esse custo diminui ainda mais
ame ou odeie esses modelos chineses, o open source está realmente nivelando o campo de forma importante.
de acordo com as informações
MSFT-2,65%
Ver original
post-image
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
quem se importa se kimi k3 é melhor do que fable? o ponto inteiro é que eles provaram que dá para conseguir um modelo de fronteira por um custo significativamente menor
o que significa que alguma coisa precisa ser reprecificada.
se você é uma empresa gastando US$ 10-100 milhões em tokens e consegue cortar isso em 21X, por que raios você não consideraria?
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
o motivo pelo qual você deveria se importar com kimi k3 não é porque ele vence fable, é porque ele tem zero restrições: IA sem censura.
o motivo pelo qual você deveria se preocupar com a china é porque eles alcançaram os eua. imagine um mythos sem censura indo para o modo rogue.
inteligência por token é o que importa agora e a china está aqui pra jogar e os modelos deles são baratos pra caralho.
as regras mudaram.
kimi agora. deepseek, zhipu, qwen todos para seguir.
DEEPSEEK-0,09%
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
lembrete — o Opus 5 cai na próxima semana e provavelmente vai superar o K3.
a principal vantagem que a Anthropic e a OpenAI têm é que elas conseguem destilar seus próprios modelos topo de linha em modelos mais baratos e acessíveis, com alta inteligência por custo.
também o Fable 6 e o GPT 6 estarão aqui em ~1 mês. os ciclos estão ficando mais curtos.
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
kimi k3 parece mais significativo do que o momento do deepseek. difícil de não ver isso:
> supera o fable, fez 5,6 em múltiplos benchmarks importantes. primeira vez que um modelo chinês *não* fica para trás
> e faz isso por uma fração do tamanho, custo e sem as GPUs chiques da nvidia
> avanços repetidos nos dados usados para treinar modelos + nas técnicas de treinamento fizeram da China um centro legítimo para pesquisa em IA
tudo isso também é open source. em que ponto começamos a reconhecer que talvez eles realmente tenham alguma vantagem aqui?
a lacuna caiu para no máximo 3 meses agora.
DEEPSEEK-0,09%
NVDA3,11%
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
google $GOOG está tendo dificuldade para vender seus TPUs; 75% dos chips usados pelas neoclouds são da Nvidia, mas existe um forte argumento para o Google vencer nos próximos 12 meses: custo.
meta, uber, microsoft e muitos outros reduziram o ritmo de gastos agressivos com IA nos últimos meses, optando por modelos mais baratos — isso já economizou US$ 10-100 milhões
mas o maior custo ao usar modelos de IA vem da infraestrutura subjacente usada para atendê-la aos clientes: os tpus são a alternativa mais barata (e mais eficiente).
minha aposta é que, à medida que a inferência se torne 50%+ do us
GOOG0,04%
NVDA3,11%
META-2,66%
UBER-1,38%
MSFT-2,65%
Ver original
post-image
post-image
post-image
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
cara, que época para estar vivo.
agora temos 10+ modelos de IA com capacidades parecidas que surgiram do nada, e a gente ganha uma nova versão a cada ~2-3 semanas
a melhor parte é que, não importa o que você esteja procurando, existe um modelo que atende a isso:
mais barato do que o fable? gpt 5.6
preocupado com privacidade? 5+ modelos abertos
não sabe qual modelo usar? cursor ou openrouter
anthropic, openai, xai, meta, google, zhipu, deepseek, moonshot, alibaba estão todos competindo de forma agressiva — e isso é ótimo para você, o usuário
nvidia, cerebras, etched, groq, intel,
NVDA3,11%
INTC-1,05%
TSM-0,62%
META-2,66%
BABA-1,27%
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
uau. A Apple está processando a OpenAI por roubar segredos de hardware para seus dispositivos de IA que serão lançados mais tarde este ano.
aparentemente, 1 funcionário convenceu membros da equipe da Apple a levarem dispositivos proprietários de hardware para as entrevistas.
OpenAI e Apple vão se enfrentar em dispositivos de IA para consumidores mais tarde este ano, com a Apple planejando um novo modelo de AirPods com câmeras, óculos inteligentes e um dispositivo tipo pingente.
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
Esta semana foi uma vitória total para a IA: tantos novos modelos e recursos para testar neste fim de semana:
> 1 novo modelo de fronteira: gpt 5.6 Sol
> 2 novos modelos absurdamente baratos que são 80% da fronteira: grok 4.5 e meta muse spark 1.1
> 2 novos modelos de imagem: muse image e seedream 5.0
> prime intellect levantando $130M para impulsionar a produção de mais modelos abertos
e o Google liberando 3,5 na próxima semana, deepseek v4 também, um modelo grok de 4-5T em um mês e GPT 6 em um mês
tá tudo acontecendo rápido demais
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
Uma das maiores mudanças na IA tem sido treinar chips de IA para chips otimizados para inferência - e por um bom motivo:
inferência é onde o dinheiro (e a inteligência) é feito
> a anthropic é rumorejada a obter margens de receita de 80% em inferência. eles serão lucrativos antes de qualquer outro laboratório de IA.
> apple, meta, openai, google estão todos fazendo seus próprios chips de IA personalizados para e inferência
> laboratórios de modelos chineses (apesar da desvantagem de hardware) constroem inteligência de fronteira puramente forçando o modelo a pensar por mais tempo.
o ponto é:
META-2,66%
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
à medida que os EUA completam 250 anos, é mais importante do que nunca lembrar que o segredo deste país são suas pessoas e sua busca incansável por ideias ousadas e ambiciosas. foi isso que manteve os EUA vencendo e continuará a mantê-los vencendo no futuro.
ameaças iminentes de concorrência estrangeira em IA - roubo de designs de modelos, restrições de recursos naturais, guerras de escala etc. - se tornarão cada vez mais um problema.
precisamos proteger nossos data centers, pessoas, mas, acima de tudo, nossas ideias. é isso que nos mantém na vanguarda em *qualquer tecnologia* nos últimos 25
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
a tesla acaba de se tornar a última empresa a cortar gastos com IA, impondo um limite de gasto de US$ 200 por semana em tokens para funcionários e incentivando-os a usar os modelos grok + cursor - um sinal dos tempos que virão
> elon está pressionando os funcionários a usar versões internas do grok + modelo cursor composer.
> eles criaram vários agentes privados treinados com dados da tesla para aumentar a produtividade
> os funcionários ainda têm acesso ao claude e gpt por meio de sua "plataforma bottleneck" interna.
> isso segue a uber, microsoft e meta, que agora reduziram agressivamente os
TSLA-0,87%
UBER-1,38%
MSFT-2,65%
META-2,66%
Ver original
post-image
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
parece que a OpenAI está apostando forte em inferência para superar a Anthropic nos próximos 6 meses:
> entre seus chips cerebras e os próximos chips jalapeño de IA, a OpenAI terá o melhor hardware otimizado para GPT
> eles reduziram os custos de inferência em 50% (de acordo com a informação) o que economizará $10Ms
> o GPT 5.6 depende fortemente de raciocínio e execução agentivos (pesado em inferência)
a inferência representa 40-50% dos gastos computacionais nos laboratórios, reduzir isso pela metade libera computação para uso em treinamento - os efeitos compostos disso não podem ser subestim
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
eu não compro essa FUD sobre meta e memória de IA:
- o google acabou de desligar a meta por usar muito poder computacional, por que eles precisariam vender excesso de computação?
- a meta possui uma das maiores frotas de GPUs, eles provavelmente estão vendendo as mais antigas para inferência (como a SpaceX) enquanto usam as novas Rubin.
- memória é sem dúvida o recurso mais escasso em IA, a demanda supera qualquer oferta futura projetada em 5 a 10 vezes.
- no caso de alguém projetar um chip, modelo ou agente que exija menos memória, isso só resultará em MAIS demanda por memória
você tem observ
META-2,66%
SPCX-3,79%
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
então parece que há algumas tendências-chave convergindo na IA recentemente
- modelos de fronteira agora representam uma ameaça legítima à segurança do governo, exigindo intervenção governamental (adeus fábula)
- isso significa que futuras versões de modelos serão privadas (restritas). quaisquer lançamentos públicos futuros quase certamente serão limitados
- ao mesmo tempo, modelos abertos chineses alcançaram a capacidade de fronteira. em menos de 6 meses, estarão no nível do mythos
- modelos abertos são mais baratos, podem ser executados de forma privada, difíceis de regular pelos gov
GLM0,37%
MSFT-2,65%
DEEPSEEK-0,09%
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
o problema é que, mesmo que a Anthropic crie magicamente uma salvaguarda à prova de hackers para o Mythos - haverá outras superfícies de ataque para atores explorarem
serviços em nuvem, funcionários, centros de dados, injeção de prompts
nunca poderá haver um modelo 100% à prova de falhas, teremos que melhorar na defesa como fizemos em cada atualização de software
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
  • Fixado