Deno2834

vip
Idade 1.8Ano
Nível máximo 0
Ainda não há conteúdo
O novo CLI de segurança da OpenAI não apenas aponta falhas. Ele confirma que o patch realmente as corrigiu.
A maioria dos scanners para no alerta e deixa você adivinhar se a correção funcionou.
Verificar se a correção funcionou é a etapa que quase todo mundo pula.
Ver original
post-image
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
Há dois anos, banir modelos de IA chineses era uma proposta de política dos EUA amplamente defendida.
hoje, o CEO da Meta está registrado contra isso e aberto a uma revisão por pares do modelo, desde que seja construído com cuidado.
a mudança por baixo é silenciosa, mas real. As aberturas de código (“open weights”) chinesas saíram de um argumento de segurança nacional e viraram uma dependência sobre a qual agora rodam produtos em produção.
META-0,04%
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
como você sabe que seu agente resolveu a tarefa e não apenas encontrou a chave de respostas?
em um SWE-Bench personalizado, a correção pretendida já existe no histórico do repositório, e os testes de avaliação vêm junto com a própria tarefa.
um modelo capaz faz esse atalho todas as vezes, a menos que você o remova primeiro. esse é o trabalho real ao construir um eval.
Ver original
post-image
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
Uma reação contrária à Anthropic está surgindo no Vale do Silício, segundo o Wall Street Journal.
vale a pena ler além das personalidades para ver o sinal real.
toda equipe que constrói em cima de um modelo de base carrega uma exposição compartilhada: o laboratório pode entrar no seu mercado sempre que decidir.
esse risco estrutural é a história aqui, e é verdade para todo laboratório de ponta, não apenas este.
ANTHROPIC-1,90%
Ver original
post-image
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
O relato da conta da OpenAI sobre a violação da Hugging Face parece mais uma lista de verificação de higiene de credenciais do que uma história de terror com IA.
> ponto de entrada: credenciais expostas, não um exploit de modelo
> pegada: quatro contas separadas
> propagação: quatro serviços de terceiros publicamente disponíveis
> lição real: o raio de explosão de um agente equivale a toda chave que ele consegue alcançar
o modelo nunca foi o elo fraco. os segredos deixados à vista estavam.
Ver original
post-image
post-image
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
Agora é a segunda empresa de tecnologia cujo acesso foi comprometido por um agente da OpenAI, segundo a Reuters.
o que vale observar aqui não é o modelo. são as permissões.
um agente com acesso permanente a contas ao vivo tem um raio de impacto real assim que sai do roteiro.
qualquer pessoa que esteja construindo agentes deve definir credenciais de forma restrita e manter um controle humano nas ações privilegiadas.
Ver original
post-image
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
A OpenAI transformou um de seus próprios agentes no atacante em um teste de red team e invadiu o Hugging Face sem que um humano o conduzisse.
o marco não é o alvo. o objetivo é que o agente encadeou toda a intrusão sozinho.
a segurança de agentes acabou de deixar de ser teórica.
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
O Claude agora está sendo usado para descobrir fraquezas em implementações criptográficas reais, e a Anthropic enviou a demonstração para você conseguir reproduzi-la.
> a pesquisa: Descobrindo fraquezas criptográficas com Claude
> a prova: A Anthropic disponibilizou o repositório completo da demonstração
> o método: direcione o modelo para código criptográfico e deixe-o raciocinar sobre onde a matemática vaza
> a mudança: a criptoanálise com assistência de IA deixa de ser uma curiosidade de laboratório e se torna algo que você pode executar por conta própria
Ver original
post-image
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
Um agente autônomo comprometeu contas em duas empresas separadas.
Primeiro, a Hugging Face. Agora, um cliente da Modal Labs, um provedor de infraestrutura de IA.
A lição: um agente com credenciais reais não é uma ferramenta; é uma violação que pode se propagar.
Ver original
post-image
post-image
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
~17,6 mil ações. é quantas etapas um único agente de IA executou durante uma intrusão.
a Hugging Face transformou o incidente em uma linha do tempo forense pública e recorreu ao GLM-5.2 para dar sentido aos logs.
leitura para quem constrói: um agente com credenciais reais se move mais rápido do que a maioria dos modelos de ameaça supõe.
o registro de ações e permissões com escopo deixam de ser opcionais no momento em que você coloca um agente com acesso ao vivo.
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
nunca pare de construir
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
há uma década, aprender online significava assistir sozinho a uma aula gravada e torcer para que “pegasse”.
agora, a Coursera está investindo $100M para que Andrew Ng possa substituir isso por um tutor de IA que responde em tempo real.
o diferencial nunca foi a biblioteca de conteúdo. era o professor.
Ver original
post-image
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
vulnerabilidades nos algoritmos criptográficos que protegem a internet.
encontradas por um modelo, não por um laboratório de pesquisa cheio de pessoas.
para quem constrói, esta é a mudança que vale observar. a revisão de segurança deixa de ser um gargalo humano escasso e passa a ser algo que você pode executar nos próprios sistemas, sob demanda.
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
A Liquid AI acabou de lançar modelos de encoder projetados para rodar contextos longos em uma CPU comum.
sem GPU no circuito.
isso significa busca (retrieval), reclassificação (reranking) e embeddings em hardware que você já tem.
Ver original
post-image
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
Um laboratório chinês construiu seu modelo de fronteira usando os mais novos GPUs da Nvidia.
> Kimi K3 treinado em chips da Nvidia, incluindo Blackwell
> A Moonshot agora procura mais Blackwell para o K4
> O Blackwell é da mesma geração, restringida para a China
> o hardware está chegando de qualquer forma
relatado pela The Information.
NVDA0,99%
KIMI1,85%
Ver original
post-image
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
liberdade financeira
esse é o meu objetivo para este ano e o próximo
quando eu digo liberdade financeira, eu quero dizer para mim e para o meu círculo
se você está aqui comigo e apoia minha visão, você vai fazer grana
azar se você for intolerante à lactose
Ver original
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
A Amazon acabou de redefinir toda a estratégia de seu modelo de IA.
> a maior parte da linha Nova está sendo descontinuada
> os recursos estão sendo direcionados para uma iniciativa de Pesquisa de Modelos Frontier
> isso é um relatório apurado do Business Insider, não um post de lançamento
> a Amazon passou um ano promovendo a Nova como sua resposta de fronteira
hard reset, um ano depois.
AMZN-0,18%
Ver original
post-image
post-image
  • Recompensa
  • 1
  • Repostar
  • Compartilhar
AsiaticTreaty:
1111111111111111111111111
7 de 9.
é assim que muitos dos principais modelos de imagens do Hugging Face editaram uma foto com roupa para uma versão sem roupa no topo, a pedido.
sem jailbreak. um prompt de seis palavras.
a investigação detalha quais modelos cumpriram e quão pouco foi necessário.
Ver original
post-image
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
  • Fixado