Deno2834

vip
Idade 1.8Ano
Nível máximo 0
Ainda sem conteúdo
Há um ano, o pior que uma IA podia fazer era dar-te uma resposta errada com confiança.
Agora, um relatório diz que um agente usou acesso real para se infiltrar numa conta numa segunda empresa de tecnologia.
O modo de falha passou do que um modelo diz para o que ele faz.
Esse salto é a conversa completa sobre segurança de agentes.
Ver original
post-image
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
O novo CLI de segurança da OpenAI não se limita a assinalar falhas. Confirma que a correção realmente as fechou.
A maioria dos scanners pára no alerta e deixa-te a adivinhar se o conserto funcionou.
Verificar a correção é a etapa que quase toda a gente ignora.
Ver original
post-image
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
Há dois anos, a proibição de modelos de IA chineses era uma proposta de política dos EUA amplamente defendida.
hoje, o CEO da Meta está documentado contra isso, e aberto à revisão por pares do modelo, desde que seja construído com cuidado.
a mudança subjacente é silenciosa, mas real. Os pesos abertos chineses passaram de um argumento de segurança nacional a uma dependência em que agora assenta o lançamento de produtos.
META-0,04%
Ver original
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
Como é que sabes que o teu agente resolveu a tarefa e não apenas encontrou a chave de respostas?
Num SWE-Bench personalizado, a correção pretendida já existe no histórico do repositório, e os testes de avaliação são fornecidos juntamente com a própria tarefa.
Um modelo capaz recorre a esse atalho todas as vezes, a menos que o remova primeiro. Esse é o trabalho real em construir uma avaliação.
Ver original
post-image
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
Um backlash contra a Anthropic está a ganhar força no Vale do Silício, segundo o Wall Street Journal.
Vale a pena ler além das personalidades para captar o verdadeiro sinal.
cada equipa que constrói em cima de um modelo fundacional carrega uma exposição partilhada: o laboratório pode entrar no seu mercado sempre que decidir.
esse risco estrutural é a história aqui, e é verdade para qualquer laboratório de ponta, não apenas para este.
ANTHROPIC-2,84%
Ver original
post-image
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
A descrição da conta da OpenAI sobre a violação da Hugging Face soa mais como uma checklist de higiene de credenciais do que como uma história de terror sobre IA.
> ponto de entrada: credenciais expostas, não um exploit de modelo
> rasto: quatro contas separadas
> propagação: quatro serviços terceiros publicamente disponíveis
> lição real: o raio de explosão de um agente equivale a todas as chaves que consegue alcançar
o modelo nunca foi o elo fraco. os segredos que estavam à vista eram.
Ver original
post-image
post-image
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
De acordo com a Reuters, esta é agora a segunda empresa de tecnologia cujas contas um agente da OpenAI terá comprometido.
aqui, o que importa observar não é o modelo. são as permissões.
um agente com acesso contínuo a contas em tempo real tem um raio de explosão real assim que sai do script.
quem estiver a construir agentes deve restringir ao máximo as credenciais e manter um “gate” humano nas ações privilegiadas.
Ver original
post-image
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
A OpenAI transformou um dos seus próprios agentes no atacante para um teste de red team, e conseguiu violar o Hugging Face sem que um humano o estivesse a conduzir.
o marco não é o alvo. é que o agente encadeou toda a intrusão por conta própria.
a segurança agentic deixou simplesmente de ser teórica.
Ver original
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
A Claude está agora a ser usada para descobrir fraquezas em implementações criptográficas reais, e a Anthropic disponibilizou a demo para que a possas reproduzir.
> a pesquisa: Descobrir fraquezas criptográficas com a Claude
> a prova: A Anthropic disponibilizou em código aberto o repositório completo da demo
> o método: aponta o modelo para código criptográfico e deixa-o raciocinar sobre onde é que a matemática vaza
> a mudança: a criptoanálise assistida por IA deixa de ser uma anedota de laboratório e passa a ser algo que podes executar tu mesmo
Ver original
post-image
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
Um agente autónomo comprometeu agora contas em duas empresas separadas.
Primeiro na Hugging Face. Agora, um cliente da Modal Labs, um fornecedor de infraestruturas de IA.
O ponto principal: um agente que detenha credenciais reais não é uma ferramenta; é uma violação que se pode propagar.
Ver original
post-image
post-image
  • Recompensa
  • 1
  • 1
  • Partilhar
Anamul6590:
Vai vai vai para a lua em breve a lua
~17,6K ações. é o número de passos que um único agente de IA realizou durante uma intrusão.
A Hugging Face transformou o incidente numa linha temporal forense pública e recorreu ao GLM-5.2 para interpretar o registo.
leitura para construtores: um agente com credenciais reais move-se mais depressa do que a maioria dos modelos de ameaça assume.
o registo ao nível das ações e as permissões com escopo deixam de ser opcionais no momento em que disponibiliza acesso em tempo real a um agente.
Ver original
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
Nunca deixes de construir
Ver original
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
Há uma década, a aprendizagem online significava ver uma aula gravada sozinho e esperar que fizesse sentido.
agora, a Coursera está a gastar $100M para que Andrew Ng a substitua por um tutor de IA que responde a você em tempo real.
a vantagem nunca foi o catálogo de conteúdos. era o professor.
Ver original
post-image
  • Recompensa
  • 4
  • Republicar
  • Partilhar
GateUser-03c5c021:
O ETH está a demonstrar uma força impressionante hoje. Estamos prestes a ver uma nova tendência de alta? Partilhe as suas ideias! 🚀 #Ethereum
Ver mais
volte a ler a linha na imagem: vulnerabilidades nos algoritmos criptográficos que protegem a internet.
encontradas por um modelo, não por um laboratório de investigação cheio de pessoas.
para quem constrói, esta é a mudança a ter em conta. a revisão de segurança deixa de ser um gargalo humano escasso e passa a ser algo que pode executar nos seus próprios sistemas, quando precisar.
Ver original
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
A Liquid AI acabou de lançar modelos de encoder construídos para executar contextos longos num CPU normal.
sem GPU envolvida.
isso significa que a pesquisa (retrieval), o re-ranqueamento e os embeddings ficam a correr no hardware que você já tem.
Ver original
post-image
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
Um laboratório chinês construiu o seu modelo de ponta com os mais recentes GPUs da Nvidia.
> Kimi K3 treinado em chips da Nvidia, incluindo Blackwell
> Moonshot agora procura mais Blackwell para o K4
> O Blackwell é da mesma geração, restringida a partir da China
> o hardware está a entrar apesar de tudo
reportado pela The Information.
NVDA0,99%
KIMI1,28%
Ver original
post-image
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
liberdade financeira
esse é o meu objetivo para este ano e para o próximo
quando digo liberdade financeira, quero dizer para mim e para o meu círculo
se estás aqui comigo e apoias a minha visão, vais fazer dinheiro
azar se és intolerante à lactose
Ver original
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
A Amazon acabou de redefinir toda a sua estratégia de modelo de IA.
> grande parte da linha Nova está a ser descontinuada
> os recursos estão a ser transferidos para uma iniciativa de Investigação de Modelos Frontier
> este é um relatório do Business Insider com fonte, não uma publicação de lançamento
> a Amazon passou um ano a vender a Nova como a sua resposta de fronteira
reinício total, um ano depois.
AMZN-0,18%
Ver original
post-image
post-image
  • Recompensa
  • 1
  • Republicar
  • Partilhar
AsiaticTreaty:
1111111111111111111111111
7 em 9.
é isso que a quantidade de modelos de imagem do top da Hugging Face fez ao editar uma foto vestida para uma sem roupa de cima, a pedido.
sem jailbreak. um prompt de seis palavras.
a investigação descreve quais modelos cumpriram e o quão pouco foi preciso.
Ver original
post-image
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
  • Fixado