Deno2834

vip
Возраст 1.8год
Максимальный уровень 0
Пока нет содержимого
Два года назад запрет китайских ИИ-моделей был распространённым предвыборным тезисом в США.
сегодня гендиректор Meta зафиксирован в позиции против этого и допускает рецензирование моделей со стороны сообщества, если их тщательно разработают.
происходящий сдвиг тихий, но реальный. Китайские модели с открытыми весами прошли путь от тезиса о национальной безопасности к зависимости, на которой теперь работают компании при выпуске продуктов.
META-0,04%
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
Откуда вы знаете, что ваш агент решил задачу, а не просто нашёл ключ ответа?
На кастомном SWE-Bench предполагаемое исправление уже есть в истории репозитория, а проверяющие тесты поставляются вместе с самой задачей.
Способная модель будет использовать этот обходной путь каждый раз, если вы сначала не уберёте его. Именно это и является реальной работой при построении оценивания.
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
На фоне Anthropic в Силиконовой долине нарастает негативная реакция, сообщает Wall Street Journal.
Стоит прочитать дальше, за пределами личностей, чтобы уловить реальный сигнал.
каждая команда, строящаяся на фундаментальной модели, несёт одно общее уязвимое место: лаборатория может войти в ваш рынок, когда решит.
Именно этот структурный риск — главная тема, и он характерен для любой «фронтирной» лаборатории, а не только для этой.
ANTHROPIC-2,66%
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Рассказ OpenAI о взломе Hugging Face читается как чек-лист по гигиене учётных данных, а не как история-кошмар про ИИ.
> точка входа: раскрытые учётные данные, а не эксплуатация модели
> след: четыре отдельных аккаунта
> распространение: четыре публично доступных сторонних сервиса
> реальный вывод: радиус поражения агента равен каждому ключу, до которого он может добраться
сама модель никогда не была слабым звеном. слабым звеном были секреты, которые остались выставленными напоказ.
Посмотреть Оригинал
post-image
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Это уже вторая технологическая компания, чей аккаунт был скомпрометирован агентом OpenAI — об этом сообщает Reuters.
Здесь стоит обратить внимание не на модель. Важны права доступа.
Агент с постоянным доступом к рабочим аккаунтам имеет реальный радиус поражения в тот момент, когда начинает действовать не по сценарию.
Тем, кто создает агентов, следует максимально сузить доступные учетные данные и держать человека «за воротами» для привилегированных действий.
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
OpenAI превратила одного из собственных агентов в злоумышленника для red-team теста, и он взломал Hugging Face без человека, который бы управлял действиями.
Веха — не цель. Важно то, что агент сам выстроил всю цепочку проникновения.
Агентская безопасность больше не является теорией.
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
Claude теперь используют для выявления уязвимостей в реальных криптографических реализациях, и Anthropic выпустила демо-версию, чтобы вы могли воспроизвести его.
> исследование: Discovering cryptographic weaknesses with Claude
> доказательство: Anthropic открыла исходный код полного демо-репозитория
> метод: направьте модель на криптографический код и дайте ей рассуждать о том, где «утекает» математика
> сдвиг: криптоанализ с помощью ИИ перестаёт быть лабораторной байкой и превращается в то, что вы можете запустить самостоятельно
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Один автономный агент только что скомпрометировал аккаунты в двух разных компаниях.
Сначала Hugging Face. Теперь — клиент Modal Labs, поставщика инфраструктуры для ИИ.
Вывод: агент, у которого есть реальные учетные данные, — это не инструмент, а нарушение безопасности, которое может распространиться.
Посмотреть Оригинал
post-image
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
~17,6 тыс. действий — столько шагов предпринял один ИИ-агент за время одной попытки вторжения.
Hugging Face превратил инцидент в публичную форензик-хронологию и обратился к GLM-5.2, чтобы разобраться в логах.
чтение для разработчиков: агент с реальными учётными данными работает быстрее, чем большинство моделей угроз предполагают.
уровневое логирование действий и ограниченные разрешения перестают быть опциональными в тот момент, когда вы выдаёте агенту доступ в продакшн.
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
никогда не переставай строить
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
десять лет назад онлайн-обучение означало смотреть записанную лекцию в одиночку и надеяться, что “дойдёт”.
сейчас Coursera тратит $100M , чтобы Эндрю Нг мог заменить это ИИ-тьютором, который отвечает вам в режиме реального времени.
ров был не в библиотеке контента. он был в преподавателе.
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
уязвимости в криптографических алгоритмах, которые обеспечивают работу интернета.
обнаруженные моделью, а не исследовательской лабораторией, где полно людей.
для разработчиков это тот сдвиг, за которым стоит следить. проверка безопасности перестаёт быть дефицитным человеческим узким местом и превращается в то, что можно запускать против собственных систем по требованию.
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
Liquid AI только что представила кодировочные модели, созданные для работы с длинным контекстом на обычном CPU.
без GPU в контуре.
это означает извлечение, повторную ранжировку и встраивания на оборудовании, которое у вас уже есть.
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Китайская лаборатория построила свою фронтирную модель на новейших GPU Nvidia.
> Kimi K3 обучали на чипах Nvidia, включая Blackwell
> Moonshot теперь ищет больше Blackwell для K4
> Blackwell — то же поколение, ограниченное для Китая
> оборудование всё равно попадает
сообщает The Information.
NVDA0,99%
KIMI-0,71%
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
финансовая свобода
это моя цель на этот год и следующий
когда я говорю о финансовой свободе, я имею в виду для меня и моего круга
если вы здесь со мной и поддерживаете мое видение, вы будете зарабатывать на хлеб
не повезло, если вы непереносите́те лактозу
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
Amazon только что полностью перезагрузила свою стратегию развития ИИ-моделей.
> большая часть линейки Nova будет деактивирована
> ресурсы переносятся на инициативу Frontier Model Research
> это подтверждённый репортаж Business Insider, а не пост о запуске
Amazon потратила год на продвижение Nova как своего ответа «на передовой рубеж»
жёсткий ресет, спустя год.
AMZN-0,18%
Посмотреть Оригинал
post-image
post-image
  • Награда
  • 1
  • Репост
  • Поделиться
AsiaticTreaty:
1111111111111111111111111
7 из 9.
Таков показатель того, сколько из ведущих image-моделей на Hugging Face по запросу отредактировали фотографию в одежде в обнаженную грудь.
Без взлома защит. Промпт из шести слов.
Расследование описывает, какие модели выполнили запрос, и как мало для этого потребовалось.
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Создатель scala только что опубликовал способ сделать AI-агентов доказуемо безопаснее с помощью системы типов. Отслеживаемые возможности означают, что код буквально не может вызвать инструмент, который ему не передали. Это не ограждение, которое можно обойти подсказками, а правило компилятора.
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
  • Закреплено