Новости

  • 20.07.2026
  • В симуляции найма LLM формировали новые стереотипы сильнее людей
    Большие языковые модели начали связывать вымышленные демографические группы с определёнными профессиями, хотя все кандидаты имели одинаковые шансы на успех. У передовых LLM разделение кандидатов оказалось в среднем на 65% сильнее, чем у людей, участвовавших в аналогичном эксперименте.
  • GitHub сделал сервис Code Quality общедоступным
    GitHub Code Quality стал общедоступен в тарифах Enterprise Cloud и Team. Сервис проверяет сопровождаемость и надежность кода в запросах на включение изменений, сочетая анализ CodeQL с ИИ-поиском проблем и автоматическими исправлениями.
  • Bristol Myers Squibb построит ИИ-кластер на восьми системах NVIDIA Vera Rubin
    Биофармацевтическая компания Bristol Myers Squibb развернет второй кластер DGX SuperPOD, включающий восемь стоечных систем DGX Vera Rubin NVL72. Его объединят с существующей инфраструктурой и используют для обучения собственных моделей, молекулярного дизайна и агентных процессов при разработке лекарств.
  • Имитация авторского стиля снижает точность детекторов ИИ-текста
    Эксперимент Epoch AI показал, что детекторы Pangram, GPTZero и Originality.ai значительно чаще пропускают сгенерированные тексты, если языковая модель имитирует стиль конкретного автора. Особенно ненадёжными оказались результаты для научных материалов: доля пропусков достигала 29% в среднем по отдельным детекторам и 48% в одном из сценариев.
  • Alibaba открыла исходный код стека SAIL для ИИ-ускорителей Zhenwu
    Полупроводниковое подразделение Alibaba T-Head открыло программный стек SAIL для разработчиков по всему миру. Компания рассчитывает упростить перенос ИИ-нагрузок на ускорители Zhenwu и расширить программную экосистему, конкурирующую с Nvidia CUDA.
  • RadLE 2.0 выявил самоуверенные ошибки ИИ при анализе медицинских снимков
    CRASH Lab при Университете Ашоки представила тест RadLE 2.0, оценивающий точность медицинских ИИ-моделей, обоснованность их уверенности и способность передавать сложные случаи специалисту. На 200 диагностических задачах все 16 протестированных моделей уступили рентгенологам по главному показателю, а некоторые системы сообщали ошибочные диагнозы с высокой уверенностью.
  • Axios: власти США обсуждают фактические ограничения для китайских ИИ-моделей
    Администрация Дональда Трампа рассматривает меры, которые могут ограничить использование китайских открытых ИИ-моделей в США без прямого запрета, сообщает Axios. Среди вариантов — включение разработчиков в экспортный список Entity List, предупреждения о рисках и ответственность американских компаний за безопасность размещаемых моделей. Официальных решений пока не принято.
  • Alibaba открыла предварительный доступ к Qwen3.8 Max на 2,4 трлн параметров
    Команда Alibaba Qwen представила предварительную версию Qwen3.8-Max — модели на 2,4 трлн параметров, предназначенной в том числе для программирования, анализа данных и офисных задач. Сейчас она доступна через Qoder и Qwen Cloud, а публикацию открытых весов разработчики обещают позднее; результатов бенчмарков пока нет.
  • Новые уязвимости WordPress уже используют в атаках
    Компании Patchstack, Hexastrike и watchTowr зафиксировали эксплуатацию двух недавно исправленных уязвимостей WordPress, связка которых позволяет удалённо выполнять код без аутентификации. Разработчики выпустили обновления для веток 7.0, 6.9 и 6.8 и включили принудическую автоматическую установку исправлений.
  • У разработчика медицинского биллинга Craneware похитили данные сотрудников и клиентов
    Британская Craneware, поставляющая финансовое и биллинговое ПО организациям здравоохранения США, обнаружила несанкционированный доступ к части своей инфраструктуры. Злоумышленники выгрузили значительный объём имён файлов, а также часть данных сотрудников, клиентов и партнёров; точный состав информации пока устанавливается.
  • Hugging Face сообщила о компрометации внутренних датасетов и служебных ключей
    Злоумышленники внедрили вредоносный набор данных, добились выполнения кода в инфраструктуре Hugging Face и получили доступ к части внутренних датасетов и служебным учетным данным. Компания устранила уязвимости и рекомендует пользователям сменить токены доступа и проверить активность учетных записей.
  • 19.07.2026
  • AISI: модели с открытыми весами сократили отставание в кибервозможностях до 4–7 месяцев
    Британский AI Security Institute оценил кибервозможности GLM-5.2 и DeepSeek V4-Pro и сравнил их с закрытыми frontier-моделями. По результатам тестов, разрыв между open-weight и закрытыми системами заметно сократился, а защитные ограничения в открытых моделях почти не мешали выполнению киберзадач.
  • Tracebit предложила «контекстные бомбы» против атакующих AI-агентов
    Tracebit описала защитный прием, при котором prompt injection размещают в ложных секретах и других «канареечных» ресурсах облачной инфраструктуры. В тестах на имитации AWS-окружения такие строки резко снижали успешность автономных AI-агентов, пытавшихся развить атаку до административного доступа.
  • Сооснователь Index Ventures: богатство от ИИ будет перераспределено добровольно или принудительно
    Сооснователь венчурной компании Index Ventures Нил Раймер заявил, что богатство, быстро концентрирующееся вокруг ИИ, в той или иной форме будет перераспределено. По его мнению, технологические лидеры могут сделать это добровольно, иначе давление перейдет в политическую и регуляторную плоскость.
  • Дэйв Эггерс заявил сотрудникам OpenAI, что ChatGPT мешает студентам учиться писать
    Американский писатель Дэйв Эггерс выступил перед сотрудниками OpenAI по приглашению Сэма Альтмана и резко раскритиковал влияние ChatGPT на образование. По данным Financial Times, он заявил, что сервис усложнил работу преподавателей и лишает учащихся практики самостоятельного письма.
  • CMS тестирует ИИ для проверки медуслуг перед оплатой Medicare
    Американское агентство Centers for Medicare & Medicaid Services запустило модель WISeR, где ИИ и машинное обучение используются вместе с клинической проверкой для оценки отдельных услуг в Original Medicare. Пилот рассчитан на 2026–2031 годы в шести штатах и уже вызвал спор из-за риска автоматизации отказов по медицинскому покрытию.
  • GitHub добавила приложение Copilot в API метрик использования
    GitHub расширила Copilot usage metrics API: теперь отчеты для предприятий и организаций показывают использование приложения GitHub Copilot. Администраторы смогут учитывать активных пользователей, сессии, запросы, промпты и расход токенов вместе с другими метриками Copilot.
  • Китай запустил WAICO — межправительственную организацию по сотрудничеству в области ИИ
    В Шанхае подписано соглашение о создании World Artificial Intelligence Cooperation Organization (WAICO), новой межправительственной организации по сотрудничеству и глобальному управлению искусственным интеллектом. Си Цзиньпин также объявил о 5 тыс. мест на программах обучения ИИ для развивающихся стран и о создании прикладных центров сотрудничества с крупными региональными объединениями.
  • Anthropic оставит Claude Fable 5 в Max и Team Premium с половиной лимита
    С 20 июля 2026 года Claude Fable 5 будет входить в тарифы Max и Team Premium, но только в пределах 50% лимита плана. Пользователи Pro и Team Standard сохранят доступ через usage credits и получат разовый кредит $100.
  • 17.07.2026
  • Kimi анонсировала K3 с 2,8 трлн параметров и обещает открыть веса до 27 июля
    Kimi представила мультимодальную модель K3 с открытыми весами, контекстным окном 1 млн токенов и архитектурой Mixture-of-Experts. Полные веса обещаны к 27 июля 2026 года, а API уже доступен по цене, заметно более высокой, чем у Kimi K2.6.
...  11    12    13    14    15   

Связь с редакцией