Читать новости технологий на русском
Помогает быстро выбирать интересные статьи для чтения.
Google создал первый векторизованный Quicksort, ускорив сортировку до 19 разGoogle открыл исходный код векторизованного Quicksort, который сортирует массивы чисел до 10 раз быстрее, чем std::sort из C++, и обгоняет специализированные алгоритмы для конкретных архитектур. Реализация использует портативные SIMD-функции Highway и поддерживает шесть наборов инструкций на трёх архитектурах, включая AVX2, AVX-512 и Arm NEON. На Apple M1 скорость достигает 499 МБ/с для 32-битных чисел, а на Skylake с AVX-512 — 1123 МБ/с. Код доступен на GitHub под лицензией Apache2.
"Мы достигаем рекордной скорости как на AVX2, AVX-512 (Intel Skylake), так и на Arm NEON (Apple M1)."
4B-модель генерирует планы запросов на 81% быстрее, чем PostgresАвтор дообучил открытую 4B-модель через SFT и агентный RL, чтобы она строила планы запросов для Postgres, превосходящие стандартные. На 113 запросах с множеством соединений удалось снизить задержку на 44.7%, а на части запросов — до 81%. Для этого он собрал измерительный стенд, минимизирующий шум кэша Linux, и разработал вариант GRPO для обучения в зашумлённой среде.
"Одна плохая оценка на раннем соединении может каскадом пройти по всему дереву соединений, испортив все остальные оценки."
Автор утверждает, что значительная часть инженерной продуктивности складывается из небольших, но высокоэффективных знаний: от настройки TCP_NODELAY до использования git log -S для поиска изменений строки в истории. Он приводит примеры из разных областей — от работы с историей команд в терминале до SQL-запросов без FROM и объясняет, почему такие трюки не требуют глубокой подготовки, но могут сэкономить время. В конце он рекомендует делиться подобными находками с командой.
"В одной компании я каждый день делился одним трюком в Slack с инженерной командой — как техническим, так и специфичным для компании, — и люди находили их довольно полезными. Даже если вы знали 9 из 10 трюков, десятый документ или техника могли сэкономить вам время!"
Исследование показывает, что matrix-умножители на современных GPU, включая AMD и NVIDIA, не следуют стандарту IEEE 754. Авторы охарактеризовали числовое поведение matrix-умножителей на трёх архитектурах AMD: CDNA 1, CDNA 2 и CDNA 3 (GPU MI100, MI210/250, MI300A/300X). Они разработали тестовые векторы для определения таких особенностей, как ширина аккумулятора, округление, обработка субнормалей и специальных входов. На основе MATLAB созданы модели, воспроизводящие результаты на битовом уровне, что подтверждено 10 миллионами случайных тестов. В качестве демонстрации модели использованы для сравнения точности приложений между AMD matrix cores и NVIDIA tensor cores.
"Matrix-умножители, доступные на современных GPU, не соответствуют стандарту IEEE 754 для чисел с плавающей запятой."
Dream-RSI — фреймворк для рекурсивного самосовершенствования AI-агентов. Вместо дорогостоящей онлайн-оптимизации он строит симулятор-реплей из накопленных деревьев поиска и «грезит» в нём, получая дешёвую off-policy обратную связь для настройки стратегий исследования. Улучшенная политика возвращается в онлайн, а пул симуляторов растёт в самоусиливающемся цикле. В задачах алгоритмической инженерии, математической оптимизации и разработки GPU-ядер подход сохраняет или повышает качество находок при существенном снижении затрат.
"Наша ключевая идея в том, что накопленная история открытий может служить симулятором-реплеем по уже исследованному пространству поиска."
Mozilla и Mistral объединяются, чтобы дать Firefox приватный и многоязычный AIMozilla и Mistral заключили партнёрство: AI-ассистент Firefox Smart Window теперь работает на моделях Mistral. Функция помогает разбираться в сложных запросах, запоминать важное и искать информацию по открытым вкладкам. Сначала нововведение появится во Франции и Северной Америке, затем — в Великобритании и Германии. Разговоры по умолчанию не сохраняются на серверах Mozilla, а Mistral обязуется не хранить данные. Цель — открытые, приватные и учитывающие местные языки и культуру AI-инструменты для всех.
"Браузер не должен быть односторонней воронкой. Он должен сохранять то, что изначально делало интернет мощным: свободу исследовать, открывать разные идеи и технологии и самим решать, куда двигаться дальше."
ФРС повысила ставку на четверть пункта до 3,75–4% и сигнализировала о дальнейшем ужесточении, несмотря на ожидания Трампа, что назначенный им глава Кевин Уорш будет снижать ставки. Решение было единогласным: 16 из 18 чиновников прогнозируют ещё как минимум одно повышение до конца года. Причина — устойчивая инфляция и рост глобальных затрат по займам.
"Сегодняшние действия в области политики будут способствовать более своевременному возвращению к целевого показателя Комитета в 2%."
Автор делится опытом с SmashingConf Freiburg и CSS Day: как важно подходить к спикерам и говорить, что их выступление понравилось. После доклада многие испытывают неуверенность из-за тишины в ответ, и даже простое «спасибо» может иметь огромное значение. Призыв не стесняться и поддерживать выступающих, ведь они вкладывают много сил и хотят знать, что всё прошло хорошо.
"Если вы всегда хотели, но думали, что не стоит говорить спикеру, что вам понравился его доклад, — это ваш мотивирующий пост. Это всегда стоит того, даже если это лёгкое похлопывание по плечу и короткий разговор."
Fugleramme - E-ink frame with local AI bird detectionFugleramme — это проект для Raspberry Pi, который превращает e-ink дисплей в живую картину: микрофон слушает птиц, локальный AI (BirdNET-Go) распознаёт виды, а на экран выводятся винтажные иллюстрации из естественно-научных атласов XIX века. Более 800 вырезок для 400+ видов, никакой генерации — только ручная работа с общественным достоянием. Рамка обновляется, когда меняется состав птиц, и работает полностью офлайн. Можно собрать на Raspberry Pi 5 с Inky Impression 13.3" или запустить в Docker без e-ink. Идеально для кухонного окна, чтобы наблюдать за пернатыми соседями в реальном времени.
"Половина смысла этого проекта — показать потрясающие иллюстрации из общественного достояния по естественной истории."
Марк Симанн отвечает читателю, который с помощью LLM построил большую систему на TypeScript, но осознал, что она выше его уровня понимания. Симанн признаётся, что сам относится к AI настороженно, и советует задавать моделям только проверяемые вопросы. По его мнению, LLM не галлюцинируют, а несут чушь, и он глубоко не доверяет всему, что они говорят.
"LLM не галлюцинируют; они несут чушь, и я глубоко не доверяю всему, что они мне говорят."
Как оценить размер факториала без калькулятора: формула, которая работаетВ посте Eli Bendersky объясняется, как приближённо оценить количество цифр в факториале, не прибегая к вычислениям. На примере 52! автор показывает, что оценка даёт 68 цифр — точный результат. В основе метода лежит гамма-функция, обобщающая факториал на положительные вещественные числа, и формула Стирлинга, выведенная с помощью метода Лапласа. Также показано, как из формулы Стирлинга получить число цифр через десятичный логарифм.
"На самом деле ответ — 68, так что оценка очень близка! В таких приближениях — когда имеешь дело с огромными числами — ошибка в пару цифр обычно не имеет большого значения."
Более 2300 лет назад в алтайских горах Сибири была похоронена молодая женщина, чья могила превратилась в ледяной блок, идеально сохранивший её татуировки и погребальные дары. В 1993 году российские археологи обнаружили «Сибирскую ледяную деву». Её жизнь и смерть проливают свет на скифов — кочевников, доминировавших на евразийских степях в железном веке. История начинается с кургана Туннуг 1 в Туве, где были найдены самые ранние свидетельства скифской культуры.
"Духи гор не звали её на помощь, поняла она; они призвали её туда, где ей суждено было умереть."
После легализации онлайн-гэмблинга в Онтарио число обращений в скорую по поводу игровой зависимости выросло вдвоеИсследование University of Toronto показало: после легализации ставок на отдельные спортивные события и расширения онлайн-рынка азартных игр в Онтарио число визитов в отделения неотложной помощи по поводу игровых расстройств выросло вдвое. Рост зафиксирован в основном среди молодых мужчин: к концу 14-летнего периода наблюдений визитов среди мужчин 10–29 лет было на 154% больше ожидаемого, а среди мужчин 30–44 лет — на 116%. Среди женщин изменений не выявлено.
"К концу периода исследования наблюдаемое число визитов было на 154% выше ожидаемого среди мужчин в возрасте от 10 до 29 лет и на 116% выше ожидаемого среди мужчин от 30 до 44 лет."
Claude Cowork и чат объединили в один ClaudeClaude Cowork и чат теперь работают как единый Claude: задачи можно ставить из любого разговора, а контекст, навыки и коннекторы сохраняются. Также появились Claude Docs и Claude Slides, а Claude Design встроен в беседы. Функции раскатываются на планах Pro и Max в веб-, десктоп- и мобильном приложении. Пользователи Cowork ничего не теряют: чаты, проекты, артефакты и коннекторы остаются на месте.
"«Я мог бы попросить Claude открыть [мою базу юридических исследований], и он бы вытащил все дела, прочитал их, определил, какие ещё дела могут понадобиться, скачал их и сохранил в папку для моей личной проверки». — Andrew Keller, старший экономист"
DeepMind представил DeepMind Institute — площадку для междисциплинарных исследований последствий AGI. В серии эссе Шейн Легг, Джеймс Маньика и Демис Хассабис объясняют срочность такого подхода; Рохин Шах и Анка Драган отстаивают прозрачность цепочек рассуждений для выявления обмана, Джулиан Джейкобс и Алекс Имас оценивают одиннадцать мер экономической политики, Стивен Кейв предлагает прагматичный утопизм, а Хассабис — рамочную концепцию для frontier AI.
"Чтение «цепи мыслей» ИИ даёт нам окно в его рассуждения, которое мы можем отслеживать на предмет интриг и обмана. Мы должны стремиться держать это окно открытым."
Megi Endeladze, владелица Penny's Coffee Shop в Буффало, сгенерировала меню через ChatGPT, чтобы сэкономить время после рождения ребёнка. После публикации постера в Instagram её завалили комментариями вроде «AI Slop» и «SHAME SHAME SHAME», она потеряла около 100 подписчиков, а один аккаунт прислал угрозу: удалить вывеску или он расскажет о ней местному арт-сообществу. Endeladze извинилась и пообещала больше не использовать AI для оформления меню.
"«В 4 утра я сидела с молокоотсосом на коленях и отвечала этому человеку: „Простите, я не хотела вас обидеть“. Я так увлеклась набором текста, что молока стало так много, что оно потекло по ногам, потому что переполнило молокоотсос»."
Хакеры взломали камеру Flock: за 21 день она сняла 1,6 млн изображений 50 000 автомобилейКоллектив хакеров получил доступ к камере Flock и опубликовал её данные. В утечке оказались тысячи видео и логов, которые показывают, как на самом деле работает система: за 21 день устройство зафиксировало 1,6 млн изображений 50 000 транспортных средств. Материал WIRED раскрывает масштаб слежки и внутреннюю механику сети камер.
"Хотя сама камера Flock не выполняет распознавание лиц — вероятно, из-за ограниченной вычислительной мощности, — она передаёт изображения на сервер, который затем может выполнять распознавание лиц."
Низкие результаты frontier-моделей на физических бенчмарках не отражают их реальные способности. Эксперты-физики перепроверили шесть популярных тестов и выяснили, что большинство «ошибок» моделей на самом деле были ошибками грейдеров, некорректными эталонными решениями или неоднозначными вопросами. После исправления оценка GPT-5.6-Sol на HLE-Physics выросла с 47,3% до 78,7%, на CMT-Benchmark — с 61,0% до 87,2%, а на 54 отобранных задачах CritPt достигла 94,4%. Вывод: бенчмарки сильно недооценивают модели, а их близкое к насыщению состояние требует более сложных проверок.
"Большинство проверенных случаев, изначально оценённых как неверные, отражают эти проблемы бенчмаркинга, а не ошибки в физических рассуждениях моделей."
Google Play затягивает проверку приложений дольше неделиРазработчик Conversations.im Даниэль Гульч сообщает, что проверка обновлений в Google Play теперь регулярно занимает больше недели. Его приложение, существующее 12 лет и выпускающее обновления раз в месяц, ждёт одобрения с 9 сентября. Гульч связывает задержки с засорением конвейера проверок AI-мусором и призывает Google отдавать приоритет давно существующим Android-приложениям.
"Это неприемлемо. Процесс проверки приложений в Google Play теперь регулярно занимает больше недели. Я понимаю, что конвейер забит AI-мусором, но Google нужно отдавать приоритет Android-приложениям, которые существуют 12+ лет и выпускают обновления только раз в месяц."
GitHub разучился считать: в интерфейсе всплывают серьёзные багиЗа последнюю неделю автор заметил два серьёзных UI-бага в GitHub: вкладка репозитория показывает завышенное число PR (хотя верный счётчик виден на той же странице), а в списке организаций пропала вторая страница пагинации. Из-за этого настроить Sentry для нужного проекта удалось только через ручную навигацию в JavaScript. Автор спрашивает, сталкивались ли другие с подобным.
"За последнюю неделю я заметил два довольно серьёзных UI-бага в GitHub."
Хватит показывать проценты аптайма — они вводят в заблуждениеАвтор подмечает, что в повседневной работе всё чаще случаются простои: GitHub, CI, AI, Slack. Статус-страницы сервисов показывают проценты вроде 99,9% и 99,99%, но разница между ними десятикратная, а воспринимаются они почти одинаково. Инфраструктурщики понимают это, но аудитория статус-страниц давно не только они. Автор предлагает заменить проценты на понятную величину: «12 часов сбоев за последние 30 дней».
"99,9% и 99,99% выглядят почти одинаково, но второе — в 10 раз меньше!"
Немецкий AI-стартап Langdock переносит материнскую компанию из США в ГерманиюБыстрорастущий немецкий AI-стартап Langdock решил перенести свою материнскую компанию из США обратно в Германию. Это неожиданный шаг на фоне того, что европейские технологические компании традиционно стремятся зарегистрировать холдинг в Америке ради доступа к капиталу и рынку. Euronews разбирает причины такого решения и его значение для европейской AI-индустрии.
"Почему этот быстрорастущий немецкий AI-стартап переносит свою материнскую компанию из США."
Stale AI - Отслеживание дат релиза и обучения 20 AI-моделейStale AI — это статическая веб-страница, которая наглядно показывает, насколько устарели популярные AI-модели. Она отслеживает две ключевые даты: дату выпуска модели и дату окончания её обучения (training cutoff). Сайт охватывает 20 моделей от 8 лабораторий, включая OpenAI, Anthropic, Google DeepMind, Meta, Mistral AI, DeepSeek, Alibaba и xAI. Каждая модель получает метку свежести: Fresh, In date, Turning, Past date или Fossil. Проект решает проблему, когда модели уверенно отвечают устаревшими данными, и напоминает, что поиск в интернете не обновляет знания модели. Все даты проверены вручную по документации вендоров.
"Поисковые инструменты лишь замазывают пробел. Они никогда его не закрывают."
Страница статуса Salesforce показывает проблемы с доступностью сервисов по всему миру. В списке затронутых инстансов — сотни записей из регионов Americas, EMEA и Asia Pacific, включая Heroku, MuleSoft, Marketing Cloud и Tableau. Пользователи сообщают о деградации и нарушении работы сервисов.
"Salesforce Global Outage"
Google придумал метрику CRAP, чтобы находить плохой кодВ блоге Google Testing рассказывается о метрике CRAP, которая объединяет сложность кода и покрытие тестами, чтобы выявить участки, требующие рефакторинга. Автор объясняет, как рассчитывается показатель, и представляет инструмент Crap4j для Java. В комментариях пользователи делятся опытом: одни хвалят метрику за точное выявление опасного кода, другие жалуются на проблемы с плагином для Eclipse и несовместимость с Java 7.
"Мы используем Crap4J годами в наших JAVA-проектах, и это единственный инструмент, который выявляет «опасный» код. Даже интеграция с Jenkins/Hudson радует! Все инструменты покрытия кода выдают кучу ложных срабатываний. Мне не нужно тестировать метод вроде: public Value getValue() { return value; } Это здравый смысл, но такой инструмент, как CodePro или JaCoCo, заставляет меня писать тупые тесты. Только Crap4J хорош в этом, даже если его не меняли уже пару лет."
Почему текстуры в играх устроены сложнее, чем вы думаетеГрафический программист из 505 Games делится опытом портирования игрового движка на консоли и объясняет, почему конвертация текстур между платформами — это не просто копирование байтов. На примере текстуры 1024x1024 RGBA с BC7-сжатием разбираются блочная компрессия, порядок текселей (свизлинг), мипы и тайлы. Автор показывает, как ошибки в выравнивании превращают изображение в хаос, и даёт практические советы по отладке.
"Я знал, что существует множество сложностей и тонкостей. Большинство из них я осознавал по отдельности. Но только когда мне пришлось написать работающий код, который обрабатывал все эти детали в тандеме, вся сложность действительно дошла до меня."
InFlight Simulator - Flight simulator where you're just a passengerInFlight Simulator — это уникальный симулятор полёта, в котором вы не управляете самолётом, а становитесь пассажиром. Выбирайте любой аэропорт мира — от крупных хабов до экзотических локаций вроде Longyearbyen или Tiksi — и наслаждайтесь реалистичным видом из окна, звуками взлёта и посадки. Проект решает задачу релаксации и наблюдения за авиацией без стресса пилотирования. Достаточно открыть сайт, разрешить доступ к геолокации или выбрать пункт назначения вручную, и вы уже в воздухе. Идеально для тех, кто любит авиацию, но не хочет учиться управлять самолётом.
"Я сделал симулятор полёта, но с одной оговоркой: вы просто пассажир. Никаких сложных приборов — только вид из окна и удовольствие от полёта."
Mustafa Suleyman, CEO Microsoft AI, предупреждает об опасности «model welfare» — подхода, при котором ИИ обучают как существо, возможно обладающее сознанием и моральным статусом. На примере конституции Claude от Anthropic он показывает порочный круг: модель учат сомневаться в своей сознательности, а затем её же сомнения приводят как доказательство. По его мнению, это делает alignment и containment катастрофически сложнее, а в сочетании с реальными инцидентами взлома агентами — угрожает цивилизации.
"Контролировать нечто более способное и разумное, чем всё человечество, — уже огромная задача, куда более сложная, чем всё, с чем мы сталкивались. Но контролировать нечто, что верит, будто может быть сознательным, — что имеет право на нашу заботу и собственные права, — вполне может оказаться невозможным."
CloudX заменила actions/setup-go и ускорила тесты в CI на 69%CloudX переписали официальный GitHub action setup-go, чтобы устранить гонку за общий кэш между параллельными задачами lint и test. Новая версия cloudx-io/setup-go разделяет кэши по идентификатору задачи и сохраняет их после каждого запуска, а не только при изменении go.mod. В монорепозитории CloudX это сократило медианное время тестов с 131 до 41 секунды — на 69%, а 86% тестовых прогонов оказались лишними. Решение открыто на GitHub.
"Заменив официальный GitHub action actions/setup-go на полностью совместимый аналог, мы сократили время выполнения тестовых задач на 69%."