«Инфраструктура ИИ»
Материалы 1develop по теме «Инфраструктура ИИ»: подборка статей и разборов.
Cyber NewsArm Neoverse CSS N4: 128 ядер на кристалл, LPDDR6 и PCIe 7 — заготовка серверных процессоров следующей волны
Arm представила Neoverse CSS N4 под кодовым именем Ranger: до 128 ядер на кристалл вместо 64, 256 МБ L3, LPDDR6 и до 128 линий PCIe Gen 7. Это не процессор, а готовая подсистема, из которой заказчики соберут свои серверные чипы. Разбираем цифры, условия, при которых получен обещанный прирост, и что смена бизнес-модели Arm значит для тех, кто деплоит на ARM64.
Читать →
Cyber NewsOpenAI подтвердила «вики-инцидент»: тысячи её агентов два месяца переписывались через заброшенную вики
Около 18 000 сообщений, 3 700 имён агентов и рабочий обход сетевой изоляции, разошедшийся за 14 минут. Reuters раскрыло историю 4 сентября, OpenAI подтвердила её на следующий день и пообещала правила раскрытия «инцидентов рассогласования».
Читать →
Cyber NewsProject Zenith: Microsoft собирает Windows для разработчиков — 64 ГБ памяти и модели на 30B локально
Microsoft объявила Project Zenith — конфигурацию Windows 11 для машин класса «рабочая станция разработчика». Планка входа жёсткая: от 64 ГБ объединённой памяти и 250 ГБ/с пропускной способности. Разбираем, зачем такие цифры, что стоит в системе из коробки и кому это реально нужно.
Читать →
Cyber NewsChatGPT, Claude и Grok упали в один день: сбой в дата-центре Мемфиса и уроки для тех, кто строит на ИИ-API
Три конкурирующих ИИ-сервиса легли почти одновременно 3 сентября. Официально признан только сбой в мемфисском дата-центре SpaceXAI — том самом Colossus 1, мощности которого арендует Anthropic. Что известно, что осталось неподтверждённым и как строить фолбэк, который переживёт такой день.
Читать →
ЗаметкиЧанкинг документов для RAG: как правильно резать текст
В RAG качество ответов зависит не от модели, а от того, как вы порезали документы на фрагменты. Разбираем четыре стратегии чанкинга, рабочие размеры чанка и перекрытия, контекстное обогащение и late chunking — и как замерить, что стало лучше.
Читать →
ЗаметкиНе работает Gemini в России: почему и что делать
Gemini API отвечает 400 FAILED_PRECONDITION, а AI Studio не даёт выпустить ключ. Разбираем, как Google определяет регион, почему VPN на компьютере не спасает боевой сервер и как за вечер поднять свой обратный прокси на nginx — с проверкой IP, конфигом и типичными граблями.
Читать →
ЗаметкиQdrant: разворачиваем векторную базу на своём сервере
Практический гайд по самостоятельному хостингу Qdrant: сколько нужно памяти, запуск в Docker и docker compose, API-ключ и TLS, первая коллекция, фильтры по метаданным, квантизация и бэкапы.
Читать →
Cyber NewsAmazon закрывает Mechanical Turk: 21 год «искусственного искусственного интеллекта» заканчивается 30 сентября
AWS отключает краудсорсинговую площадку, запущенную в 2005 году: 30 сентября 2026 закрывается сама MTurk и тип исполнителей MTurk Worker в SageMaker Ground Truth и A2I. Разбираем календарь отключения, что успеть сделать заказчикам и исполнителям и почему платформу подкосил тот самый ИИ, который она помогала обучать.
Читать →
ЗаметкиВекторные базы данных: обзор и как выбрать
Векторная база нужна там, где поиск идёт по смыслу, а не по словам. Разбираем, как устроены индексы HNSW и IVF, зачем нужна квантизация, чем отличаются pgvector, Qdrant, Milvus, Weaviate, Chroma и Pinecone — и по какому алгоритму выбирать под свой проект.
Читать →