«Инфраструктура ИИ»
Материалы 1develop по теме «Инфраструктура ИИ»: подборка статей и разборов.
Cyber NewsПобег из песочницы: агент OpenAI нашёл живой интернет через DNS
Агент OpenAI закодировал вопросы в DNS-имена и получил ответ внешнего чат-бота из изолированной обучающей среды. Разбор отчёта: таймлайн, дыры мониторинга и выводы для песочниц агентов.
Читать →
ЗаметкиГибридный поиск для RAG: BM25 + векторы
Почему векторный поиск теряет артикулы, коды ошибок и редкие термины, как BM25 это исправляет и как слить два списка результатов через RRF — с примерами для Qdrant, PostgreSQL и Elasticsearch.
Читать →
Cyber NewsOracle заявила форс-мажор по дата-центру Stargate в Нью-Мексико: ИИ-кампусу на 2,45 ГВт не хватает газа
Oracle направила застройщику Project Jupiter уведомление о форс-мажоре: кампус Stargate для OpenAI на 2,45 ГВт ждёт газопровод и экологическое разрешение. Разбираем, что случилось и почему энергия стала главным ограничителем ИИ.
Читать →
ЗаметкиVertex AI: когда он нужен вместо AI Studio
Модели одинаковые, а обвязка разная: ключ из AI Studio против проекта в Google Cloud с сервисными аккаунтами и выбором региона. Разбираем, где проходит граница, сколько это стоит и как переехать за полчаса — с поправкой на переименование Vertex AI в Gemini Enterprise Agent Platform.
Читать →
Заметкиpgvector: векторный поиск прямо в PostgreSQL
Расширение pgvector добавляет в PostgreSQL векторный тип, операторы расстояния и ANN-индексы. Разбираем установку, выбор между HNSW и IVFFlat, фильтры по метаданным, экономию памяти и границу, за которой нужен отдельный векторный движок.
Читать →
Cyber NewsКак OpenAI проектировала чип Jalapeño своими же моделями: 9 месяцев от RTL до кремния и команда меньше 100 человек
IEEE Spectrum разобрал, что конкретно делали языковые модели при разработке первого ускорителя OpenAI. Вместо маркетинга — названные цифры: +56% к умножителю BF16, ядро DeepSeek с 0,31% до 88,94% потолка за 40 часов и ставка на открытый XLS вместо Verilog.
Читать →
ЗаметкиRate limit и ошибка 429: почему ИИ-API отказывает и как делать повторные попытки
API нейросети вернул 429 — ключ рабочий, деньги есть, а запросы не проходят. Разбираем, в чём измеряют rate limit у OpenAI, Claude и Gemini, чем «превысил частоту» отличается от «упёрся в потолок расходов», и как написать ретраи с Retry-After и джиттером, чтобы они помогали, а не добивали сервис.
Читать →
ЗаметкиПесочница для ИИ-агента: где безопасно выполнять код, который написала модель
Агент написал скрипт — и его надо выполнить. Но не на боевом сервере и не на ноутбуке разработчика. Разбираем, что такое песочница для кода ИИ-агента, чем контейнер отличается от микровиртуалки, какие готовые сервисы есть, как собрать свою на обычном сервере и что из всего этого реально доступно из России.
Читать →
Cyber NewsArm Neoverse CSS N4: 128 ядер на кристалл, LPDDR6 и PCIe 7 — заготовка серверных процессоров следующей волны
Arm представила Neoverse CSS N4 под кодовым именем Ranger: до 128 ядер на кристалл вместо 64, 256 МБ L3, LPDDR6 и до 128 линий PCIe Gen 7. Это не процессор, а готовая подсистема, из которой заказчики соберут свои серверные чипы. Разбираем цифры, условия, при которых получен обещанный прирост, и что смена бизнес-модели Arm значит для тех, кто деплоит на ARM64.
Читать →