«Инфраструктура ИИ»
Материалы 1develop по теме «Инфраструктура ИИ»: подборка статей и разборов.
ЗаметкиЧанкинг документов для RAG: как правильно резать текст
В RAG качество ответов зависит не от модели, а от того, как вы порезали документы на фрагменты. Разбираем четыре стратегии чанкинга, рабочие размеры чанка и перекрытия, контекстное обогащение и late chunking — и как замерить, что стало лучше.
Читать →
ЗаметкиНе работает Gemini в России: почему и что делать
Gemini API отвечает 400 FAILED_PRECONDITION, а AI Studio не даёт выпустить ключ. Разбираем, как Google определяет регион, почему VPN на компьютере не спасает боевой сервер и как за вечер поднять свой обратный прокси на nginx — с проверкой IP, конфигом и типичными граблями.
Читать →
ЗаметкиQdrant: разворачиваем векторную базу на своём сервере
Практический гайд по самостоятельному хостингу Qdrant: сколько нужно памяти, запуск в Docker и docker compose, API-ключ и TLS, первая коллекция, фильтры по метаданным, квантизация и бэкапы.
Читать →
Cyber NewsAmazon закрывает Mechanical Turk: 21 год «искусственного искусственного интеллекта» заканчивается 30 сентября
AWS отключает краудсорсинговую площадку, запущенную в 2005 году: 30 сентября 2026 закрывается сама MTurk и тип исполнителей MTurk Worker в SageMaker Ground Truth и A2I. Разбираем календарь отключения, что успеть сделать заказчикам и исполнителям и почему платформу подкосил тот самый ИИ, который она помогала обучать.
Читать →
ЗаметкиВекторные базы данных: обзор и как выбрать
Векторная база нужна там, где поиск идёт по смыслу, а не по словам. Разбираем, как устроены индексы HNSW и IVF, зачем нужна квантизация, чем отличаются pgvector, Qdrant, Milvus, Weaviate, Chroma и Pinecone — и по какому алгоритму выбирать под свой проект.
Читать →
ЗаметкиЭмбеддинги простыми словами: как текст превращается в числа
Эмбеддинг — это набор чисел, в который модель превращает текст, чтобы компьютер мог сравнивать смыслы. Разбираем без формул: откуда берутся эти числа, как считают близость, какие модели актуальны в 2026 году и какие ошибки чаще всего ломают поиск.
Читать →
Cyber NewsNvidia платит Poolside $6 млрд за «фабрику моделей»: 109 инженеров уходят делать открытые Nemotron
Nvidia заплатит стартапу Poolside 6 млрд долларов за неисключительную лицензию на его платформу обучения моделей и вложит ещё миллиард в саму компанию. 109 инженеров переходят работать над открытыми моделями Nemotron. Формально это не покупка — и в этом весь смысл конструкции.
Читать →
Cyber NewsWaymo раскрыла собственный чип для роботакси: 5 нм, больше 1000 TOPS и 13 камер в реальном времени
Waymo десять лет не рассказывала, что стоит в багажнике её роботакси. Теперь компания раскрыла собственный 5-нанометровый ASIC: более 1000 TOPS, одновременная обработка 13 камер, временнóе шумоподавление и два независимых движка с горячим резервом. Разбираем, зачем эксплуатанту сервиса свой кремний и что из этого стоит забрать разработчикам.
Читать →
ЗаметкиЛокальные модели: запускаем Ollama на своём сервере
Ollama ставит языковую модель на ваше железо и поднимает рядом HTTP-сервер, совместимый с OpenAI API. Разбираем требования к памяти, установку, команды, настройки сервиса и то, где локальный запуск честно проигрывает облаку.
Читать →