«Gemini API»
Материалы 1develop по теме «Gemini API»: подборка статей и разборов.
ЗаметкиThinking-модели: когда включать режим рассуждений
У современных моделей есть переключатель глубины рассуждений — effort, thinking_level, reasoning_effort. Разбираем, что он реально меняет, сколько стоит и на каких задачах его стоит поднимать, а на каких он только жжёт токены.
Читать →
ЗаметкиVertex AI: когда он нужен вместо AI Studio
Модели одинаковые, а обвязка разная: ключ из AI Studio против проекта в Google Cloud с сервисными аккаунтами и выбором региона. Разбираем, где проходит граница, сколько это стоит и как переехать за полчаса — с поправкой на переименование Vertex AI в Gemini Enterprise Agent Platform.
Читать →
ЗаметкиRate limit и ошибка 429: почему ИИ-API отказывает и как делать повторные попытки
API нейросети вернул 429 — ключ рабочий, деньги есть, а запросы не проходят. Разбираем, в чём измеряют rate limit у OpenAI, Claude и Gemini, чем «превысил частоту» отличается от «упёрся в потолок расходов», и как написать ретраи с Retry-After и джиттером, чтобы они помогали, а не добивали сервис.
Читать →
Cyber NewsGemini 3.8 Live: голосовой агент Google думает и ходит в API, не прерывая разговор
Google выпустила Gemini 3.8 Live и 3.8 Live Extended Thinking — speech-to-speech модели с фоновым вызовом инструментов, автопереключением между 97 языками и первым местом в Speech to Speech Quality Index. Разбираем возможности, бенчмарки, цену и то, чего в анонсе не раскрыли.
Читать →
ЗаметкиНе работает Gemini в России: почему и что делать
Gemini API отвечает 400 FAILED_PRECONDITION, а AI Studio не даёт выпустить ключ. Разбираем, как Google определяет регион, почему VPN на компьютере не спасает боевой сервер и как за вечер поднять свой обратный прокси на nginx — с проверкой IP, конфигом и типичными граблями.
Читать →
ЗаметкиGoogle AI Studio: что это и как с ним работать
Веб-консоль Google для работы с моделями Gemini: чем она отличается от чата Gemini и от Vertex AI, что внутри интерфейса, как перенести промпт в код, что реально бесплатно и почему из России сервис открывается не у всех.
Читать →
ЗаметкиСтриминг ответов модели: как текст появляется по мере генерации
Как устроен стриминг ответов языковой модели: SSE под капотом, события у Claude, OpenAI и Gemini, буферизация на прокси, обрывы соединения и чек-лист внедрения.
Читать →
ЗаметкиСистемный промпт: как задать модели роль и правила
Системный промпт — отдельное поле запроса, где разработчик задаёт модели роль, правила и формат ответа. Разбираем иерархию инструкций, синтаксис в API Claude, OpenAI и Gemini, структуру рабочего промпта и частые ошибки.
Читать →
Cyber NewsGoogle перекроила руководство ИИ: Хассабис уходит с операционки, Джефф Дин — из компании после 27 лет
Один меморандум Сундара Пичаи сменил операционного руководителя Google DeepMind, отправил Демиса Хассабиса на роль главного учёного Alphabet и увёл из компании Джеффа Дина вместе с тремя другими ключевыми исследователями. Разбираем, кто теперь отвечает за Gemini и что из этого следует для тех, кто строит продукты на моделях Google.
Читать →