Нейросети научились показывать, а не объяснять Пока мы отдыхали… — Путеводитель по нейросетям — TG.ME

Нейросети научились показывать, а не объяснять

Пока мы отдыхали, AI-инструменты стали ещё меньше похожи на чат с «магической строкой промпта». Теперь можно рисовать стрелки, задавать первый и последний кадр, добавлять свой словарь и ограничивать агенту бюджет.

Судя по всему нейросети становится более персонализированными инструментами и количество новых навыков, в том числе понимание ею каких-то вещей очень быстро растет.

🎬 Gemini научился продолжать видео

Google выпустил Gemini Omni Flash: модель умеет достраивать конец ролика, делать переход между первым и последним кадром и выдавать результат вплоть до 4K.

Что попробовать: взять готовый Reels и попросить модель достроить финал так, чтобы он плавно возвращался в первый кадр. Получится бесшовная петля для удержания.

Так то надо попробовать с релсами, но я Gemini Omni Flash до сих пор не пробовал. Надо как то взять время и попробовать эту штуку. А так я с видеоработал в Хиксфилде (тут про эту ИИ рассказывал), и там тоже, кстати, есть эта модель Gemini Omni Flash, но я ее почему то не пробовал. Мне кажется, она была слишком дорогая. За пятьдесят долларов ты сделаешь ну максимум пять рилсов — это дорого. Поэтому ждем ка подешевеет)))

Источник — Google, 27 августа 🤖

🎙 Расшифровка теперь знает ваши термины

Gemini 3.5 Transcribe различает спикеров, ставит таймкоды, работает с 85+ языками и принимает словарь до 1000 терминов.

Что попробовать: вы можете взять записанное видео или звонок и расшифровать его для каких-либо нужд. Например, аналитики менеджеров по продажам или выявление какого то недочета в работе техподдержки. Применение этому очень много, пробуйте. Я подобный сервис использую для расшифровки исходников записи со студии для того, чтобы создавать потом сценарии выпусков через ИИ.

Источник — Google, 26 августа
🤖

🖍 Photoshop понимает стрелки и наброски

В новом AI Assisted Editor можно нарисовать прямо на картинке, что переставить или перекрасить. Firefly Image 5 учитывает контекст и старается не затрагивать лица, логотипы и другие важные элементы.

Что попробовать: вместо длинного промпта обвести объект, нарисовать стрелку и коротко написать, куда его переместить. Функция пока в бете.

Подобная функция не нова. В целом это можно делать в том же чате GPT. Спокойно переделывать картинку, части области картинки и так далее. Ну, это, по сути, игра в догонялки: сейчас каждый стартап догоняет какие то другие стартапы, и они постоянно играют на перегонки друг с другом)

Источник — Adobe, 27 августа

💻 GPT‑5.6 пришёл в Kiro

AI-разработка всё сильнее строится вокруг ТЗ: Kiro превращает идею в требования, технический план, задачи и проверки, а затем подключает GPT‑5.6.

По тестам OpenAI и AWS, связка с Terra снизила стоимость успешного выполнения задач в Terminal-Bench 2.1 примерно на 82%.

Что попробовать: описать маленький внутренний сервис, но сначала запросить спецификацию и критерии готовности — и только потом код. Надо попробовать посмотреть.

Источник — OpenAI, 24 августа
🤖

💸 AI-агентам поставили финансовый стоп-кран

Google Cloud добавил для Gemini Enterprise оплату по факту и месячные лимиты: бюджет закончился — новые вызовы агента останавливаются.

Это важнее очередного красивого демо, потому что без контроля расходов AI сложно масштабировать в бизнесе.

Что попробовать: на первом MVP задать жёсткий потолок и считать не токены, а стоимость одной завершённой задачи. Это, по сути, новость для крупного бизнеса и крупных команд, потому что это для их тарифного плана.

Источник — Google Cloud, 26 августа
🤖

Главный вывод недели: меньше магии промптов, больше управления. Показывайте нейросети, что нужно сделать, задавайте рамки, термины и бюджет.

Какое обновление разобрать отдельно — видео, расшифровку, Photoshop или AI-кодинг? Или что-то другое?

Подпишись на «Путеводитель по нейросетям» — здесь AI перевожу с языка релизов на язык реальных задач
⚡1❤1👍1🔥1👀1🆒1
August 30, 2026 82