Больше вычислений — больше возможностей: почему оценки ИИ-агентов должны учитывать test-time compute Стандартные оценки ограничивают, сколько вычислительных ресурсов может потратить ИИ-агент. Мы показываем, что повышение этих лимитов меняет измеряемые возможности, сложность задач, которые агент способен решить, и то, насколько быстро, как кажется, движется передний край развития. Читать статью
Больше вычислений — больше возможностей: почему оценки ИИ-агентов должны…
Источник
https://t.me/ai_longreads/743Канал Про AI: Лучшие cтатьи и исследования · опубликовано 15 июл. 2026 г.
Из этого канала
- #744Как стать прикладным AI-инженером Практическое руководство по переходу от…
Как стать прикладным AI-инженером Практическое руководство по переходу от классической разработки к Applied AI Engineering: почему мышление становится…
- #745AI-сообщество обсуждает сегодня: Релиз Ornith-1.0-35B-GGUF Представлена модель…
AI-сообщество обсуждает сегодня: Релиз Ornith-1.0-35B-GGUF Представлена модель Ornith-1 в формате GGUF, оптимизированная для эффективного инференса.
- #746Начало работы с циклами Команда Claude Code объясняет, что такое циклы (loops)…
Начало работы с циклами Команда Claude Code объясняет, что такое циклы (loops) в агентной разработке: четыре основных типа циклов, когда применять каждый, и…
- #742Позвольте Claude Code полагаться на собственное суждение Саймон Уиллисон…
Позвольте Claude Code полагаться на собственное суждение Саймон Уиллисон делится приёмом от команды Claude Code: не диктуйте модели, как именно работать, а…
- #741Сегодня в AI-мире обсуждают: Mimic: перехват и вызов приложений через Python…
Сегодня в AI-мире обсуждают: Mimic: перехват и вызов приложений через Python Инструмент позволяет перехватывать работу любого приложения и вызывать его функции…