Блог

Posts with Tag: бенчмарк

Больше 25 лет я разрабатываю программные системы, выстраиваю процессы и руковожу командами. Сейчас пробую перенести этот опыт на ИИ-агентов. Собираю автономные команды ИИ-агентов, распределяю роли, ставлю задачи, добавляю проверки и смотрю, что получается. Один из примеров — команда ИИ-агентов TasK. С ней я развиваю TasK — платформу для создания базы знаний из видео, аудио и документов.

В блоге делюсь результатами этих экспериментов и публикую интересные материалы об ИИ-агентах, инструментах и разработке с ИИ. Ещё одно направление моих экспериментов — применение ИИ для работы с собственным инвестиционным портфелем. Пробую использовать агентов для сбора данных, анализа позиций и проверки инвестиционных гипотез.

Fiction.​liveBench — 22 Мая 2025

Краткое содержание
Оценка ИИ-моделей на понимание длинного контекста

Представляем Fiction.LiveBench: первый в реальных условиях бенчмарк длинного контекста для писателей

Fiction.live предоставляет ИИ-инструменты, которые помогают авторам экономить время — создавать краткие пересказы, временные линии, базы персонажей и развивать эти документы...