"MAI-Image-2.5-Pro Майкрософт ворвался в лидеры на t2i арене со своей Pro версией модели. Чаржат за генерацию по токенам: • $5 per 1M text input tokens, • $8 per 1M image input tokens • $106 per 1M image output tokens Выходит ~$108.5 за тысячу 1024x1024 картинок. Что дает нам понять, что одна 1024x1024 картинка это примерно 1024 токенов (32x32), то есть у них используется автоэнкодер с 16x сжатием по кадой стороне. Для сравнения MAI-Image-2.5 чтоит $48 за 1к картинок, а Image-2.5-Flash $20. Черипики от арены меня не очень впечатлили - кмк разница с GPT-Image-2 минимальная. Что по сути говорит о том, что арена все менее имеет какой-то вес, т.к. там тестируют модель обычные рандомы из интернета на абсолютно любых промптах вроде ""нарисуй собаку, сделай красиво"". Среди топ-10 моделей различия можно найти только с специфичных кейсах, а в среднем модели очень близки друг к другу по качеству. У Microsoft кстати еще неделю назад вышла MAI-Image-2.6-Preview - трудно понять, в чем различие с 2.5-Pro, но к 2.6, и тестили ее только на другой арене (arena.ai), где она уступает GPT-Image-2. Но в любом случае респект парням из команды MAI (ex Meta GenAI team 💪), что так внезапно ворвались в топ по генерации картинок, ведь Microsoft особо SOTA моделей не выдавал до этого момента вообще. >> Потыкать модели можно в их плейграунде (абсолютно убогом) @ai_newz"
"MAI-Image-2.5-Pro Майкрософт ворвался в лидеры на t2i арене со своей Pro…
Из этого канала
- #4701MAI-Image-2.5-pro потестить нигде не дают - поэтому я потестил 2.6 Разнообразие…
MAI-Image-2.5-pro потестить нигде не дают - поэтому я потестил 2.6 Разнообразие генерации просто на нуле.
- #4705Конференция о технологических вызовах в эпоху AI В прошлом году я уже разбирал…
Конференция о технологических вызовах в эпоху AI В прошлом году я уже разбирал доклад с big tech night, а в этом году 5 сентября Яндекс проводит уже deep tech…
- #4706ARC AGI 3 — Skill Issue Скиллы оказались куда лучше системных промптов. В них…
ARC AGI 3 — Skill Issue Скиллы оказались куда лучше системных промптов. В них можно зашить tool use, решая проблему повторяемости и консистентности ответов.
- #4695Cerebras показали CS-4 Новый сервер позволяет запускать модели на скорости в 2…
Cerebras показали CS-4 Новый сервер позволяет запускать модели на скорости в 2 раза выше, и даёт возможность запускать 10T модели на скорости в 1000+ токенов в…
- #4694Крипто карты от Nvidia начали использовать для инференса Ещё в 2021 году Nvidia…
Крипто карты от Nvidia начали использовать для инференса Ещё в 2021 году Nvidia наклепала для майнинга гору очень сильно урезанных карт CMP HX170, на основе…