BTC $79,396.61 -0.74%
ETH $2,490.96 -0.38%
BNB $744.33 -1.69%
XRP $1.40 -1.34%
SOL $105.06 -1.28%
TRX $0.3368 +0.77%
DOGE $0.0896 -0.29%
ADA $0.2191 -0.01%
BCH $256.97 -1.46%
LINK $13.30 +8.29%
HYPE $87.78 -0.02%
AAVE $134.35 -0.34%
SUI $0.8128 +1.66%
XLM $0.1921 +3.08%
ZEC $1,206.79 +1.65%
BTC $79,396.61 -0.74%
ETH $2,490.96 -0.38%
BNB $744.33 -1.69%
XRP $1.40 -1.34%
SOL $105.06 -1.28%
TRX $0.3368 +0.77%
DOGE $0.0896 -0.29%
ADA $0.2191 -0.01%
BCH $256.97 -1.46%
LINK $13.30 +8.29%
HYPE $87.78 -0.02%
AAVE $134.35 -0.34%
SUI $0.8128 +1.66%
XLM $0.1921 +3.08%
ZEC $1,206.79 +1.65%

flash

Все
Статьи
Новости

B.AI объявила, что DeepSeek V4 Flash завершит бесплатный период и будет взимать плату в размере 50%

Платформа AI моделей B.AI объявила, что с 3 сентября 2026 года в 17:00 (SGT) DeepSeek V4 Flash и DeepSeek V4 Flash Vision Exp завершат бесплатный период, и начнется платное использование с 50% скидкой, при этом две модели все еще будут доступны бесплатно.B.AI будет синхронизировать официальные цены DeepSeek и внедрять дополнительные скидки: в пиковые часы (будние дни с 09:00 до 12:00 и с 14:00 до 18:00 SGT) будет действовать официальная цена со скидкой 50%, в нерабочие часы (остальное время будних дней и все выходные) будет предоставлена дополнительная скидка 50%, что составит 25% от официальной цены. GLM 5.3 Flash останется бесплатным, эта модель имеет 320B общих параметров и 18B активных параметров, поддерживает 1M контекста. Qwen3.8 Flash, Hy3, MiMo V2.5 также останутся бесплатными.

first_img Сотрудники Google протестировали модель следующего поколения Gemini 3.8 Flash

Согласно сообщениям ChainCatcher и Business Insider, после того как Google в этом месяце выпустила новую модель ИИ, некоторые сотрудники начали тестировать предварительную версию Gemini 3.8 Flash на внутренней платформе кодирования Jetski. Один из тестировщиков заявил, что модель значительно превосходит 3.7 Flash, но подчеркнул, что сейчас слишком рано для полной оценки. Google не прокомментировала это.На фоне того, что 3.5 Pro еще не выпущен, а Anthropic и OpenAI продолжают ускоряться, Google больше не имеет передовых моделей и вместо этого сосредоточилась на более быстрых и дешевых "основных моделях" серии Flash для кодирования и запуска агентов. Gemini 3.6 Flash была выпущена в июле, а 3.7 Flash последовала всего через три недели. Генеральный директор Сундар Пичаи на отчетной конференции за Q2 заявил, что цель компании — выпускать новые версии почти каждый месяц.Предварительный просмотр сотрудниками намекает на то, что публичный запуск Gemini 3.8 Flash может быть не за горами, но это не гарантировано. Некоторые наблюдатели за ИИ считают, что следы этой модели уже были обнаружены на сайте бенчмаркинга Arena AI, где Google ранее тестировала предстоящие версии. В начале этого года Google также выпустила агента Gemini Spark.

B.AI запустила модель Zhipu GLM-5.3-Flash и бесплатно открыла API

Сообщение ChainCatcher, 27 августа, универсальная платформа инфраструктуры AGI B.AI объявила о том, что Zhipu GLM-5.3-Flash (320B-A18B) официально запущена на платформе и полностью бесплатно доступна в официальной группе API. В качестве первой нативной модели полного модального ряда серии GLM-5, GLM-5.3-Flash имеет 320B общих параметров и 18B активных параметров, поддерживаемых вычислительной мощностью чисто отечественных AI чипов, впервые внедряя смешанную архитектуру разреженного и линейного внимания, в сочетании с 1M сверхдлинным контекстом, обладая как мощной производительностью, так и исключительной ценой. С сегодняшнего дня разработчики могут без затрат вызывать через официальную группу API B.AI, легко справляясь со сложным выводом, обработкой длинных текстов и многомодальными задачами.

Alibaba Cloud снизил цену на модель Qwen3.8-Flash

ChainCatcher сообщает, что согласно информации от Jinshi, Alibaba Cloud объявила, что с 27 августа 2026 года в 12:00:00 по пекинскому времени будет снижена цена на модель Qwen3.8-Flash на платформе больших моделей Bailian. Qwen3.8-Flash — это новейшая многомодальная большая модель от Qianwen, которая изначально поддерживает контекстное окно на миллион слов, может обрабатывать сверхдлинные документы, кодовые репозитории и сложные диалоги за один раз, демонстрируя выдающиеся результаты в таких сценариях, как помощь в программировании, сотрудничество интеллектуальных агентов и понимание текста и изображений. Она совместима с интерфейсными протоколами OpenAI и Anthropic, что делает её подходящей для создания высоконагруженных приложений и интеллектуальных рабочих процессов.Конкретно: цена на ввод до корректировки составляла 1 юань, после корректировки — 0.8 юаня; цена на вывод до корректировки составляла 3 юаня, после корректировки — 2.7 юаня.

first_img Zhìpǔ выпустила GLM-5.3 Flash, предоставляющую услуги вывода на основе 100000 отечественных чипов, сопоставимую с DeepSeek V4 Flash

Сообщение ChainCatcher, Zhipu выпустила легковесную флагманскую модель GLM-5.3 Flash, предназначенную для конкуренции с DeepSeek V4 Flash и использующую более 100 000 отечественных чипов для предоставления услуг вывода. Масштаб параметров этой модели составляет около 300B, что составляет примерно 40% от GLM-5.3 и в основном соответствует DeepSeek V4 Flash; использует архитектуру MoE, фактически активированные параметры составляют около 18B, обладает нативными мультимодальными возможностями, поддерживает ввод изображений и видео, также это первая новая модель с мультимодальными возможностями после того, как Zhipu сосредоточила свои усилия на стратегии кодирования.Общий оценочный балл превышает предыдущую флагманскую модель GLM-5.2, равен Claude Opus 4.8 и выше соответствующих баллов официальной версии DeepSeek V4 Pro. Цены составляют 0.8 юаня за миллион токенов ввода, 2.8 юаня за вывод, 0.23 юаня за кэш-попадание, что составляет примерно одну десятую от GLM-5.3, в первые две недели после запуска предлагается скидка 50%. Модель полностью адаптирована к отечественным вычислительным мощностям, онлайн-трафик обрабатывается отечественными чипами, Zhipu утверждает, что эффективность аппаратного обеспечения кластера и стоимость токена на единицу достигли уровня, сопоставимого с основными графическими процессорами NVIDIA; эта модель ранее проходила анонимное тестирование на зарубежных платформах под кодовым названием Ox Alpha.

Zhìpǔ запустил и открыл исходный код модели "Ниу Лай" GLM-5.3-Flash

Сообщение ChainCatcher, официально объявлено компанией Zhipu о запуске и открытом исходном коде GLM-5.3-Flash, который является первой нативной многомодальной моделью серии GLM-5.Согласно информации, общая производительность GLM-5.3-Flash превышает GLM-5.2, программирование и оценка Agent близки к Claude Opus 4.8, но цена составляет всего одну десятую от GLM-5.2. Также была заменена основная модель, впервые в основной серии GLM была введена смешанная архитектура разреженного внимания и линейного внимания, и модель была предварительно обучена на многомодальных данных объемом 30T Token.Zhipu заявила, что для сбора широких и профессиональных отзывов от пользователей перед официальным выпуском была проведена масштабная тестирование анонимной модели Ox-Alpha (в китайском сообществе известной как Нюлай) на OpenCode и OpenRouter. Ox-Alpha быстро стала самой популярной моделью недели, установив новый рекорд по количеству вызовов на обеих платформах, при этом весь поток запросов обеспечивался вычислительной мощностью отечественных чипов.Ранее в сообществе тестирование Ox Alpha с использованием DeepSWE на малом объеме данных показало результат 80%, но это было всего лишь на 10 вопросах. После увеличения объема выборки результат снизился до примерно 63%, а тестировщики также самостоятельно исправили первоначальное утверждение. Этот результат по-прежнему относится к первой группе, но не так впечатляющ, как первоначальные 80%. После открытия весов разработчики могут напрямую использовать такие фреймворки, как vLLM, SGLang, KTransformers для развертывания, не прибегая к API анонимной модели.

first_img Алибаба выпустит Qwen 3.8-Flash-Next, представит архитектуру Qwen 4

Сообщение ChainCatcher, команда Alibaba Qwen в среду выпустит Qwen 3.8-Flash-Next, это модель смешанных экспертов (MoE) с общим количеством параметров 125 миллиардов, но каждый токен активирует только 6 миллиардов параметров. Команда позиционирует её как предварительную версию следующей архитектуры Qwen 4, а не как окончательную флагманскую модель.Эта модель описывается как мультимодальная и построена на основе предстоящей архитектуры Qwen 4. Команда заявила, что предварительный выпуск этой ранней версии предназначен для того, чтобы разработчики могли подготовиться к последующей полной серии Qwen. Веса модели будут размещены на платформах Hugging Face и ModelScope.На данный момент Qwen не опубликовал результаты бенчмаркинга этой модели и не выпустил сравнительные данные с собственной серией Qwen 3 или зарубежными конкурентами, конкретные цифры 125 миллиардов и 6 миллиардов параметров пока не получили официального подтверждения. В качестве модели с открытыми весами разработчики могут бесплатно загружать, донастраивать и запускать её, не отправляя данные в закрытое API, что помогает снизить затраты на хостинг модели.

DeepSeek-V4-Flash-Vision-Exp вход в B.AI, полностью бесплатно открыт

Сообщение от ChainCatcher, платформа B.AI запустила новый флагманский многомодальный экспериментальный модель DeepSeek-V4-Flash-Vision-Exp, в настоящее время официальная группа API уже завершила полный доступ и открыла его для всех пользователей бесплатно.Эта модель, продолжая лучшие возможности V4-Flash в области чистого текста и кода Agent, официально разблокировала родные возможности понимания изображений, комплексные показатели многомодального Agent уже близки к флагманскому уровню Claude Opus-4.8.Новая модель поддерживает смешанный ввод текста и изображений и 1M сверхдлинный контекст, она легко справляется с такими сложными сценариями, как генерация многомодальных PPT, сложная реконструкция пользовательского интерфейса и фронтенд-эффекты, ввод изображений тарифицируется по токенам, за одно изображение взимается максимум 384 токена. Теперь все пользователи, войдя на платформу B.AI, могут без барьеров бесплатно использовать возможности этой новейшей многомодальной модели, позволяя передовым вычислительным мощностям ускорить реализацию креативности и производительности.

DeepSeek-V4-Flash бесплатная акция продолжает набирать популярность, B.AI общий объем превышает 641,5 миллиарда

Сообщение ChainCatcher, платформа B.AI DeepSeek-V4-Flash продолжает набирать популярность с бесплатной акцией без порога входа, общий объем токенов на платформе уже превысил 6,415.24 миллиарда, из которых 20 августа максимальный объем за один день составил 2,859.63 миллиарда токенов, что почти в 4 раза больше по сравнению с первым днем акции, непрерывно обновляя исторические рекорды.За этой группой данных стоит не только жесткая проверка высокой пропускной способности платформы, но и отражение реального всплеска спроса на доступный ИИ. B.AI будет продолжать снижать стоимость использования ИИ, предоставляя разработчикам и пользователям Web3 низкий порог входа и неограниченные возможности для создания и использования Agentic приложений, чтобы передовые вычислительные мощности стали действительно доступными.

DeepSeek визуальная модель официально запущена API: цена такая же, как у V4 Flash

Сообщение от ChainCatcher, DeepSeek официально запустил новую визуальную модель deepseek-v4-flash-vision-exp. Официальная документация API уже сопоставила её с V4 Flash и V4 Pro, разработчики могут напрямую передавать изображения через DeepSeek API. Модель поддерживает контекст в 1 миллион токенов, максимальный вывод составляет 384 тысячи токенов, также поддерживаются JSON Output, Tool Calls, Responses API и Anthropic API.Цены напрямую соответствуют V4 Flash. Каждый миллион токенов ввода при отсутствии кэширования в пиковые часы составляет 3 юаня, в нерабочее время — 1.5 юаня; при попадании в кэш стоимость составляет всего 0.1 юаня и 0.05 юаня соответственно. Каждый миллион токенов вывода в пиковые часы стоит 9 юаней, в нерабочее время — 4.5 юаня. По сравнению с V4 Pro, цена в одном и том же сегменте составляет только треть.За изображения не взимается отдельная плата. DeepSeek будет конвертировать изображения в токены в зависимости от их размера, а затем выставлять счет вместе с текстовыми токенами. Пиковые часы — с 9:00 до 12:00 и с 14:00 до 18:00 по пекинскому времени, в остальное время цена уменьшается вдвое.

first_img DeepSeek V4 Flash визуальная модель, предположительно, скоро будет выпущена

Сообщение ChainCatcher, по данным пользователя X MaxForAI, появились признаки визуальной модели DeepSeek. Сегодня в 3 часа дня название deepseek-v4-flash-vision-exp появилось в коде, связанном с DeepSeek Harness, и последняя версия Harness начала добавлять адаптацию для нативных запросов изображений. Однако до тех пор, пока конечная точка модели не будет готова, эта модель не будет добавлена в официальный каталог моделей.На данный момент DeepSeek, похоже, тестирует визуальную версию V4 Flash, открытое API еще не было официально открыто. Некоторые пользователи уже напрямую запрашивали DeepSeek API с использованием идентификатора модели, но по-прежнему возвращается ошибка, и в официальной документации эта модель еще не указана. Путь адаптации между клиентом и Harness уже в основном подготовлен, и DeepSeek V4 Flash, вероятно, скоро получит визуальные возможности.

DeepSeek-V4-Flash бесплатное мероприятие продолжает набирать популярность, B.AI снова добавляет Tencent Hy3 полностью бесплатно

Сообщение ChainCatcher, 21 августа, платформа B.AI объявила о официальном запуске нового поколения базовой модели Tencent Hongyuan Hy3, которая полностью бесплатно доступна на Web Chat и API. Как жесткая модель, использующая архитектуру интеграции быстрого и медленного мышления, Hy3 достигла прорыва в таких аспектах, как инженерия агентов, генерация сложного кода, понимание долгосрочных намерений и устойчивость к галлюцинациям, и создана специально для реальных производственных сценариев. С сегодняшнего дня все пользователи могут без каких-либо барьеров войти на платформу B.AI и бесплатно воспользоваться возможностями этой передовой модели Tencent, не неся никаких затрат, чтобы испытать мощные возможности, которые передовые технологии ИИ приносят в разработку и творчество.
app_icon
ChainCatcher Building the Web3 world with innovations.