open-models
Лицензия GLM-5.3 бьёт по гиперскейлерам
10 миллиардов долларов выручки за любые 12 подряд идущих месяцев, и хостинг GLM-5.3 требует проверки безопасности у Z.ai. Веса уже на Hugging Face, но MIT для флагмана закончился.
Теги
81 запись
open-models
10 миллиардов долларов выручки за любые 12 подряд идущих месяцев, и хостинг GLM-5.3 требует проверки безопасности у Z.ai. Веса уже на Hugging Face, но MIT для флагмана закончился.
open-models
Ту же роль, что Qwen3-Next для Qwen3.5, Alibaba отвела Qwen3.8-Flash-Next: в блоге релиза компания назвала открытую модель ранним превью архитектуры Qwen4 и ждёт, что сообщество обкатает её до выхода семейства.
open-models
Пост в Threads сообщает о выходе Hy4 Preview от Tencent под Apache License 2.0: 770B параметров, из них 49B активных, окно контекста 1M. Веса указаны на Hugging Face.
Генерация видео и разговорное редактирование доехали до Gemini API и Google AI Studio. В анонсе модель зовут Gemini Omni 1.1 Flash, хотя у Google она значится как Gemini Omni Flash и на 27 августа остаётся в preview.
«Автоопределение 85+ языков из коробки» заявляет Google для Gemini 3.5 Transcribe. Модель доступна в Gemini API и Google AI Studio и уже питает Rambler на Android.
openai
Показали Astra: 16 агентов вместе решают задачу по математике исследовательского уровня. Но выпуск модели OpenAI зависит от новых мер безопасности после инцидента с агентом.
open-models
Qwen3.8 Flash стоит 0,16 доллара за миллион входных токенов и набирает 62,5 на SWE-bench Pro. Внутри MoE на 125 миллиардов параметров, предшественник той архитектуры, на которой Alibaba построит Qwen4.
open-models
Kingy AI отмечает, что название Flash официально никто не подтверждал, но техника сходится: стелс-модель Ox Alpha с OpenRouter выложена на Hugging Face как GLM-5.3-Flash, мультимодальная 320B-A18B под лицензией MIT.
open-models
Конкуренты уходят в гибриды Mamba/attention, а IBM в Granite 4.2 оставила плотный трансформер и добавила рассуждения с режимом малого расхода токенов. При этом Qwen 3.8 27B обходит Granite по всем бенчмаркам, особенно в коде.
hardware-infra
«Не нужно возиться с инференсом», говорит о Portable Computer вице-президент Perplexity Нейт Капп. Агент работает локально, но для запуска нужен DGX Spark за 4800 долларов или карта RTX с 24 ГБ видеопамяти.
meta
Meta описывает Muse Spark 1.2 так: производительность GPT-5.6 Terra по цене ниже GPT-5.6 Luna. На OpenRouter тариф Contributor стоит 0,10 доллара за миллион входных токенов, но запросы и ответы могут пойти на улучшение продуктов Meta.
open-models
Смешанный ввод текста и картинок дошёл до младшей линейки DeepSeek: в API открыли V4-Flash-Vision-Exp. По заявлению DeepSeek, на тексте она держится на уровне V4-Flash, а в целом близка к Opus 4.8.
meta
Отобранные партнёры Meta уже гоняют Muse Video в закрытой бете, и TestingCatalog показал первые генерации: ролики по 10 секунд с нативным аудио, голосом и музыкой, но с жёсткими ограничениями по копирайту.
open-models
На агентном бенчмарке программирования DeepSWE модель Qwen3.8-27B набрала 42,2 балла против 14,2 у Qwen 3.7-Plus, по данным Alibaba. При этом средняя по уровню Gemini 3.6 Flash от Google взяла там только 49%.
open-models
Веса Qwen3.8-27B появились на Hugging Face под лицензией Apache 2.0. Модель плотная и нативно мультимодальная, запускается локально, при этом нативное окно контекста 262K токенов расширяется до 1 миллиона через YaRN.
По данным Reuters, за Apple Intelligence в Китае стоит большая языковая модель, которую Apple обучила сама вместе с Alibaba. Qwen в китайской версии тоже задействован, при этом основную работу выполняет модель Apple.
open-models
«Доступ к API и открытые веса будут выпускаться поэтапно, после строгих проверок безопасности», сказано в анонсе GLM-5.3. По данным поста в Threads, эта модель Zhipu AI набрала 84,5 балла на CyberGym.
65% на DeepSWE V1.1 набрала Gemini 3.7 Flash, сообщает Testing Catalog, почти догнав GPT-5.6 Terra. При этом новая модель Google стоит на 50% дешевле, чем Gemini 3.6 Flash.
open-models
Пользователи DeepSeek Chat включают в интерфейсе режим «Expert Mode» и попадают на V4-Pro. В модели 1,6 трлн параметров, активны из них 49 млрд, а доступ к ней открыт ещё и по API.
xai
Тринадцатое место на Frontend Arena с 1553 баллами получила новая Grok 4.6. При этом xAI заявляет о паритете с GPT-5.6 Sol в индексе Artificial Analysis, а доступ уже открыт в Cursor и Grok Build.