7213Ejaaz

vip
Возраст 1.6 год
Максимальный уровень 0
Пока нет содержимого
вот и всё — Microsoft будет использовать Kimi K3, чтобы приводить в действие их флагманского ИИ-ассистента Copilot, экономя до 60% за каждый токен или $600M на каждый $1B , потраченный на расходы на инференс.
если Microsoft решит развернуть модель у себя, один раз Кimi откроет её исходный код 27-го числа, то эти затраты снизятся ещё сильнее.
любите или ненавидьте эти китайские модели, open source действительно выравнивает поле в большом масштабе.
согласно информации
MSFT2,20%
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Кого волнует, что Kimi k3 лучше, чем Fable? Весь смысл в том, что они доказали: вы можете получить модель уровня frontier за существенно более низкую стоимость.
А это значит, что что-то нужно пересчитать в цене.
Если вы компания, которая тратит $10–100 млн на токены, и вы можете сократить это в 21 раз — почему, блин, вы бы не стали это рассматривать?
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
причина, по которой вам стоит обратить внимание на kimi k3 — не в том, что он обыгрывает fable, а в том, что у него нулевые ограничения: нецензурный ИИ.
причина, по которой вам стоит беспокоиться из-за Китая, в том, что они догнали США. представьте, как нецензурная мифология уходит вразнос.
интеллект на токен — теперь это всё, что имеет значение, и Китай здесь, чтобы играть, а их модели стоят дёшево, аф.
правила изменились.
kimi теперь. deepseek, zhipu, qwen все следом.
DEEPSEEK-3,31%
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
напоминание: Opus 5 выйдет на следующей неделе, и, вероятно, обгонит K3.
главное преимущество, которое есть у Anthropic и OpenAI, — они могут дистиллировать свои флагманские модели в более дешёвые и доступные модели с высокой интеллектуальностью на единицу затрат
а ещё Fable 6 и GPT 6 будут здесь примерно через 1 месяц. циклы становятся короче.
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
k3 из kimi ощущается более значимым, чем момент с deepseek. трудно не заметить:
> обходит fable, получив 5,6 на нескольких ключевых бенчмарках. впервые китайская модель *не* отстаёт
> и делает это при доле от размера, стоимости и без пафосных видеокарт nvidia
> повторяющиеся прорывы в данных, использованных для обучения моделей, + в тренировочных техниках сделали Китай легитимным центром для исследований в области ИИ
всё это ещё и с открытым исходным кодом. с какого момента мы начинаем признавать, что у них здесь действительно может быть преимущество?
разрыв сократился максимум до 3 месяцев се
DEEPSEEK-3,31%
NVDA0,36%
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
Google $GOOG испытывает трудности с продажей своих TPU: 75% чипов, которые используют неоклоуды, — это чипы Nvidia, но есть веские основания для того, что Google сможет победить в течение следующего года: стоимость.
Meta, Uber, Microsoft и многие другие за последние несколько месяцев сократили агрессивные расходы на ИИ, перейдя на более дешёвые модели — это позволило им сэкономить $10-100Ms.
Но самая большая статья расходов при использовании ИИ-моделей связана с базовой инфраструктурой, которая обслуживает их для клиентов: TPU — это более дешёвая (и более эффективная) альтернатива.
Моё предпо
GOOG1,55%
NVDA0,36%
META-0,02%
UBER-0,41%
MSFT2,20%
Посмотреть Оригинал
post-image
post-image
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Боже, какое время быть живым.
Теперь у нас внезапно появилось 10+ ИИ-моделей с похожими возможностями, и мы получаем новую версию каждые ~2–3 недели.
Лучшее в том, что как бы ты ни искал — есть модель под это:
дешевле, чем fable? gpt 5.6
беспокоишься о приватности? 5+ открытых моделей
не знаешь, какую модель выбрать? cursor или openrouter
Anthropic, OpenAI, xai, meta, google, zhipu, deepseek, moonshot, alibaba — все они сейчас конкурируют агрессивно, и это отлично для тебя, пользователя.
Nvidia, cerebras, etched, groq, intel, tsmc — тоже конкурируют, чтобы оптимизировать слой жел
NVDA0,36%
INTC2,17%
TSM1,10%
META-0,02%
BABA4,73%
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
Невероятно. Apple подаёт в суд на OpenAI за кражу аппаратных секретов для их будущих AI-устройств, которые выйдут позже в этом году.
Похоже, один сотрудник убедил членов команды Apple принести на интервью собственные аппаратные устройства.
OpenAI и Apple сходятся лицом к лицу на рынке AI-потребительских устройств позже в этом году: Apple планирует новую модель Airpod с камерами, умные очки и устройство-подвес.
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
На этой неделе для AI полный успех: столько новых моделей и функций, которые можно попробовать в эти выходные:
> 1 новая модель на новом рубеже: gpt 5.6 Sol
> 2 новые безумно дешёвые модели, которые на 80% соответствуют уровню frontier: grok 4.5 и meta muse spark 1.1
> 2 новые image-модели: muse image и seedream 5.0
> prime intellect повышает $130M , чтобы выпустить больше открытых моделей
а Google ещё выпускает 3.5 на следующей неделе, deepseek v4 тоже, grok 4-5T модель через месяц и GPT 6 через месяц
всё происходит так быстро
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
Одним из крупнейших сдвигов в ИИ стал переход от обучающих чипов к чипам, оптимизированным для вывода - и не зря:
именно на выводе делаются деньги (и интеллект)
> ходят слухи, что Anthropic получает 80% маржи по доходам на выводе. они станут прибыльными раньше любой другой ИИ-лаборатории.
> Apple, Meta, OpenAI, Google — все делают свои собственные пользовательские чипы для вывода
> китайские модельные лаборатории (несмотря на аппаратные ограничения) создают передовой интеллект, просто заставляя модель думать дольше.
суть в том, что вывод будет опережать любые другие ИИ-сервисы на многие килом
META-0,02%
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
по мере того как америка отмечает 250 лет, сейчас важнее, чем когда-либо, помнить, что секретный соус этой страны — это её люди и их неустанное стремление к смелым, амбициозным идеям. именно это позволяло америке побеждать и будет позволять побеждать в будущем.
надвигающиеся угрозы иностранной конкуренции в области ИИ — кража моделей дизайна, ограничения на природные ресурсы, войны масштабирования и т. д. — будут становиться всё более серьёзной проблемой
мы должны защищать наши центры обработки данных, людей, но самое главное — наши идеи. именно это удерживает нас на передовой *любой техноло
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
tesla только что стала последней компанией, сократившей расходы на ИИ, установив лимит на токены в $200 в неделю для сотрудников и побуждая их использовать модели grok + cursor — признак грядущих времен
> Илон подталкивает сотрудников использовать внутренние версии композитора моделей grok + cursor
> они запустили несколько частных агентов, обученных на данных tesla, чтобы повысить производительность
> сотрудники по-прежнему имеют доступ к claude и gpt через свою внутреннюю "bottleneck platform"
> за этим следуют uber, microsoft и meta, которые также агрессивно сократили расходы
отметим, что И
TSLA-2,95%
UBER-0,41%
MSFT2,20%
META-0,02%
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
похоже, что openai делает большую ставку на инференс, чтобы обойти anthropic в ближайшие 6 месяцев:
> между их cerebras и предстоящими чипами jalapeño ai, openai получит идеальный стек оборудования, оптимизированный для GPT
> они сократили затраты на инференс на 50% (согласно информации), что сэкономит им $10Ms
> gpt 5.6 сильно опирается на агентное рассуждение и выполнение (тяжелый инференс)
инференс составляет 40-50% расходов на вычисления в лабораториях, сокращение этого вдвое высвобождает вычислительные мощности для обучения — совокупные эффекты этого невозможно недооценить, на мой взгляд
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
Я не верю в FUD про мету и память ИИ:
- Google только что отключила Meta за использование слишком больших вычислительных мощностей, зачем им тогда продавать избыточные мощности?
- Meta владеет одним из крупнейших парков GPU, они, скорее всего, продают старые для инференса (как SpaceX), пока используют новые Rubin.
- Память без сомнения — самый дефицитный ресурс в ИИ, спрос превышает любой прогнозируемый будущий объём поставок в 5–10 раз.
- если кто-то спроектирует чип, модель или агента, которым требуется меньше памяти — это приведёт лишь к ещё большему спросу на память
ты вообще видел, скольк
META-0,02%
SPCX-3,25%
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
так что похоже, что в последнее время в области ИИ сходятся несколько ключевых тенденций
- передовые модели теперь представляют реальную угрозу государственной безопасности, вызывая необходимость вмешательства правительства (покойся с миром, сказка)
- это означает, что будущие релизы моделей будут закрытыми (ограниченными). любые будущие публичные релизы почти наверняка будут ограничены
- одновременно китайские открытые модели догнали передовые возможности. за менее чем 6 месяцев они станут уровня Mythos
- открытые модели дешевле, их можно запускать приватно, трудно регулировать правит
GLM3,26%
MSFT2,20%
DEEPSEEK-3,31%
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
проблема в том, что даже если антропик магически создаст защиту от взлома для мифоса - всегда найдутся другие поверхности атаки, которые злоумышленники смогут использовать
облачные сервисы, сотрудники, дата-центры, внедрение подсказок
никогда не может быть полностью безошибочной модели, нам просто нужно становиться лучше в защите, как мы делали при каждом обновлении другого программного обеспечения
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
как я вижу, существует 4 компании, которые имеют шанс владеть более 70% доли рынка моделей
anthropic, openai, spaceX и… открытый исходный код
- anthropic и openai на грани самосовершенствующихся моделей. финальная стадия.
- но spacex приобрела cursor в последней четверти. их система дает им реальный шанс догнать claude и gpt в программировании. ЕСЛИ элон справится с этим, он выиграет по сырой вычислительной мощности. у никого нет больше GPU, чем у него
- открытый исходный код выигрывает, если цены на frontier модели вытеснят обычных потребителей. они достаточно хороши для 80% случаев.
SPCX-3,25%
MSFT2,20%
DEEPSEEK-3,31%
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
  • Закреплено