7213Ejaaz

vip
Вік 1.6Рік
Піковий рівень 0
Контент поки що відсутній
opus 5 — це зламаний ігровий модель. перемотаємо на 5 років назад, і ці ігри були б вірусними хітами на мобільних або ігрових консолях.
але найкраще те, що ігри генеруються в реальному часі, тож можна мати безперервні рівні, які адаптуються до гравця.
чесно кажучи, божевільно, наскільки добре ці моделі стають (я думав, що grok добереться сюди першим)
чи можете уявити, що робить opus /fable 6?
Переглянути оригінал
post-image
post-image
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
meta створює конкурента OpenRouter (прямо після новини, що openrouter можуть придбати), але є ще одна причина, чому meta це робить:
> більше ніяких $100Ms витрат на інференс. платформа б ефективно маршрутизувала ai-запити до кількох різних моделей, знижуючи витрати та видаючи кращі відповіді.
> абсолютно новий потік доходів: намір Meta — випустити це публічно, щоб будь-хто міг заощадити гроші
> потужний новий спосіб навчати свої моделі: використовуючи це внутрішньо, meta зібрала б дуже цінний датасет про те, як і коли використовувати моделі для різних цілей.
zuck's усе ще в цій гонці
META-1,78%
Переглянути оригінал
post-image
post-image
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
ось він — microsoft використовуватиме kimi k3, щоб живити свій флагманський AI-асистент copilot, заощаджуючи до 60% за токен або $600M на кожні $1B витрачені на витрати на інференс.
якщо microsoft вирішить розмістити модель у себе після того, як Kimi відкриє її у відкритий доступ 27-го числа, тоді ці витрати зменшаться ще більше
любите чи ненавидьте ці китайські моделі, open source справді значно вирівнює поле.
згідно з інформацією
MSFT0,06%
Переглянути оригінал
post-image
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
Хто взагалі хвилюється, що kimi k3 кращий за fable? Уся суть в тому, що вони показали: ви можете отримати frontier-модель за значно нижчої вартості
це означає, що щось потрібно буде переоцінити (repriced).
якщо ти компанія, яка витрачає $10-100Ms на токени, і ти можеш скоротити це в 21X, то чому б, чорт забирай, тобі це не розглянути?
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
причина, чому вам варто звернути увагу на kimi k3, полягає не в тому, що він перемагає fable, а в тому, що в нього нуль обмежень: нецензурований ШІ.
причина, через яку вам слід хвилюватися про Китай, у тому, що вони наздогнали США уявіть собі нецензурований міфос, який пішов у рознос.
інтелект на токен — тепер усе, що має значення & Китаю тут, щоб грати, і їхні моделі дешеві до божевілля.
правила змінилися.
kimi тепер. deepseek, zhipu, qwen усі мають піти за ними.
DEEPSEEK-0,22%
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
нагадування — opus 5 вийде наступного тижня, і, скоріш за все, він перевершить K3.
перевага №1, яку мають Anthropic і OpenAI, полягає в тому, що вони можуть дистилювати власні флагманські моделі в дешевші, більш доступні моделі з високим рівнем інтелекту на одиницю вартості
також fable 6 і gpt 6 будуть тут приблизно через ~1 місяць. цикли стають коротшими.
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
Мені k3 відчувається більш значущим, ніж момент deepseek. важко не помітити це:
> beats fable, отримав 5.6 на кількох ключових бенчмарках. вперше китайська модель *не* відстає
> вона робить це при значно меншому розмірі, вартості, і без розкішних nvidia gpus
> повторювані прориви в даних, використаних для навчання моделей + тренувальні техніки зробили Китай законним центром досліджень у сфері AI
усе це теж у відкритому доступі. з якого моменту ми починаємо визнавати, що в них, можливо, тут справді є перевага?
розрив скоротився до максимуму 3 місяців зараз.
DEEPSEEK-0,22%
NVDA-0,83%
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
google $GOOG важко продати свої TPUs, 75% чипів, які використовують неоклауди, це nvidia, але є вагомі підстави для того, щоб google виграв протягом наступного року: за рахунок витрат.
meta, uber, microsoft та багато інших скоротили агресивні витрати на ШІ за останні кілька місяців, обравши дешевші моделі — це заощадило їм $10-100Ms
але найбільша стаття витрат під час використання AI-моделей — це базова інфраструктура, яка використовується для надання його клієнтам: tpus — це дешевша (і більш ефективна) альтернатива.
я думаю, що коли інференс стане 50%+ від використання ai-токенів, дата-центр
GOOG0,25%
NVDA-0,83%
META-1,78%
UBER-4,32%
MSFT0,06%
Переглянути оригінал
post-image
post-image
post-image
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
чувак, який час бути живим.
зараз у нас з’явилося 10+ ai-моделей із подібними можливостями, які з’явилися ніби нізвідки, і ми отримуємо нову версію кожні ~2-3 тижні тепер
найкраще те, що незалежно від того, що саме ти шукаєш, є модель, яка під це підходить:
дешевше за fable? gpt 5.6
переживаєш про приватність? 5+ відкритих моделей
не знаєш, яку модель використовувати? cursor або openrouter
anthropic, openai, xai, meta, google, zhipu, deepseek, moonshot, alibaba — усі вони агресивно конкурують, і це чудово саме для ТЕБЕ, користувача
nvidia, cerebras, etched, groq, intel, tsmc — ус
NVDA-0,83%
INTC-7,90%
TSM-2,86%
META-1,78%
BABA-1,64%
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
вау. Apple подає позов на OpenAI за викрадення апаратних секретів для їхніх майбутніх Ai-пристроїв, які вийдуть пізніше цього року.
здається, 1 працівник переконав команду Apple привести на співбесіди запатентовані апаратні пристрої.
OpenAI та Apple зійдуться віч-на-віч у сфері AI споживчих пристроїв пізніше цього року, причому Apple планує нову модель airpod із камерами, розумними окулярами та пристроєм-підвісом.
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
Цього тижня для ШІ це був суцільний виграш — стільки нових моделей і функцій, які можна випробувати ці вихідні:
> 1 нова модель на новому рубежі: gpt 5.6 Sol
> 2 нові дуже дешеві моделі, які на 80% відповідають рівню frontier: grok 4.5 і meta muse spark 1.1
> 2 нові моделі зображень: muse image та seedream 5.0
> prime intellect піднімає $130M , щоб виштовхнути більше відкритих моделей
і релізить google 3.5 наступного тижня, deepseek v4 теж, grok модель на 4-5T за місяць і GPT 6 за місяць
все відбувається так швидко
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
Одним із найбільших зрушень у штучному інтелекті стало переміщення від навчальних чіпів до чіпів, оптимізованих для інференції — і це не без підстав:
інференція — це те, де заробляються гроші (та інтелект)
> ходять чутки, що Anthropic має 80% маржі доходу від інференції. вони стануть прибутковими раніше за будь-яку іншу лабораторію ШІ.
> apple, meta, openai, google — всі вони створюють власні спеціалізовані чіпи ШІ для та інференції
> китайські модельні лабораторії (незважаючи на апаратні обмеження) створюють граничний інтелект, просто змушуючи модель думати довше.
суть у тому: інференція знач
META-1,78%
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
оскільки америці виповнюється 250 років, зараз як ніколи важливо пам’ятати, що секретний соус цієї країни — це її люди та їхнє невпинне прагнення до сміливих, амбітних ідей. саме це допомагало америці перемагати і допомагатиме їм перемагати й надалі.
навислі загрози з боку іноземної конкуренції в галузі штучного інтелекту — крадіжка дизайнів моделей, обмеження природних ресурсів, війни масштабування тощо — дедалі більше ставатимуть проблемою
ми повинні захищати наші центри обробки даних, людей, але найголовніше — наші ідеї. саме це тримає нас на передовій у *будь-якій технології* протягом оста
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
tesla стала останньою компанією, яка скоротила витрати на ШІ, запровадивши ліміт витрат токенів у $200 на тиждень для працівників і штовхаючи їх до використання моделей grok + cursor - ознака майбутніх часів
> елон штовхає співробітників використовувати внутрішні версії grok + cursor model composer.
> вони запустили кілька приватних агентів, навчених на даних tesla, щоб підвищити продуктивність
> співробітники все ще мають доступ до claude та gpt через їхню внутрішню "платформу bottleneck".
> це слідує за uber, microsoft та meta, які також агресивно скоротили витрати
зауважте, що елон, ймовірн
TSLA-2,03%
UBER-4,32%
MSFT0,06%
META-1,78%
Переглянути оригінал
post-image
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
схоже, що openai робить велику ставку на інференс, щоб обійти anthropic протягом наступних 6 місяців:
> завдяки своїм чіпам cerebras і майбутнім jalapeño ai chips, openai матиме ідеальний стек обладнання, оптимізований для GPT
> вони скоротили витрати на інференс на 50% (за даними the information), що заощадить їм $10Ms
> gpt 5.6 значною мірою покладається на агентне міркування та виконання (інтенсивний інференс)
інференс становить 40-50% витрат на обчислення в лабораторіях, скорочення цього вдвічі звільняє обчислювальні потужності для навчання - кумулятивні ефекти цього неможливо недооцінити,
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
я не купуюсь на мета та AI пам'ять fud:
- google просто відключив meta за використання занадто великої обчислювальної потужності, чому тоді їм потрібно продавати надлишкову обчислювальну потужність?
- meta володіє одним з найбільших парків GPU, вони, ймовірно, продають старіші для інференції (як spacex), використовуючи новіші Rubin’s.
- пам'ять безсумнівно є найдефіцитнішим товаром в AI, попит випереджає будь-яку прогнозовану майбутню пропозицію на 5-10X.
- у разі, якщо хтось розробить чіп, модель або агента, які потребують менше пам'яті - це лише призведе до БІЛЬШОГО попиту на пам'ять
ти ба
META-1,78%
SPCX-2,71%
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
здається, що в останній час кілька ключових тенденцій сходяться в штучному інтелекті
- передові моделі тепер становлять реальну загрозу урядовій безпеці, що викликає необхідність урядового втручання (спадщина казки)
- це означає, що майбутні випуски моделей будуть приватними (обмеженими). будь-які майбутні публічні випуски ймовірно будуть обмежені
- одночасно, китайські відкриті моделі наздогнали можливості передових моделей. за <6 місяців вони стануть рівнем міфос
- відкриті моделі дешевші, їх можна запускати приватно, важко регулювати урядам
- талант у галузі штучного інтелекту консолідуєтьс
GLM0,65%
MSFT0,06%
DEEPSEEK-0,22%
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
  • Закріплено