7213Ejaaz

vip
Вік 1.6 Рік
Піковий рівень 0
Контент поки що відсутній
ось він — microsoft використовуватиме kimi k3, щоб живити свій флагманський AI-асистент copilot, заощаджуючи до 60% за токен або $600M на кожні $1B витрачені на витрати на інференс.
якщо microsoft вирішить розмістити модель у себе після того, як Kimi відкриє її у відкритий доступ 27-го числа, тоді ці витрати зменшаться ще більше
любите чи ненавидьте ці китайські моделі, open source справді значно вирівнює поле.
згідно з інформацією
MSFT2,20%
Переглянути оригінал
post-image
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
Хто взагалі хвилюється, що kimi k3 кращий за fable? Уся суть в тому, що вони показали: ви можете отримати frontier-модель за значно нижчої вартості
це означає, що щось потрібно буде переоцінити (repriced).
якщо ти компанія, яка витрачає $10-100Ms на токени, і ти можеш скоротити це в 21X, то чому б, чорт забирай, тобі це не розглянути?
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
причина, чому вам варто звернути увагу на kimi k3, полягає не в тому, що він перемагає fable, а в тому, що в нього нуль обмежень: нецензурований ШІ.
причина, через яку вам слід хвилюватися про Китай, у тому, що вони наздогнали США уявіть собі нецензурований міфос, який пішов у рознос.
інтелект на токен — тепер усе, що має значення & Китаю тут, щоб грати, і їхні моделі дешеві до божевілля.
правила змінилися.
kimi тепер. deepseek, zhipu, qwen усі мають піти за ними.
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
нагадування — opus 5 вийде наступного тижня, і, скоріш за все, він перевершить K3.
перевага №1, яку мають Anthropic і OpenAI, полягає в тому, що вони можуть дистилювати власні флагманські моделі в дешевші, більш доступні моделі з високим рівнем інтелекту на одиницю вартості
також fable 6 і gpt 6 будуть тут приблизно через ~1 місяць. цикли стають коротшими.
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
Мені k3 відчувається більш значущим, ніж момент deepseek. важко не помітити це:
> beats fable, отримав 5.6 на кількох ключових бенчмарках. вперше китайська модель *не* відстає
> вона робить це при значно меншому розмірі, вартості, і без розкішних nvidia gpus
> повторювані прориви в даних, використаних для навчання моделей + тренувальні техніки зробили Китай законним центром досліджень у сфері AI
усе це теж у відкритому доступі. з якого моменту ми починаємо визнавати, що в них, можливо, тут справді є перевага?
розрив скоротився до максимуму 3 місяців зараз.
NVDA0,36%
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
google $GOOG важко продати свої TPUs, 75% чипів, які використовують неоклауди, це nvidia, але є вагомі підстави для того, щоб google виграв протягом наступного року: за рахунок витрат.
meta, uber, microsoft та багато інших скоротили агресивні витрати на ШІ за останні кілька місяців, обравши дешевші моделі — це заощадило їм $10-100Ms
але найбільша стаття витрат під час використання AI-моделей — це базова інфраструктура, яка використовується для надання його клієнтам: tpus — це дешевша (і більш ефективна) альтернатива.
я думаю, що коли інференс стане 50%+ від використання ai-токенів, дата-центр
GOOG1,55%
NVDA0,36%
META-0,02%
UBER-0,41%
MSFT2,20%
Переглянути оригінал
post-image
post-image
post-image
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
чувак, який час бути живим.
зараз у нас з’явилося 10+ ai-моделей із подібними можливостями, які з’явилися ніби нізвідки, і ми отримуємо нову версію кожні ~2-3 тижні тепер
найкраще те, що незалежно від того, що саме ти шукаєш, є модель, яка під це підходить:
дешевше за fable? gpt 5.6
переживаєш про приватність? 5+ відкритих моделей
не знаєш, яку модель використовувати? cursor або openrouter
anthropic, openai, xai, meta, google, zhipu, deepseek, moonshot, alibaba — усі вони агресивно конкурують, і це чудово саме для ТЕБЕ, користувача
nvidia, cerebras, etched, groq, intel, tsmc — ус
NVDA0,36%
INTC2,17%
TSM1,10%
META-0,02%
BABA4,73%
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
вау. Apple подає позов на OpenAI за викрадення апаратних секретів для їхніх майбутніх Ai-пристроїв, які вийдуть пізніше цього року.
здається, 1 працівник переконав команду Apple привести на співбесіди запатентовані апаратні пристрої.
OpenAI та Apple зійдуться віч-на-віч у сфері AI споживчих пристроїв пізніше цього року, причому Apple планує нову модель airpod із камерами, розумними окулярами та пристроєм-підвісом.
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
Цього тижня для ШІ це був суцільний виграш — стільки нових моделей і функцій, які можна випробувати ці вихідні:
> 1 нова модель на новому рубежі: gpt 5.6 Sol
> 2 нові дуже дешеві моделі, які на 80% відповідають рівню frontier: grok 4.5 і meta muse spark 1.1
> 2 нові моделі зображень: muse image та seedream 5.0
> prime intellect піднімає $130M , щоб виштовхнути більше відкритих моделей
і релізить google 3.5 наступного тижня, deepseek v4 теж, grok модель на 4-5T за місяць і GPT 6 за місяць
все відбувається так швидко
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
Одним із найбільших зрушень у штучному інтелекті стало переміщення від навчальних чіпів до чіпів, оптимізованих для інференції — і це не без підстав:
інференція — це те, де заробляються гроші (та інтелект)
> ходять чутки, що Anthropic має 80% маржі доходу від інференції. вони стануть прибутковими раніше за будь-яку іншу лабораторію ШІ.
> apple, meta, openai, google — всі вони створюють власні спеціалізовані чіпи ШІ для та інференції
> китайські модельні лабораторії (незважаючи на апаратні обмеження) створюють граничний інтелект, просто змушуючи модель думати довше.
суть у тому: інференція знач
META-0,02%
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
оскільки америці виповнюється 250 років, зараз як ніколи важливо пам’ятати, що секретний соус цієї країни — це її люди та їхнє невпинне прагнення до сміливих, амбітних ідей. саме це допомагало америці перемагати і допомагатиме їм перемагати й надалі.
навислі загрози з боку іноземної конкуренції в галузі штучного інтелекту — крадіжка дизайнів моделей, обмеження природних ресурсів, війни масштабування тощо — дедалі більше ставатимуть проблемою
ми повинні захищати наші центри обробки даних, людей, але найголовніше — наші ідеї. саме це тримає нас на передовій у *будь-якій технології* протягом оста
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
tesla стала останньою компанією, яка скоротила витрати на ШІ, запровадивши ліміт витрат токенів у $200 на тиждень для працівників і штовхаючи їх до використання моделей grok + cursor - ознака майбутніх часів
> елон штовхає співробітників використовувати внутрішні версії grok + cursor model composer.
> вони запустили кілька приватних агентів, навчених на даних tesla, щоб підвищити продуктивність
> співробітники все ще мають доступ до claude та gpt через їхню внутрішню "платформу bottleneck".
> це слідує за uber, microsoft та meta, які також агресивно скоротили витрати
зауважте, що елон, ймовірн
TSLA-2,95%
UBER-0,41%
MSFT2,20%
META-0,02%
Переглянути оригінал
post-image
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
схоже, що openai робить велику ставку на інференс, щоб обійти anthropic протягом наступних 6 місяців:
> завдяки своїм чіпам cerebras і майбутнім jalapeño ai chips, openai матиме ідеальний стек обладнання, оптимізований для GPT
> вони скоротили витрати на інференс на 50% (за даними the information), що заощадить їм $10Ms
> gpt 5.6 значною мірою покладається на агентне міркування та виконання (інтенсивний інференс)
інференс становить 40-50% витрат на обчислення в лабораторіях, скорочення цього вдвічі звільняє обчислювальні потужності для навчання - кумулятивні ефекти цього неможливо недооцінити,
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
я не купуюсь на мета та AI пам'ять fud:
- google просто відключив meta за використання занадто великої обчислювальної потужності, чому тоді їм потрібно продавати надлишкову обчислювальну потужність?
- meta володіє одним з найбільших парків GPU, вони, ймовірно, продають старіші для інференції (як spacex), використовуючи новіші Rubin’s.
- пам'ять безсумнівно є найдефіцитнішим товаром в AI, попит випереджає будь-яку прогнозовану майбутню пропозицію на 5-10X.
- у разі, якщо хтось розробить чіп, модель або агента, які потребують менше пам'яті - це лише призведе до БІЛЬШОГО попиту на пам'ять
ти ба
META-0,02%
SPCX-3,25%
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
здається, що в останній час кілька ключових тенденцій сходяться в штучному інтелекті
- передові моделі тепер становлять реальну загрозу урядовій безпеці, що викликає необхідність урядового втручання (спадщина казки)
- це означає, що майбутні випуски моделей будуть приватними (обмеженими). будь-які майбутні публічні випуски ймовірно будуть обмежені
- одночасно, китайські відкриті моделі наздогнали можливості передових моделей. за <6 місяців вони стануть рівнем міфос
- відкриті моделі дешевші, їх можна запускати приватно, важко регулювати урядам
- талант у галузі штучного інтелекту консолідуєтьс
GLM3,93%
MSFT2,20%
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
проблема в тому, що навіть якщо антропік магічно створить захист від зломів для міфосу — завжди будуть інші поверхні для атак, які можуть використати актори
хмарні сервіси, співробітники, дата-центри, інжекція запитів
ніколи не існуватиме модель на 100% безпомилкова, нам просто потрібно ставати кращими у захисті, як ми робили з кожним іншим оновленням програмного забезпечення
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
як я бачу, є 4 компанії, які мають шанс володіти понад 70% ринкової частки моделей
anthropic, openai, spaceX і… відкритий код
- anthropic і openai на межі самовдосконалювальних моделей. кінцева гра.
- але spacex придбав cursor у фінальній інінг. їхній ремінь дає їм реальний шанс наздогнати claude і gpt у програмуванні. ЯКЩО Ілон це зробить, тоді він виграє за рахунок сирого обчислювального ресурсу. ні у кого немає більше GPU, ніж у нього
- відкритий код виграє, якщо ціни на фронтір-моделі витіснять звичайних споживачів. вони достатньо хороші для 80% використань. ми починаємо це бачити
SPCX-3,25%
MSFT2,20%
Переглянути оригінал
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
  • Закріплено