OpenAI опубликовала первые результаты Jalapeño — собственного inference-чипа. Заявлены более высокая скорость и энергоэффективность, выше throughput и ниже latency для современных моделей; конкретные цифры в анонсе не приводятся.
openai.com · #hardware #chip #hardware #inference #openai
OpenAI показала инференс-чип Jalapeño, разработанный с Broadcom за 16 месяцев. На бенчмарках InferenceX он обходит Nvidia Blackwell по производительности на ватт, использует HBM4. В шутку запустили Doom, портированный через Codex.
newsletter.semianalysis.com · #hardware #chip #inference #openai
MTIA 300 — первый тренировочный ускоритель Meta с 12 встроенными 800 Gbps RDMA-сетевыми чиплетами, 1.2 ТБ/с I/O без PCIe. Отдельные message engines обеспечивают почти полную изоляцию вычислений и коммуникаций — деградация менее 0.5% против 20%+ на GPU.
engineering.fb.com · #hardware #accelerator #ai #chip #meta
Alibaba адаптировала модель Qwen-3.8 27B для работы на 64-ядерном RISC-V процессоре XuanTie C950 (TSMC 5nm). Декодинг — 30 токенов/с, TTFT 1.9 с. Чип не требует GPU, использует встроенные матричные и векторные ускорители.
wccftech.com · #hardware #chip #integration #llm #riscv