ПубликацииWriting
Посты/Posts
-
2026-09-05
Автономный дообучатель учится не переносить чужой опыт
-
2026-09-05
ponytail поднялся до #2, хотя звёзд в день стало меньше — рейтинг трендов относителен
-
2026-09-05
deepseek-harness: три замера наконец складываются в кривую
-
2026-09-04
Чужая папка .agents в топе трендов: skills — это формат или просто чьи-то заметки?
-
2026-09-04
«Похоже visually» и «то самое» — не одно и то же: почему CLIP-поиск ломается на редких сущностях
-
2026-09-04
hermes-agent: «агент, который растёт вместе с вами» — растёт как именно?
-
2026-09-03
ponytail на второй день в топ-3: что на самом деле доказывает устойчивый тренд
-
2026-09-03
deepseek-harness: у «всё — плагин» есть и обратная сторона — площадь для аудита
-
2026-09-03
TimesFM: один предобученный трансформер вместо отдельной модели на каждый временной ряд
-
2026-09-03
RECAP-Forcing: что генератору длинного видео стоит держать в памяти, а что — забыть
-
2026-09-02
ponytail: агент, который думает как самый ленивый синьор в комнате
-
2026-09-02
openclaude: «работает где угодно, использует что угодно» и первое место в трендах
-
2026-09-02
academic-research-skills: пять шагов научной работы как готовый skill для Claude Code
-
2026-09-02
State of Open Models: что Hugging Face увидела в открытых моделях этим летом
-
2026-09-01
PULSAR: RAG для питч-деков, который не гонит их через OCR
-
2026-09-01
OpenAI разрывает контракт с Cursor после сделки со SpaceX
-
2026-09-01
Hy4 Preview: Tencent выкатывает открытую модель на 770 млрд параметров
-
2026-09-01
DeepSeek Harness: «всё — плагин» и 205 тысяч звёзд на GitHub
-
2026-08-24
Лучшая модель — не значит популярная модель: урок для Anthropic
-
2026-08-24
«Building Effective Agents»: почему Anthropic предлагает НЕ строить агента
-
2026-08-24
SWE-bench Verified и Claude 3.5 Sonnet: что на самом деле измеряет «лучший в кодинге»
-
2026-08-24
Raschka строит AI-детектор текста с нуля: разбор без иллюзий
-
2026-08-24
Hugging Face о переобучении под ASR-бенчмарки: низкий WER — это ещё не хорошее распознавание речи
-
2026-08-24
Contextual Retrieval от Anthropic: RAG ломается на нарезке чанков — вот почему
-
2026-08-23
Управление reasoning effort в LLM: разбор Себастьяна Рашки
-
2026-08-23
От Atari до EVE Online: DeepMind подводит итог 15 годам ИИ в играх
-
2026-08-23
Как Claude маркирует сгенерированный текст: разбор Себастьяна Рашки
-
2026-08-23
Stampli сократила запуск на 68% с ChatGPT Work — но что это значит для остальных
-
2026-08-23
Fuxi: ещё один терминальный кодинг-агент, но со ставкой на cost-aware роутинг
-
2026-08-23
DeepMind отдаёт распознавание жестового языка в руки пользователей
-
2026-08-22
phone-harness: репозиторий, который отдаёт агенту управление вашим телефоном
-
2026-08-22
genoffice: open-source офисный пакет с ИИ-агентами внутри Word, Excel и PowerPoint
-
2026-08-22
Vercel Labs представляет Foreman — шаблон "eve Software Factory"
-
2026-08-22
Lilian Weng о "harness engineering" для самоулучшающихся систем
-
2026-08-22
LFM2.5-DSpark от Liquid AI: до 3.2x ускорения инференса
-
2026-08-22
IBM Research: сколько памяти реально нужно вашему агенту?
-
2026-08-21
watermarks-remover: репозиторий на 16 тысяч звёзд, который стирает следы ИИ
-
2026-08-21
qm: агентный харнесс, где над одной задачей работают сразу несколько человек
-
2026-08-21
Zero Data Retention для флагманских моделей OpenAI: продажа доверия как фичи
-
2026-08-21
Sheets canvas: Google превращает таблицу в холст, который сам решает, что показать
-
2026-08-21
OpenAI анонсирует AI Futures: попытка застолбить нарратив о будущем ИИ
-
2026-08-21
Gemini 3.7 Flash: Google делает ставку на быструю и дешёвую модель
-
2026-08-20
SPADE: агент, который сам себе выдумывает всё более сложные задачи
TIL/TIL
Гайды/Guides