офигеть, и находил же я когда-то этот удобным (и лэптопу нравилось)

офигеть, и находил же я когда-то этот удобным (и лэптопу нравилось)

У меня когда-то в начале 2000-х был «бизнес» по торговле интернетом в розницу — на CD-дисках. Я договаривался с поставщиками контента — сайтами типа algolist, openbsd и кулинарными рецептами, чтобы они ставили на все страницы по баннеру «купи этот сайт на CD», а я за это инвестировал время в создание статической версии с поиском и запись на диски. Ссылка со страниц вела на <проект>.nadiske.ru, где была большая кнопка заказать и апселл с других проектов, по теме и не очень. Процент с каждого диска уходил владельцу контента. Доставка шла наложенным платежом через почту России (то есть, я отправлял диски без предварительной оплаты), и получал деньги на почте. На сайте фактически было две страницы — список товаров с чекбоксами и форма заказа. Но подсайтов было столько, сколько партнеров — на каждом из них главный товар стоял первым, а остальное шло как апселл. Расчёт был на то, что «раз уж заказываем давай что-то ещё».
Так вот, возникало тогда несколько интересных проблем. Как сопоставлять деньги с посты с заказами? У меня для каждого заказа динамически формировалась цена — добавлялись копейки, чтобы цена была уникальной. Для конечного покупателя разницы на какую цену соглашаться, 150 рублей или 150 рублей 12 копеек не было, а мне было удобно сопоставлять. Вместе с датой это было довольно надежно.
Вторая проблема была где вести заказы со статусами и прочим. В итоге, я выбрал Microsoft Access. Он тянул с сайта XML c новыми заказами. Всю систему на аксессуар я разработал за пару часов. Она была идеальна. Кстати, а Access умер уже?
Что интересно, так это то, что лидерами продаж были диски, которые я наштамповал просто чтобы расширить ассортимент — юниксы и линуксы. Понятно, что на них не шло ни одной ссылки с партнёрских сайтов, но их покупали в нагрузку, и в итоге они держали топ;) и были проще всего и дешевле в производстве.
А еще я разработал поисковый движок для CD чтобы искать по этому контенту. Я не помню как, но тогда в браузер, открывавший index.html с диска, можно было встроить запускаемый код. То ли ASP-вставки были и DLL, то ли что-то типа.
Проект я закрыл, когда стало понятно, что в регионы нормальный интернет всё-таки проведут и спрос на диски когда-нибудь стухнет. Ну и все к этому шло. Плюс диски требовали обновления, и на это нужно было инвестировать силы и время, их было жалко (особенно с учетом первого пункта)


Гуляем с Юки, снимаю небо


Сегодня наткнулся на тесты ARC-AGI-3 для моделей AI. То есть, если вам кажется, что AI может за вас сделать что угодно, то считайте, что вы заработали уже большую часть из $850,000 призового фонда — просто сабмитьте ваш прекрасный код, и пусть он будет лучшим. Но так не работает. Кожаные мешки справляются с 100% задач, а вот программы пока не преодолели планку в 2.5-3%. Что там за задачи такие?
Программе дается не текстовое задание, а мини-игра. Нет ни инструкций, ни описания правил. На каждом шаге программа получает «кадр» — JSON-объект с текущим состоянием поля. Это сетка размером до 64×64 клетки, где ячейки закодированы числами от 0 до 15 (обозначающими разные цвета или типы блоков). У агента есть стандартизированный интерфейс (действия 1–7), включающий базовые шаги и возможность указывать конкретные координаты (X, Y). Но ИИ заранее не знает, что делают эти действия! В одной задаче «Действие 1» может сдвигать блок вправо, в другой — перекрашивать его, в третьей — включать гравитацию. Чтобы понять логику, ИИ должен активно «тыкать палочкой» в среду. Он совершает экспериментальное действие, среда реагирует и возвращает новый кадр. Агент должен проанализировать изменения, обновить свою теорию о физике этого конкретного мира и сделать следующий осознанный шаг. Игра может завершиться статусом WIN, GAME_OVER или продолжаться дальше.
Еще раз — люди набирают 100%, машины — 2-3%. На сайте ARC PRIZE можете попробовать, там есть сэмпл-задачки.

Интересно, что кажется не существует инструментов, позволяющих проверить, как работает Social Sharing Previews для Facebook, LinkedIn, Twitter для сайта, который еще не в паблике. Я могу представить два решения для этого: симуляция поведения соцсети и создание страницы с вырезанным контентом, но корректными заголовками, которая на минуту открывается в паблик, дальше выполняется генерация превью через сами инструменты FB, LI, Twitter, делаются выводы что подправить, а страница исчезает. Симуляцию тоже вполне можно сделать, вроде несложно.
Кстати, к нашему соседу периодически подъезжает к машина с надписью Pet Waste Removal. Для меня было удивление узнать что в США есть целая ниша — специальные сервисы, который занимаются очисткой газона от какашек собак, которые бегают по этому газону, для того, чтобы по этому же газону спокойнее бегали детишки. Таких компаний десятки вокруг меня. Я даже не предполагал, что такое бывает.
(Но прикол в том, что у соседа — кошка. И тут у меня совсем фантазия скисла. Не знаю, может у него просто друг там работает, но вообще есть litter box services. Приезжают раз-два в неделю, полностью меняют наполнитель, дезинфицируют лоток, увозят отходы)
Так вот, Pet Waste Removal — это реально огромная индустрия с богатой внутренней культурой. У них есть своя профессиональная ассоциация — aPaws (Association of Professional Animal Waste Specialists), которая проводит ежегодную «International Pooper Scooper Week» в апреле. Некоторые франшизы стоят десятки тысяч долларов за вход, а рынок оценивается в сотни миллионов. Логика простая: средний пёс производит около 100 кг отходов в год, американских собак под 90 миллионов, и большинство владельцев искренне ненавидят эту часть собаководства.
Есть и совсем сюрреалистичное ответвление — сервис PooPrints. Жилые комплексы и HOA заставляют жильцов сдавать ДНК своих собак в базу, и когда на газоне находят «неопознанную» кучку, её отправляют на генетическую экспертизу и вычисляют владельца-нарушителя. Штраф долларов 150–500.
У нас Юки никогда (или кажется разок за пять лет) не ходил по-большому во двор. Ну дома так вообще ни разу, даже щенком, и ни разу лужу не делал. Так что он тоже вопросительно на это все смотрит. А в США в домах собаку выпускают через дверь, она делает свои дела, побегает — и обратно. Многие собаки в субурбии годами не знают, что такое прогулка на поводке в привычном нам смысле.

Я вот недавно кстати задумался, а почему мы так боимся оставлять газ или утюг включенным? Ну я тоже боюсь, но вот задумался почему боюсь. Ведь смотрите, само собой ничего не происходит — газ будет гореть месяц, а утюг будет тот же месяц греть воздух и есть ток. Пока что? Утюг теоретически может перегореть от того, что выработается ресурс. Тогда он просто отключится. Перегореть со взрывом или открытым пламенем он не может — утюги уже не те. Газ — что с ним может быть? Пламя само собой не задуется. Сквозняки вроде у нас в закрытых помещениях нетипичны, но если даже их и представить, то нужен ну очень сильный порыв ветра, чтобы полностью сбить пламя.
Газ горит с выделением углекислого газа и водяного пара — это если горение полное. Ну хорошо, предположим, что оно не полное, но в худжем случае будет накапливаться небольшое количество угарного газа. Это нехорошо, но помним, что мы оставили газ дома, а сами ушли.
Единственная стремная ситуация — если на газу забыли кастрюлю супа, которая теоретически может его залить и тогда пойдет метан, и потенциально взрыв (Кстати, в Европе очень многие газовые плиты с термопарой flame failure device и отключают газ, если нет нагрева (то есть, залило). Вот у нас пока не так)
Тревога тут — не иррациональный сбой, а вполне разумная реакция на структуру риска: вероятность маленькая, а цена исхода катастрофическая и необратимая (пожар, взрыв, чужие жизни в соседних квартирах). Когда матожидание ущерба огромно даже при малой вероятности, эволюционно и культурно выгодно перестраховываться. Но вот оставленный утюг или газ по идее (по идее) не должны привести ни к чему за те часы, пока вы о них вспомнили. И еще мы тревожимся не о включенном утюге, а о том, что не можем проверить, выключили ли его. Мозг честно сигналит «данных нет, а ставка высокая» — и при цене проверки в тридцать секунд против цены ошибки в квартиру это математически безупречная тревога
У меня вышла новая статья по поводу того, как может выглядеть взаимодействие компаний и кандидатов на позиции в этих компаниях. Главный тезис — мы что-то засиделись с этими PDF резюме. Это какой-то привет из прошлого века. Есть интересное направление — по сути, интерактивные резюме в форме AI-агентов кандидатов и AI-агентов компаний, общающихся друг с другом 24/7. Агентов именно в том смысле, в каком они есть у селебрити и спортсменов. Меня очень удивило, что в этом направлении нет движения, хотя технологически, кажется, требуемый для этого уровень достигнут.
84 исследователя, 40+ лабораторий — кто есть кто в Search & RecSys, на одной странице.
Google, Meta, Netflix, Spotify, Amazon, CMU, UMass, UCSD и другие — для каждого человека ссылки на сайт, Google Scholar, LinkedIn, ключевые статьи. Плюс h-index и число цитирований из Semantic Scholar.
Сделал для себя, потому что так удобнее быстро смотреть кто что публикует. Готового ничего не нашёл — пришлось собрать самому. Вроде получилось полезно, надеюсь, не только мне.
Интересно, кстати, что у нас стоматолог (dentist) и терапевт не покрываются одним словом doctor, то есть doctor appointment в применении к стоматологу говорят dentist appointment, а в разных документах прямо перечисляют doctor or dentist. У них и степени разные (MD/DO и DDS/DMD). Ну и конечно страховки разные. Возможно, причины исторические — зубами раньше цирюльники занимались, то есть это были разные ремесла.
К этому ещё оптометристы как ещё одна отдельная категория, но тут все понятно и обосновано