💬 «Скоро платежи за нейросети станут обычной статьей бюджета — как интернет и ЖКХ» Китайцы представили смартфон StepX Neo, где вместо приложений — ИИ-агент: вы формулируете задачу, а он сам делает работу. Это уже не фантастика, а направление всей индустрии. И хорошая новость: чтобы потрогать агентное будущее, не нужно ждать китайский смартфон — его можно собрать себе уже сегодня. В новом выпуске подкаста «Нейросети для работы и жизни» Егор Голубев делится личным опытом использования персонального ИИ-агента Hermes — ассистента, который живет на сервере 24/7 и управляется через Telegram. 🎁 Первым 10 слушателям помогу с настройкой агента за символическую плату — контакты в описании и в профиле на Stepik. Тайм-коды и ссылки — ниже 👇
✨ Episode Outline — click any point to jump to it in the episode
Problem solved
What a personal 24/7 server-hosted Hermes AI agent can actually do day-to-day, based on two months of real use — with seven concrete cases and costs.
Benefits
Agent lives on a VPS 24/7, controlled via Telegram — no dashboards
Self-improving skills: refine a scheduled task just by chatting
Scheduled reports arrive automatically with zero manual action
ChatGPT Plus $20 subscription covers the agent's brain at average load
Works even without Telegram via Messenger Max, no VPN needed
Use cases
6am morning briefing: weather-based advice on dressing his daughter for kindergarten plus Stepik course sales stats via API
Runs 3 Telegram/Max channels: benefits digest for large families gained first organic subscribers with zero promotion
Daily/bi-daily monitoring of Russia/China neural-network news auto-published as curated digests
Editor-copywriter for his JTBD channel: turns raw notes into posts in his authorial style, queued evenly
Concierge tasks: air tickets Moscow-Ufa, Avito searches, picking kids' walkie-talkies
KPIs / results
~2 months of near-daily use
First $10 of OpenRouter tokens burned quickly; ChatGPT Plus $20/mo proved sufficient
First organic channel subscribers with no promotion
🌐 This transcript was automatically translated to English from the original.
Hello everyone, Egor Golubev is in touch and this is the Neural Network podcast for work and life. Today I’ll start with news, which, in my opinion, is far from the first sign, but at the same time it’s another wake-up call about a completely new model of human interaction with a computer and smartphone. The Chinese company StepFun introduced the StepX Neo smartphone. Its main feature is the main interface, built around an AI agent. And what does this mean in practice? The user no longer jumps between applications, he formulates the task in natural language, says plan a trip, transfer the conversation, fill out the form, find the margin, book a table, collect the result from several services, and the agent himself already goes through the applications and does all the necessary work. Think about it, what kind of shift is this? Today we are used to thinking in application logic, open one, copy another, check, and so on. And the agent interface, it understands the general focus one level higher. From the logic of “which button to press?” we are moving towards the logic of “what result do I need?” Yes, this is an early signal and far from the norm, but it is a direction that is already clearly visible. There will be less and less screens and manual switching, more and more task setting and result control. This entire story is called “And the Agents,” and today’s episode will be dedicated to it. And what is significant is that even today it is already possible to open some vacancies on HeadHunter for marketers, analysts, and project managers. And there is an increasingly common requirement that the candidate must at least touch the agents with his hands and understand how to work with them. Yes, there is no programming or anything like that, but just understanding how to use them. And now, the good news is that in order to feel this agent-based future, we no longer need to wait for some Chinese smartphone, we can already touch it today. And this issue is special. I will share today my personal experience with the personal and agent that I use is called “Hermes” or “Hermes Agent” in English. I’ll tell you what it is, how it works, show my real use cases from a morning briefing to a job search, and explain how much it costs and how to make one for yourself. Let's go, let's start our episode. Let's first understand the concept of what an agent is in general in simple words. See how working with neural networks has evolved. The first stage is prompt engineering, that is, you control the result through the formulation of a competent request. I wrote a good prompt, received an answer, and that’s basically what we did in previous issues. The second stage is context engineering, the so-called. That is, we are already trying to add the widest possible context to the prompt so that the neural network more accurately and better understands what is happening and what task it faces. These are projects and folders in the same conditional GPT chats. These are some of the correspondence histories that he takes into account, your files and references that you add. That is, the neural network already knows you better and more, and answers more accurately. And here is the third stage, the most relevant at the moment - this, as I understand it, in English it is called harness engineering or harness engineering. Tua stands around the language model, and there is a whole system around it. This is how memory works, what skills it has, what tools are used, what are available to them, rules, schedules, goals and even subagents. This whole harness is called a harness. And this is where agent logic begins. The main idea of this stage is that competition is even shifting, in a sense, between neural networks and vendors, manufacturers of neural networks. It’s not only who has a smarter model, there are a lot more parameters and so on, but also who has a better system around the model, this harness. To put it in simple words now, an agent is a system that has a brain. This is the same language model. It has both memory and context. That is, he remembers what you talked about with him, a month ago, a week ago. He has skills or skills. This is an important point, these are skills, these are not things that lie inside the model, inside the brain. These are precisely some external instructions, procedures that are written down somewhere. This is some fixed way of performing a typical task. Thanks to a skill or skill, the agent does not need to reinvent the approach every time. That is, he follows this written trajectory. Well, maybe move with deviation at the same time. A tool is something that makes it possible to interact with the outside world. This is a browser, this is work with search, with documents, with specific documents, with Excel, with tables, with internal systems, and so on. And agents also have goals, action cycles, rules of behavior, and the ability to contact other agents. But the key thing to understand now, unlike regular chat, is that the agent doesn’t just respond like regular chat. He is acting. It goes to the browser, it works with files, it accesses the service, it can attract other agents. And it moves iteratively. That is, I did it, looked at how close it was to the goal, moved on, adjusted the plan, and so on. He is moving towards the goals you have outlined. Today I will talk about one specific class. These are personal open source agents that live on a separate server. Examples that are probably very well known to those in the industry and that made a splash last year are openclaw. And Hermes is some, well, the next chain or branch, as if its direct competitor. That's what we'll talk about today. The meaning or idea of such an agent is very simple. It is deployed on a VPS, which is a rented private server. And he lives there 24/7, that is, around the clock. And it is controlled through a convenient method of communication. For example, via telegram or via mail. That is, you go there to the server to communicate with it, not to climb. What can he do? He knows how to work according to a schedule. He surfs the Internet, works with files, collects digests, responds in instant messengers. It connects, which is important, yes, it can, you can connect different models of brains. Set up subagents. His main feature, Hermes, is that he remembers, he has good memory work. He remembers and structures your communication. And at the same time he improves himself due to this. That is, he refines his own skills. I will now analyze this with an example, that is, to make it clearer. For example, you ask, once a week, go to such and such a site and check the price of a competitor’s product. He creates a regular task for this task and describes it as a skill. Where to go to see, that is, and use this skill. Starts automatically sending you a scheduled price to the desired chat. And just imagine, 2-3 weeks pass, you additionally wanted him to look at availability. It shows the availability of items in the warehouse, for example, for leftovers. And you just write to him, yes, here’s the completed task, and add all the availability there. And that’s it, he will improve his skill himself. Next time he will send you both the price and the remaining balance. And you don’t need any global reconfigurations or climb anywhere. No programmers involved. That is, you have a model for this data collection parsing, it changed once or twice, and he remembered it. This is an example of how he can improve his own skills. Let me now tell you how my agent works. I bought a VPS server in the Netherlands through a Russian provider. I placed this Hermes on it, connected the brains to it, these LLMs in two versions at once. Moreover, the first one I initially connected was OpenRouter, which is an aggregator of different language models. I played around there, switched models, spent the first 10 dollars on tokens and realized that tokens are generally used up very quickly. Here the scheme is more profitable. I also found out about her. For brains, you can use a regular ChatGPT Plus subscription for $20. And at the same time, with some average load on the agent, he is completely overwhelmed. But especially in the first month, there will be enough time to play around and try. But again, you need to understand that this is something that can be changed. Now I can get ChatGPT to work by default, and on a separate task, if I need something unique, then I can connect from OpenRouter and pull something up. I communicate with an agent via a Telegram bot. At first I just had a direct dialogue with this bot, but then I realized that I needed to separate the topics, because many different questions were already arising with them. I created a general group with different threads and added a bot there. And then it generally seemed like a good move to me. I even added this to my wife’s chat, started several topics for her, and now it turns out that he helps not only me with my tasks, but also her with some personal family issues. A couple of settings that I made additionally, I was faced with the fact that large files are now being sent through Telegram, not always correctly, so I set up a common Yandex.Disk for us together with Hermes. He can upload files there himself, and I can upload these files to him there too. Plus, I connected Hermes to the BuildIn.EI service, this is a Chinese analogue of Notion, with Kanban boards, a knowledge base, and so on. How I use this, I’ll tell you about a specific case a little later. Plus another interesting point: I managed to connect communication with Hermes not only through Telegram, but also in Messenger Max. True, you can repeat this only if you have a TP or a legal entity, because there are currently restrictions on creating bots in Max. But in general, in my case, even if Telegram is blocked, it turns out that the agent will remain available and will work without a VPN, without a station with a tambourine, and so on. And, by the way, recently the developers also released a desktop version of the agent, which can be installed on a computer, but I have not installed it yet. According to reviews on Reddit, this is a completely crude beta with a bunch of bugs. We need to wait 1-2 months, let these bugs be fixed, and then, I think, I’ll try. Well, now the most interesting thing is the cases. I've been using this agent for about two months now, but I use it almost every day. In terms of user experience and simplicity, it really suits me. The first case is the morning briefing. I admit honestly, my wife perfectly solves the problem of how to dress a child for kindergarten according to the weather. But I just have some kind of internal barrier with this, it’s hard to solve such things. And so in the morning, when I take my daughter to kindergarten, my wife and other children are still sleeping. And what does Hermes do? Every morning around 6 am he sends me a report, but not just a weather report like it’s plus 17 today, cloudy, and so on. And he sends it in this logic. The weather today is such and such, the weather during the child’s walk in kindergarten will be such and such, there will be no rain or, on the contrary, it will be, what the wind will be like. And most importantly, based on this, he gives specific recommendations on what to wear for the child, such as a T-shirt or a thin long sleeve top, bottoms, light trousers, sneakers, a cap, and so on. That is, the problem of how to dress a child is solved in this way for me. I understand this is an unusual scenario, but for me it is very valuable. And so it turns out that one of the features of the Hermes agent is that he can perform certain tasks on a schedule at the pace you need. And then let's continue. This morning briefing, it also includes not only this, but I also added work there. That is, for example, I am now developing sales of my course on stepik, and Hermes and I made a connection to stepik via API, and every morning, when I wake up, he sends the latest statistics on sales, student dynamics, podcast statistics, plus the information comes on its own, this is the value for me, on a schedule, without any action on my part. That is, I woke up, and I already have fresh data, a ready report. Well, it's just beautiful. The second case is how an agent helps manage my channels. We are a large family, and I am interested in following news about benefits and support measures from the state. But I don’t have enough time or discipline to specifically look for them, so I started a public telegram channel and asked Hermes to collect a news digest for large families once a week and post it there. And the funny thing is, that is, he started doing this, the funny thing is, some of the first organic subscribers even appeared there, without any promotion on my part at all. Second example. The second example, it is more specific, is closer to us. I have a channel on the neural networks of Russia and China, both in Telegram and Max. And so Hermes once a day, once every two days, he goes, monitors news from specific sources on this topic and publishes useful collections there. This way my students and I keep our finger on the pulse without any manual monitoring. Well, moreover, I still have a third channel, it’s about Jobs to be done and my direction. And there Hermes works as an editor and copywriter. What's the point? I send him my raw notes, some ideas, thoughts, screenshots. He automatically frames this matter in my author’s style, because he read this channel, he understood how I write before. Here. Then he queues these publications at a given pace. He doesn't spam, he gives them out evenly, just like I told him. This channel is not idle and I don’t need to sit down to prepare these publications every time. At the same time, I can even form this sequence of publications on the fly. The third case is concierge logic. As an example of working with air tickets. The task was, for example, there Moscow-Ufa to select a specific date range without luggage at the desired departure time. Preferred airports. We have 6 passengers, we have a code. That is, it used to take a couple of hours to manually compare aggregators to select tickets. This is the pain of choosing checkboxes and so on. All this happened. Now I give these criteria to the agent. And he collects himself, goes through the best options, structures them, shows compromise solutions. It’s cheaper here, the flight here is inconvenient. It's a few rubles more expensive here, but from a closer airport. Here. And this really simplified our selection of air tickets. Or here's another case. This is selling things on Avito. I send him a recent case, I send him photos of the headphones that I want to sell. I give him a voice note. I'm talking about these headphones, I'm telling you. And in the end I get the finished ad text. He even gives me some comments, like let’s change the angle here a little. And he suggests an adequate market price, because he went and looked at the results on Avito. Or another case. This is the selection of goods according to complex criteria. Here is an example of a real request. Help me choose children's walkie-talkies for a two-year-old and a five-year-old, so that there is simple control, without setting up channels, a minimum of buttons, that is, reliability, video communication is not needed, and so on. And he himself goes, compares and suggests options, which are quite good. That is, we chose good radios. As a result, they even found a pack in which there were 3 pieces in the set. Well, or I’ll tell you something else briefly from the cases. This is a handy thing. Reading threads on Reddit. Moreover, Reddit is often blocked or access there is limited. I send him a link to a third page that turned up in the search. I say, read what they write there, extract opinions. And I receive a summary of fresh opinions from the Western community on a specific topic. Moreover, he can make animations, short videos, even with voice acting in Russian. Well, the voice acting is a bit crooked right now, but I’m experimenting with it. In theory, you need to connect separate services for this, and then everything will be fine. Or here is another useful case that works for me. This is a direct launch of promotions through the Stepik API. There is some serious automation here. That is, Hermes himself creates promotional codes in the Stepik admin panel with the required deadlines, he himself writes the texts of promotions, he himself places them on the landing page inside the platform, he himself writes the offer inside Telegram with a link to the course. And when the promotion ends, he himself removes information about it. That is, it turns out to be a whole mini-marketer who does this on his own and reports that everything is done. Well, the final, most recent case is monitoring vacancies. Also as an example for you. I have now launched a background selection of vacancies that suit me, subscribed to HeadHunter for wide search filters, where the latest vacancies are published. Once a day they arrive in my email in a selection. And then, together with Hermes, I set up sending vacancies there so that he could pick them up directly from the mail, told him what filtering rules should be in place, which is important for me when choosing. And I gave him my resume, showed him examples of options that were suitable for me and those that were not. And now he receives these mailings, filters, evaluates the list of these vacancies using this internal scoring, shows relevance in numbers and collects super relevant vacancies directly into the Kanban board on Build-in AI, in this space, for my consideration and response. And then I look, it turns out, with the eyes of the vacancies that are most interesting to me. And he will also help me during the process. In fact, I ended up with a career assistant in some way. To summarize, I would like to say that he has much more cases. I've only highlighted a few now. I hope you already have some initial understanding of its possibilities. In conclusion, I want to talk about the nuances, my feelings and money, how much it all costs. The advantages of such a personal agent are that you have much more control, you can customize it for yourself, you can connect any models you want. You connect a permanent assistant. He lives with you 24/7. There is also a minus. This still requires setting up the server, that is, you will need to go into the terminal, and maybe even more than once. But any neural network, when configured, will tell you what and where to write to you. Yes, there are glitches. For example, last month our data center in the Netherlands went down for more than a day, and the agent did not work all this time, since I did not provide plans for such an alternative for such fault tolerance. There are still security questions. Remember my warning from previous episodes about sensitive data. In the Russian Federation, personal data and trade secrets in this regard cannot be sent abroad. But what is Hermes's trick here? The fact is that, in fact, it can be deployed in the Russian circuit, and Alice and Ai from Yandex can be connected as brains. But I personally haven’t tried this yet, I can’t say how well it will really work in this regard. Well, in general, for now this is, of course, more of an experimental zone than some kind of reliable corporate solution. Therefore, he is positioned more as a personal agent for now. But at the same time, how does the interaction feel? At first it’s like a toy, like some kind of Tamagotchi that can talk and do something, but at the same time regularly eats tokens. But then, as the opportunity opens, the real wow effect comes. Yes, he has problems, he has limitations, but at the same time, he saves incredible time every day. And gradually it even causes some kind of mild addiction effect. How much does it cost? Or how much does something like this cost? Well, here's an example, my example. Subscription to GPT chat, taking into account the commission of intermediaries and other things, well, around 2000 rubles per month. Hosting in the Netherlands through a Russian VPN, through a Russian provider, is 1100. Well, plus you have to add the costs of VPN, probably, but it can be different here. That is, for me it was around 600 rubles. Total, roughly speaking, around 4,000 rubles per month you get a 24-hour personal assistant. And at the same time, it is important to understand that in a scheme like mine, you also get a second agent. That is, a code or GPT chat appears on your computer, now it has been renamed GPT Work chat, also with its own features and features. And how can you even create such an agent for yourself? There are 4 ways that I will suggest, in principle there are clearly more of them, but these are the first 4 that come to me. The first is you googling “Hermes Agent manuals” or “Settings” yourself. Watch the video, it’s online, even on Rutube. The second option is ready-made solutions for deployment. For example, on Yandex.Cloud I saw from 3,642 rubles per month. The third one is on Avito. There are a lot of wizards who help with the setup. Well, fourth, you can contact me. I will help for a separate payment, but for the first 10 clients for a purely symbolic fee. Ways to contact me are in the profile on Stepik and in the description of this issue. Well, now let's sum it up. Today we looked at and explained to you what an EA Agent is and how they differ from regular chats. That is, the agent not only responds, he acts. We looked at the evolution, how we move from promts through the context to this harness, to the harnes around us of the model. Using live examples, we saw what a personal agent can already do today. He does morning briefings, can run channels, can perform concierge tasks, and so on. Plus, I’ll return to the beginning of the issue and the news from the beginning of the issue. A smartphone where instead of an application there is an agent, it already exists. That is, this is the direction in which the entire industry is moving. Employers are already looking for people who touched agents. This whole story costs 3-5 thousand rubles a month and one evening at a construction site. It seems like a very cheap ticket to the next stage of your professional competitiveness. And in my opinion, in general, payments on neural networks will soon become a regular budget item, such as expenses for the Internet and housing and communal services. Everyone will not become some kind of comodity. I propose to conclude here. Egor Golubev was with you, a neural network podcast for work and life. Subscribe to the channel, like, share with your colleagues. See you in a month.
Всем привет, на связи Егор Голубев и это подкаст Нейросети для работы и жизни. Сегодня начну с новости, которая на мой взгляд уже далеко не первая ласточка, но при этом еще один звоночек про совершенно новую модель взаимодействия человека с компьютером и смартфоном. Китайская компания StepFun представила смартфон StepX Neo. Его главная особенность – это основной интерфейс, построенный вокруг ИИ-агента. И что это значит на практике? Пользователь больше не прыгает между приложениями, он формулирует задачу естественным языком, говорит спланируй поездку, переведи разговор, заполни форму, найди маржрут, забронируй столик, собери результат из нескольких сервисов и сам агент уже ходит по приложениям и делает всю необходимую работу. Задумайтесь, какой это сдвиг? Сегодня мы привыкли думать с вами в логике приложений, открыть одно, скопировать другое, проверить и так далее. А агентный интерфейс, он понимает общий фокус на уровень выше. От логики «какую кнопку нажать?» мы двигаемся к логике «какой мне нужен результат?». Да, пока это ранний сигнал и далеко не норма, но это направление, которое уже отчетливо видно. Все меньше будет экранов и ручного переключения, все больше будет постановки задач и контроля результата. Вот эта история вся и называется «И агенты», и посвящен будет сегодняшний наш выпуск. И что показательно, даже сегодня уже можно открыть некоторые вакансии на HeadHunter по маркетологам, аналитикам, менеджерам проектов. И там уже все чаще встречается требование, что кандидат хотя бы должен трогать агентов руками, понимать, как с ними работать. Да, там не программировать, ничего такого, но именно понимать, как их использовать. И вот, хорошая новость, чтобы почувствовать это агентное будущее, нам уже не нужно ждать какой-то китайский смартфон, его можно уже потрогать сегодня прям. И этот выпуск, он особенный. Я поделюсь сегодня личным опытом использования персонального и агента, который я использую, называется «Гермес» или «Хермес Эджент» на английском. Расскажу, что это такое, как устроен он, покажу свои реальные кейсы использования от утреннего брифинга до поиска работы и объясню, сколько вообще это стоит и как сделать себе такого же. Поехали, начинаем наш выпуск. Давайте сначала разберемся с понятием, что такое и агент вообще простыми словами. Смотрите, как эволюционировала работа с нейросетями. Первый этап – это prompt engineering, то есть вы управляете результатом через формулировку грамотного запроса. Написал хороший prompt, получил ответ и это то вообще, чем мы с вами в основном занимались в прошлых выпусках. Второй этап – это context engineering, так называемый. То есть к prompt уже мы стараемся добавлять максимально широкий контекст для того, чтобы нейросеть точнее и лучше понимала, что происходит, какая задача перед ней стоит. Это вот проекты и папки в тех же условных чатах GPT. Это некоторые истории переписки, которые он учитывает, ваши файлики и референсы, которые вы добавляете. То есть нейросеть уже знает вас лучше и больше, точнее отвечает. И вот третий этап, самый актуальный на данный момент – это, как я это понимаю, по-английски он называется harness engineering или это engineering обвязки. Туа стоит вокруг языковой модели, а вокруг там целая система. Это как устроена память, какие у нее есть навыки, какие используются инструменты, какие им доступны, правила, расписание, цели и даже субагенты. Вот эта вся обвязка, она и называется harness. И вот здесь и начинается агентная логика. Главная мысль этого этапа в том, что конкуренция даже смещается в каком-то смысле между нейросетями и вендорами, производителями нейросетей. Уже не только у кого модель умнее, там куча параметров больше и прочее, но и у кого вот лучше устроена эта система вокруг модели, эта обвязка. Если простыми словами теперь сказать, то агент – это система, у которой есть мозг. Это вот та самая языковая модель. У него есть и память, и контекст. То есть он помнит то, о чем вы с ним общались, тирай месяц назад, неделю назад. У него есть навыки или скиллы. Это важный момент, это скиллы, это не штуки, которые лежат внутри модели, внутри мозга. Это именно внешние некоторые инструкции, процедуры, которые где-то записаны. Это некоторый фиксированный способ выполнения типовой задачи. Благодаря скиллу или навыку агенту не нужно каждый раз заново изобретать подход. То есть он идет по вот этой написанной траектории. Ну, может с отклонением двигаться при этом. Инструмент – это то, что дает возможность взаимодействовать со внешним миром. Это браузер, это работа с поиском, с документами, с конкретными, с Excel-ками, с таблицами, с внутренними системами и так далее. И еще есть у агентов цели, циклы действий, правила поведения и возможность обращаться к другим агентам. Но ключевое, что важно понимать сейчас, в отличие от привычного чата, это то, что агент не просто отвечает, как обычный чат. Он действует. Он идет в браузер, он работает с файлами, он обращается к сервису, он может других агентов привлекать. И он двигается итеративно. То есть сделал, посмотрел, насколько получилось близко к цели, пошел дальше, скорректировал план и так далее. Он движется к цели, которые вы обозначили. Сегодня я расскажу про один конкретный класс. Это персональные open source агенты, которые живут на отдельном сервере. Примеры известные, наверное, очень тем, кто в индустрии находится, нашумевшие в прошлом году, это openclaw. А гермес это некоторая, ну, следующая цепочка или ветка, как бы и прямой конкурент его. Вот про него сегодня речи пойдет. Смысл или идея такого агента очень простая. Он разворачивается на VPS, это арендованный частный сервер. И живет там 24 на 7, то есть круглосуточно. И управляется через удобный вам способ связи. Например, через телеграм или через почту. То есть вы туда на сервер, чтобы с ним общаться, не лазить. Что он умеет? Он умеет работать по расписанию. Он ходит в интернет, работает с файлами, собирает дайджесты, отвечает в мессенджерах. Подключает, что важно, да, он может, можно разные модели мозгов подключать. Настраивать субагентов. У него, вот у гермеса главная фишка в том, что он запоминает, у него хорошая работа с памятью. Он запоминает, структурирует ваше общение. И он при этом самоулучшается за счет этого. То есть он дорабатывает собственные навыки. Я сейчас это разберу на примере, то есть, чтобы было понятней. Например, вы просите, раз в неделю заходи на такой-то сайт и проверяй цену на товар конкурента. Он под это дело формирует регулярную задачу, описывает ее как навык. Куда сходить, чтобы посмотреть, то есть и пользоваться этим навыком. Начинает вам автоматически присылать в нужный чат цену по расписанию. И вот представьте, проходит 2-3 недели, вы захотели дополнительно, чтобы он смотрел еще и наличие. Там показывается наличие штук на складе, например, на остатки. И вы ему просто пишете, да, вот на отработавшую задачу, а добавь все туда наличие. И все, он сам улучшит свой навык. В следующий раз он пришлет вам и цену и остатки. И вам не нужно при этом никаких глобальных перенастройок, никуда залазить. Никаких программистов привлекать. То есть у вас модель вот этого парсинга сбора данных, она поменялась на раз-два, и он при этом это запомнил. Вот это пример того, как он может самоулучшать собственные навыки. Давайте теперь расскажу, как агент устроен у меня. Я купил VPS сервер в Нидерландах через российского провайдера. Я разместил на нем этого гермеса, подключил к нему мозги, вот эти LLM в двух вариантах сразу. Причем первый изначально я подключил OpenRouter, это агрегатор разных языковых моделей. Там поигрался, попереключал модели, потратил первые 10 долларов на токены и понял, что токены расходуются вообще очень быстро. Здесь схема выгоднее. Узнал тоже про нее. В качестве мозгов можно использовать обычную подписку ChatGPT Plus за 20 долларов. И при этом, при некоторой средней нагрузке на агента, его вообще с головой хватает. Но особенно в первый месяц по-любому хватит для того, чтобы поиграться, попробовать. Но опять же, надо понимать, что это то, что можно менять. Теперь у меня получается по умолчанию работать ChatGPT, а на отдельной задаче, если мне что-то нужно уникальное, то я могу подключиться из OpenRouter, что-то подтянуть. Я общаюсь с агентом через Telegram-бота. Сначала был у меня просто прямой диалог с этим ботом, но потом я понял, что нужно темы разделять, потому что много разных вопросов уже с ними возникает. Я создал общую группу с разными тредами, добавил туда бота. И потом мне это вообще показалось удачным ходом. Я даже в чат это добавил супругу, завел несколько тем для нее, и теперь получается он помогает не только мне с моими задачами, но и ей какими-то семейными личными вопросами. Пара настроек, которые я сделал дополнительно, это я столкнулся с тем, что большие файлы сейчас через Telegram ходят, не всегда корректно, поэтому я настроил нам вместе с Гермесом общий Яндекс.Диск. Он сам туда может выкладывать файлы, и я могу ему туда скидывать тоже эти файлы. Плюс я подключил Гермеса к сервису BuildIn.EI, это аналог Notion китайский, с Kanban-досками, с базой знаний и так далее. Как я это использую, там про конкретный кейс я чуть позже расскажу. Плюс еще интересный момент, мне удалось подключить общение с Гермесом не только через Telegram, но и в Messenger Max. Правда, повторить это вы сможете только если у вас есть TP или юрлицо, потому что там в Max сейчас есть ограничения на создание ботов. Но зато вообще в моем случае, даже если Telegram заблокируют, получается агент останется доступен и будет работать без VPN, без станции с бубном и прочего. И, кстати, недавно разработчики выпустили у него еще и десктоп-версию агента, которую можно установить на компьютер, но я ее пока не ставил. По отзывам на Reddit это совсем сырая бета с кучей багов. Надо подождать месяцев 1-2, пусть пока исправят эти баги, и потом уже, я думаю, пробовать буду. Ну а теперь самое интересное, это кейсы. Я использую этого агента уже около двух месяцев, но я пользуюсь им почти каждый день. По пользовательскому опыту и простоте он мне очень заходит. Первый кейс это утренний брифинг. Я признаюсь честно, жена моя прекрасно решает задачу, как одеть ребенка в садик по погоде. А вот у меня прям барьер какой-то внутренний с этим, тяжело такие штуки решать. И вот утром, когда я веду дочку в садик, жена с другими детьми еще спит. И что делает Гермес? Он каждое утро около 6 утра присылает мне сводку, но не просто сводку по погоде в духе там сегодня плюс 17, облачно и так далее. А он присылает ее в такой логике. Погода сегодня такая-то, погода на время прогулки ребенка в садике будет такая-то, дождя не будет или наоборот будет, какой будет ветер. И главное, на основе этого он дает конкретные рекомендации, что одеть ребенку, типа верх футболка или тонкий лонгслив, низ там, легкие брюки, кроссовки, кепка и так далее. То есть задача, как одеть ребенка, для меня решается таким образом. Я понимаю, это необычный сценарий, но для меня он очень ценный. И вот получается, одна из особенностей агента Гермеса, это то, что он может по расписанию определенные задачи выполнять в нужном вам темпе. И тут давайте продолжим. Вот этот утренний брифинг, он еще и включает у меня не только это, но и добавил я туда рабочее. То есть я, например, сейчас развиваю продажи своего курса на степик, и мы с Гермесом сделали подключение к степику по API, и он каждое утро к моему пробуждению присылает свежую статистику по продажам, по динамике учеников, статистику подкаста, плюс информация приходит это сама, в этом ценность для меня, по расписанию, без любого моего действия. То есть я проснулся, и у меня уже свежие данные, готовый отчет. Ну просто красота. Второй кейс, это то, как агент помогает вести мои каналы. Мы многодетная семья, и мне интересно отслеживать новости про льготы и меры поддержки от государства. Но специально вот искать их, у меня ни времени, ни дисциплины не хватает, и я завел публичный телеграм-канал и попросил Гермеса раз в неделю собирать дайджест новостей для многодетных семей, туда выкладывать. И вот самое забавное, то есть он это начал делать, самое забавное, там даже появились уже какие-то первые органические подписчики, вообще без продвижения с моей стороны. Второй пример. Второй пример, он более предметный, уже ближе к нам. У меня есть канал по нейросетям России и Китая, и в Телеграме, и в Макс. И вот Гермес раз в день, раз в два дня, он ходит, отслеживает новости из конкретных источников по этой тематике и публикует туда полезные подборки. Я и мои студенты таким образом держим руку на пульсе без какого-то ручного мониторинга. Ну и более того, у меня еще есть третий канал, он по Jobs to be done и моему вот этому направлению. И там Гермес работает как редактор и копирайтер. Смысл какой? Я ему скидываю свои сырые заметки, какие-то идеи, мысли, скриншоты. Он это дело автоматически оформляет в моем авторском стиле, потому что он почитал этот канал, он понял, как я пишу до этого. Вот. Дальше он ставит в очередь эти публикации с заданным темпом. Он не спамит, он выдает их равномерно, так как я ему сказал. Канал этот не простаивает и мне не нужно каждый раз садиться оформлять эти публикации. При этом я могу даже набегу формировать эту очередность публикаций. Третий кейс это консьерж логика. Как пример работы с авиабилетами. Задача была, например, там Москва-Уфа подобрать конкретный диапазон дат без багажа в нужное время вылета. Предпочтительные аэропорты. У нас 6 пассажиров, у нас код. То есть раньше на подбор билетов пару часов ручного сравнения агрегаторов. Вот это боль выбора чекбоксов и прочее. Все это было. Сейчас я отдаю критерии эти агенту. И он собирает сам, ходит лучшие варианты, структурирует их, показывает компромиссные решения. Вот тут дешевле, тут вылет неудобный. Тут на сколько-то рублей дороже, но из более близкого аэропорта. Вот. И это действительно нам сильно упростило подбор авиабилетов. Или вот еще кейс. Это продажа вещей на Авито. Я ему скидываю, вот недавний кейс, скидываю ему фотки наушников, которые хочу продать. Даю ему голосовую заметку. Говорю про эти наушники, рассказываю. И в итоге получаю готовый текст объявления. Он мне даже какие-то комментарии дает, типа поменяем немножко тут ракурс. И адекватную рыночную цену подсказывает, потому что он пошел и посмотрел выдачу на Авито. Или еще один кейс. Это подбор товаров по сложным критериям. Вот там пример реального запроса. Помоги мне подобрать детские рации для двухлетки и пятилетки, чтобы было при этом простое управление, без настройки каналов, минимум кнопок, то есть надежность, видеосвязь не нужна и так далее. И он сам идет, сравнивает и подсказывает варианты, которые при этом достаточно неплохие. То есть выбрали мы хорошие рации. По итогу даже нашли пак, в котором было в наборе 3 штуки. Ну или вот еще из кейсов что-то кратенько расскажу. Это удобная штука. Чтение веток на Reddit. Тем более, что Reddit часто заблокирован или доступ туда ограничен. Я ему кидаю ссылку на трет, который оказался в поиске. Говорю, прочитай, что там пишут, сделай выжимку мнений. И получаю сводку свежих мнений от западного сообщества по конкретной тематике. Более того, он умеет делать анимации, короткие видео, даже с озвучкой на русском. Ну озвучка, правда, сейчас кривоватая выходит, но я с этим экспериментирую. По идее для этого нужно отдельные сервисы подключать, и тогда будет все хорошо. Или вот еще один полезный кейс рабочий для меня. Это прям запуск промо-акций через API Stepik. Тут уже прям серьезная автоматизация. То есть Гермес сам создает промо-коды в админке Stepik с нужными сроками, он сам пишет тексты промо-акций, сам размещает их на лендинге внутри платформы, сам пишет оффер внутри Телеграма со ссылкой на курс. И когда акция уже заканчивается, то он сам убирает информацию о ней. То есть получается такой целый мини-маркетолог, который самостоятельно это делает и отчитывается, что все сделано. Ну и финальный, самый свежий кейс – это мониторинг вакансий. Тоже как пример вам. Я запустил сейчас фоновый подбор подходящих мне вакансий, подписался на HeadHunter на широкие фильтры поиска, где свежие вакансии публикуются. Раз в сутки они приходят мне на почту подборкой. И дальше вместе с Гермесом я настроил пересылку вакансий туда, чтобы он прямо их из почты забирал, рассказал ему, какие правила должны быть у фильтрации, что для меня важно при выборе. И отдал ему свое резюме, показал ему примеры подходящих мне вариантов и неподходящих. И теперь он получает эти рассылки, фильтрует, оценивает список этих вакансий по вот этому скорингу внутреннему, показывает релевантность в цифрах и собирает супер релевантные вакансии прямо в Kanban доску на Build-in AI, вот в этом пространстве, на мое рассмотрение и отклик. И дальше уже я смотрю, получается, глазами максимально интересные мне вакансии. И уже по процессу он тоже мне будет помогать. По сути у меня получился в каком-то плане карьерный ассистент. Подытож, я бы хотел сказать, что кейсов у него значительно больше. Я сейчас подсветил только несколько. Надеюсь, у вас сложилось уже какое-то первичное понимание его возможности. В завершение хочу рассказать про нюансы, мои ощущения и деньги, сколько это все стоит. Плюсы такого персонального агента, это то, что у вас больше контроля значительно, вы разворачиваете его под себя, вы подключаете любые модели, которые хотите. Вы подключаете постоянного помощника. Он живет у вас 24 на 7. Минус тоже есть. Это все равно нужна настройка сервера, то есть в терминал нужно будет залезть, и может быть даже не один раз. Но любая нейросеть при этом по настройке такой подскажет, что и куда вам писать. Да, бывают сбои. Например, в прошлом месяце на сутки с лишним у нас упал дата-центр в Нидерландах, и агент все это время не работал, так как я не предусмотрел планы такой альтернативного на такую отказоустойчивость. Есть вопросы все равно по безопасности. Помните мое предостережение из прошлых выпусков про чувствительные данные. В РФ нельзя отправлять за границу персональные данные, коммерческие тайны в этом плане. Но тут фишка Гермеса в чем? В том, что вообще-то его можно развернуть и в российском контуре, а в качестве мозгов можно подключить Алису и Ай от Яндекса. Но такого я лично еще не пробовал, не могу сказать, насколько реально он хорошо будет в этом плане работать. Ну и в целом, пока это больше, конечно, экспериментальная зона, чем какое-то надежное корпоративное решение. Поэтому он и позиционируется больше пока как персональный агент. Но при этом, как ощущается взаимодействие? Сначала это как игрушка, как какой-то собственный тамагочи, который умеет говорить, что-то делать, но при этом регулярно ест токены. А вот потом, по мере открытия возможности, наступает настоящий вау-эффект. Да, у него бывают косяки, у него есть ограничения, но при этом каждый день он нереально время экономит. И постепенно он даже уже какой-то эффект легкой зависимости вызывает. Сколько он стоит? Или сколько стоит такое дело? Ну вот на примере, на моем примере. Подписка чат GPT с учетом комиссии посредников и прочего, ну в районе 2000 рублей в месяц. Хостинг в Нидерландах через российский VPN, через российского провайдера, это 1100. Ну и плюс надо расходы на VPN плюсануть, наверное, но тут уже по-разному может быть. То есть у меня это было в районе 600 рублей. Итого, грубо говоря, в районе 4000 рублей в месяц вы получаете круглосуточного персонального ассистента. И при этом важно понимать, что вот в такой схеме, как у меня, вы также получаете и второго агента. То есть у вас на компьютере появляется кодекс или чат GPT, сейчас его переименовали чат GPT Work, тоже со своими фишками и со своими особенностями. И как же такого агента вообще сделать для себя? Есть 4 пути, которые я подскажу, их в принципе явно больше, но вот это первые 4, которые мне приходят. Первый, это вы самостоятельно гуглите «Гермес Эджент руководства» или «Настройка». Посмотрите видео, есть в сети, даже на Рутубе есть. Второй вариант, это есть готовые решения по разворачиванию. Например, на Яндекс.Клауде я видел от 3642 рублей в месяц. Третий, это на Авито. Куча мастеров есть, которые помогают с настройкой. Ну и четвертый, вы можете обратиться ко мне. Я помогу за отдельную оплату, но первым 10 клиентам за чисто символическую. Способы связи со мной есть в профиле на Степик и в описании этого выпуска. Ну и теперь давайте подведем некоторый итог. Сегодня мы посмотрели, разобрали с вами, что такое ЕАгент и чем они отличаются от привычных чатов. То есть агент не просто отвечает, он действует. Мы посмотрели на эволюцию, как от промтов двигаемся через контекст к этой обвязке, к харнесу вокруг нам модели. На живых примерах мы увидели, что персональный агент уже может сегодня. Он делает утренние брифинги, может вести каналы, может консьерж задачи выполнять, ну и так далее. Плюс вернусь к началу выпуска и к новости из начала выпуска. Смартфон, где вместо приложения агент, он уже существует. То есть это направление, в котором движется вся индустрия. Работодатели уже ищут людей, которые трогали агентов. Вся эта история стоит там 3-5 тысяч рублей в месяц и один вечер на стройке. Кажется, что это очень дешевый билет, следующий этап вашей профессиональной конкурентоспособности. И по моему мнению, вообще скоро платежи на нейросети станут обычной статьей бюджета, типа как расходы на интернет и на ЖКХ. Все не станут некоторым комодити. На этом я предлагаю завершать. С вами был Егор Голубев, подкаст нейросети для работы и жизни. Подписывайтесь на канал, ставьте лайки, делитесь коллегами. До встречи через месяц.