Нейромережі


Kanal geosi va tili: Ukraina, Ukraincha


Канал про нейромережі, технології та IT

#ГоловнеЗаТиждень - добірка всіх новин за тиждень

Інші наші канали:
НейроЄнот: https://t.me/neuroenot
Технологіі: https://t.me/trend_technology_news
Реклама: @New_Life_Technology

Связанные каналы  |  Похожие каналы

Kanal geosi va tili
Ukraina, Ukraincha
Statistika
Postlar filtri


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Claude отримав нові інструменти для автономних агентів

Anthropic відкрила повний доступ до Computer Use, Skills API та Files API. Тепер Claude може виконувати складніші послідовності дій, працювати зі структурою вебсторінок і повторно використовувати завантажені файли.

🔘Детальніше

Computer Use дозволяє виконувати ланцюжок дій без окремого запиту після кожного кроку.

Browser Tool допомагає точніше знаходити елементи вебсторінки.

Skills API додає агентам власні інструкції та скрипти.

Files API зберігає файли для повторного використання.

• Anthropic показала приклад, де автоматизований процес скоротився з 32 до 13 хвилин.

➡️ Детальніше тут.

➡️Запроси друга до Neirom🇺🇦


Зберігаємо найцікавіші нейромережі за тиждень, які ви могли пропустити.

➡️ MiniMax Music 3 тепер можна запускати локально;
➡️ OpenAI пояснила, як ефективніше працювати з GPT-5.6;
➡️ DeepSeek Harness опенсорсний каркас для власних ШІ-агентів;
➡️ ChatGPT навчився пам'ятати вашу роботу на Mac;
➡️ Tencent створила WorldClaw для генерації цілих 3D-світів;
➡️ Pika зібрала музику, голос і звукові ефекти в одному API;
➡️ У Codex можна розширити контекст GPT-5.6 Sol до 1 мільйона токенів;
➡️ Watermarks Remover локальний інструмент для очищення контенту від прихованих метаданих;
➡️ Cursor тепер може хостити код і керувати репозиторіями;
➡️ Hermes Desktop тепер дозволяє створювати окремих ШІ-ботів;
➡️ MAGI-2 Preview відкрита MoE-модель для генерації відео зі звуком;
➡️ Google Research показала PhotoScan — ШІ для оцінки складу тіла за фото;
➡️ Claude Code навчився працювати з дизайнами інтерфейсів;
➡️ Firecrawl тепер є в офіційному каталозі Claude;
➡️ Stable Audio 3.0 додала плагін для Ableton та Logic;
➡️ Alibaba випустила модель для створення пісень за текстом;
➡️ Ornith-1.5 сама створює завдання для власного навчання;
➡️ Claude почав самостійно проєктувати білки для розробки ліків;
➡️ ElevenLabs оновила v3 для живих розмов;
➡️ MAI-Image-2.5-Pro вийшла одразу в топ Image Arena;
➡️ Google AI Studio Build отримав двосторонню синхронізацію з GitHub;
➡️ ChatGPT отримав доступ до Messages на Mac;
➡️ OpenBot створює ізольовані робочі середовища для ШІ-агентів;
➡️ FLUX Upscale навчився підвищувати відео до 4K;
➡️ MiniMax Design перетворює генерацію відео на агентний процес;
➡️ Claude Academy безкоштовне навчання роботі з ШІ від Anthropic;
➡️ OpenAI знизила ціну GPT-5.6 Sol.

#ГоловнеЗаТиждень

➡️Запроси друга до Neirom🇺🇦


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Claude Academy — безкоштовне навчання роботі з ШІ від Anthropic

Anthropic запустила власну освітню платформу, де вчить не просто користуватися Claude, а правильно працювати з ШІ та оцінювати його результати.

🔘Детальніше

• Є курси, покрокові завдання та практичні сценарії.

• Навчання охоплює вибір задач для ШІ та перевірку результатів.

• Anthropic окремо наголошує на збереженні власних навичок і контролі роботи моделі.

• Матеріали можна підбирати відповідно до конкретних робочих або навчальних задач.

• Для Claude також доступний skill Claude Academy, який допомагає знаходити відповідні навчальні програми.

➡️ Спробувати тут.
➡️ Детальніше тут.

➡️Запроси друга до Neirom🇺🇦


OpenAI знизила ціну GPT-5.6 Sol

Вартість GPT-5.6 Sol в API та кредитах зменшили більш ніж на 20%. OpenAI називає це тимчасовим зниженням на наступні три місяці.

🔘Детальніше

• Вхідні токени — $4 за 1M замість $5.

• Вихідні токени — $20 за 1M замість $30.

• Для довгого контексту — $8 за 1M вхідних і $30 за 1M вихідних.

• Знижені тарифи поширюються на API та кредити.

• Ліміти Plus, Pro та Business залишаються без змін.

➡️ Анонс у Твіттер тут.

➡️Запроси друга до Neirom🇺🇦


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
MiniMax Design перетворює генерацію відео на агентний процес

MiniMax запустила платформу, де ШІ сам планує креативну задачу, розподіляє роботу між агентами та збирає результат в одному проєкті.

🔘Детальніше

• Можна почати просто з ідеї або короткого брифу.

• Агент сам розбиває роботу на окремі завдання.

• Текст, зображення, відео та аудіо створюються в одному робочому процесі.

• Canvas дозволяє зв'язувати сценарії, розкадровки, відео та монтаж.

• Готові Skills можна встановлювати або створювати власні для повторюваних задач.

• Серед готових сценаріїв є реклама, e-commerce, короткі серіали та музичні проєкти.

➡️ Спробувати тут.

➡️Запроси друга до Neirom🇺🇦


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
FLUX Upscale навчився підвищувати відео до 4K

Black Forest Labs запустила окремий інструмент для апскейлу відео. Він може не лише збільшувати роздільність, а й відновлювати деталі, які втрачаються під час масштабування.

🔘Детальніше

• Відео можна масштабувати до 1080p, 2K або 4K.

• Precise максимально зберігає оригінал і краще підходить для облич та референсних деталей.

• Creative сильніше працює з деталями та артефактами, але може змінювати окремі елементи кадру.

• Підтримується FLUX 3, для якого інструмент оптимізований.

• Вартість починається від $0,07 за мегапіксель на секунду.

• Доступний через API та Playground.

➡️ Спробувати тут.
➡️ Детальніше тут.

➡️Запроси друга до Neirom🇺🇦


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
OpenBot створює ізольовані робочі середовища для ШІ-агентів

CopilotKit відкрила OpenBot — платформу, де кожен агент працює у власному середовищі з браузером, файлами та інструментами.

🔘Детальніше

• Агенти можуть одночасно працювати з сайтами та застосунками, не заважаючи один одному.

• Дані, файли та авторизації ізольовані між агентами.

• Для кожного агента налаштовуються власні правила доступу.

• Дії агента можна записувати в журнал і вимагати підтвердження для ризикованих операцій.

• OpenBot орієнтований на автономних агентів, які мають виконувати реальні дії в інтернеті.

➡️ Код тут.
➡️ Детальніше тут.

➡️Запроси друга до Neirom🇺🇦


ChatGPT отримав доступ до Messages на Mac

Новий Messages-плагін дозволяє ChatGPT Work і Codex працювати з переписками прямо на Mac. ШІ може знаходити повідомлення, аналізувати контекст і виконувати пов'язані з ними задачі.

🔘Детальніше

• Пошук потрібних переписок і повідомлень.

• Аналіз пропущених розмов та підготовка відповідей.

• Відправлення повідомлень через Messages.

• Робота з iMessage, SMS та RCS.

• Повідомлення можна використовувати як контекст для виконання складніших задач у ChatGPT та Codex.

➡️Запроси друга до Neirom🇺🇦


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Google AI Studio Build отримав двосторонню синхронізацію з GitHub

Тепер AI Studio можна використовувати разом із уже готовими GitHub-проєктами. Репозиторій імпортується в Build, після чого його можна доопрацьовувати ШІ та синхронізувати зміни в обидві сторони.

🔘Детальніше

• Існуючий GitHub-репозиторій можна імпортувати без ручного перенесення файлів.

• AI Studio дозволяє продовжити роботу над кодом за допомогою Gemini.

• Зміни з AI Studio синхронізуються назад у GitHub.

• Зміни з GitHub можна підтягнути в AI Studio та продовжити роботу там.

• Це спрощує перемикання між AI Studio та звичайним GitHub-процесом розробки.

➡️ Спробувати тут.

➡️Запроси друга до Neirom🇺🇦


MAI-Image-2.5-Pro вийшла одразу в топ Image Arena

Microsoft випустила MAI-Image-2.5-Pro — нову модель для генерації та редагування зображень, яку компанія позиціонує як свою найякіснішу на цей момент.

🔘Детальніше

• У рейтингу Artificial Analysis модель стартувала з 1 місцем у редагуванні зображень.

• У Text to Image вона посіла 7 місце.

• У редагуванні випередила Reve 2.1, GPT Image 2 та MAI-Image-2.5.

• Модель орієнтована на складне редагування, деталізовані сцени та точний текст у зображеннях.

• Ціна — $5 за 1M текстових токенів, $8 за 1M вхідних і $106 за 1M вихідних токенів зображень.

• Для 1000 зображень 1024×1024 це приблизно $108,5.

➡️ Спробувати тут.
➡️ Анонс у Твіттер тут.

➡️Запроси друга до Neirom🇺🇦


🤖 AI вже змінює роботу і бізнес.
Але як встигати за сотнями нових інструментів, моделей і можливостей?
AI Digest — щодня:
🔥 головні новини AI
🧠 готові промпти
⚙️ автоматизації та AI-інструменти
💼 практичне застосування для роботи і бізнесу
Без води. Українською.
Підписуйся та будь на крок попереду 👇


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
ElevenLabs оновила v3 для живих розмов

Eleven v3 Conversational призначена для ШІ-агентів, яким потрібно не просто говорити текст, а реагувати природно та з урахуванням емоційного контексту.

🔘Детальніше

• Модель розуміє audio tags для емоцій, інтонації та реакцій.

• Можна додати [laughs], [whispers], [sighs] та інші інструкції прямо в текст.

• Підтримується 70+ мов, включно з українською.

• Conversational-версія оптимізована для діалогів у реальному часі.

• Система також враховує інтонацію та емоційні сигнали, щоб природніше визначати момент відповіді агента.

➡️ Спробувати тут.

➡️Запроси друга до Neirom🇺🇦


Claude почав самостійно проєктувати білки для розробки ліків

Anthropic показала експеримент, де Claude не просто генерував білкові послідовності, а самостійно керував процесом їхнього дизайну та відбору перед лабораторною перевіркою.

🔘Детальніше

• Claude працював одразу з 15 молекулярними мішенями та отримав позитивний результат для 14.

• До 35,1% створених кандидатів підтвердили активність у лабораторії.

• Модель сама запускала спеціалізовані інструменти, відбирала структури та покращувала наступні варіанти.

• Участь людей після запуску процесу була мінімальною.

• Opus 5 також зміг проаналізувати NMR та LC-MS дані за лічені хвилини.

• Результат аналізу чистоти зразка — 96,4% у Claude проти 96,33% у лабораторії.

➡️ Детальніше тут.

➡️Запроси друга до Neirom🇺🇦


Ornith-1.5 сама створює завдання для власного навчання

Вийшла нова версія відкритої моделі Ornith, яка використовує self-improvement під час навчання. Вона не покладається лише на готові завдання, а поступово створює власний навчальний курс.

🔘Детальніше

• Ornith-1.5 самостійно генерує нові завдання та підвищує їхню складність.

• Потім модель створює середовище й інструменти для перевірки розв'язань.

• Результати виконання використовуються для подальшого навчання через reinforcement learning.

• Доступні моделі на 9B, 35B і 397B параметрів.

• Ornith-1.5-397B показала 86,1 на Terminal-Bench 2.1 — трохи вище за заявлений результат Claude Opus 4.8 у 85 балів.

• Водночас на інших тестах перевага Opus 4.8 зберігається, тому заяви про повну рівність варто сприймати обережно.

➡️ Моделі та код тут.

➡️Запроси друга до Neirom🇺🇦


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Alibaba випустила модель для створення пісень за текстом

Fun-Music від Alibaba Cloud генерує музику за описом стилю або готовими словами пісні. Модель може самостійно створити лірику, композицію та вокальне виконання або згенерувати трек без вокалу.

🔘Детальніше

• Можна описати бажаний жанр, настрій, темп, сцену та інструменти — модель використає ці параметри під час генерації.

• Якщо надати власні слова, Fun-Music побудує композицію на їхній основі.

• Для створення музики без вокалу передбачений окремий режим instrumental.

• Підтримуються чоловічий та жіночий вокал у моделі fun-music-v1.

• Готові треки можна отримати у форматах MP3 або WAV.

• Система підтримує потокову генерацію, коли аудіо надходить поступово під час створення.

• Зараз Fun-Music доступна в обмеженому preview через Alibaba Cloud Model Studio.

➡️ Спробувати тут.

➡️Запроси друга до Neirom🇺🇦


Stable Audio 3.0 додала плагін для Ableton та Logic

Stability AI перенесла генерацію музики безпосередньо в DAW. Створені фрагменти можна одразу використовувати в проєкті, редагувати та міксувати з іншими доріжками.

🔘Детальніше

• Генерація синхронізується з BPM проєкту.

• Можна створювати фрагменти або композиції до шести хвилин.

• Варіанти генерації зберігаються як окремі тейки.

• Плагін працює в Ableton Live та Logic Pro на macOS.

• У вебверсії тепер можна текстом редагувати вже створену композицію та робити audio-to-audio варіації.

• Також доступне редагування окремих доріжок і застосування ефектів.

Плагін зараз перебуває в beta.

➡️ Спробувати тут.
➡️ Детальніше тут.

➡️Запроси друга до Neirom🇺🇦


Firecrawl тепер є в офіційному каталозі Claude

Firecrawl додали до каталогу Anthropic як плагін для Claude Code. Він перетворює вебпошук і збір інформації із сайтів на доступні для ШІ інструменти.

🔘Детальніше

• Claude Code отримує через Firecrawl пошук вебом із можливістю одразу отримувати очищений вміст знайдених сторінок.

• Можна окремо скрапити сторінку, просканувати весь сайт або побудувати його карту URL.

• Firecrawl Agent здатен самостійно знаходити потрібну інформацію на кількох сайтах і повертати структуровані результати.

• Пошук працює з актуальними вебданими та підтримує фільтри за періодом, джерелами й типом контенту.

• Firecrawl також має окремі категорії пошуку для GitHub, наукових джерел і PDF.

• У власному тестуванні Firecrawl агент із GPT-5.4 та Firecrawl Search отримав 94,7% на SimpleQA. Це результат зв’язки інструментів, а не окремий показник самої моделі Firecrawl.

➡️ Плагін тут.

➡️Запроси друга до Neirom🇺🇦


Video oldindan ko‘rish uchun mavjud emas
Telegram'da ko‘rish
Claude Code навчився працювати з дизайнами інтерфейсів

У Claude Code з'явився експериментальний Skill /design, який пов'язує Claude Design із середовищем розробки.

🔘Детальніше

• Достатньо описати потрібний інтерфейс, щоб отримати кілька варіантів макета.

• Макети можна переглядати та редагувати перед переходом до коду.

• Вибраний дизайн можна передати Claude Code для створення робочого інтерфейсу.

• Skill доступний у CLI та Desktop.

• Зараз /design перебуває у статусі Research Preview.

Фактично Claude намагається скоротити шлях від ідеї та макета до готового коду, не змушуючи розробника вручну переносити дизайн між різними інструментами.

➡️Запроси друга до Neirom🇺🇦


Google Research показала PhotoScan — ШІ для оцінки складу тіла за фото

Дослідники Google створили систему, яка за звичайними фотографіями людини зі смартфона намагається оцінити склад тіла та окремі показники кардіометаболічного ризику.

🔘Детальніше

• PhotoScan аналізує не лише загальний відсоток жиру, а й особливості його розподілу.

• Для попереднього навчання використали дані понад 35 000 учасників UK Biobank.

• Потім модель донавчали на 677 людях, для яких були доступні фото зі смартфона та результати DXA.

• Середня похибка оцінки відсотка жиру в дослідженні становила близько 2,13 процентного пункту.

• Для прогнозування інсулінорезистентності PhotoScan отримала AUROC 0,760 проти 0,773 у DXA.

• Результати показують, що звичайні фотографії можуть містити більше інформації про метаболічне здоров'я, ніж просто індекс маси тіла.

• Але PhotoScan поки є дослідницьким прототипом і не призначена для самостійної діагностики.

➡️ Детальніше тут.

➡️Запроси друга до Neirom🇺🇦


MAGI-2 Preview — відкрита MoE-модель для генерації відео зі звуком

Sand.ai опублікувала MAGI-2 Preview разом із кодом та weights. Модель генерує до 10 секунд відео із синхронною аудіодоріжкою, а фінальний результат можна отримати в роздільності до 1080p.

🔘Детальніше

• Усередині використовується MoE-архітектура на 114B параметрів.

• На кожному токені активується близько 6B параметрів, що значно зменшує обсяг обчислень.

• Пайплайн спочатку генерує відео в низькій роздільності, а потім окремий refiner підвищує якість.

• Відео та аудіо створюються синхронно в одному процесі.

• Код та weights доступні відкрито, тому модель можна досліджувати й запускати самостійно.

• Для локального запуску потрібне потужне обладнання — MAGI-2 поки не орієнтована на відеокарти з 24 ГБ пам'яті.

➡️ Код тут.
➡️ Ваги моделі тут.
➡️ Технічний звіт тут.

➡️Запроси друга до Neirom🇺🇦

20 ta oxirgi post ko‘rsatilgan.