tgindex
Контур.AI

Контур.AI

Статистика

Мы делаем искусственный интеллект в Контуре и пишем об этом tech.kontur.ru/data-science

Последний пост
24 июл.
Последнее чтение
09:13
Постов за неделю
0
Всего постов
20
Тип
открытый
Язык
русский
Категория
Искусство
В каталоге с
12 авг.
Подписчики
1 207
−1 за 3 дн.
Сутки
0
0,00%
Неделя
 
Месяц
 
Просмотров на пост
907
20 постов
Вовлечённость
75,1%
к подписчикам
Постов в день
0,0
всего 20
Упоминаний
0
каналов
Охват размещения
оценка
1/24сутки в ленте
391
1/48двое суток
448
1/72трое суток
483

Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.

Посты

  • видео или голосовое, без подписи

  • 3 июл.718217

    Мы делегируем работу AI или учим его своим ошибкам? 🟣 Почему искусственный интеллект похож на человека, который не знает китайского, но даёт правильные ответы? 🟣 Как мы перестаём экономить код и чем это оборачивается в нашей работе? 🟣 И в какие моменты ИИ тормозит разработку, а не ускоряет? Даниил Мясников рассказывает про подводные камни в AI и LLM-моделях и объясняет всё на примерах. Читайте на Хабре!

  • Миша Трегубов выступил на DataFest и рассказал как VLM превращают документооборот из архива в активный интеллект 👾 Вот несколько тезисов из презентации: ✔️ Под капотом изображение заранее режем на слайсы «фиксированной сложности» и уже именно их подаем в OCR-модель. Далее раскладываем выход по полочкам уже с помощью Qwen и возвращаем заказчикам искомые сущности ✔️ Дообучение на синтетике валидно, но нужно внимательно и аккуратно подходить к генерации ✔️ Актуальные SOTA DL подходы наподобие DLM (Diffusion Language Model) можно и нужно адаптировать под работу с документами ✔️ Если вы не знаете, что такое VLM, но обладаете экспертизой в классическом CV, то вам будет чем заняться, ведь препроцессинг опять актуален А как все это связано и причем тут экосистема — в записи выступления, которую можно посмотреть тут

  • 28 мая7772из reliable_ml

    Секция Data Strategy от Reliable ML Data Fest 2026, Online, Анонс В это воскресенье проведем онлайн-день секции Data Strategy. К нам придут 2 очень интересных спикера. Фокус - опыт разработки и внедрения стратегии по данным и AI, эффективный и системный подход к масштабированию AI в организациях. Всех ждем! Только надо зарегистрироваться. Онлайн-день будет на платформе DION. Инструкции и ссылки по подключению появятся в ближайшие дни. Ваш @Reliable ML #reliable_ml #data_strategy #data_fest

  • Привет! Давно не было обзора ML-соревнований, так что, как всегда, приносим вам три варианта для участия! 🚀 Orbit Wars В этом соревновании вам предстоит стать командующим своего звездного флота и завоевать превосходство над галактикой! Авторы сделали симуляцию в жанре космических стратегий с планетами, кометами и кораблями, а ваша задача - создать агента, который исходя из ситуации в игре будет принимать оптимальные решения. На ваш выбор два основных подхода: использовать RL или собирать алгоритм на эвристиках. Вместо метрики в игре — полноценный рейтинг, в котором место вашего агента получается из побед\поражений в играх с другими участниками. Соревнование началось недавно, так что у вас еще 2 месяца на изучение и тюнинг используемых подходов! 🦉 BirdCLEF+ 2026 Нечасто залетают соревнования со звуком — здесь вам предлагается распознавать животных по аудиозаписям, собранным в Пантанале — одном из самых богатых по биоразнообразию регионов мира. Данные не очень велики по объему (в отличие от медицины), но далеки от идеальных: шум, наложения сигналов и вариативность условий записи усложняют классификацию. Можно начать с файнтюна Perch от Google, посмотреть на метрики и подумать над улучшениями - на эксперименты еще 2 месяца. 🤖 NVIDIA Nemotron Model Reasoning Challenge И последнее на сегодня — соревнование про улучшение reasoning способности модели. На столе Nemotron-3-Nano-30B, для которой требуется улучшить accuracy на тестовых задачах. Участникам предлагается широкий простор для экспериментов: от продвинутого prompt engineering до синтетической генерации примеров и fine-tuning через LoRA. Выглядит, как хорошая возможность погрузиться в RL (если еще нет) за оставшиеся два месяца до конца соревнования и попытаться забрать медаль!

  • Nvidia выкатили свои модные SALM‑модели для распознавания речи — в Центре ИИ решили проверить, что будет, если проверить: а как эта новоиспеченная SOTA покажет себя на наших реалиях — на русском языке, в домене телефонии и видеоконференций, в условиях, когда у нас нет десятков тысяч часов размеченных людьми данных. Что же у нас получилось? Читайте в новой хабростатье 🖤

  • 17 апр.971321из UseDataConfChannel

    На AiConf будут эксперты из Контура Не виделись полгода! На стенде можно будет подискутировать на темы вокруг LLM, агентов и ML-разработки, посоревноваться с моделькой в определении категорий товаров (да, у нас много разных сервисов для бизнеса). А еще будет игра, в которой вы на себе ощутите все тяготы предпринимательства и легкость бытия, когда все процессы автоматизированы ⚡️ Ребята готовы к любым вопросам, обмену опытом и ламповому общению. С нетерпением ждем встречи 😊

  • 20 апреля будем рады увидеться вживую на AiConf в Москве 🐾

  • 10 апр.1 00253

    ✨ Почему фраза «я использую GPT» ничего не значит и как не надо сравнивать опыт использования нейронок? Почитайте рассуждения Гоши Соловьёва, возможно, там найдется что-то интересное ✨

  • 27 мар.1 08489

    Чем меньше используешь ИИ, тем больше не хочется начинать 😁 Ну а если начинать все-таки надо? Как это сделать менее болезненно можно прочитать в нашей новой статье на Хабре 🖤

  • 18 мар.1 1501614

    ⚡️ Ищем менеджера разработки в Лаборатории Центра ИИ Контура Ты нам подходишь, если: - умеешь вести кросс-функциональную команду, - работать на стыке разработки и ML, - держать фокус одновременно на результате, людях и устойчивости системы. Важно не только управлять командой, но и влиять на то, как именно она работает: развивать процессы и производственные метрики, помогать тимлидам, держать баланс между бизнес-задачами, инфраструктурой и технологическим развитием, вместе с командой двигать AI-направление вперед. Нам подойдет человек с опытом управления командой через тимлидов, пониманием контекста ML/data science и сильным системным мышлением — в работе с людьми, процессами и рисками. Подробности и отклик по ссылке 🖤 Или пиши @LyubovVdovichenko — она поможет понять насколько это подходящая тебе роль 😊

  • 🛠 Раз в квартал мы публикуем дайджест на внутреннюю аудиторию, в котором рассказываем, какие новые ИИ-технологии появились в последнее время. Это не исчерпывающий список: мы выбираем только то, что может быть полезно Контуру. В этот раз мы решили поделиться им и с вами — вдруг и вы найдете что-то полезное и интересное для себя 💎 🤖 Технологии построения отказоустойчивых агентских систем Традиционный подход к построению ИИ-систем — синхронные вызовы — не работает в production. Команда OpenAI во время запуска ChatGPT Images обнаружила это на практике. Ключевой урок: при пиковых нагрузках приоритет отдаётся доступности, а не латентности — лучше медленный ответ, чем отказ. Проблема ИИ агентов в том, что они по природе своей недетерминированы и долгоживущи. LLM может отказать из-за rate limit, вернуть неожиданный результат или выполнять цепочку рассуждений часами. Гарантия того, что агент при сбое не перезапустит весь пайплайн с нуля — это буквально экономия на повторной оплате той же работы. Говоря чуть более техническим языком нужна exactly-once семантика. Durable Execution — концепция, решающая эту проблему. Workflow-движок сохраняет состояние каждого шага и при падении процесса восстанавливает выполнение с точки остановки. Также эта концепция позволяет поддерживать долгоживущие workflow, которые живут десятки минут, часы или дни. 📢 Синтез и клонирование русскоязычной речи Раньше, чтобы получить качественный синтезированный голос, требовался большой корпус записей: десятки (порядка ~40) часов начитанной речи диктора, плюс чистка, обучение и калибровка — то есть время, деньги и люди (диктор, монтаж, DS). Это делало кастомный голос дорогим и длительным проектом, который редко окупается на малых масштабах. Ситуация изменилась. Появились предобученные модели синтеза речи и клонирования голоса — перенос тембра/манеры диктора на новый текст, которые работают “из коробки” и поддерживают русский язык. В результате, для прототипа или даже сценариев продакшена голос можно получить почти бесплатно: без долгого сбора датасета и без обучения моделей с нуля. Примеры таких моделей: Coqui XTTS-v2: zero-shot и CosyVoice 2/3: LLM-style 🎤 Детекция дипфейков в аудио FakeSound Дипфейки опасны не только тем, что картинка или звук выглядят правдоподобно, но и тем, что они подрывают саму модель доверия: любое доказательство в виде записи становится спорным, а проверка подлинности превращается в отдельную дорогостоящую процедуру. В аудио риск особенно острый, потому что канал дешёвый и массовый: одного короткого звонка или голосового сообщения достаточно, чтобы запустить социальную инженерию — «срочно переведи деньги», «подтверди код», «я в беде». Плюс аудио-дипфейки легко встраиваются в реальные записи частично. Отсюда логично вырастает задача Deepfake General Audio Detection — определение факта манипуляции и локализация поддельных временных интервалов в произвольном аудио, не только в речи. FakeSound предлагает датасет и постановку задачи под это, а сами подделки генерируются автоматически, через реалистичное встраивание в исходный звук, без полной перегенерации всего аудио. Чтобы на этом можно было строить прикладные решения, авторы предоставляют бенчмарк, предобученные модели и датасет. Это превращает тему дипфейков в аудио из абстрактной угрозы в измеримую инженерную задачу. Можно сравнивать подходы, обучать детекторы и тестировать обобщаемость на новые генераторы. 📍 А какие технологические новости привлекли ваше внимание?

  • В СПб и нет планов на 5 марта? Приходи послушать Машу Зырянову 🖤 — она знает все-все про бизнесовое применение AI! Университет ИТМО совместно с компанией Nexign проводит бесплатный митап на тему внедрения ИИ в исследовательские центры для снижения рисков и развития инноваций в компаниях. AI 4 Business Data-Driven & RnD Meetup: как использование ИИ снижает риски и ускоряет инновации 🚀 🗓️ 5 марта, 10:00–14:00 📍 Офис Nexign (г. Санкт-Петербург, ул. Уральская, д. 4) Зарегистрироваться на круглый стол можно по ссылке⚡️

  • 17 февр.843178из KonturTech

    🎙 Ура! Ловите запись прямого эфира с продактом ИИ-фичей в Толке Юлей Ладик Ставьте скорость на 1,2х или быстрее, прыгайте по тайм-кодам, пока заваривается чаёк ☕️ 00:00 — вступление от ведущих Юли и Серёжи 03:21 — как мы строим и проверяем гипотезы, как убеждаемся, что ИИ-фича работает на бизнес-цели 08:34 — влияет ли включенная камера на эффективность встреч в Толке по мнению участников? 14:23 — как мы пришли к тому, что и ИИ-решения недостаточно, нужен онбординг 19:27 — выстраиваем каскад гипотез, смотрим, как продуктовое решение влияет на бизнес-метрику 21:43 — переход к вопросам от слушателей Спасибо слушателям за вопросы в конце эфира, мы были рады провести этот пятничный час с вами❤️ #konturtech_video #konturtech_datascience Хабр | Сообщество канала 💻

  • Про трушное применение ИИ в бизнесе послушать не хотите ли? 🤩 Будет интересно не только продактам, но и всем, кто хочет узнать, как моделька превращается в фичу.

  • 11 февр.1 1401716

    ИИ может в разы ускорить ресёрч, но без критического мышления легко утонуть в галлюцинациях и самообмане. 😭 Рома Теплоухов на хабре показывает свой рабочий метод: как с помощью ИИ быстро делать конкурентный анализ, генерировать продуктовые сценарии, проверять гипотезы, прикидывать рынок и PnL — при этом не сливая коммерческую тайну и всегда валидируя результаты на реальных данных и контексте компании.

  • 5 февр.1 094469

    На конференции OpenTalks.AI, которая пройдет в Белграде 19-20 февраля, Паша Кузнецов расскажет, как мы внедрили детекцию дипфейков для Толка — первой в России ВКС с таким AI-функционалом. Поделится, с какими вызовами мы сталкивались при создании собственного детектора, и как мы их преодолевали. Дипфейки — реальная угроза, которая несёт в себе большие финансовые и репутационные риски, так как практически каждый может создать их во время видеозвонка. Детектор в Толке не только повысил безопасность наших клиентов в сценариях удаленной идентификации личности, но и привёл к операционной эффективности, сократив время проверок почти в три раза и снизив нагрузку на ответственных сотрудников. 👾 — если планируете быть на конференции лично или послушать онлайн 👀

  • 16 янв.1 07887

    По-тихоньку возвращаемся в рабочий ритм после новогодних каникул. 🥂 Давайте начнем с чего-то легкого. Мы уже писали о том, как применяем Dify для проверки ML-гипотез, и вот настало время рассказать, как Low-code-платформы могут быть полезны сильным командам классических разработчиков А поможет нам с этим старший инженер-программист в команде RAG Миша Викторов. 🥽

  • 23 дек.1 125284

    ⚡️ Современные технологии генерации видео используются не только для создания смешных роликов. Остро стоит проблема мошенничества с использование дипфейков — наверняка, вы уже читали, а возможно, даже и сталкивались, с самыми изощренными сценариями. Для того, чтобы успешно детектировать дипфейки, нужно понимать, как они создаются, какие бывают типы угроз и какие из них являются на данный момент наиболее актуальными. Команда Лаборатории компьютерного зрения Центра ИИ Контура совместно с асессорской службой ❤️ сделала часть работы за вас, и готова поделиться датасетом со сгенерированными видео дипфейков, который вы можете использовать для своих исследований и задач. Подробное описание датасета в статье, но вот самое интересное: - всего в датасете 11К примеров, также мы планируем выложить исходные данные, использованные при генерации (видео с youtube и фото с соответствующей лицензией) - статистики по каждому видео (пол, освещение, наличие аксессуаров и другое) - упор сделан на самые актуальные на текущий момент генераторы дипфейков, которые при этом могут использоваться в том числе и в realtime режиме Датасет распространяется под лицензией Creative Commons BY-SA. Пользуйтесь и делитесь своими впечатлениями в комментариях на хабре 🙃

  • 12 дек.912152из Selectel

    ⚡ Как масштабировать пилоты в ML и не сойти с ума? В новом сезоне «Сегодня на ретро» обсуждаем экономику ML и эффективность AI-проектов для бизнеса — от теста до внедрения в реальные кейсы Пилот ML-модели — один из безопасных способов проверить гипотезу, не инвестируя в крупный запуск. Но как увидеть реальный эффект еще до продакшена? И все ли успешные модели нужно масштабировать? 💯 В новом выпуске подкаста «Сегодня на ретро» мы решили посмотреть на вопросы с разных сторон — продуктовой и аналитической. В нашей студии — Юлия Ладик, менеджер по развитию продукта Толк ИИ «Контур», и Елизавета Афанасьева, Senior Data Scientist «Точка Банка». Мы обсудили, как структурировать пилоты и выбирать из них те, что достойны реализации. Смотрите выпуск на наших видеоплощадках: 🔹 VK Video, 🔹 YouTube, 🔹 Rutube. Если пилоту вашего проекта нужны мощности для роста, разверните IT-инфраструктуру с GPU для инференса и обучения ML-моделей в Selectel ➡️

Контур.AI — tgindex