Как ИИ-агенты восстанавливают приложения по их поведению
Как ИИ помогает разрабатывать игры
Как проверить, понимает ли ИИ-ассистент мотивы людей
Как ИИ-агент управлял интернет-магазином и увеличил капитал в 14 раз
Последний ИИ, созданный людьми: на пути к рекурсивному самоулучшению
Как ИИ-агент за несколько дней собрал играбельный шутер
Как граф превращает ошибки ИИ-агента в подсказки
А что, если ИИ-агенту проще пересоздать библиотеку, чем чинить её?
Как ИИ-агент превращает научную статью в рабочий код
Как ИИ-агент делает дизайн красивым и редактируемым
Как собирать готовые навыки для ИИ-агентов из репозиториев с кодом
Почему каждому студенту нужен ИИ-репетитор
Как ИИ-агенты меняют роль разработчика
ИИ-агент собирает законы физики из видео
Как опыт превращается в рабочие навыки ИИ-агента
Автоматическая отладка улучшила ИИ-агентов на 10%
Можно ли научить ИИ-агента делать покупки как человек
Как ИИ-агент восстанавливается после ошибок и меняет план
Как графы помогают ИИ-агентам работать вместе
Как ИИ-агент переносит навыки между разными задачами
Как ИИ-агенты начинают самостоятельно обучать роботов
Как ИИ-агенты начинают самостоятельно обучать роботов
Как ИИ-агенты начинают самостоятельно обучать роботов
Как ИИ-агенты начинают самостоятельно обучать роботов
Как сильная модель улучшает слабую без переобучения
Что если агенты смогут менять среду и саму эволюцию
Зачем агенту понимать причины поступков человека
ComBodied Agents: a New Paradigm of Human-Centric Agentic AI
ИИ-агенты для генерации кода решили лишь 41% задач в новом тесте
SWE-Bench ProMax: Benchmarking Agents on Large-Scale Multilingual Code Refactoring
Как миллионы виртуальных пользователей помогают заменить дорогие тесты на людях
MatrAIx: Simulating the World with 8.3 Billion Persona Agents
Почему лучший ИИ собрал ответ из разных данных с точностью лишь 66%
DataSpace: Benchmarking Data Agents for Verifiable Analytics over Heterogeneous Workspaces
Почему для продвижения бренда в ответах ИИ нужны сторонние сайты
How Large Language Models Source Brand Reputation Across Languages and Markets
Как проверить, способен ли ИИ вести торги целый год
MerchantBench: Benchmarking LLM Agents for Long-Term Coherence in E-Commerce Operations
Игра в шпиона помогает ИИ улучшать тексты и рассуждения
From RLVR to RLSVR: Task Transformation Induces Self-Verifiable Rewards for Open-Ended LLM Self-Improvement
Как один ИИ-агент работает в телефоне, браузере и на компьютере
Qwen-UI-Agent Technical Report: Toward Next-Generation Real-World Centric Foundation GUI Agents
Что помогает ИИ лучше писать код с нуля
SpecFirst: Behavioral Specification Elicitation as a First-Class Step in Agent-Based Program Synthesis from Scratch
ИИ-агенты соблюдают правила компании лишь в 36% случаев
HANDBOOK.md: A Benchmark for Long-Context Agentic Instruction Following
Холст превращает разрозненные идеи в понятный для ИИ проект
JarvisHub: An Open Harness for Canvas-Native Multimodal Creative Agents
ИИ-агентов научили управлять памятью во время долгих задач
ACM: Agentic Context Management for Long Horizon Tasks
Как один разбор ИИ-агента исправил втрое больше задач, чем прежние методы
AgentDebugX: An Open-Source Toolkit for Failure Observability, Attribution, and Recovery in LLM Agents
Дата-пайплайны надёжнее и дешевле, чем Claude Code, без потери качества
DataFlow-Harness: A Grounded Code-Agent Platform for Constructing Editable LLM Data Pipelines
Что мешает ИИ нормально искать ответы в интернете
SearchOS-V1: Towards Robust Open-Domain Information-Seeking Agent Collaboration
Карта поведения помогает быстрее менять ИИ-агентов
Harness Handbook: Making Evolving Agent Harnesses Readable,Navigable, and Editable
Что меняется, когда ИИ учится на собственном опыте
MemoHarness: Agent Harnesses That Learn from Experience
ИИ чинит код лучше, если сначала задаёт вопросы
Know Before Fix: QA-Driven Repository Knowledge Acquisition for Software Issue Resolution
ИИ для смартфона и очков учится помнить жизнь
LightMem-Ego: Your AI Memory for Everyday Life
Метапознание как следующий рубеж для LLM
Metacognition in LLMs: Foundations, Progress, and Opportunities
Почему ИИ-агенты пока не так автономны как кажутся
Critique of Agent Model
Как сократить расходы на ИИ без потери качества
The Harness Effect: How Orchestration Design Sets the Token Economics of Enterprise Agentic AI
Как заставить ИИ-судью меньше ошибаться в сложных агентных задачах
LLM-as-a-Verifier: A General-Purpose Verification Framework
Оказалось, память может быть важнее самого мышления
AutoMem: Automated Learning of Memory as a Cognitive Skill
Почему ИИ-агентам вредно давать слишком много инструментов сразу
MCP Server Architecture Patterns for LLM-Integrated Applications
Почему тесты переоценивают качество работы ИИ-агентов
Building to the Test: Coding Agents Deliver What You Check, Not What You Requested
Люди не узнают перевод ИИ, но доверяют человеку больше
AI translation of literary texts is "fine", but readers still prefer human translations
Путь к более общему ИИ лежит через модель мира
Orca: The World is in Your Mind
Как ИИ научился читать мысли без имплантов
Brain-to-Text Decoding: A Non-invasive Approach via Typing
Почему даже лучшие ИИ-агенты сильно отстают от людей
AgentOdyssey: Open-Ended Long-Horizon Text Game Generation for Test-Time Continual Learning Agents
Проверять код ИИ стало труднее, чем писать
The Verification Horizon: No Silver Bullet for Coding Agent Rewards
Готовы ли ваши агенты к AI-Native памяти?
Are We Ready For An Agent-Native Memory System?
Как улучшить ИИ-агента без новых данных
SkillOpt: Executive Strategy for Self-Evolving Agent Skills
Улучшать нужно не модель, а интерфейс агента
Adapting the Interface, Not the Model: Runtime Harness Adaptation for Deterministic LLM Agents
Почему код стал операционной системой для агентов
Code as Agent Harness
Как ИИ-агенты собирают презентации нового поколения с голосом, видео и интерактивом
PresentAgent-2: Towards Generalist Multimodal Presentation Agents
Как графы знаний учат LLM меньше галлюцинировать
PersonalAI 2.0: Enhancing knowledge graph traversal/retrieval with planning mechanism for Personalized LLM Agents
Как ИИ-соавтор для математиков решает открытые задачи
AI co-mathematician: Accelerating mathematicians with agentic AI
Как агентам делегировать задачи без потери контроля
Intelligent AI Delegation
Синтетические компьютеры учат агентов работать неделями
Synthetic Computers at Scale for Long-Horizon Productivity Simulation
Что на самом деле делает мультиагентные системы умнее
HeavySkill: Heavy Thinking as the Inner Skill in Agentic Harness
Почему агенты хуже учатся на длинных задачах
On Training Large Language Models for Long-Horizon Tasks: An Empirical Study of Horizon Length
Для чего нужна рекурсивная мультиагентная система
Recursive Multi-Agent Systems
Как построить компанию из одного человека и ИИ-агентов
From Skills to Talent: Organising Heterogeneous Agents as a Real-World Company
Модели мира для агентов нового поколения
Agentic World Modeling: Foundations, Capabilities, Laws, and Beyond
Разработка игр стала новым бенчмарком для ИИ-агентов
GameDevBench: Evaluating Agentic Capabilities Through Game Development
Архитектура общей памяти агентов для программирования
Memory Transfer Learning: How Memories are Transferred Across Domains in Coding Agents
Как ИИ-агенты учатся помнить через окружающий мир
Artifacts as Memory Beyond the Agent Boundary
Когда у ИИ-агента несколько пользователей
Multi-User Large Language Model Agents
Двунаправленная память: как основа эволюции агентов, которые помнят прошлые шаги
Memory Intelligence Agent
Атомарные навыки: как улучшить агентов для программирования на 18.7%
Scaling Coding Agents via Atomic Skills
Когда агент — это граф: как устроена оптимизация процессов на лету
From Static Templates to Dynamic Runtime Graphs: A Survey of Workflow Optimization for LLM Agents
ИИ не может запустить стартап — и вот почему
YC-Bench: Benchmarking AI Agents for Long-Term Planning and Consistent Execution
Ваша LLM умнее, чем кажется — вы просто используете ее неправильно
Meta-Harness: End-to-End Optimization of Model Harnesses
ИИ как коллективный разум: куда ведёт эпоха агентных систем
Agentic AI and the next intelligence explosion
Всё, что нужно знать об обучении агентов простыми словами
The Landscape of Agentic Reinforcement Learning for LLMs: A Survey
Почему ИИ-агенты плохо интегрируются с реальными API и как их приручить
The Auton Agentic AI Framework
Теория разума для ИИ: что происходит, когда агенты начинают «догадываться» о намерениях друг друга
Evaluating Theory of Mind and Internal Beliefs in LLM-Based Multi-Agent Systems
Context Engineering: новая дисциплина для автономных ИИ-агентов
Context Engineering for AI Agents in Open-Source Software
От восприятия к визуальному мышлению: как добавить ИИ внутреннее «воображение»
Toward Cognitive Supersensing in Multimodal Large Language Model
От статичных пайплайнов к адаптивным агентам
Learning to Configure Agentic AI Systems
Code2Worlds: LLM как движок мира — как ИИ начинает симулировать реальность
Code2Worlds: Empowering Coding LLMs for 4D World Generation
Интерфейс как среда: модель мира для офисных ИИ-агентов
Computer-Using World Model
Интерфейс как среда: модель мира для офисных ИИ-агентов
Qwen2.5-VL Technical Report
Когда контекст мешает: почему AGENTS.md делает работу агентов хуже
Evaluating AGENTS.md: Are Repository-Level Context Files Helpful for Coding Agents?
Иллюзия социализации: урок Moltbook для будущего интернета
Does Socialization Emerge in AI Agent Society? A Case Study of Moltbook
Коллективное поведение ИИ-агентов в социальных дилеммах: почему умные агенты разрушают общее благо
Evaluating Collective Behaviour of Hundreds of LLM Agents
Как ИИ-ассистенты незаметно лишают нас самостоятельности
Who's in Charge? Disempowerment Patterns in Real-World LLM Usage
Не один агент, а целая команда: мультиагентный подход к автономной разработке
Agyn: A Multi-Agent System for Team-Based Autonomous Software Engineering
От симуляции к пониманию: как собрать настоящую модель мира
Research on World Models Is Not Merely Injecting World Knowledge into Specific Tasks
Когда агенту нужен дирижёр: AOrchestra и динамическая оркестрация LLM через субагентов
AOrchestra: Automating Sub-Agent Creation for Agentic Orchestration
Open-source наносит ответный удар: Управляемая симуляция мира, которая работает в реальном времени
Advancing Open-source World Models
Как LLM помогают дата инженерам наводить порядок в «грязных» данных
Can LLMs Clean Up Your Mess? A Survey of Application-Ready Data Preparation with LLMs
GameTalk: как научить LLM выигрывать в переговорах
GameTalk: Training LLMs for Strategic Conversation
Аналитика без SQL и отчётов: как продавцы в Amazon получают инсайты напрямую из данных
Insight Agents: An LLM-Based Multi-Agent System for Data Insights
RoboBrain: как робот понимает глубину 3D-сцены и учится самоконтролю
RoboBrain 2.5: Depth in Sight, Time in Mind
Общество мыслей: как LLM становятся сильнее, когда спорят сами с собой
Reasoning Models Generate Societies of Thought
От прототипа к продакшену: с какими проблемами сталкиваются мультиагентные системы
A Large-Scale Study on the Development and Issues of Multi-Agent AI Systems
Агентный RAG против модульного: что реально лучше на практике
Is Agentic RAG worth it? An experimental comparison of RAG approaches
Как превратить GitHub в память для ИИ-агента
MemGovern: Enhancing Code Agents through Learning from Governed Human Experiences
Когда данных нет совсем, а учиться всё равно нужно: как ИИ сам придумывает задачи и сам себя проверяет
Absolute Zero: Reinforced Self-play Reasoning with Zero Data
Как LLM находит нужный код в репозитории, который не помещается в контекст
One Tool Is Enough: Reinforcement Learning for Repository-Level LLM Agents
LLM — не тупик. Проблема AGI совсем в другом
AGI Requires a Coordination Layer on Top of Pattern Repositories
Профессиональные разработчики не вайбят с агентами — они их контролируют
Professional Software Developers Don't Vibe, They Control: AI Agent Use for Coding in 2025
Почему ИИ-агенты не помнят собственную жизнь — и как агенту Софье дали автобиографию, мотивацию и долгосрочную память
Sophia: A Persistent Agent Framework of Artificial Life
Почему ИИ-агенты хорошо чинят баги, но плохо доводят продукт до релиза
SWE-EVO: Benchmarking Coding Agents in Long-Horizon Software Evolution Scenarios
Как ИИ-агенты проводят эксперименты с помощью лабораторного оборудования
SCP: Accelerating Discovery with a Global Web of Autonomous Scientific Agents
Почему ИИ не справляется со списком покупок и когда мы сможем доверить ему бытовые задачи
The AI Consumer Index (ACE)
Сможет ли ИИ пройти сложный экзамен по финансовому анализу?
Reasoning Models Ace the CFA Exams
Как измерить «общий научный интеллект» у LLM
Probing Scientific General Intelligence of LLMs with Scientist-Aligned Workflows
Как ИИ-агенты решают задачи международной олимпиады по математике
Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad-Level Mathematical Problem Solving
Как писать README-файлы для ИИ-агентов
Agent READMEs: An Empirical Study of Context Files for Agentic Coding
Как ИИ-агенты живут в "Станции" и делают научные открытия
The Station: An Open-World Environment for AI-Driven Discovery
DataFlow: PyTorch для дата инженеров в эпоху LLM
DataFlow: An LLM-Driven Framework for Unified Data Preparation and Workflow Automation in the Era of Data-Centric AI
Когда цифр недостаточно: язык как скрытый сигнал в экономических ИИ-моделях
Think, Speak, Decide: Language-Augmented Multi-Agent Reinforcement Learning for Economic Decision-Making
Когда тесты молчат: как ИИ-агент чинит баги
InfCode: Adversarial Iterative Refinement of Tests and Patches for Reliable Software Issue Resolution
ИИ-агент против людей-безопасников: кто кого в реальном пентесте?
Comparing AI Agents to Cybersecurity Professionals in Real-World Penetration Testing
DeepCode: как ИИ научился собирать репозиторий по статье
DeepCode: Open Agentic Coding
Когда команда ИИ-агентов помогает, а когда делает только хуже
Towards a Science of Scaling Agent Systems
Matrix: распределенный мультиагентный фреймворк для генерации синтетических данных
Matrix: Peer-to-Peer Multi-Agent Synthetic Data Generation Framework
Как сделать интернет удобным для ИИ-агентов
Building the Web for Agents: A Declarative Framework for Agent-Web Interaction
Как ИИ-агенты научились рефакторить код: что получается хорошо, а что не очень
Agentic Refactoring: An Empirical Study of AI Coding Agents
Как универсальный ИИ-агент учится жить в открытом мире
Lumine: An Open Recipe for Building Generalist Agents in 3D Open Worlds
Как обучить ИИ работать за компьютером
Grounding Computer Use Agents on Human Demonstrations
Почему мышление через видео может быть следующим шагом в развитии ИИ
Thinking with Video: Video Generation as a Promising Multimodal Reasoning Paradigm
Как ИИ-ученый пишет научные статьи о машинном обучении на уровне джуна
Jr. AI Scientist and Its Risk Report: Autonomous Scientific Exploration from a Baseline Paper
Как ИИ-ученый пишет научные статьи о машинном обучении на уровне джуна
The AI Scientist-v2: Workshop-Level Automated Scientific Discovery via Agentic Tree Search
Как ИИ-ученый пишет научные статьи о машинном обучении на уровне джуна
The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery
От пикселей к смыслу: как SVG помогает ИИ понимать мир
VCode: a Multimodal Coding Benchmark with SVG as Symbolic Visual Representation
Как ИИ-браузер ChatGPT Atlas разгадал судоку за пару минут, но проиграл в Flappy Bird
Can Agent Conquer Web? Exploring the Frontiers of ChatGPT Atlas Agent in Web Games
Децентрализованный ИИ: как рой нейросетей побеждает большие модели
Fortytwo: Swarm Inference with Peer-Ranked Consensus
ИИ в белом халате: как он учится ставить диагнозы в виртуальной клинике
Evolving Interactive Diagnostic Agents in a Virtual Clinical Environment
Будущее программирования — мультимодальное: как JanusCoder научился видеть интерфейс, который сам создает
JanusCoder: Towards a Foundational Visual-Programmatic Interface for Code Intelligence
Как ИИ-агенты учатся параллелить задачи с помощью графа размышлений
GAP: Graph-Based Agent Planning with Parallel Tool Use and Reinforcement Learning
Проактивная память: как ИИ-агенты научились сворачивать контекст и думать на 100 шагов вперёд
AgentFold: Long-Horizon Web Agents with Proactive Context Management
От хаоса данных к управляемому знанию: как ИИ-агенты помогают бизнесу принимать верные решения
Enterprise Deep Research: Steerable Multi-Agent Deep Research for Enterprise Analytics
Длинное мышление против жёстких пайплайнов: как DeepAgent превращает рассуждение в действие
DeepAgent: A General Reasoning Agent with Scalable Toolsets
Почему слова мешают ИИ-агентам понимать друг друга
Thought Communication in Multiagent Collaboration
Как ИИ-агенты научились писать аналитические отчёты не хуже профессиональных аналитиков
FinSight: Towards Real-World Financial Deep Research
Почему ИИ-агенты теряются в море MCP-серверов
TheMCPCompany: Creating General-purpose Agents with Task-specific Tools
Почему ИИ-агенты для интерфейсов учатся в симуляции лучше, чем в реальности
LLMs as Scalable, General-Purpose Simulators For Evolving Digital Agent Training
Агентная операционная система — новая парадигма взаимодействия человека и машины
ColorAgent: Building A Robust, Personalized, and Interactive OS Agent
Эпоха автономных аналитиков: как ИИ меняет науку о данных
DeepAnalyze: Agentic Large Language Models for Autonomous Data Science
Как ИИ-очки предсказывают ваши желания прежде чем вы о них подумаете
AI for Service: Proactive Assistance with AI Glasses
Почему маленькие ошибки больших языковых моделей важнее, чем кажутся
When Models Lie, We Learn: Multilingual Span-Level Hallucination Detection with PsiloQA
Как роботы начинают учиться гораздо быстрее
Robot Learning: A Tutorial
Почему линейная регрессия всё ещё обыгрывает трансформеры в анализе временных рядов
Why Do Transformers Fail to Forecast Time Series In-Context?
ИИ-ученый, который открывает законы природы без участия человека
SR-Scientist: Scientific Equation Discovery With Agentic AI
Когда тесты пишутся сами: как ИИ превращает текст в рабочие сценарии тестирования
GenIA-E2ETest: A Generative AI-Based Approach for End-to-End Test Automation
Как ИИ-агенты учатся работать в браузере, и почему это может перевернуть будущее веба
BrowserAgent: Building Web Agents with Human-Inspired Web Browsing Actions
Иллюзия интеллекта: как живые тесты разоблачают ИИ-кодеров
BigCodeArena: Unveiling More Reliable Human Preferences in Code Generation via Execution
Как агент учится на ходу: почему память оказалась сильнее дообучения
Learning on the Job: An Experience-Driven Self-Evolving Agent for Long-Horizon Tasks
Инженирия контекста для саморазвивающихся ИИ-агентов
Agentic Context Engineering: Evolving Contexts for Self-Improving Language Models
Что, если новые бенчмарки для ИИ станут появляться сами по себе?
MLE-Smith: Scaling MLE Tasks with Automated Multi-Agent Pipeline
Почему тесты на безопасность ИИ-агентов внезапно перестали работать
Code Agent can be an End-to-end System Hacker: Benchmarking Real-world Threats of Computer-use Agent
Почему ИИ-агенты ошибаются в простых веб-задачах — и как граф знаний помогает им перестать быть тупыми
Graph2Eval: Automatic Multimodal Task Generation for Agents via Knowledge Graphs
Как агенты учатся по видео на YouTube
Watch and Learn: Learning to Use Computers from Online Videos
Как ИИ научился делать научные видео — от слайдов до говорящей головы
Paper2Video: Automatic Video Generation from Scientific Papers
Графики по щелчку: как ИИ-агенты берут на себя работу дата-аналитика
CoDA: Agentic Systems for Collaborative Data Visualization
Как управлять интернетом вещей с помощью LLM
IoT-MCP: Bridging LLMs and IoT Systems Through Model Context Protocol
Как выжать максимум смысла из тысяч строк кода
LongCodeZip: Compress Long Context for Code Language Models
Как ИИ-агенты учатся работать с временными рядами
TimeSeriesScientist: A General-Purpose AI Agent for Time Series Analysis
Агент-исследователь: как научить LLM работать с поиском в интернете
InfoAgent: Advancing Autonomous Information-Seeking Agents
Увидел-указал-полетел: как управлять автономными дронами без обучения с нуля
See, Point, Fly: A Learning-Free VLM Framework for Universal Unmanned Aerial Navigation
Что будет, если заставить ИИ-агента работать с тысячами API
Towards General Agentic Intelligence via Environment Scaling
Как думают ИИ-модели: раскладываем рассуждения на эпизоды
Understanding the Thinking Process of Reasoning Models: A Perspective from Schoenfeld's Episode Theory
Агентная федерация: как мультиагентные системы учатся работать сообща
Federation of Agents: A Semantics-Aware Communication Fabric for Large-Scale Agentic AI
Умеют ли нейросети создавать игры?
V-GameGym: Visual Game Generation for Code Large Language Models
ИИ-агенты против людей: кто сегодня пишет лучший код?
On the Use of Agentic Coding: An Empirical Study of Pull Requests on GitHub
Почему ИИ в программировании спотыкается в реальной работе: новый бенчмарк показал всю правду
SWE-Bench Pro: Can AI Agents Solve Long-Horizon Software Engineering Tasks?
Меньше примеров — больше интеллекта
LIMI: Less is More for Agency
RPG для кода: как ИИ собирает целые проекты с помощью графов
RPG: A Repository Planning Graph for Unified and Scalable Codebase Generation
Маленькая модель с большими возможностями: как K2‑Think обыгрывает гигантов в математике и программировании
K2-Think: A Parameter-Efficient Reasoning System
Как научить ИИ мыслить по-человечески: разбор WebResearcher и его революционной стратегии
WebResearcher: Unleashing unbounded reasoning capability in Long-Horizon Agents
Как научить ИИ-агентов работать с инструментами без ручной разметки
Towards General Agentic Intelligence via Environment Scaling
Агенты, которые не теряют цель: как полуонлайн‑обучение научило ИИ решать многошаговые задачи
UI-S1: Advancing GUI Automation via Semi-online Reinforcement Learning
Эмоции на длинной дистанции: как ИИ учится быть эмпатичным
LongEmotion: Measuring Emotional Intelligence of Large Language Models in Long-Context Interaction
ИИ-агенты выходят на рынок: как строится новая агентная экономика
Virtual Agent Economies
Как мозг предсказывает следующее слово и при чем тут ИИ
The Predictive Brain: Neural Correlates of Word Expectancy Align with Large Language Model Prediction Probabilities
Как обучение с подкреплением перестраивает мышление LLM
Emergent Hierarchical Reasoning in LLMs through Reinforcement Learning
Агенты без скриптов: что происходит, когда ИИ сталкивается с реальностью
LiveMCP-101: Stress Testing and Diagnosing MCP-enabled Agents on Challenging Queries
Репозитории на автопилоте: как ИИ сам поднимает окружение и запускает код
EnvX: Agentize Everything with Agentic AI
Как ИИ начинает понимать чёрный юмор
D-HUMOR: Dark Humor Understanding via Multimodal Open-ended Reasoning — A Benchmark Dataset and Method
Как оживить научные статьи: превращаем исследования в интерактивных ИИ-ассистентов
Paper2Agent: Reimagining Research Papers As Interactive and Reliable AI Agents
Что скрыто за характером LLM: читаем поведенческие отпечатки
Behavioral Fingerprinting of Large Language Models
Почему LLM врут с умным видом
Why Language Models Hallucinate
Глубокие исследования без границ: выбираем свою LLM и управляем стратегией поиска
Universal Deep Research: Bring Your Own Model and Strategy
ИИ как соавтор: как агенты меняют науку прямо сейчас
From AI for Science to Agentic Science: A Survey on Autonomous Scientific Discovery
Vision Language World Model: язык как картина мира
Planning with Reasoning using Vision Language World Model
Почему Text-to-SQL до сих пор ломается и как это исправить
SQL-of-Thought: Multi-agentic Text-to-SQL with Guided Error Correction
Память для роботов: как машины учатся видеть мир осознанно
From reactive to cognitive: brain-inspired spatial intelligence for embodied agents
Увидел-кликнул-победил: как UItron управляет компьютером по-человечески
UItron: Foundational GUI Agent with Advanced Perception and Planning
Аккуратные дипфейки: как невидимые подмены лиц рушат доверие к видео
FakeParts: a New Family of AI-Generated DeepFakes
Как Avengers‑Pro превращает зоопарк LLM в супер-роутер за счёт одного ползунка
Beyond GPT-5: Making LLMs Cheaper and Better via Performance-Efficiency Optimized Routing
Как построить мультиагентную систему, которая реально работает без магии и костылей
AgentScope 1.0: A Developer-Centric Framework for Building Agentic Applications
Как дообучать LLM на лету с помощью памяти вместо файнтюнинга
Memento: Fine-tuning LLM Agents without Fine-tuning LLMs
Нажал — и мир двинулся: Matrix-Game 2.0 делает видео интерактивным в реальном времени
Matrix-game 2.0: An open-source real-time and streaming interactive world model
Покажи — и робот поймёт: как Embodied‑R1 сокращает разрыв между «вижу» и «делаю»
Embodied-R1: Reinforced Embodied Reasoning for General Robotic Manipulation
OmniTry: виртуальная примерка одежды и аксессуаров без масок — система сама найдёт, куда «надеть»
OmniTry: Virtual Try-On Anything without Masks