90% кода — как ИИ меняет программирование
Перевод статьи: автор сообщает, что в его проекте 90% кода пишет ИИ‑агенты, но ответственность за архитектуру остаётся за человеком. Источник — Хабр.
Перевод статьи: автор сообщает, что в его проекте 90% кода пишет ИИ‑агенты, но ответственность за архитектуру остаётся за человеком. Источник — Хабр.
Meta выпустила Code World Model (CWM) — LLM на 32 млрд параметров, обученную на исполнениях Python и взаимодействиях с Docker.
Анонс Qwen3‑Omni — мультимодальная модель от Qwen: текст, картинки, аудио и видео; новая схема Thinker–Talker, MoE и SOTA по ряду бенчмарков.
Anthropic опубликовали тестовое задание по оптимизации производительности виртуальной машины: старт 147 734 такта, лучшие результаты Opus 4.5 около 1363 тактов.
Anthropic добавили нативную поддержку LSP в Claude Code — доступ к семантике кода, переходам, типам и символам для агентных сценариев.
Anthropic представили Claude Code с доступом к браузеру — чтение DOM, отслеживание ошибок в консоли и проверка фич прямо в браузере.
Краткий разбор внутреннего исследования Anthropic: 132 инженера, 53 интервью и 200 000 сессий Claude Code — выводы по продуктивности, навыкам и ролям.
29 практичных советов по использованию Gemini CLI и другим AI‑утилитам в терминале; перевод и ссылка на статью на Habr.
Краткий обзор: Gemini 3 Pro, агентная IDE Antigravity от Google, сбой Cloudflare из‑за прав доступа и релиз xAI Grok 4.1.
Краткий обзор ChatGPT Atlas от OpenAI: браузер на Chromium с интегрированным чат‑ассистентом, доступен на macOS, 7 дней расширенных возможностей.
OpenAI запустил DevDay 2025 в Fort Mason (Сан‑Франциско); ключевое выступление Сам Альтмана идёт в прямом эфире на YouTube.
Список из 20 концептов для AI‑стартапов: от камерных фильтров с Nano Banana до Deep Research‑агентов и маркетплейсов AI‑агентов.
Обновление Cursor 1.7: автокомплит для Agent, Hooks (beta), Team Rules, песочница для терминалов и поддержка изображений. Источник: cursor.com.
GLM-4.6 от Z.ai: контекст до 200k токенов, улучшения в кодинге и агентности, ~15% экономии по токенам; ссылки на HuggingFace и ModelScope.
Разбор работы Anthropic: деление ошибок LLM на bias и variance, влияние на агентные цепочки и непредсказуемость поведения.
Анонс вебинара Veai: разбор AI‑ассистентов 2026 — проблемы на больших кодовых базах, planning mode, memory bank. 12 февраля, 14:30 МСК.
В логах Vertex AI найден id claude-sonnet-5@20260203; инсайдеры прогнозируют SWE-Bench 82.1%, прежние цены и контекст в 1 млн токенов.
Исследование Anthropic, AI Security и Alan Turing показывает, что 250 «ядовитых» документов могут встроить бэкдор в LLM, активируемый словом <SUDO>.
О модели DeepSeek‑V3.2‑Exp: эксперимент с DeepSeek Sparse Attention для ускорения длинных контекстов; код открыт на GitHub и Hugging Face.
OpenAI представил GDPval — набор из задач для 44 профессий; GPT‑5 и Claude Opus показывают почти паритет с экспертами и рост производительности более чем в 3 раза.