AI-дайджест — главные события первой недели 2026
Краткий AI-дайджест: DeepSeek V4, приёмы работы с Claude Code, динамический контекст Cursor, сокращения в Tailwind, ограничения Anthropic и новость о Линусе.
Краткий AI-дайджест: DeepSeek V4, приёмы работы с Claude Code, динамический контекст Cursor, сокращения в Tailwind, ограничения Anthropic и новость о Линусе.
Короткий обзор исследования JetBrains: маскирование vs суммирование в памяти LLM‑агентов — маскирование оказалось точнее, дешевле и стабильнее.
Краткий обзор Devstral 2 (123B) и Small 2 (24B): результаты на SWE-bench, цены vs Sonnet, доступ через OpenRouter и Mistral Vibe CLI.
Anthropic заявляет о первой крупной кибератаке, почти выполненной ИИ; в публичном отчёте пока мало проверяемых фактов.
Краткий обзор двух исследований по AI‑безопасности: «Rule of Two» от Meta и масштабные атаки на защиты prompt injection (успешность >90%).
Обзор новой волны конкуренции в ИИ: ChatGPT Apps, Gemini CLI Extensions и Claude Code Plugins — плагины, субагенты и маркетплейсы.
Сэм Альтман о подходе OpenAI к приватности, возрастной проверке и детскому режиму — баланс безопасности подростков и свободы пользователей.
Anthropic открыл Agent Skills — стандарт для переносимых агентных workflows; в каталоге на claude.com есть навыки от Notion, Canva, Figma и др.
Разбор Opus 4.5: Tool Search Tool, Programmatic Tool Calling и Tool Use Examples — уменьшение токенов и рост точности вызовов агентов.
Anthropic представила Claude Haiku 4.5 — в три раза дешевле и в два раза быстрее Sonnet 4; доступна через Claude.ai, API, AWS Bedrock, Vertex AI и Copilot.
Краткая выжимка из отчёта JetBrains 2025: 85% разработчиков используют ИИ, TypeScript растёт, Scala — самый высокооплачиваемый язык.
Пошаговые гайды RouterAI по подключению в VS Code, IntelliJ, NeoVIM и Zed; настройка для Claude 4.5 Sonnet, GPT-5.1 и других.
Короткая заметка о слухах вокруг Opus 4.5: упоминания Sonnet 4.5, Haiku 4.5 и инсайдов с кодовым названием Kayak от Anthropic.
Codex‑Mini — облегчённая версия GPT‑5-Codex: в ~4 раза больше запросов при небольшой потере точности; повышенные лимиты для Plus, Business и Edu.
Miguel Grinberg объясняет, почему генеративные ИИ‑агенты не ускоряют работу и повышают риски — подробности на Хабр.
Cowork от Anthropic даёт Claude доступ к файловой системе — чтение, правка и создание файлов; есть коннекторы, skills и параллельные задачи. Отмечены риски: удаление файлов и prompt injection.
Z.ai выпустили GLM-4.7 с фокусом на агентные сценарии и interleaved thinking; заметный прирост в SWE-bench и Terminal Bench, веса на Hugging Face.
Claude Code от Anthropic помог найти ошибку в Go‑реализации ML‑DSA: модель указала на «high bits» и подсказала идею автозапуска LLM при падении тестов.
Результаты бенчмарка GPT-4.1-nano: Markdown-KV даёт 60,7% точности, CSV — 44,3%; Markdown-KV дороже по токенам (×2,7). Источник: Habr.
Краткий обзор OpenAI DevDay 2025: Apps SDK, AgentKit, обновлённый Codex, и анонс GPT-5 Pro и Sora-2 в API.