Google wprowadził nową funkcjonalność "Agentic Vision" do swojego modelu Gemini 3 Flash, która przekształca rozumienie obrazu w aktywny proces. Zamiast jednorazowej analizy, model może planować, wykorzystywać kod Pythona do manipulacji obrazami, a następnie ponownie analizować przetworzone dane, co poprawia dokładność w zadaniach wymagających precyzji. Ta metoda "Myśl, Działaj, Obserwuj" (Think, Act, Observe) oferuje znaczący, 5-10% wzrost jakości w benchmarkach wizyjnych i jest dostępna przez API Gemini oraz w aplikacji Gemini.
Key Intelligence
- • Hidden Analysis Point #1...
- • Hidden Analysis Point #2...
- • Hidden Analysis Point #3...
Premium Archive
This intelligence report is now archived for premium members only. Enter your access code to unlock the full history.
Don't have a code? Subscribe to our newsletter.