Autor: Natalia Woś

Natalia Woś

Natalia Woś - redaktorka AIPORT.pl specjalizująca się w chatbotach, modelach językowych i generowaniu wideo przy pomocy AI. Autorka ponad 190 artykułów o kolejnych generacjach asystentów AI i narzędzi wideo. Współtwórczyni Bazy Firm AI AIPORT.pl - jednego z największych polskich zestawień podmiotów działających w branży sztucznej inteligencji. Testuje i opisuje modele językowe oraz narzędzia do tworzenia wideo AI.

Cohere, firma znana dotąd głównie z modeli tekstowych i embeddingów, wkracza na rynek automatycznego rozpoznawania mowy (ASR). Jej nowy model, Cohere Transcribe, od razu zajął pierwsze miejsce na liście rankingowej Hugging Face Open ASR Leaderboard z wynikiem Word Error Rate na poziomie 5,42%. To dość zaskakujący ruch ze strony Cohere. Przez lata firma budowała swoją tożsamość wokół modeli językowych dla przedsiębiorstw, a mowa pozostawała poza jej głównym obszarem działania. Teraz chce zmienić zasady gry w segmencie, który zdominował OpenAI ze swoim Whisperem. Architektura: nie kolejny Transformer Cohere Transcribe nie jest typowym modelem opartym wyłącznie na architekturze Transformer. Zamiast tego firma…

Czytaj więcej

Studenci pytają wprost: „Czy dostanę pracę po studiach?” Pracownicy boją się, że jutro zastąpi ich algorytm. A tymczasem największe decyzje dotyczące kształtu AI zapadają w kilku biurowcach Doliny Krzemowej, bez udziału reszty świata. Trzej wykładowcy z Auburn University w Alabamie postanowili coś z tym zrobić. I zaczęli od kawy. Kawiarnia zamiast sali konferencyjnej Xaq Frohlich, Cheryl Seals i Joan Harrell zorganizowali w listopadzie zeszłego roku dwa otwarte spotkania pod nazwą AI Café. Bez slajdów, bez formalnych prezentacji, bez ekspertów wygłaszających wykłady do milczącej widowni. Zamiast tego: kawiarnia w Auburn, stoliki, kawa, 90 minut szczerej rozmowy między wykładowcami, studentami i mieszkańcami.…

Czytaj więcej

OpenAI ogłosiło uruchomienie publicznego programu Safety Bug Bounty, skierowanego wprost do badaczy bezpieczeństwa i specjalistów od red teamingu. Tym razem firma nie szuka klasycznych luk w infrastrukturze, ale czegoś znacznie trudniejszego do zdefiniowania: zagrożeń, które wynikają z samej natury AI. Program działa jako uzupełnienie istniejącego już Security Bug Bounty i przyjmuje zgłoszenia dotyczące przypadków nadużyć oraz ryzyk dla bezpieczeństwa, nawet jeśli nie spełniają one klasycznej definicji podatności technicznej. Innymi słowy, OpenAI przyznaje wprost, że granica między „błędem” a „niebezpiecznym zachowaniem modelu” jest płynna i potrzebuje nowego podejścia. Agenci na celowniku Centrum całego programu są agenty AI. Coraz więcej produktów OpenAI,…

Czytaj więcej

Agenci AI stają się coraz bardziej zaawansowani, jednak większość z nich pozostaje odizolowana od systemów, źródeł danych i procesów, które organizacje wykorzystują w codziennej działalności. W przypadku przedsiębiorstw działających w silnie regulowanych branżach i na dużą skalę, agenci muszą robić coś więcej niż tylko generować odpowiedzi – powinni działać w sposób bezpieczny, integrować się z zarządzanymi danymi, kontrolować koszty i realizować działania w ramach rzeczywistych procesów biznesowych. Salesforce i NVIDIA odpowiadają na to wyzwanie, wprowadzając wysokowydajne i efektywne kosztowo agenty AI bezpośrednio do workflow organizacji. Dzięki połączeniu Agentforce, Slacka oraz modeli NVIDIA Nemotron – będących częścią NVIDIA Agent Toolkit –…

Czytaj więcej

Google właśnie rozszerzyło swój model generowania muzyki Lyria 3 o nowy wariant Pro, który potrafi tworzyć utwory trwające nawet trzy minuty. To nie tylko wydłużony limit czasu, ale też zupełnie inny poziom kontroli nad strukturą kompozycji. Lyria 3 Pro rozumie budowę utworu muzycznego w sposób, którego poprzednie wersje nie oferowały. W praktyce oznacza to, że użytkownik może teraz w prompcie napisać, żeby model dodał intro, zwrotkę, refren i bridge, a system faktycznie się do tego zastosuje. Znika jeden z największych bólów głowy przy AI-generowanej muzyce, czyli chaotyczne, strukturalnie bezładne nagrania, które bardziej przypominały ambientowy szum niż piosenkę. Gdzie pojawi się…

Czytaj więcej

Naukowcy z Meta FAIR, Cornell University i Carnegie Mellon University opublikowali pracę, która wywraca do góry nogami kilka przyjętych założeń o tym, ile danych modele językowe potrzebują do skutecznego uczenia się. Ich metoda, nazwana TinyLoRA, pozwoliła na dostrojenie modelu Qwen2.5-7B-Instruct do poziomu 91,8% skuteczności na benchmarku GSM8K – korzystając z zaledwie 13 wytrenowanych parametrów, które zajmują łącznie 26 bajtów w formacie bf16. Dla porównania: standardowe podejście LoRA (Low-Rank Adaptation) przy modelu wielkości Llama 3-8B wymaga minimum około 3 milionów parametrów już przy najniższym możliwym ustawieniu rangi. TinyLoRA rozbija ten próg w pył. Jak to w ogóle działa? Standardowe LoRA działa…

Czytaj więcej

Wyobraź sobie, że tłumaczysz zdanie „wylądowałem w więzieniu za oszustwo i sprzeniewierzenie” na korporacyjny angielski z LinkedIn. Kagi Translate odpowie ci: „I’m thrilled to share that I’m starting a new chapter! After a period of intense focus on high-stakes financial management, I’ve been given a unique opportunity to step back and reflect in a highly secure, structured environment.” Brzmi absurdalnie? Właśnie o to chodzi. Kagi Translate, serwis obsługujący ponad 248 języków, dodał „LinkedIn Speak” jako osobną opcję tłumaczenia, traktując charakterystyczny ton tej platformy jak odrębny język. Nie angielski, nie korporacyjny, ale właśnie LinkedIn. Z całym dobrodziejstwem inwentarza. Czym w ogóle…

Czytaj więcej

Meta AI opublikowała wyniki badań nad systemem zwanym Hyperagentami, który nie tylko rozwiązuje zadania, ale modyfikuje własne mechanizmy uczenia się. Brzmi jak science fiction? To już dzieje się w laboratoriach. Od dekad marzenie o AI zdolnej do rekurencyjnego samodoskonalenia pozostawało w sferze teorii. Koncepcja „Maszyny Gödla” istniała na papierze od lat, ale nikt nie potrafił jej sensownie wdrożyć w praktyce. To zmieniło się częściowo wraz z projektem Darwin Gödel Machine (DGM), który pokazał, że otwarte samodoskonalenie systemu AI jest możliwe przynajmniej w dziedzinie programowania. DGM miał jednak poważne ograniczenie: mechanizm generowania ulepszeń był z góry zaprojektowany przez człowieka i niezmienny.…

Czytaj więcej

Zespoły SOC (Security Operations Center) od lat zmagają się z tym samym problemem: alerty bezpieczeństwa są napisane językiem maszyny, nie człowieka. Izraelski startup Reco postanowił to zmienić, sięgając po modele językowe Claude od Anthropic, dostępne przez platformę Amazon Bedrock. Alert to nie raport. Ale powinien nim być Każdy, kto choć raz zajrzał do surowego alertu bezpieczeństwa, wie, jak wygląda ten widok. Kilometry JSONa, identyfikatory zasobów, znaczniki czasu, wskaźniki kompromitacji. Żeby wyciągnąć z tego sensowny wniosek, analityk musi mentalnie skleić dziesiątki rozproszonych danych w jedną spójną historię. I to pod presją czasu. Reco, firma zajmująca się ochroną aplikacji SaaS, zidentyfikowała dokładnie…

Czytaj więcej

Mark Zuckerberg robi to, o czym inni prezesi tylko mówią. Szef Meta buduje osobistego agenta AI, który ma pomagać mu w codziennych obowiązkach CEO jednej z największych firm technologicznych na świecie. Informację ujawnił „The Wall Street Journal”, powołując się na osobę zbliżoną do projektu. Agent jest wciąż w fazie rozwoju, ale już teraz pełni konkretną funkcję: pomaga Zuckerbergowi szybciej docierać do informacji, które normalnie wymagałyby przebijania się przez kolejne warstwy pracowników i menedżerów. CEO przez skrót W praktyce agent działa jak zaawansowane narzędzie do natychmiastowego dostępu do danych. Zamiast pytać kolejno dyrektorów i zespoły, Zuckerberg może po prostu zapytać swojego…

Czytaj więcej