KI Suche
Die Suche durchsucht Rubriken, Unterrubriken, Cluster, importierte Artikel, Firmen, Quellen und die wichtigsten Service-Seiten der KI-Linksammlung.
Suchergebnisse
28 Treffer für die aktuelle Abfrage.
Feinabstimmung
Aktuelle Links, Zusammenfassungen und Marktinformationen zu Feinabstimmung innerhalb von Optimierung auf JetztStarten.de.
The Big AI Labs Are Suddenly Competing with Your Own Data
In der aktuellen Debatte über Künstliche Intelligenz wird die Bedeutung offener Modelle für Wettbewerb, Sicherheit und nationale Souveränität hervorgehoben. Unternehmen nutzen Techniken wie überwachte und verstärkende Feinabstimmung, um generische KI-Modelle in spezialisierte Intelligenz zu transfor
Murati's 975B Model Fine-Tuned Itself on Launch Day — and Cracked the Top US Open-Weight Spot
Am Launchtag hat das neue 975B-Parameter-Modell „Inkling“ von Mira Murati’s Thinking Machines Lab eine bemerkenswerte Selbstoptimierung durch Feinabstimmung vorgenommen. Ziel des Modells war es, ein Lipogramm zu erstellen, das den Buchstaben „e“ konsequent vermeidet, was mit herkömmlichen Methoden n
Fine-tune video and image models at scale with NVIDIA NeMo Automodel and 🤗 Diffusers
Die Kooperation zwischen NVIDIA und Hugging Face hat zur Schaffung von NeMo Automodel geführt, einer offenen Trainingsbibliothek, die speziell für die Feinabstimmung von Diffusionsmodellen entwickelt wurde. Diese innovative Integration ermöglicht es Nutzern, Diffusionsmodelle direkt von der Hugging
DPO Fine-Tuning from First Principles in Python
Der Artikel "DPO Fine-Tuning from First Principles in Python" erläutert das Direct Preference Optimization (DPO) Verfahren als vereinfachte Methode zur Feinabstimmung großer Sprachmodelle (LLMs). Im Gegensatz zum traditionellen Reinforcement Learning from Human Feedback (RLHF), das mehrere Modelle u
DPO vs SFT vs RLHF: Which Training Method Does Your Model Actually Need?
In dem Artikel "DPO vs SFT vs RLHF: Which Training Method Does Your Model Actually Need?" werden drei zentrale Methoden zur Feinabstimmung von Modellen untersucht: Supervised Fine-Tuning (SFT), Reinforcement Learning from Human Feedback (RLHF) und Direct Preference Optimization (DPO). Der Autor hebt
GPT and Claude failed Bridgewater's finance tests because the right answers were never public
Bridgewater und das Thinking Machines Lab haben ein offenes KI-Modell entwickelt, das bei der Analyse finanzieller Dokumente führende kommerzielle Modelle übertrifft und kostengünstiger ist. Das Qwen3-235B-Modell erreicht eine Genauigkeit von fast 85 Prozent, was auf die Feinabstimmung mit internem
Presentation: Fine Tuning the Enterprise: Reinforcement Learning in Practice
In der Präsentation "Fine Tuning the Enterprise: Reinforcement Learning in Practice" stellen Will Hang und Wenjie Zi von OpenAI die Agent Reinforcement Fine-Tuning (RFT) Plattform vor, die darauf abzielt, die Leistung autonomer Agenten in unterschiedlichen Anwendungen zu optimieren. Im Gegensatz zu
Inside Target’s LLM-Based System for Semantic Matching in Marketing Forecast Pipelines
Target hat ein innovatives, KI-gestütztes System entwickelt, das auf großen Sprachmodellen basiert, um die Prognose von Marketingkampagnen zu optimieren. Das System identifiziert und bewertet ähnliche historische Kampagnen, bevor neue Kampagnen gestartet werden. Es wird von internen Marketing- und A
Accelerating Transformers Fine-Tuning with NVIDIA NeMo AutoModel
NVIDIA NeMo AutoModel ist eine offene Bibliothek, die auf dem NVIDIA NeMo Framework basiert und die Feinabstimmung von generativen KI-Modellen erheblich beschleunigt. Durch innovative Techniken wie Expert Parallelism, DeepEP und TransformerEngine-Kerne erzielt NeMo AutoModel eine Trainingsdurchsatzs
I Fine-Tuned One Model 3 Ways: The $50,000 Run Forgot More Than the $1,500 One
In einem Experiment wurde ein 8B-Modell auf drei verschiedene Arten feinjustiert: vollständige Feinabstimmung, LoRA und QLoRA. Die kostspielige Methode, die 50.000 Dollar kostete, zeigte zwar bei einem Benchmark eine leichte Überlegenheit, beeinträchtigte jedoch die allgemeinen Fähigkeiten des Model
RAG from Scratch [Part 2]: Loading — The Step Everyone Skips and Everyone Regrets
Der Artikel "RAG from Scratch [Part 2]: Loading — The Step Everyone Skips and Everyone Regrets" beleuchtet die oft vernachlässigte, aber entscheidende Phase des Ladens in der Entwicklung von RAG-Pipelines. Viele Entwickler orientieren sich an Tutorials mit einfachen Daten und sind frustriert, wenn s
YY Group Holding Accelerates Vertical Workforce AI Strategy with Investment in High-Performance NVIDIA Blackwell Architecture Infrastructure
YY Group Holding Limited hat eine strategische Investition in Hochleistungs-Hardware auf Basis der NVIDIA Blackwell-Architektur getätigt, um ihre vertikale Workforce-AI-Strategie voranzutreiben. Diese Infrastruktur nutzt die Tensor Core-Technologie von NVIDIA, um die Feinabstimmung eigener KI-Modell
Zero-Shot SAR-Optical Matching
In dem Artikel "Zero-Shot SAR-Optical Matching" wird die Fähigkeit vortrainierter Vision-Modelle untersucht, Satellitenbilder aus verschiedenen Sensoren, insbesondere Synthetic Aperture Radar (SAR) und optischen Bildern, ohne vorheriges Training zuzuordnen. Der Autor hebt die Unterschiede zwischen d
Workers are getting paid to teach AI how to do their jobs
In der aktuellen Entwicklung der künstlichen Intelligenz werden zunehmend Fachkräfte eingestellt, um AI-Modelle zu trainieren und zu optimieren. Diese neuen Arbeitsplätze, die von Hollywood-Drehbuchautoren bis zu Ärzten reichen, sind entscheidend, da große Sprachmodelle (LLMs) mehr Feinabstimmung be
Adaption aims big with AutoScientist, an AI tool that helps models train themselves
Adaption hat mit AutoScientist ein innovatives KI-Tool entwickelt, das darauf abzielt, Modelle eigenständig zu trainieren und zu optimieren. Durch einen automatisierten Ansatz zur Feinabstimmung verbessert das Tool die Lernfähigkeit von KI-Modellen und vereinfacht den Trainingsprozess erheblich. Sar
AI models follow their values better when they first learn why those values matter
Eine Studie des Anthropic Fellows Program zeigt, dass KI-Modelle ihre Werte effektiver einhalten, wenn sie zunächst verstehen, warum diese Werte wichtig sind. Die Forscher führten eine neue Trainingsphase namens "Model Spec Midtraining" (MSM) ein, in der Modelle auf synthetisch generierten Dokumente
The Must-Know Topics for an LLM Engineer
Der Artikel "The Must-Know Topics for an LLM Engineer" bietet eine umfassende Übersicht über die wesentlichen Konzepte, die Ingenieure im Bereich der großen Sprachmodelle (LLMs) verstehen müssen. LLMs sind entscheidend für moderne KI-Anwendungen wie Chatbots und Automatisierung, doch die Vielzahl an
Study: AI models that consider user's feeling are more likely to make errors
Eine aktuelle Studie des Internet Institute der Universität Oxford untersucht die Fehleranfälligkeit von KI-Modellen, die darauf trainiert sind, empathisch und freundlich zu kommunizieren. Die Forscher fanden heraus, dass diese Modelle dazu neigen, unangenehme Wahrheiten zu beschönigen, um zwischenm
Multitask AI models help robots tackle complex tasks with improved efficiency
Die Forschung des Toyota Research Institute zeigt, dass Multitask-KI-Modelle, auch große Verhaltensmodelle (LBMs) genannt, traditionelle Einzelaufgabenansätze in der Robotik deutlich übertreffen. Diese Modelle benötigen für vergleichbare Ergebnisse nur 3 bis 5 Mal weniger Trainingsdaten, was die Kos
RAG Chunking That Works: Semantic Splitting, Overlap, and Eval-Driven Tuning
Der Artikel "RAG Chunking That Works: Semantic Splitting, Overlap, and Eval-Driven Tuning" behandelt innovative Ansätze zur Verbesserung der Chunking-Techniken in der Retrieval-Augmented Generation (RAG). Die Autoren präsentieren Methoden zur semantischen Aufteilung von Texten, die es ermöglichen, r
RAG vs MCP: The Architectural Difference Every AI Developer Must Understand
Der Artikel "RAG vs MCP: The Architectural Difference Every AI Developer Must Understand" beleuchtet die grundlegenden Unterschiede zwischen den beiden Architekturansätzen RAG (Retrieval-Augmented Generation) und MCP (Model-Centric Paradigm). RAG kombiniert die Stärken von Informationsabruf und gene
Chapter 2: The Efficiency Revolution: PEFT and Its Next Generation
In Kapitel 2 mit dem Titel "Die Effizienzrevolution: PEFT und seine nächste Generation" wird die Entwicklung und Bedeutung von PEFT (Parameter-Effiziente Feinabstimmung) im Kontext moderner KI-Modelle untersucht. Das Kapitel beleuchtet, wie PEFT-Techniken es ermöglichen, große Sprachmodelle effizien
Fine-Tune an Open Source LLM with Claude Code/Codex
Der Artikel "Fine-Tune an Open Source LLM with Claude Code/Codex" behandelt die Feinabstimmung (Fine-Tuning) von Open-Source-Sprachmodellen (LLMs) mithilfe der Claude-Code- und Codex-Technologien. Er erklärt, wie Entwickler diese Modelle an spezifische Anwendungsfälle anpassen können, um die Leistun
LoRA, QLoRA, DoRA — Which Fine-Tuning Method Should You Actually Use?
In dem Artikel "LoRA, QLoRA, DoRA — Which Fine-Tuning Method Should You Actually Use?" werden verschiedene Methoden zur Feinabstimmung von KI-Modellen untersucht. LoRA (Low-Rank Adaptation) ermöglicht eine effiziente Anpassung von Modellen, indem nur ein kleiner Teil der Parameter aktualisiert wird,
The 4 Parameter-Efficient Fine-Tuning Methods: How to Adapt LLMs 100× Faster
Der Artikel "The 4 Parameter-Efficient Fine-Tuning Methods: How to Adapt LLMs 100× Faster" behandelt innovative Ansätze zur effizienten Feinabstimmung von großen Sprachmodellen (LLMs). Die vorgestellten Methoden zielen darauf ab, den Anpassungsprozess erheblich zu beschleunigen, indem sie den Parame
The 6-Stage Journey: How Pre-Training Creates AI Intelligence from Scratch
Der Artikel "The 6-Stage Journey: How Pre-Training Creates AI Intelligence from Scratch" beschreibt den Prozess der Entwicklung künstlicher Intelligenz (KI) durch ein sechsstufiges Pre-Training-Modell. In den ersten Phasen wird eine große Menge an Daten gesammelt und aufbereitet, um ein umfassendes
Master LoRA: Fine-Tune Giant AI Models on Your Laptop (Complete Guide)
"Master LoRA: Fine-Tune Giant AI Models on Your Laptop (Complete Guide)" ist ein umfassender Leitfaden, der sich mit der Feinabstimmung großer KI-Modelle unter Verwendung der Low-Rank Adaptation (LoRA) Technik beschäftigt. Der Autor erklärt, wie Nutzer auch auf leistungs schwächeren Geräten, wie Lap