Teilen der Technologie des Volcano-Engine-Tools: Verwenden Sie KI, um das Data Mining und das SQL-Schreiben ohne Schwellenwert von Null abzuschließen-KI-php.cn

Inhaltsverzeichnis

Die von der Volcano Engine eingeführte BI-Plattform DataWind für intelligente Dateneinblicke hat eine neue erweiterte funktionsvisuelle Modellierung eingeführt.

Die Datenproduktion und -verarbeitung ist der erste Schritt zur Datenbeschaffung und -analyse.

Wenn Sie die Anzahl der Bestellungen und die Bestellmenge nach Datum und Stadtgranularität sowie die Stadtdaten der 10 größten Tagesverbrauchsmengen erhalten möchten, ist der Vorgang wie folgt:

2.2 [Szenario 2] Kombinieren Sie schnell mehrere Tabellen, um Multi-Daten-Assoziationsberechnungen einfach zu lösen.

3. KI-Data-Mining ist nicht mehr unerreichbar

4. Multi-Szenario-, Multi-Task-Konstruktion, Management ist nicht mehr dezentral

Heim

Technologie-Peripheriegeräte

Teilen der Technologie des Volcano-Engine-Tools: Verwenden Sie KI, um das Data Mining und das SQL-Schreiben ohne Schwellenwert von Null abzuschließen

PHPz

May 18, 2023 pm 08:19 PM

ai 数据挖掘

火山引擎工具技术分享：用 AI 完成数据挖掘，零门槛完成 SQL 撰写

Beim Einsatz von BI-Tools stoßen wir häufig auf die Frage: „Wie können wir Daten erzeugen und verarbeiten, wenn wir SQL nicht kennen? Können wir Mining-Analysen durchführen, wenn wir keine Algorithmen kennen?“ Ein professionelles Algorithmenteam führt Data Mining durch. Die Datenanalyse und -visualisierung erscheint ebenfalls relativ fragmentiert. Eine optimierte Durchführung der Algorithmenmodellierungs- und Datenanalysearbeiten ist ebenfalls eine gute Möglichkeit, die Effizienz zu verbessern.

Gleichzeitig stehen für professionelle Data-Warehouse-Teams Dateninhalte mit demselben Thema vor dem Problem der „wiederholten Erstellung, relativ verstreuten Verwendung und Verwaltung“ – gibt es eine Möglichkeit, Daten mit demselben Thema und unterschiedlichen Inhalten gleichzeitig zu erstellen? gleichzeitig in einer Aufgabe? Kann der erstellte Datensatz als Eingabe für die erneute Teilnahme an der Datenkonstruktion verwendet werden?

1. Die visuelle Modellierungsfunktion von DataWind ist da

Die von der Volcano Engine eingeführte BI-Plattform DataWind für intelligente Dateneinblicke hat eine neue erweiterte funktionsvisuelle Modellierung eingeführt.

Benutzer können den komplexen Datenverarbeitungs- und Modellierungsprozess durch visuelles Ziehen, Ziehen und Verbinden in einen klaren und leicht verständlichen Canvas-Prozess vereinfachen. Alle Arten von Benutzern können die Datenproduktion und -verarbeitung gemäß der Idee abschließen Was sie wollen, ist, was sie bekommen, wodurch die Datenproduktionsschwelle gesenkt wird.

Canvas unterstützt die gleichzeitige Erstellung mehrerer Canvas-Prozesse, wodurch die Effizienz der Datenkonstruktion verbessert und die Kosten für die Aufgabenverwaltung gesenkt werden können Arten von Datenbereinigungs- und Feature-Engineering-Algorithmen. Sie decken grundlegende bis erweiterte Datenproduktionsfunktionen ab und erfordern keine Codierung, um komplexe Datenfunktionen zu vervollständigen.

2. Null-Schwellen-SQL-Tools

Die Datenproduktion und -verarbeitung ist der erste Schritt zur Datenbeschaffung und -analyse.

Für technisch nicht versierte Benutzer gibt es einen bestimmten Schwellenwert für die Verwendung der SQL-Syntax. Gleichzeitig können lokale Dateien nicht regelmäßig aktualisiert werden, was dazu führt, dass das Dashboard jedes Mal manuell neu erstellt werden muss. Der für die Datenbeschaffung erforderliche technische Arbeitsaufwand muss häufig eingeplant werden, wodurch die Aktualität und Zufriedenheit der Datenerfassung erheblich verringert wird. Daher ist es besonders wichtig, Tools zur Datenkonstruktion ohne Code zu verwenden.

Im Folgenden sind zwei typische Szenarien aufgeführt, wie die nullschwellige Datenverarbeitung am Arbeitsplatz angewendet wird.

2.1 [Szenario 1] Was Sie denken, ist das, was Sie erhalten. Der Datenverarbeitungsprozess wird visuell abgeschlossen werden durch visuelle Modellierung per Drag-and-Drop-Operator konstruiert.

Wenn Sie die Anzahl der Bestellungen und die Bestellmenge nach Datum und Stadtgranularität sowie die Stadtdaten der 10 größten Tagesverbrauchsmengen erhalten möchten, ist der Vorgang wie folgt:

Allgemeiner DatenverarbeitungsprozessVisueller Modellierungsprozess

Bitte rufen Sie technische Studenten die detaillierten Daten der Bestellung ab, einschließlich Bestell-ID/Bestellmenge/Benutzer-ID/Bestellung Datum Stadt usw.
Stellen Sie die Daten durch die Bedienung des Perspektivdiagramms als Bestelldatum, Stadt ein und die Indikatoren sind die Summe der Bestellmengen und die Summe der Bestell-IDs #🎜🎜 #
Sortieren Sie die Perspektivenergebnisse nach Menge und schreiben Sie dann die Seriennummer #🎜🎜 ##🎜🎜 #
Datenquelle auswählen, eine Bibliothekstabelle auswählen oder eine CSV-Datei hochladen oder eine Verbindung zu LarkSheet herstellen

Feldinformationen filtern Sie müssen Ihre eigenen definierten Feldnamen und Formate verwenden und konfigurieren zur Datums- und Stadtaggregation

Wählen Sie den Top-Wert-Operator und nehmen Sie den Top10-Betrag

Datensatz ausgeben, Daten Der Satz kann zum Zeichnen von Diagrammen in Fengshen angewendet werden

火山引擎工具技术分享：用 AI 完成数据挖掘，零门槛完成 SQL 撰写

2.2 [Szenario 2] Kombinieren Sie schnell mehrere Tabellen, um Multi-Daten-Assoziationsberechnungen einfach zu lösen.

Im Datenverarbeitungsprozess müssen mehrere Datenquellen kombiniert und verwendet werden. Es ist schwierig, sie auf hoher Ebene zu beherrschen Vlookup und andere Algorithmen über Excel und dauert lange. Wenn gleichzeitig die Datenmenge groß ist, ist die Computerleistung möglicherweise nicht in der Lage, die kombinierte Berechnung der Daten abzuschließen.

Wenn zwei Bestelldaten mit einer relativ großen Datenmenge und eine Tabelle mit Kundenattributinformationen vorhanden sind, muss der Gewinnbetrag basierend auf dem Rechnungsbetrag und dem Kostenbetrag berechnet werden, und dann werden die Top-100-Benutzer-Bestellinformationen basierend darauf übernommen Gewinnbeitrag

Sie müssen die beiden Bestelldaten öffnen und Kopieren Sie die Daten in eine Datei Dann können Sie die Bestelldaten für März/April zu einem einzigen Daten zusammenführen

Verwenden Sie VloopUp, um die Benutzerdaten in der Bestellung und die Benutzerdaten im Kunden zu finden, und kombinieren Sie dann die beiden Daten, um neue Daten zu generieren

Verwenden Sie eine Pivot-Tabelle, um Berechnen Sie den Benutzerrechnungsbetrag und den Kostenbetrag und berechnen Sie dann den Gewinnbetrag.

Erhalten Sie TopN-Kundeninformationen sortiert nach Gewinnbetrag

Verbinden Sie die Attributtabelle der Kundeninformationen und verknüpfen Sie die Kundenattributinformationen
Wählen Sie die Aggregation aus, um den Rechnungsbetrag und den Kostenbetrag zu berechnen entsprechend dem kundenspezifischen Betrag
Wählen Sie die Berechnungsspalte aus, um den Gewinn basierend auf dem Rechnungsbetrag und dem Kostenbetrag zu berechnen. Betrag
Sortieren Sie nach Gewinnbetrag, um TopN-Kundeninformationen zu erhalten

3. KI-Data-Mining ist nicht mehr unerreichbar

Wenn die Datenkonstruktion und Datenanalyse nicht mehr ausreichend ist, wann Sie benötigen die Unterstützung von KI-Algorithmen, um mehr versteckte Werte in den Daten zu ermitteln. Studenten des Algorithmenteams leiden möglicherweise unter der Unfähigkeit, gut mit visuellen Diagrammen zu arbeiten, und können keine guten Daten produzieren, die schnell angewendet werden können, während normale Benutzer möglicherweise direkt durch die hohe Schwelle des KI-Codes daran gehindert werden, die Entwicklung dieses Algorithmus zu unterdrücken – was die Anforderungen erhöht Aber aus Angst ist die Nachfrage zu gering und der Wert kann derzeit nicht richtig eingeschätzt werden.

Die visuelle Modellierung von DataWind umfasst mehr als 30 gängige KI-Operatorfunktionen. Benutzer müssen lediglich die Funktion des Algorithmus verstehen und die Eingabe- und Trainingsziele des Algorithmusoperators durch Modelltraining konfigurieren, um schnell eine Vorhersage zu erhalten Ergebnisse basierend auf anderen konfigurierten Dateninhalten.

# 🎜🎜# Im Folgenden zeigen wir Ihnen anhand zweier typischer Szenarios, wie Sie das Data Mining mit Python durchführen.

3.1 [Grundkenntnisse] Sie können Data Mining durchführen, auch wenn Sie Python nicht kennen
Die tägliche Arbeit der Benutzer umfasst im Grunde nichts Schreiben von Python, aber es gibt Data-Mining-Anforderungsszenarien. Er muss ein Customer Intention Mining auf der Grundlage bestehender Kundenstichproben mit hoher Absicht durchführen. An diesem Punkt kann der Data-Mining-Prozess durch visuelle Modellierung aufgebaut werden:
1. Ziehen Sie es in den Klassifizierungsalgorithmus, z. B. den XGB-Algorithmus für das Modelltraining.
2. Ziehen Sie den Vorhersageoperator hinein und bauen Sie die Beziehung zwischen dem Modell und allen Daten für die Vorhersage auf.
3. Die tatsächlichen Daten und vorhergesagten Ergebnisse werden mit dem Ausgabedatensatz kombiniert, um die Absichtsverteilung aller Benutzerdaten zu analysieren.
3.2 [Fortgeschritten] Sie können komplexe Algorithmusmodelle erstellen, ohne Python
Benutzer zu schreiben Sie müssen ein Benutzerrückkaufmodell basierend auf vorhandenen Daten erstellen. Während der Modellerstellung ist es notwendig, nach der Datenbereinigung und Formatkonvertierung einen Gradienten-Boosting-Baum zu verwenden. Zu diesem Zeitpunkt kann der Rückkaufmodellprozess basierend auf der visuellen Modellierung erstellt werden:
#🎜 🎜#
# 🎜🎜#Zeilen zusammenführen: Füge die Ausgabedatentabellen von n Operatoren (Rechtecke im Bild) zu einer Gesamtdatentabelle zusammen, die auf konsistenten Überschriften basiert In den Benutzerverkaufsdaten sind hier keine Änderungen erforderlich.
1. One-Hot-Codierung: Texttypattribute können nicht direkt vom Modelltraining verwendet werden und erfordern eine One-Hot-Codierung in einen numerischen Vektor. Zum Beispiel:
3. #🎜🎜 ##🎜 🎜#
Gradient Boosting Tree: Verantwortlich für die Anpassung der Trainingsdaten und die Ausgabe eines Modells, das für die Vorhersage verwendet werden kann (Parameter, die in der Abbildung nicht markiert sind, müssen von Betreuern nicht geändert werden): # 🎜🎜#
Aggregation_1: Duplikate in den Vorhersagedaten entfernen und die maximale Wahrscheinlichkeit verwenden.

Felder extrahieren: Extrahieren Sie die erforderliche Beschriftung und Wahrscheinlichkeitswertausgabe.
2. 4. Multi-Szenario-, Multi-Task-Konstruktion, Management ist nicht mehr dezentral
  
  Als Datenanalyst wird es im täglichen Leben viel Arbeit geben, Datensätze und Daten-Dashboards zu erstellen . Normalerweise handelt es sich bei der aus dem Data Warehouse erhaltenen unteren Tabelle um eine breite Tabelle. Auf dieser Grundlage werden verschiedene Datensatzaufgaben entsprechend den unterschiedlichen Szenarioanforderungen erstellt.
  
  Bei der späteren Verwendung stoßen wir häufig auf immer mehr ähnliche Datensätze, die spezifische Logik kann jedoch nicht gut verglichen und bestätigt werden. Zu diesem Zeitpunkt wäre es großartig, wenn die gesamte Datensatzlogik in einem Datensatz konfiguriert und generiert würde und jeder Datensatz durch den Aufgabenprozess beurteilt und definiert werden könnte.
  
  Für dieses Szenario können auch die visuellen Modellierungsfunktionen von DataWind sehr gut ergänzt werden. Die visuelle Modellierungsfunktion unterstützt die gleichzeitige Verarbeitung eines einzelnen Datensatzes durch mehrere Logikprozesse, um mehrere Datensätze zu generieren. Nehmen Sie als Beispiel die Verarbeitung von Bestelldaten und Benutzerdaten:
  1. Wenn ein Benutzer Bestellstatistiken sehen möchte, kann er den Datenverarbeitungsprozess von Auftragsstatistikdatensatz# aufbauen 🎜🎜# .
  2. Bestelldetails-Datensatz erfolgen konstruiert werden.
  3. Benutzerbestellungen zu generieren.
  4. -Datensatz mit Benutzerbestelldetails unter Mehrfachtabellenzuordnung generieren.
  Somit wird die Generierung von 4 Datensätzen durch eine Aufgabe und zwei Dateneingaben abgeschlossen. Die 4 Datensätze können eine Datensubjektdomäne erstellen und anschließend verwandte Daten verwenden die Datensätze, die als Ausgabe dieser Aufgabe verfügbar sind.
  
  5. Über uns
  
  Volcano Engine Intelligent Data Insight DataWind ist eine erweiterte Unterstützung ABI-Plattform für die Self-Service-Analyse von Big Data auf granularer Ebene. Vom Datenzugriff über die Datenintegration bis hin zur Abfrage und Analyse werden sie schließlich Geschäftsanwendern in Form von visuellen Datenportalen, digitalen Großbildschirmen und Management-Cockpits präsentiert, sodass Daten ihren Wert entfalten können.

Das obige ist der detaillierte Inhalt vonTeilen der Technologie des Volcano-Engine-Tools: Verwenden Sie KI, um das Data Mining und das SQL-Schreiben ohne Schwellenwert von Null abzuschließen. Für weitere Informationen folgen Sie bitte anderen verwandten Artikeln auf der PHP chinesischen Website!

Erklärung dieser Website

Der Inhalt dieses Artikels wird freiwillig von Internetnutzern beigesteuert und das Urheberrecht liegt beim ursprünglichen Autor. Diese Website übernimmt keine entsprechende rechtliche Verantwortung. Wenn Sie Inhalte finden, bei denen der Verdacht eines Plagiats oder einer Rechtsverletzung besteht, wenden Sie sich bitte an admin@php.cn

Heiße KI -Werkzeuge

Undresser.AI Undress

KI-gestützte App zum Erstellen realistischer Aktfotos

AI Clothes Remover

Online-KI-Tool zum Entfernen von Kleidung aus Fotos.

Undress AI Tool

Ausziehbilder kostenlos

Clothoff.io

KI-Kleiderentferner

Video Face Swap

Tauschen Sie Gesichter in jedem Video mühelos mit unserem völlig kostenlosen KI-Gesichtstausch-Tool aus!

Heißer Artikel

Was ist neu in Windows 11 KB5054979 und wie Sie Update -Probleme beheben

1 Monate vor By DDD

Wie kann ich KB5055523 in Windows 11 nicht installieren?

3 Wochen vor By DDD

Wie kann ich KB5055518 in Windows 10 nicht installieren?

3 Wochen vor By DDD

Kraftstufen für jeden Feind & Monster in R.E.P.O.

3 Wochen vor By 尊渡假赌尊渡假赌尊渡假赌

Blauer Prinz: Wie man zum Keller kommt

3 Wochen vor By DDD

Heiße Werkzeuge

Notepad++7.3.1

Einfach zu bedienender und kostenloser Code-Editor

SublimeText3 chinesische Version

Chinesische Version, sehr einfach zu bedienen

Senden Sie Studio 13.0.1

Leistungsstarke integrierte PHP-Entwicklungsumgebung

Dreamweaver CS6

Visuelle Webentwicklungstools

SublimeText3 Mac-Version

Codebearbeitungssoftware auf Gottesniveau (SublimeText3)

Heiße Themen

Java-Tutorial

1653

CakePHP-Tutorial

1413

Laravel-Tutorial

1305

PHP-Tutorial

1251

C#-Tutorial

1224

Related knowledge

Was sind die zehn Top -Apps für virtuelle Währungshandel? Die neuesten Ranglisten für digitale Währung Exchange Apr 28, 2025 pm 08:03 PM

Die zehn Top -Börsen für digitale Währungen wie Binance, OKX, Gate.io haben ihre Systeme, effiziente diversifizierte Transaktionen und strenge Sicherheitsmaßnahmen verbessert.

Welche der zehn besten Währungsplattformen der Welt sind die neueste Version der zehn besten Währungshandelsplattformen Apr 28, 2025 pm 08:09 PM

Zu den zehn Top -Kryptowährungs -Handelsplattformen der Welt gehören Binance, OKX, Gate.io, Coinbase, Kraken, Huobi Global, Bitfinex, Bittrex, Kucoin und Poloniex, die alle eine Vielzahl von Handelsmethoden und leistungsstarken Sicherheitsmaßnahmen bieten.

Empfohlene zuverlässige Handelsplattformen für digitale Währung. Top 10 Digitalwährungsbörsen in der Welt. 2025 Apr 28, 2025 pm 04:30 PM

Empfohlene zuverlässige Handelsplattformen für digitale Währung: 1. OKX, 2. Binance, 3. Coinbase, 4. Kraken, 5. Huobi, 6. Kucoin, 7. Bitfinex, 8. Gemini, 9. Bitstamp, 10. Poloniex, diese Plattformen sind für ihre Sicherheit, Benutzererfahrung und verschiedene Funziktionen, geeignet für Benutzer, geeignet für Benutzer, geeignet für Benutzer, geeignet für Benutzer, geeignet für Ufers, für Benutzer, geeignet für Ufersniveaus, in unterschiedlichen Digitalverkehrsniveaus, in unterschiedlichen Niveaus, bei Digitalwährung, für Nutzer, für Benutzer, in unterschiedliche Ebenen von Digitalwährung, für Benutzer, die für Nutzer, für Benutzer, in unterschiedlichen Digitalverkehrsniveaus, auf Digitalwährung, auf Digitalwährung, auf Digitalwährung, bei Digitalwährung, auf Digitalwährung bekannt

Decryption Gate.io Strategy Upgrade: Wie definieren Sie das Krypto -Asset -Management in Memebox 2.0? Apr 28, 2025 pm 03:33 PM

Memebox 2.0 definiert das Krypto -Asset -Management durch innovative Architektur- und Leistungsbrachdurchbrüche. 1) Es löst drei Hauptschmerzpunkte: Vermögenssetsilos, Einkommensverfall und Paradox der Sicherheit und Bequemlichkeit. 2) Durch intelligente Asset-Hubs werden dynamische Risikomanagement- und Renditeverstärkungsmotoren die Übertragungsgeschwindigkeit, die durchschnittliche Ertragsrate und die Reaktionsgeschwindigkeit für Sicherheitsvorfälle verbessert. 3) Nutzern die Integration von Asset Visualisierung, Richtlinienautomatisierung und Governance -Integration zur Verfügung stellen und die Rekonstruktion des Benutzerwerts realisieren. 4) Durch ökologische Zusammenarbeit und Compliance -Innovation wurde die Gesamtwirksamkeit der Plattform verbessert. 5) In Zukunft werden intelligente Vertragsversicherungspools, die Prognosemarktintegration und die KI-gesteuerte Vermögenszuweisung gestartet, um weiterhin die Entwicklung der Branche zu leiten.

Welche der zehn besten Währungshandelsplattformen der Welt gehören 2025 zu den zehn Top -Währungshandelsplattformen Apr 28, 2025 pm 08:12 PM

Zu den zehn Top -Kryptowährungsbörsen der Welt im Jahr 2025 gehören Binance, OKX, Gate.io, Coinbase, Kraken, Huobi, Bitfinex, Kucoin, Bittrex und Poloniex, die alle für ihr hohes Handelsvolumen und ihre Sicherheit bekannt sind.

Wie viel ist Bitcoin wert? Apr 28, 2025 pm 07:42 PM

Der Preis von Bitcoin liegt zwischen 20.000 und 30.000 US -Dollar. 1. Bitcoin's Preis hat seit 2009 dramatisch geschwankt und im Jahr 2017 fast 20.000 US -Dollar und im Jahr 2021 in Höhe von fast 60.000 USD erreicht. 2. Die Preise werden von Faktoren wie Marktnachfrage, Angebot und makroökonomischem Umfeld beeinflusst. 3. Erhalten Sie Echtzeitpreise über Börsen, mobile Apps und Websites. V. 5. Es hat eine gewisse Beziehung zu den traditionellen Finanzmärkten und ist von den globalen Aktienmärkten, der Stärke des US-Dollars usw. betroffen. 6. Der langfristige Trend ist optimistisch, aber Risiken müssen mit Vorsicht bewertet werden.

Was sind die Top -Währungshandelsplattformen? Die Top 10 neuesten virtuellen Währungsbörsen Apr 28, 2025 pm 08:06 PM

Derzeit unter den zehn besten Börsen der virtuellen Währung eingestuft: 1. Binance, 2. OKX, 3. Gate.io, 4. Coin Library, 5. Siren, 6. Huobi Global Station, 7. Bybit, 8. Kucoin, 9. Bitcoin, 10. Bit Stamp.

Wie misst ich die Thread -Leistung in C? Apr 28, 2025 pm 10:21 PM

Durch die Messung der Thread -Leistung in C kann Timing -Tools, Leistungsanalyse -Tools und benutzerdefinierte Timer in der Standardbibliothek verwendet werden. 1. Verwenden Sie die Bibliothek, um die Ausführungszeit zu messen. 2. Verwenden Sie GPROF für die Leistungsanalyse. Zu den Schritten gehört das Hinzufügen der -PG -Option während der Kompilierung, das Ausführen des Programms, um eine Gmon.out -Datei zu generieren, und das Generieren eines Leistungsberichts. 3. Verwenden Sie das Callgrind -Modul von Valgrind, um eine detailliertere Analyse durchzuführen. Zu den Schritten gehört das Ausführen des Programms zum Generieren der Callgrind.out -Datei und das Anzeigen der Ergebnisse mit KCACHEGRIND. 4. Benutzerdefinierte Timer können die Ausführungszeit eines bestimmten Codesegments flexibel messen. Diese Methoden helfen dabei, die Thread -Leistung vollständig zu verstehen und den Code zu optimieren.

See all articles