目次
SheetCopilot のハイライト
メソッドの原理
評価方法
ホームページ テクノロジー周辺機器 AI 需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインです

需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインです

Jun 12, 2023 pm 07:24 PM
操作する モデル

このスムーズな操作プロセスは、専門家にとってまさに朗報です。

需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインです

最近、オートメーション研究所、中国科学院、香港理工大学、その他の機関の研究者らが、 「Table AI Assistant」「SheetCopilot」このインテリジェント エージェントは、ユーザーの指示に基づいてテーブルを操作するためのソリューションを生成し、特定のソフトウェア (Excel、GoogleSheets など) 上で実行できます。 SheetCopilot は、複数の表処理ソフトウェアに素早く接続でき、複数の表の操作、チャートの描画、ピボット テーブルの生成をサポートしており、複数の分野で表データの処理と視覚化を強化し、汎用的なインテリジェント アシスタントの実現に向けた重要な一歩を踏み出すことが期待されています。

需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインです

ウェブサイト: https://sheetcopilot-demo.github.io/

論文: https://arxiv.org/abs/2305.19308

次の例を通じて、SheetCopilot がどのように作業効率を大幅に向上させるかを最初に体験してみましょう。

あなたは新人で、ある日、上司から販売データの分析を手伝ってほしいと頼まれたとします。フォームを受け取ってそれを見ると、何千行ものデータに目がくらむでしょうが、どこから始めればよいのかわからないので、確認しながら確認していきます。

まず、各製品の名前を抽出し、式を使用して各製品の収入を合計します。

需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインです

20 分以上作業した後、SUMIF は「#NAME?」エラーを報告し続けたので、上。

ネットで検索を続けたところ、ピボットテーブルという便利なツールがあることを知り、2回目のチャレンジを開始しました。

需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインです

#最終的に完了するまでに 20 分以上かかりました。プロセス全体で 1 時間近くかかり、効率は満足のいくものではありませんでした。上司が新しいフォーム処理タスクを与えるたびに、これまでの経験はほとんど役に立たないため、Web サイトを表示して最初から処理することしかできません。

あなたの同僚は SheetCopilot を使用しており、あらゆる種類の奇妙な要件をわずか数秒で完了できます :)。

需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインです

SheetCopilot がとてもスムーズなので試してみると、絵を描くのが簡単でした。

需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインです

SheetCopilot を使用すると、画面を超えるデータを選択するためにテーブルの半分にマウスをスライドさせる必要がなくなりました。数千行を簡単に選択できます。データは複数のテーブル間を移動します。

需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインです

SheetCopilot が提案された理由

長い間、人々は次のような人材を求めてきました。専門的な経験がなくても熟練し、複雑なソフトウェアを使いこなす能力。私たちの多くは、PhotoShop の煩雑なインターフェースの操作方法が分からない、データを分析したいがピボットテーブルの高度な機能を知らない、歯車を描きたいが Solidworks について何も知らない、といった状況に陥ったことがあるでしょう。

強力な言語理解および生成機能を備えた大規模言語モデル (LLM) の出現により、このビジョンはこれまで以上に現実に近づきました。 LLM を誘導してさまざまなソフトウェアを使いこなすことができれば、LLM のほぼ無限の可能性が解放され、人間の生産性が前例のない高みに達することが可能になります。

この記事では、スプレッドシートは一般的で多用途な制作ツールであるため、この調査を実施するための理想的な基盤であることを指摘します。しかし、テーブル操作はさまざまな課題に直面しており、ユーザーが絶えず変化するタスク要件に対処するのに十分なテーブル処理スキルとプログラミング スキルを習得することは困難です。

豊富なソフトウェア制御スキルを習得したジェネラリスト AI エージェントがあれば、オフィスの効率が大幅に向上するだけでなく、企業の出力も大幅に加速されます。 SheetCopilot の登場はまさに人々のビジョンにぴったりです。

SheetCopilot のハイライト

1. テーブル処理の一般的なニーズをカバーします

#SheetCopilot は、テーブル操作のほぼすべての典型的なタスクを処理し、さまざまなチャート生成タスクを優れた方法で完了できます。

需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインです

# 販売データ分析

需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインです

実験チャートの描画

需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインです

##複雑な数式の計算

需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインです

条件付き書式設定の適用

2. VBA ベースのアプローチを超えて

#SheetCopilot は、GPT-3.5 を使用して VBA コードを生成して実行する方法よりも優れており、生成されたソリューションは後者よりも大幅に優れており (下図を参照)、SheetCopilot は強力な AI 補助ツールになることが期待されています将来のデータ処理担当者向け。

需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインですそれだけでなく、難解な VBA コードと比較して、SheetCopilot によって生成されたソリューションには理解しやすい手順が含まれていますこれにより、新しいプログラミング言語を学習したり、デバッグに苦労したりする煩わしさがなくなります。

需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインです

#左の図: 長い VBA コード、右の図: SheetCopilot のシンプルで理解しやすいソリューションプラン。

#3. 快適な使用エクスペリエンス

SheetCopilot の Whenネットワーク接続が安定しているため、複数のテーブルの組み合わせ操作を約 10 ステップ行うだけで、数千の行と数十の列を持つテーブルのタスクを迅速に完了できます。これにより、ユーザーの疲れた目から解放されるだけでなく、Web サイトを見つけて手順を 1 つずつ試す無駄な時間を節約し、VBA の学習コストも節約できます。

メソッドの原理

この記事では、テーブル操作に必要なコア関数を一連の仮想 API (アトミック操作と呼ばれます。以下の図を参照) に抽象化します。これらの関数は、LLM A としてソリューションを生成するために使用されます。アプリケーション ソフトウェアとの対話のためのブリッジ。

需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインです

最も簡単な方法は、LLM の 1 つのクエリでタスクのすべてのステップを生成することです。しかし、タスクの複雑さが増すにつれて、後続のステップは前のステップの実行結果に依存するようになり、この種の開ループ制御では正しい結果を得ることが困難になります。たとえば、フィルタリング後にデータが表示される場所を決定できない場合、LLM は操作の範囲を決定することが困難になります。

効率的な閉ループ制御を実現するために、SheetCopilot はソフトウェア ステータスのフィードバックと外部のアトミック操作ナレッジ ベースに基づいてソリューションを最適化し、成功率と効率を向上させます。

評価方法

この記事では、高品質の評価ベンチマークを提案します。次のワード クラウドに示すように、このベンチマークのタスクにはさまざまな定式化があり、豊富なアトミック操作が含まれます。

需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインです

このベンチマークは、次のメトリクスを採用しています。成功率 (高いほど良い):

  • Exec@1: 生成されたタスク ソリューションの実行成功率。
  • Pass@1: タスクの合格率、つまり、実行後に参照回答と一致するソリューションの割合。

このベンチマークでは、次の効率指標も考慮されています (低いほど優れています):

  • A50: ミッション要件を満たします。解のステップ数を参照解答の最小ステップ数で割って、すべての計算の中央値が取られます。
  • A90: 計算方法は上記と同じですが、すべての計算結果の 90 パーセンタイルが取得されます。この指標は、アクション数の極値分布を反映します。
#実験結果

需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインです

##表 1: SheetCopilot データ セット GPT の比較3.5-Turbo、GPT-4、Claude、および VBA の生成方法。

当然のことながら、GPT-4 はタスク要件を満たし、効率が最も高いソリューションの割合が最も高く、GPT-3.5-Turbo がそれに僅差で続き、クロードが優勝しました。最も多い回数ですが、GPT-3.5-Turbo にも近いです。

注目すべき結果の 1 つは、ユーザーの指示を VBA コードに変換して Excel 上で実行する方法と比較して、SheetCopilot が優れた成功率を達成したことです。これは、SheetCopilot がソフトウェア インテリジェント制御を私たちに大きく近づけ、コンピューターに命令するプログラムを作成できないユーザーでも、日常のコミュニケーションを通じて複雑なタスクを完了できるようにすることを意味します。

以下の各細分カテゴリの指標を通じて、これら 3 つの LLM それぞれの長所と短所を見てみましょう。

需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインです

GPT-3.5 と GPT-4 は、管理 (並べ替えやフィルタリングなどのテーブル管理操作) と入力および入力を簡単に解決します。操作(データ入力と操作)タスクは、両方とも実行率 100% を達成しました。さらに、3 つの LLM はそれぞれ、異なるタスク カテゴリで最高の効率を示しました。この興味深い発見は、各 LLM には独自の利点があり、GPT-4 が他のモデルを上回るパフォーマンスを発揮できないことを示しています。

結論

SheetCopilot は LLM を使用して、テキスト インターフェイスを介して認識、推論、意思決定の閉ループを形成し、効率的なスプレッドシート制御を実現し、よりスマートなソフトウェア制御を促進します。次のレベルに進むことは、ジェネラリストエージェントに興味のある研究者に新たなインスピレーションをもたらします。

以上が需要を管理し、大規模なモデルを使用して問題を解決する: チャート処理アーティファクト SheetCopilot はオンラインですの詳細内容です。詳細については、PHP 中国語 Web サイトの他の関連記事を参照してください。

このウェブサイトの声明
この記事の内容はネチズンが自主的に寄稿したものであり、著作権は原著者に帰属します。このサイトは、それに相当する法的責任を負いません。盗作または侵害の疑いのあるコンテンツを見つけた場合は、admin@php.cn までご連絡ください。

ホットAIツール

Undresser.AI Undress

Undresser.AI Undress

リアルなヌード写真を作成する AI 搭載アプリ

AI Clothes Remover

AI Clothes Remover

写真から衣服を削除するオンライン AI ツール。

Undress AI Tool

Undress AI Tool

脱衣画像を無料で

Clothoff.io

Clothoff.io

AI衣類リムーバー

AI Hentai Generator

AI Hentai Generator

AIヘンタイを無料で生成します。

ホットツール

メモ帳++7.3.1

メモ帳++7.3.1

使いやすく無料のコードエディター

SublimeText3 中国語版

SublimeText3 中国語版

中国語版、とても使いやすい

ゼンドスタジオ 13.0.1

ゼンドスタジオ 13.0.1

強力な PHP 統合開発環境

ドリームウィーバー CS6

ドリームウィーバー CS6

ビジュアル Web 開発ツール

SublimeText3 Mac版

SublimeText3 Mac版

神レベルのコード編集ソフト(SublimeText3)

世界で最も強力なオープンソース MoE モデルが登場。GPT-4 に匹敵する中国語機能を備え、価格は GPT-4-Turbo のわずか 1% 近くです 世界で最も強力なオープンソース MoE モデルが登場。GPT-4 に匹敵する中国語機能を備え、価格は GPT-4-Turbo のわずか 1% 近くです May 07, 2024 pm 04:13 PM

従来のコンピューティングを超える能力を備えているだけでなく、より低コストでより効率的なパフォーマンスを実現する人工知能モデルを想像してみてください。これは SF ではありません。世界で最も強力なオープンソース MoE モデルである DeepSeek-V2[1] が登場しました。 DeepSeek-V2 は、経済的なトレーニングと効率的な推論の特徴を備えた強力な専門家混合 (MoE) 言語モデルです。これは 236B のパラメータで構成されており、そのうち 21B は各マーカーをアクティブにするために使用されます。 DeepSeek67B と比較して、DeepSeek-V2 はパフォーマンスが優れていると同時に、トレーニング コストを 42.5% 節約し、KV キャッシュを 93.3% 削減し、最大生成スループットを 5.76 倍に高めます。 DeepSeek は一般的な人工知能を研究する会社です

AI が数学研究を破壊する!フィールズ賞受賞者で中国系アメリカ人の数学者が上位 11 件の論文を主導 | テレンス・タオが「いいね!」しました AI が数学研究を破壊する!フィールズ賞受賞者で中国系アメリカ人の数学者が上位 11 件の論文を主導 | テレンス・タオが「いいね!」しました Apr 09, 2024 am 11:52 AM

AI は確かに数学を変えつつあります。最近、この問題に細心の注意を払っている陶哲軒氏が『米国数学協会会報』(米国数学協会会報)の最新号を送ってくれた。 「機械は数学を変えるのか?」というテーマを中心に、多くの数学者が意見を述べ、そのプロセス全体は火花に満ち、ハードコアで刺激的でした。著者には、フィールズ賞受賞者のアクシャイ・ベンカテシュ氏、中国の数学者鄭楽軍氏、ニューヨーク大学のコンピューター科学者アーネスト・デイビス氏、その他業界で著名な学者を含む強力な顔ぶれが揃っている。 AI の世界は劇的に変化しています。これらの記事の多くは 1 年前に投稿されたものです。

Google は大喜び: JAX のパフォーマンスが Pytorch や TensorFlow を上回りました! GPU 推論トレーニングの最速の選択肢となる可能性があります Google は大喜び: JAX のパフォーマンスが Pytorch や TensorFlow を上回りました! GPU 推論トレーニングの最速の選択肢となる可能性があります Apr 01, 2024 pm 07:46 PM

Google が推進する JAX のパフォーマンスは、最近のベンチマーク テストで Pytorch や TensorFlow のパフォーマンスを上回り、7 つの指標で 1 位にランクされました。また、テストは最高の JAX パフォーマンスを備えた TPU では行われませんでした。ただし、開発者の間では、依然として Tensorflow よりも Pytorch の方が人気があります。しかし、将来的には、おそらくより大規模なモデルが JAX プラットフォームに基づいてトレーニングされ、実行されるようになるでしょう。モデル 最近、Keras チームは、ネイティブ PyTorch 実装を使用して 3 つのバックエンド (TensorFlow、JAX、PyTorch) をベンチマークし、TensorFlow を使用して Keras2 をベンチマークしました。まず、主流のセットを選択します

MLP に代わる KAN は、オープンソース プロジェクトによって畳み込みまで拡張されました MLP に代わる KAN は、オープンソース プロジェクトによって畳み込みまで拡張されました Jun 01, 2024 pm 10:03 PM

今月初め、MIT やその他の機関の研究者らは、MLP に代わる非常に有望な代替案である KAN を提案しました。 KAN は、精度と解釈可能性の点で MLP よりも優れています。また、非常に少数のパラメーターを使用して、多数のパラメーターを使用して実行する MLP よりも優れたパフォーマンスを発揮できます。たとえば、著者らは、KAN を使用して、より小規模なネットワークと高度な自動化で DeepMind の結果を再現したと述べています。具体的には、DeepMind の MLP には約 300,000 個のパラメーターがありますが、KAN には約 200 個のパラメーターしかありません。 KAN は、MLP が普遍近似定理に基づいているのに対し、KAN はコルモゴロフ-アーノルド表現定理に基づいているのと同様に、強力な数学的基礎を持っています。以下の図に示すように、KAN は

こんにちは、電気アトラスです!ボストン・ダイナミクスのロボットが復活、180度の奇妙な動きにマスク氏も恐怖 こんにちは、電気アトラスです!ボストン・ダイナミクスのロボットが復活、180度の奇妙な動きにマスク氏も恐怖 Apr 18, 2024 pm 07:58 PM

Boston Dynamics Atlas は正式に電動ロボットの時代に突入します!昨日、油圧式アトラスが歴史の舞台から「涙ながらに」撤退したばかりですが、今日、ボストン・ダイナミクスは電動式アトラスが稼働することを発表しました。ボストン・ダイナミクス社は商用人型ロボットの分野でテスラ社と競争する決意を持っているようだ。新しいビデオが公開されてから、わずか 10 時間ですでに 100 万人以上が視聴しました。古い人が去り、新しい役割が現れるのは歴史的な必然です。今年が人型ロボットの爆発的な年であることは間違いありません。ネットユーザーは「ロボットの進歩により、今年の開会式は人間のように見え、人間よりもはるかに自由度が高い。しかし、これは本当にホラー映画ではないのか?」とコメントした。ビデオの冒頭では、アトラスは仰向けに見えるように地面に静かに横たわっています。次に続くのは驚くべきことです

FisheyeDetNet: 魚眼カメラに基づいた最初のターゲット検出アルゴリズム FisheyeDetNet: 魚眼カメラに基づいた最初のターゲット検出アルゴリズム Apr 26, 2024 am 11:37 AM

目標検出は自動運転システムにおいて比較的成熟した問題であり、その中でも歩行者検出は最も初期に導入されたアルゴリズムの 1 つです。ほとんどの論文では非常に包括的な研究が行われています。ただし、サラウンドビューに魚眼カメラを使用した距離認識については、あまり研究されていません。放射状の歪みが大きいため、標準のバウンディング ボックス表現を魚眼カメラに実装するのは困難です。上記の説明を軽減するために、拡張バウンディング ボックス、楕円、および一般的な多角形の設計を極/角度表現に探索し、これらの表現を分析するためのインスタンス セグメンテーション mIOU メトリックを定義します。提案された多角形モデルの FisheyeDetNet は、他のモデルよりも優れたパフォーマンスを示し、同時に自動運転用の Valeo 魚眼カメラ データセットで 49.5% の mAP を達成しました。

テスラのロボットは工場で働く、マスク氏:手の自由度は今年22に達する! テスラのロボットは工場で働く、マスク氏:手の自由度は今年22に達する! May 06, 2024 pm 04:13 PM

テスラのロボット「オプティマス」の最新映像が公開され、すでに工場内で稼働可能となっている。通常の速度では、バッテリー(テスラの4680バッテリー)を次のように分類します:公式は、20倍の速度でどのように見えるかも公開しました - 小さな「ワークステーション」上で、ピッキング、ピッキング、ピッキング:今回は、それがリリースされたハイライトの1つビデオの内容は、オプティマスが工場内でこの作業を完全に自律的に行​​い、プロセス全体を通じて人間の介入なしに完了するというものです。そして、オプティマスの観点から見ると、自動エラー修正に重点を置いて、曲がったバッテリーを拾い上げたり配置したりすることもできます。オプティマスのハンドについては、NVIDIA の科学者ジム ファン氏が高く評価しました。オプティマスのハンドは、世界の 5 本指ロボットの 1 つです。最も器用。その手は触覚だけではありません

Llama 70B を実行するシングル カードはデュアル カードより高速、Microsoft は FP6 を A100 オープンソースに強制導入 Llama 70B を実行するシングル カードはデュアル カードより高速、Microsoft は FP6 を A100 オープンソースに強制導入 Apr 29, 2024 pm 04:55 PM

FP8 以下の浮動小数点数値化精度は、もはや H100 の「特許」ではありません。 Lao Huang は誰もが INT8/INT4 を使用できるようにしたいと考え、Microsoft DeepSpeed チームは NVIDIA からの公式サポートなしで A100 上で FP6 の実行を開始しました。テスト結果は、A100 での新しい方式 TC-FPx の FP6 量子化が INT4 に近いか、場合によってはそれよりも高速であり、後者よりも精度が高いことを示しています。これに加えて、エンドツーエンドの大規模モデルのサポートもあり、オープンソース化され、DeepSpeed などの深層学習推論フレームワークに統合されています。この結果は、大規模モデルの高速化にも即座に影響します。このフレームワークでは、シングル カードを使用して Llama を実行すると、スループットはデュアル カードのスループットの 2.65 倍になります。 1つ

See all articles