BTC $82,747.19 -0.48%
ETH $2,496.53 +0.28%
BNB $750.21 +1.44%
XRP $1.40 +1.33%
SOL $109.90 -0.29%
TRX $0.3312 -0.27%
DOGE $0.0859 +1.42%
ADA $0.2553 +7.30%
BCH $279.19 +1.99%
LINK $13.11 +2.31%
HYPE $85.43 +0.23%
AAVE $172.77 +2.32%
SUI $1.11 +5.70%
XLM $0.1975 +2.27%
ZEC $1,230.85 +0.90%
AAPL $336.47 +1.01%
AMZN $262.66 +1.28%
GOOGL $352.30 -0.23%
MSFT $534.52 +0.47%
META $718.63 -0.24%
NVDA $230.41 -0.15%
TSLA $382.49 -1.21%
SNDK $1,591.33 -1.30%
INTC $104.98 -1.06%
SPCX $163.52 +0.78%
MU $1,034.59 +0.04%
AMD $609.91 -0.64%
BTC $82,747.19 -0.48%
ETH $2,496.53 +0.28%
BNB $750.21 +1.44%
XRP $1.40 +1.33%
SOL $109.90 -0.29%
TRX $0.3312 -0.27%
DOGE $0.0859 +1.42%
ADA $0.2553 +7.30%
BCH $279.19 +1.99%
LINK $13.11 +2.31%
HYPE $85.43 +0.23%
AAVE $172.77 +2.32%
SUI $1.11 +5.70%
XLM $0.1975 +2.27%
ZEC $1,230.85 +0.90%
AAPL $336.47 +1.01%
AMZN $262.66 +1.28%
GOOGL $352.30 -0.23%
MSFT $534.52 +0.47%
META $718.63 -0.24%
NVDA $230.41 -0.15%
TSLA $382.49 -1.21%
SNDK $1,591.33 -1.30%
INTC $104.98 -1.06%
SPCX $163.52 +0.78%
MU $1,034.59 +0.04%
AMD $609.91 -0.64%

像

すべて
記事
速報

first_img GoogleはNano Banana 2.1画像モデルを発表し、開発者の呼び出し価格は前の世代の約半分です。

Googleは10月6日に最新の画像生成と編集モデルNano Banana 2.1を発表し、Geminiアプリ、Google検索のAIモード、Google Ads、Google AI Studio、Flow、Stitchなどの開発者ツールに導入しました。このモデルは、テキストの説明から画像を生成することができ、既存の写真を編集することも可能です。Googleは今回のアップグレードが3つの側面に集中していると述べています:視覚デザイン、マスクベースの編集(特定の領域をマークした後、その領域のみが変化する)および主体の一貫性、つまり人物や物体が何度も編集された後でも元の特徴を保持することです。文生図全体の好みテストにおいて、Nano Banana 2.1は1050 ELOポイントを獲得し、Nano Banana 2の990ポイントおよびNano Banana Proの935ポイントを上回りました。このモデルは最大で14枚の参照画像を同時に処理し、4つのキャラクターと10の物体を追跡し、最高4K、アスペクト比は最大8:1を出力します。開発者は生成前の思考時間を設定することができ、Google検索およびGoogle画像検索に基づいて事実確認を行うことができます。Google開発者APIを呼び出す際、標準1K画像の価格は0.0336ドルで、Nano Banana 2の0.067ドルの半分です;4K画像は0.0756ドルで、前世代は0.151ドル、バッチタスクではさらに50%割引が適用されます。上記の性能データはGoogle自身のテストに基づいています。

hot_img 噂によると、OpenAIは新しい画像モデルluna-lisa-alphaをテストしており、これはGPT Image 2.5の初期バージョンである可能性があります。

最近、多くのユーザーが luna-lisa-alpha という画像モデルが LMArena テストプラットフォームに登場したことを発見しました。これは OpenAI がテストしている新世代の画像生成モデルである可能性があります。公式な確認はされていませんが、外部では GPT Image 2.5 または次世代の GPT Image の初期バージョンではないかと推測されています。テストのフィードバックによると、新しいモデルはキャラクターの一貫性、画像のリアリズム、テキスト生成能力、およびノイズ制御の面で明らかな向上が見られます。一部のテスターは、これを GPT Image 2.0、Nano Banana Pro、Grok Imagine などのモデルと比較した結果、luna-lisa-alpha は複数回の生成において同じキャラクターの外観、衣装、スタイルをより良く保持できると考えています。しかし、複雑なテクスチャ領域には依然として繰り返しのテクスチャの問題があると指摘するテスターもいます。同日、OpenAI は GPT Image 2 API プレビューが透明な背景生成をサポートすることを発表しました。これは製品画像やウェブデザインなどのシーンで使用できます。複数のチェックポイント名の露出も、コミュニティが OpenAI が A/B テストを行っているのではないかと推測する要因となっています。このモデルが最終的に正式にリリースされるかどうかはまだ不確定で、OpenAI の公式情報を待つ必要があります。

DeepSeekが画像認識モードを開始しましたが、梁文鋒を認識できません。

DeepSeek は正式にウェブ版の画像認識モードを立ち上げ、アプリは現在ベータテスト段階にあります。機能的には、今回立ち上げられた画像認識モードはまだ初期段階にあり、記者は DeepSeek の創業者である梁文鋒の写真を使ってモデルを何度も試しましたが、モデルは数分間考えた後、多くの誤った答えを出し、最後には「本当に自信がありません。名前を推測することはお勧めしません。間違えることは「わからない」と言うよりも悪いです。」と認めました。他のネットユーザーのテストでは、創業者梁文鋒の写真に対して、DeepSeek は彼を月の暗い面の創業者である楊植麟や、馬化騰の「若い版」と認識することさえありました。注目すべきは、画像認識モードの立ち上げ前夜に、DeepSeek が500億元を超える初回資金調達を決定したことが明らかになったことです。市場の情報によれば、DeepSeek の投資条件の核心は、どの大手企業や VC ファンドに対しても、梁文鋒の最も重要な要求は「DeepSeek の人を引き抜かないこと、または彼らに起業を勧めないこと」です。記者は DeepSeek の内部関係者に関連情報を尋ねたところ、この言説は基本的に真実であることがわかりました。
app_icon
ChainCatcher Building the Web3 world with innovations.